Teknik

Fei-Fei Li när AMD köper World Labs: ”Universum består inte av ord, utan av verkliga ting…”

När Fei-Fei Li berättade att World Labs säljs till AMD upprepade hon idén som labbet grundades på. Från en chiptillverkares blivande forskningschef låter det mindre som filosofi och mer som en satsning på hårdvara.
Adrian Kessler
Lägg till oss på Google

Fei-Fei Li är forskaren vars arbete lärde maskiner att se. Nu har hon sålt laboratoriet hon byggde för att föra AI bortom språket. När hon meddelade att World Labs blir en del av AMD, chiptillverkaren som leds av hennes tidiga finansiär Lisa Su, upprepade hon företagets grundidé i en enda mening – en formulering som också är en satsning mot AI-erans fokus på ord.

”Universum består inte av ord, utan av verkliga ting. Många av de viktigaste problem AI behöver lösa – inom allt från vetenskap och underhållning till robotik – kräver modeller som kan resonera kring den fysiska världens struktur och beteende.”

Li skrev det i ”World Labs to AMD”, ett inlägg på sin Substack-blogg, och The Register citerade formuleringen i sin rapport om affären. Meningen precis före slår fast utgångspunkten: företaget har ”vägletts av den grundläggande övertygelsen att språk ensamt inte räcker för att utveckla modeller”.

AMD har gått med på att förvärva World Labs i en aktieaffär värderad till omkring 8,2 miljarder dollar. Affären väntas slutföras före utgången av 2026, förutsatt att myndigheterna godkänner den. Li blir vice vd och chefsforskare på AMD, med direkt rapportering till Su. San Francisco-laboratoriet, som hon grundade tillsammans med Ben Mildenhall och Justin Johnson i början av 2024, utvecklar det branschen kallar världsmodeller: system som skapar, återskapar och simulerar 3D-miljöer utifrån text, bilder och video. Medan en stor språkmodell förutsäger nästa ord föreställer sig en världsmodell, som The Register uttrycker det, omgivningen och tar sig an problemet därifrån.

Den närmaste parallellen är Yann LeCun, Metas tidigare chefsforskare inom AI, som har hävdat att stora språkmodeller kan vara en återvändsgränd. Lis ståndpunkt är snävare; The Register var noga med att påpeka att hon inte är emot stora språkmodeller. Hennes laboratoriums senaste modell lånar upplägget från dem: Atlas förutsäger, skriver hon, nästa vy utifrån en uppsättning 2D-bilder på samma sätt som en språkmodell förutsäger nästa token. Det är inte metoden hon invänder mot, utan materialet. Text är en av människor skriven återgivning av världen; hennes poäng är att de problem som är värda att lösa – från vetenskap och underhållning till robotik – finns i det som texten beskriver.

Det som ger meningen tyngd är vem som betalar för den. En chiptillverkare satsar inte miljarder i aktier på en filosofi. I AMD:s tillkännagivande motiveras köpet med beräkningskapacitet, och bolaget konstaterar att ”kraven på beräkningsinfrastruktur blir mer varierade” i takt med att AI breder ut sig inom robotik, simulering och fysisk AI. Sus egen formulering avslöjar vad som står på spel: ”Att bygga beräkningsplattformarna för nästa generation AI kräver en djup förståelse för hur modellerna utvecklas.” Enkelt uttryckt vill AMD se nästa typ av arbetsbelastning innan bolaget utformar kretsarna som ska hantera den. Jämfört med Nvidia är AMD:s mjukvaruutvecklingsteam pyttelitet, noterar The Register. World Labs ger bolaget en egen forskargrupp, bara några veckor efter att det gått med på att köpa Taalas, en startup som bygger in modellvikter direkt i kisel.

Li beskriver samma mekanism från andra hållet. ”Utan en fokuserad satsning på hårdvara hämmas AI:s effektivitet. Och skalbarhet. Och för våra syften förblir den fångad i den digitala världen”, skriver hon. Det är vad citatet i praktiken handlar om. En modell som resonerar kring fysiskt utrymme är bara så användbar som den maskin som kan köra den tillräckligt snabbt för att styra en robot. Li har kommit fram till att den snabbaste vägen till en sådan maskin är att flytta in i företaget som tillverkar den.

Orden väger tungt tack vare karriären bakom dem. Li gav sig in i fältet år 2000 med siktet inställt på visuell intelligens, både hos maskiner och i hjärnan. Arbetet med ImageNet vid hennes laboratorium bidrog till att bana väg för den moderna AI-eran. Senare grundade hon Google Clouds AI-enhet som chefsforskare och blev den första chefen för Stanfords institut för Human-Centered AI. Ett kvarts sekel senare är argumentet detsamma. Men insatserna har blivit större. När affären väl är slutförd kommer professorn som förde fram argumentet att rapportera till Su.

Om hon har rätt har AMD köpt sig en tidig inblick i de arbetsbelastningar som kommer att prägla nästa generation AI-hårdvara. Om hon har fel och språket fortsätter att svälja allt har bolaget köpt en dyr försäkring – precis så läste The Register affären: som en gardering mot att stora språkmodeller visar sig vara en återvändsgränd.

Lis mening börjar som ett påstående om universum. När affären väl är slutförd kommer den att vara en specifikation.

Taggar: , , , ,

Lägg till oss på Google

Diskussion

Det finns 0 kommentarer.