Teknik

Claude leder en fjärdedel av Anthropics AI-forskning — med 30 000 agenter igång samtidigt

Adrian Kessler
Lägg till oss på Google

Ett av var fjärde AI-forskningsuppdrag på Anthropic leds nu av Claude. Inte som att Claude tilldelats en hjälpande roll, inte heller att Claude granskat i efterhand – utan startat från en övergripande prompt och slutförts från början till slut, med en människa som kontrollerar resultatet när det är klart. För nio månader sedan var den siffran mindre än en procent.

Anthropic drar en gräns mellan två saker. När Claude leder en uppgift hanterar den större delen av arbetet självständigt; en handledare granskar resultatet snarare än att vägleda varje steg. Det är en annan kategori än de nittio procent av Anthropics totala forskning och utveckling där Claude agerar som samarbetspartner – en människa styr, Claude sköter specifika delar. Att leda är den svårare klassificeringen. Det står nu för 26 procent av all AI-forskning företaget bedriver, viktat efter den tid forskare annars skulle lägga på dessa uppgifter.

Skalan är konkret. Cirka 30 000 Claude-agenter körs samtidigt på Anthropics interna plattformar och utför arbete inom modellträning, utvärderingar, tolkningsbarhetsforskning och säkerhetsanalys. I augusti fattade dessa agenter sammanlagt över en miljard beslut. Anthropics realtidsövervakningssystem blockerade 0,002 procent av dem – ungefär ett av 47 000 ageranden – innan utförande. Ett offline-lager flaggade sedan cirka 100 000 transkriptioner i veckan för granskning, och eskalerade ungefär 50 till en människa.

Säkerhet har en mätbar budget inom det systemet. Under en enda vecka i juli förbrukade arbete som ägnades åt att hålla agenter säkra sex procent av all AI-forsknings- och utvecklingsberäkning, och tolv procent av den beräkning som AI-driven forskning och utveckling själv använde. Anthropic säger att man klassificerade konservativt, exklusive dedikerade säkerhetsklassificerare från räkningen, vilket tyder på att den verkliga andelen är ännu högre.

Ett epistemologiskt problem ligger i centrum av allt detta. Claudes bidrag till Anthropics forskning utvärderas delvis av Claude själv. En Claude-modell bedömer Claudes arbete; översiktssiffrorna täcker endast en intern plattform; och beräkningsklassificeringen förlitade sig på att Claude-modeller provtog och märkte sina egna körningar. Ingen oberoende tredje part har granskat metoden. De tre siffror som Anthropic publicerade är precisa, men de är självrapporterad precision – vilket är en annan sak än verifierad precision.

Anthropic säger att man kommer att börja integrera externa utvärderare i processen. Inga namn, inga startdatum och ingen jämförbar offentliggörande från andra AI-laboratorier har ännu dykt upp. Siffran på 26 procent, i den takt den har rört sig, är en ögonblicksbild snarare än ett tak.

Taggar: , , , , ,

Lägg till oss på Google

Diskussion

Det finns 0 kommentarer.