AI-modeller och plattformar

‘Kodagenten’ är fel namn. Det är en allt-agent.

mm
Lägg till Unite.AI bland dina föredragna källor på Google

På Code with Claude, Anthropics utvecklarevent i London, ställde en ingenjör vid namn Jeremy Hadfield en fråga till rummet: vem här har skickat en pull request under den senaste veckan som skrevs helt av Claude? Ungefär hälften av händerna gick upp. Sedan frågade han följdfrågan – vem skickade en utan att läsa koden alls? Nervösa skratt. De flesta händerna stannade uppe.

Anthropic säger nu att de flesta av deras egna programvara skrivs av Claude, inklusive de flesta koderna inuti Claude Code själv. Och det är inte bara de. Under samma period blev OpenAI utsedd till ledare inom företagskodningsagenter av Gartner och driver på sitt Codex-agent i företag som Dell och Ramp. Två labb, en riktning, ingen tvetydighet: att ge din kod till en agent har gått från nyhet till normalt på ungefär ett år.

Vi fortsätter att kalla dessa saker “kodagenter”. Det namnet kommer att göra att många missar vad som faktiskt byggs.

Vad som faktiskt händer

Ramarna på scenen på Code with Claude var inte “AI hjälper dig att skriva kod snabbare.” Det var längre bort än så. Boris Cherny, som ansvarar för Claude Code, sa så här: “Standarden är inte ‘Jag ska fråga Claude’ – standarden är nu ‘Jag ska låta Claude fråga sig själv.'” En annan ingenjörs version: “att komma ur Claudes väg. Vi säger: låt det koka.” Anthropic demoade till och med en funktion där kodagenter skriver anteckningar till sig själva, och sedan sammanfogar dessa anteckningar för att bli bättre på ett kodbas över tid.

Företagen som visade upp sig för att demo var inte bara stora ingenjörsbutiker, även om Spotify och Delivery Hero (DHER.DE ) var där. Tecknet var startup-företagen: Lovable, Base44, Monday.com, företag vars hela produkt är att låta människor bygga appar genom att beskriva dem. Appar som hjälper dig att bygga appar. Abstraktionen klättrar, och den klättrar mot människor som inte skriver kod.

En av Anthropics ledare sa att Claude “förmodligen är lika bra som en medelingenjör på att skriva kod” idag. En annan sa att slutmålet de siktar mot är att Claude “i princip kan bygga sig själv.”
<h2.Varför "kodagent" underskattar det

Kod är bara den mest läsbara sak att mäta. Det är text, det fungerar eller det fungerar inte, och du kan räkna pull requests. Så det är där benchmarkerna pekar och det är det namn som fastnat.

Men om du tar bort det och ser på vad det faktiskt är, så är det inte kodverktyg. De är allmänna agenter som kan ha ett mål, bryta det ner i steg, använda verktyg, kontrollera sitt eget arbete och försöka igen tills något fungerar. Kod är bara den renaste demonstrationen av den loopen. Själva loopen handlar inte om kod.

Det är det som de flesta rapporter missar. Huvudstoryn är “utvecklare skriver mindre kod för hand.” Den faktiska storyn är att gapet mellan en person med en idé och en fungerande sak krymper. Och kod var bara en uttrycksform för det gapet.

När demon är “Claude skickade en pull request”, diskuterar utvecklare om det är bra eller dåligt för utvecklare. En rimlig diskussion. Men det begraver den större frågan: samma förmåga som skriver en pull request kan bygga det lilla interna verktyg en marknadsförare behöver, skriptet som sammanfogar två oordnade kalkylblad, pipelinen som omvandlar en mapp med anteckningar till en publicerad utkast. Inget av det är “programvaruutveckling” i den meningen att det är ett jobb. Allt det är nu byggbart av någon som kan beskriva vad de vill ha.

De människor som det faktiskt förändrar

Jag är inte en ingenjör. Jag ansvarar för innehåll och drift. För ett år sedan, om jag behövde ett verktyg som inte fanns, hade jag tre alternativ: köpa något som var tillräckligt bra, vänta på att någon skulle bygga det, eller klara mig utan. Nu finns det ett fjärde alternativ – beskriva det och låta en agent bygga det, åt mig, runt hur jag faktiskt arbetar.

Det är låset som “kodagent”-ramen döljer. De största vinnarna av agenter som skriver kod är inte de människor som redan skriver kod. De är de människor som aldrig kunde. Övertaget ackumuleras inte till ingenjörer som blir 20% snabbare. Det ackumuleras till operatörer som går från noll verktyg till sina egna verktyg.

Och det linjerar upp med allt annat som skickas just nu. Samma vecka som Code with Claude visade Google (GOOGL ) sökningsagenter som bygger en anpassad mini-app från en enda fråga. Ett annat företag, samma vektor: programvara blir något du ber om istället för något du anställer. Startup-företagen som demoade “appar som bygger appar” är bara mitten av den kurvan. Slutet av den är alla.

Fällan som är värd att nämna

Detta är inte en ren vinst, och rummet visste det. Utanför konferensen trycker många utvecklare hårt tillbaka. Forskare varnar för att den översvämning av ogenomgången kod som skapas skapar säkerhets- och underhållsskuld som ingen betalar av ännu. Vissa ingenjörer säger att deras egna färdigheter försämrats. Till och med Anthropics folk medgav att de gamla programvarubästa praxis fortfarande gäller, och att många team har förlorat sikte på dem i ruschen.

Tag det på allvar. Att skicka kod som du inte kan läsa, i stor skala, till produktion som människor är beroende av, är hur du bygger en långsam katastrof.

Men märk vem den varningen faktiskt är till. Det är för team som lämnar över tillsyn på system där sprängverkan är andra människor. För en operatör som bygger ett litet verktyg för sin egen arbetsflöde är sprängverkan deras egen eftermiddag. Nackdelen är ett skript som inte körs. Övertaget är en kraft som inte fanns för ett år sedan.

Så kalla det för vad det är. Inte en kodagent – en allt-agent som råkar vara bäst på kod just nu. Historien är inte att maskiner skriver programvara. Det är att dörren till att bygga programvara just öppnades för alla som var låsta utanför den, och de flesta av dem har inte gått igenom den ännu.

Alex leder Unite.AI:s AI-drivna nyhetsverksamhet, som kombinerar journalistik, forskning och automation för att stödja snabb och skalbar bevakning av artificiell intelligens. Hans arbete hjälper till att säkerställa att framväxande AI‑utvecklingar lyfts fram effektivt samtidigt som publikations redaktionella standarder upprätthålls.