AI-modellen en platforms
OpenAI en Anthropic lanceren duellerende modellen terwijl de AI-wapenwedloop escalerend

OpenAI en Anthropic hebben vandaag binnen enkele minuten na elkaar nieuwe vlaggenschipmodellen uitgebracht, terwijl OpenAI tegelijkertijd een enterprise-agentplatform lanceerde en Perplexity een multi-modelonderzoeksfunctie introduceerde. Vandaag zijn er meer significante AI-productaankondigingen gedaan in één middag dan de meeste weken in totaal.
Hieronder volgt wat er is gebeurd en wat het betekent.
Anthropics Opus 4.6: Agent Teams en een miljoen-tokenvenster
Anthropic heeft Claude Opus 4.6 uitgebracht, zijn meest capabele model, met twee belangrijke functies: een contextvenster van één miljoen tokens en een nieuwe functionaliteit genaamd Agent Teams.
Het contextvenster is de grootste technische prestatie. Met één miljoen tokens kan Opus 4.6 ongeveer 3.000 pagina’s tekst in één prompt verwerken – vier keer het limiet van 256.000 tokens van zijn voorganger. In combinatie met ondersteuning voor 128.000-tokenuitvoer kan het model nu hele codebases, reguliere deposanten of onderzoekscollecties zonder chunking of samenvatting verwerken en gebruiken.
Agent Teams, beschikbaar in Claude Code, laat meerdere Claude-exemplaren toe om parallel te werken aan een gedeelde codebase. In plaats van één agent die taken sequentieel uitvoert, kunnen ontwikkelaars teams opzetten waarin één agent frontend-wijzigingen afhandelt, een andere tests schrijft en een derde backend-logica herschrijft – allemaal tegelijkertijd aan hetzelfde project werken.
Opus 4.6 introduceert ook adaptief denken, waarmee het model kan bepalen hoeveel redeneerinspanning het moet investeren in een bepaalde prompt. Simpele vragen krijgen snelle antwoorden; complexe problemen triggeren dieper, verlengd nadenken. Ontwikkelaars kunnen dit via inspanningscontroles op vier niveaus aanpassen: laag, medium, hoog en max.
Op benchmarks scoort Opus 4.6 het hoogst op Terminal-Bench 2.0 voor agentic coding en leidt Humanity’s Last Exam, een complexe redenevaluatie. Anthropic claimt een 144-punten Elo-voorsprong op GPT-5.2 op de GDPval-AA-evaluatie en een 190-puntenverbetering ten opzichte van Opus 4.5.
API-prijzen blijven ongewijzigd bij $5 per miljoen inputtokens en $25 per miljoen outputtokens, hoewel prompts die 200.000 tokens overschrijden een premietarief van $10/$37,50 hebben.
In een opvallende ondernemingszet heeft Anthropic een onderzoeksvoorbeeld van Claude in Microsoft PowerPoint aangekondigd, waar het model bestaande lay-outs en sjablonen van dia’s kan lezen en presentaties kan genereren of bewerken terwijl het bedrijfsformattering behoudt.
OpenAI’s GPT-5.3-Codex: Het model dat zichzelf hielp bouwen
Enkele minuten na de aankondiging van Anthropic heeft OpenAI GPT-5.3-Codex gelanceerd, zijn meest capabele coderingsmodel. De release combineert de frontier-coderingsprestaties van GPT-5.2-Codex met de redeneer- en professionele kennisfunctionaliteiten van GPT-5.2 in één systeem dat ook 25 procent sneller is.
Het meest opvallende claim: GPT-5.3-Codex heeft zichzelf geholpen bij de bouw. OpenAI’s Codex-team gebruikte vroege versies van het model tijdens zijn eigen trainingsproces – fouten in trainingsruns opsporen, implementatie-infrastructuur beheren en evaluatieresultaten diagnosticeren. Het is OpenAI’s eerste openbare erkenning dat een model instrumenteel was bij zijn eigen ontwikkeling, een mijlpaal die zowel efficiëntie- als veiligheidsvragen oproept.
GPT-5.3-Codex zet nieuwe industrienormen op SWE-Bench Pro en Terminal-Bench, benchmarks die echte software-engineeringtaken evalueren. Het model kan langlopende taken met onderzoek, toolgebruik en complexe uitvoering aan en gebruikers kunnen er tijdens de taak mee communiceren zonder context te verliezen – meer zoals samenwerken met een collega dan opdrachten geven.
Het model is nu beschikbaar voor alle betaalde ChatGPT-gebruikers via de Codex-app, CLI, IDE-extensie en webinterface. API-toegang komt binnenkort beschikbaar.
Voor ontwikkelaars die kiezen tussen AI-codegeneratoren is het concurrerende beeld nu scherp gedefinieerd: Opus 4.6 leidt op agentcoördinatie en lang-contextwerk, terwijl GPT-5.3-Codex benadrukt snelheid en geïntegreerde redenering. Beide claimen de hoogste scores op overlappende benchmarks, en tools zoals Cursor en Apple’s Xcode ondersteunen beide, zodat ontwikkelaars vrijelijk kunnen schakelen.
OpenAI Frontier: Enterprise-agents krijgen hun eigen platform
Naast de modellancering heeft OpenAI Frontier geïntroduceerd, een enterprise-platform voor het bouwen, implementeren en beheren van AI-agents. Frontier verbindt met databases, CRM-systemen, HR-platforms, ticketingtools en andere bedrijfsapplicaties en laat vervolgens AI-agents processen over hen uitvoeren.
OpenAI beschreef Frontier als “een semantische laag voor het bedrijf” waar menselijke werknemers en AI-agents op hetzelfde platform werken met gedeelde gegevenstoegang en beveiligingscontroles. Agents krijgen identiteiten die vergelijkbaar zijn met die van werknemers, gedeelde organisatorische context en ondernemingsklasse-machtigingen.
Het platform is model-agnostisch – bedrijven kunnen agents beheren die zijn gebouwd op OpenAI’s modellen naast die van Google (GOOGL ), Microsoft en Anthropic. Initiële klanten zijn onder andere Intuit (INTU ), State Farm, Thermo Fisher en Uber.
Frontier positioneert OpenAI om rechtstreeks te concurreren met enterprise-platforms zoals Salesforce’s Agentforce en ServiceNow’s AI-agents. Het verschil: OpenAI bouwt vanaf de modellaag, terwijl gevestigde bedrijven AI toevoegen aan bestaande workflowtools. Of ondernemingen de voorkeur geven aan hun agent-infrastructuur van hun AI-leverancier of hun softwareleverancier, zal de enterprise-AI-concurrentie in 2026 definiëren.
Perplexity’s Model Council: Drie modellen, één antwoord
Perplexity heeft Model Council gelanceerd, een functie die dezelfde query uitvoert over drie modellen tegelijk – Claude Opus, GPT en Gemini – en vervolgens een synthesizer-model gebruikt om hun uitvoer te combineren tot één antwoord dat overeenstemming en meningsverschillen markeert.

Afbeelding: Perplexity
De premisse is dat geen enkel model betrouwbaar het beste is voor alle queries. Wanneer drie frontier-modellen hetzelfde antwoord geven, is het vertrouwen hoog. Wanneer ze divergeren, weten gebruikers dat ze verder moeten onderzoeken. Model Council is beschikbaar voor Max-abonnees en is gericht op beleggingsonderzoek, strategische analyse en complexe besluitvorming.
De functie weerspiegelt Perplexity’s strategie om te differentiëren door middel van multi-modelorkestratie in plaats van foundation-modellen te bouwen. Aangezien de kloof tussen frontier AI-chatbots smaller wordt op individuele benchmarks, kan het combineren van hun uitvoer waardevoller blijken dan het kiezen van één provider.
Wat het allemaal betekent
Deze releases bevestigen dat de AI-concurrentie is verschoven van modelcapaciteit naar productinfrastructuur. Zowel OpenAI als Anthropic hebben modellen die de hoogste scores behalen op dezelfde benchmarks; de differentiatie leeft nu in wat je er bovenop kunt bouwen.
Perplexity, daarentegen, maakt een stille bewering dat de modeloorlogen minder belangrijk kunnen zijn dan hoe je modellen combineert. Als Model Council nuttig blijkt, suggereert het dat de toekomst niet gaat over het kiezen tussen Claude en GPT – het gaat over het gebruik van beide.
Voor ontwikkelaars en ondernemingen die hun AI-stack evalueren, maakt dit de beslissing moeilijker.












