AI-modeller og plattformer

Claude 3.7 Sonnet er Anthropics AI-gjennombrudd

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

Anthropic har lansert Claude 3.7 Sonnet, en høyt etterlengtet oppgradering av sin store språkmodell (LLM)-familie. Den blir markedsført som selskapets “mest intelligente modell til dato” og den første hybrid resonans AI på markedet, og introduserer noen store forbedringer over sin forgjenger (Claude 3.5 Sonnet) i hastighet, resonans og virkelige oppgave-ytelse. 

Lanseringen skjer midt i raske fremgang fra konkurrenter som OpenAI og xAI’s nylige Grok 3, og fører mange AI-entusiaster (inkludert meg) til å se på denne lanseringen som Anthropics svar på nylige innovasjoner. Den nye modellen har til hensikt å blande rask konversasjonssvar med dypere analytisk tenkning i ett system – en samlet tilnærming som kan vise oss hva fremtidig interaksjon med AI vil se ut som. 

Lenge etterlengtet oppgradering av en elsket AI-assistent

For mange vanlige AI-brukere var Claude 3.5 Sonnet allerede et gå-til-verktøy. Det ble ansett som ett av de beste der ute. Likevel har Anthropic i de siste månedene møtt økende press. AI-industrien har vært gal med nye funksjoner og modeller – OpenAI’s ChatGPT fikk stemme, multi-steg resonans-evner og dypt forskning. Grok 3 gjorde sin debut med sanntids-X-data, og andre plattformer som Perplexity og Gemini holdt lanseringene komme. Mange observatører begynte å merke at Anthropic begynte å falle bak. Samfunnet hadde ivrig vente på Anthropics svar, med forventninger om at en ny Claude-modell var due hver dag.

Claude 3.7 Sonnet ankom endelig for å møte disse forventningene. Det er et betydelig sprang fremover fra Claude 3.5, snarere enn en mindre justering. Anthropic markedsfører det som en omfattende oppgradering: raskere, smartere og mer variert.

Modellens hastighet og utgangskvalitet er slående. I mine egne tester fant jeg det å være usedvanlig raskt sammenlignet med den siste versjonen, og prosesserte lange tekst-inndata nesten øyeblikkelig. Gitt Anthropics langsommelige oppdaterings-syklus, føles 3.7-utgaven som en lenge etterlengtet oppfølging som gjenvinner Claudes posisjon i AI-løpet. Claude 3.7 dobbelt ned på hva som gjorde brukerne elske Claude 3.5 – unik ytelse i praktiske oppgaver – mens det legger til innovative resonans-egenskaper under panseret.

Hybrid resonans: Rask svar og dypt tenkning i ett

Den mest fremtredende funksjonen i Claude 3.7 Sonnet er dens hybrid resonans-kapasitet. I enkle termer kan denne modellen operere i to moduser: en standard-modus for nesten-øyeblikkelige svar, og en ny “utvidet tenkning”-modus hvor den arbeider gjennom problemer steg-for-steg, og viser sin tenkning-kjede til brukeren.

I stedet for å utgi en separat Claude resonans-utgave, har Anthropic slått sammen både rask og reflektert tenkning i ett AI-“hjerne” for enkel bruk. “Like mennesker bruker en enkelt hjerne for både rask svar og dypt refleksjon, mener vi at resonans bør være en integrert egenskap… snarere enn en separat modell i seg selv,” forklarte selskapet i sin kunngjøring, og betonet en samlet tilnærming for en sammenhengende brukeropplevelse.

I praksis betyr dette at brukerne kan bestemme når de ønsker et raskt svar og når de lar Claude reflektere over lengre tid. En enkel ombytter lar deg bytte til utvidet modus hvis et spørsmål krever detaljert analyse eller multi-steg logikk. I standard-modus fungerer Claude 3.7 Sonnet som en forbedret versjon av 3.5 – raskere og mer raffinert, men med den kjente rask konversasjon-stilen. I utvidet modus “selv-reflekterer” AI-en før den svarer, og skriver ut sin tenkning-prosess intern og (og gjør den synlig) for å nå mer nøyaktige eller komplekse løsninger.

Tenkning-kjeden ruller ut steg-for-steg på skjermen, en funksjon som har blitt populær i andre avanserte AI-systemer og nå endelig kommer til Claude.

Alex McFarland/Unite AI

Anthropics filosofi her kontrasterer bevisst med noen konkurrenter. OpenAI, for eksempel, har tilbudt separate modeller eller moduser, som noen finner forvirrende å håndtere. Claudes 3.7 all-i-ett-tilnærming er ment å forenkle ting for brukerne. Å bytte mellom moduser er rett frem, og prompt-stilen forblir den samme. Kraft-brukere kan sogar finjustere hvor mye AI-en tenker: gjennom API-en kan utviklere sette en token-budsjett for resonans, og fortelle Claude hvor lenge den skal gruble (fra bare noen få steg opp til en massiv 128k-token tenkning-prosess) før den finaliserer et svar. Denne granulerte kontrollen lar en bytte av hastighet for grundighet på forespørsel.

Nøkkel-forbedringer i Claude 3.7 Sonnet:

Her er noen av de viktigste forbedringene vi ser fra Claude 3.7 Sonnet:

  • Hybrid resonans-moduser – Tilbyr både øyeblikkelige svar og en utvidet tenkning-modus hvor AI-en arbeider gjennom problemer steg-for-steg med synlig resonans. Brukere velger modus per spørsmål, og samler rask samtale og dypt analyse i ett system.
  • Samlet modell-filosofi – Integrerer rask og reflektert tenkning i ett AI-“hjerne” for enkel bruk. Dette kontrasterer med konkurrenter som krever flere modeller eller tillegg, og reduserer kompleksiteten for slutt-brukeren.
  • Hastighet og responsivitet – Leverer svar raskere enn Claude 3.5. Tidlige tester viser merkbart raskere ytelse i standard-modus.
  • Utvidet tenkning-kontroll – Gjennom API-en kan brukere begrense eller utvide AI-ens resonans-lengde (opp til 128 000 token) for å balansere hastighet mot kvalitet etter behov. Dette sikrer at utvidet modus bare brukes så mye som nødvendig.
  • Virke-lige oppgave-fokus – Ifølge selskapet ble Claudes 3.7-trening flyttet mot praktiske forretnings- og kreative oppgaver snarere enn vanskelige matematikk-olympiade-pusler. Modellen utmerker seg i hverdags-problem-løsning og oppgaver som reflekterer vanlige bruk-tilfeller.
  • Koding og verktøy-bruk – Sterkere ytelse i programmerings-oppgaver, spesielt front-end web-utvikling. Anthropic lanserte sogar et kompanjons-verktøy, Claude Code, som lar utviklere bruke Claude fra kommandolinjen for å skrive og fikse kode. Tidlige benchmark-tester viser Claude 3.7 toppende lister i å løse virkelige programvare-problemer.

Begrensninger og hva som kommer neste for AI-brukere

Til tross for all spenningen er Claude 3.7 Sonnet ikke uten begrensninger, og det er ikke en magisk kule for alle AI-utfordringer. For det første har Anthropic bevisst nedtonet visse domener i treningen av denne modellen. De “optimerte noe mindre for matematikk og datavitenskapelige konkurranse-problemer” til fordel for mer hverdagslige forretnings-oppgaver. Dette betyr at selv om Claude 3.7 kan løse matematikk- og kode-spørsmål (ofte bedre enn 3.5 kunne), kan det kanskje ikke toppe listen på hver enkelt akademisk benchmark eller pusle. Brukere hvis behov sklir mot komplekse matematikk-bevis eller spesialiserte kode-konkurranser kan fortsatt finne områder hvor Claudes svar krever dobbel-tjekking eller hvor en konkurrents modell tilpasset for den nisjen gjør det bedre. Anthropic ser ut til å ha akseptert dette valget, og retter modellen mot praktisk nytte snarere enn teoretisk dyktighet.

I tillegg introduserer utvidet tenkning-modus noen kompleksitet. Den er innebygget langsommere enn standard-modusen; når AI-en er i dypt tenkning, vil brukerne merke en kort pause mens den arbeider gjennom sin resonans. Dette er forventet – bytte av hastighet for grundighet – men det betyr at brukerne må bestemme når de faktisk trenger den ekstra kraften. I mange hverdags-samtale-spørsmål vil standard-modusen være tilstrekkelig og mer effektiv. Det er også faktum at utvidet resonans kan noen ganger overgjøre og gi mer enn du faktisk trenger. I noen tilfeller kan dette overvelde eller avvie fra sporet. Anthropic må sikre at AI-ens villighet til å “gå stor” med ideer forblir relevant og på tema. Brukere kan lære å stille mer presise spørsmål eller sette token-begrensninger for å kurve unna løpske tangenter.

Bunnen av saken

Claude 3.7 Sonnets lansering er en erklæring om at Anthropic er meget i spillet sammen med OpenAI, Google (GOOGL ) /DeepMind og nye spillere som xAI. For AI-entusiaster og utviklere legger det til en topp-modell til å eksperimentere med, en som tilbyr en unik vrikt med sin hybrid resonans.

I den konkurranse-utsatte AI-industrien kan Anthropics siste trekk også påvirke hvordan selskaper stiller sine modeller. Ved å velge å ikke gjøre et stort modell-størrelses-sprang eller en glitzy multi-modal demo, men i stedet forbedre brukeropplevelsen (samling av moduser, hastighet, praktiske bruk-tilfeller), skaper Anthropic en nisje fokusert på brukervennlighet og pålitelighet. 

Samlet sett er Claude 3.7 Sonnet et avgjørende øyeblikk for Anthropic. Det er en utvikling av Claude-serien som viser at selskapet lærer av samfunnets behov – dobbelt ned på styrker mens det adresserer svakheter. Det er fortsatt områder å se på (og fremtidige Claude-iterasjoner å vente på), men denne lanseringen har tydelig gjenopplivet Anthropics brukerbase. 

Alex McFarland er en AI-journalist og forfatter som utforsker de nyeste utviklingene innen kunstig intelligens. Han har samarbeidet med tallrike AI-startups og publikasjoner verden over.