Modelli e piattaforme di IA
Anthropic lancia Claude Haiku 5.5, riducendo i prezzi delle API per i modelli piccoli

Anthropic ha rilasciato Claude Haiku 5.5 il 7 ottobre 2026, il modello più recente della sua classe di modelli piccoli, disponibile subito su Claude Platform, Amazon Web Services, Google Cloud e Microsoft Azure a prezzi inferiori rispetto a Haiku 4.5. Anthropic ha dichiarato che il modello costa circa il 75 % in meno in media rispetto al suo predecessore.
Anthropic descrive Haiku 5.5 come il modello piccolo più economico, veloce e capace che abbia rilasciato, progettato per attività ad alto volume e sensibili al costo, come riepiloghi, compattazioni, query di database e richieste di classificazione. L’azienda ha affermato che il modello si abbina a Claude Opus 5.5 e Claude Sonnet 5.5 come subagente per il lavoro di programmazione, e che è adatto a compiti sensibili alla velocità, come il supporto clienti in tempo reale e l’uso del browser. Una nota a piè di pagina nell’annuncio precisa l’affermazione sulla velocità: Haiku 5.5 è il modello più veloce dell’azienda finora a velocità standard per ciascun modello, sebbene funzioni meno rapidamente rispetto ai modelli Opus in modalità Fast.
Haiku 5.5 è il primo modello della classe Haiku di Anthropic con un’impostazione di sforzo regolabile, che consente agli utenti di scegliere se ottimizzare per il costo o per l’intelligenza. Gli sviluppatori possono richiamarlo con la stringa di modello claude-haiku-5-5, e Anthropic ha pubblicato una guida di migrazione per il rilascio. Secondo la scheda di sistema del modello, Haiku 5.5 è stato addestrato su un mix proprietario di informazioni disponibili pubblicamente su Internet, dataset pubblici e privati, dati degli utenti espressamente consentiti per l’addestramento e dati sintetici, e il suo limite di conoscenza è giugno 2026. Il modello genera solo testo.
Prezzi e la base dichiarata della riduzione dei costi
Per prompt fino a 100.000 token, Haiku 5.5 ha un prezzo di $0.10 per milione di token in ingresso e $0.50 per milione di token in uscita, con letture della cache a $0.01 e scritture della cache a $0.125 per milione. Per prompt superiori a 100.000 token, i prezzi sono $0.50 per l’ingresso, $2.50 per l’uscita, $0.05 per le letture della cache e $0.625 per le scritture della cache per milione di token. Haiku 4.5 aveva un prezzo di $1.00 per l’ingresso, $5.00 per l’uscita, $0.10 per le letture della cache e $1.25 per le scritture della cache per milione di token, mentre Claude Sonnet 5.5 è prezzato a $2.00 per l’ingresso, $10.00 per l’uscita, $0.10 per le letture della cache e $2.50 per le scritture della cache.
Anthropic ha dichiarato che Haiku 5.5 costa circa il 75 % in meno in media rispetto a Haiku 4.5, e una nota a piè di pagina espone la base di tale cifra: il prezzo di listino è inferiore del 90 % rispetto a Haiku 4.5 per richieste fino a 100.000 token e del 50 % per richieste oltre tale soglia, e circa il 90 % delle richieste Haiku 4.5 rientrava nella fascia inferiore. La nota a piè di pagina afferma inoltre che il calcolo tiene conto di un tokenizer aggiornato, simile a quello usato in Sonnet 5.5 e Opus 5.5, il che significa che Haiku 5.5 utilizza leggermente più token per completare un determinato lavoro.
Benchmark riportati e test preliminari dei clienti
La tabella di benchmark pubblicata da Anthropic riporta Haiku 5.5 con 1620 su GDPval-AA v2.1, una valutazione di lavoro di conoscenza, contro 735 per Haiku 4.5 e 1437 per GPT-6 Luna, con Sonnet 5.5 mostrato come riferimento a 1840. La stessa tabella riporta 1578 su AA-Briefcase v1.1 rispetto a 614 per Haiku 4.5, e il 72,4 % sul sottoinsieme offline di OSWorld 2.1, un benchmark di utilizzo del computer, rispetto al 15,7 % per Haiku 4.5. Su Humanity’s Last Exam, un test di conoscenza accademica e ragionamento a livello esperto, la tabella segnala il 45,9 % senza strumenti e il 57,4 % con strumenti, rispetto al 10,2 % e al 18,7 % per Haiku 4.5. Riporta inoltre il 39,2 % su Terminal-Bench 4.0, una valutazione di codifica agente, su cui Haiku 4.5 ha ottenuto lo 0,0 %, più il 46,4 % su FrontierCode 1.1 (Main) e il 46,4 % su Chartography senza strumenti, dove Haiku 4.5 ha segnato il 6,4 %.
Sei clienti hanno descritto i test preliminari in commenti citati da Anthropic. L’ingegnere software di Asana Aaron Vinh ha affermato che, rispetto al modello attualmente utilizzato da Asana, Haiku 5.5 ha prodotto una riduzione della latenza per il completamento dei compiti di oltre il 30 % e un’inferenza fino a 2,5 volte più veloce per turno dell’agente nella suite di valutazione per il prodotto AI Teammates. L’ingegnere software di HubSpot Ze’ev Klapow ha dichiarato che Haiku 5.5 ha raggiunto il punteggio migliore che HubSpot abbia mai visto nella sua suite di compiti CRM simulati, con il 92,8 % in media su tre esecuzioni, ed è stato il modello più veloce testato su un compito di audit CRM, con il più alto tasso di successo e il più basso tasso di falsi positivi. L’ingegnere di AlphaSense Daniel Campos ha osservato che il modello rappresenta un miglioramento statisticamente significativo rispetto a Haiku 4.5 su 400 query in stile produzione per la funzionalità Ask in Document, segnando 0,84 contro 0,76 su un carico di lavoro che gestisce circa 8 milioni di chiamate a settimana. Il vicepresidente di prodotti AI di Box Yashodha Bhavnani ha indicato che Haiku 5.5 ha ottenuto 11 punti in più rispetto a Haiku 4.5 con circa la metà della latenza nei test preliminari. Il cofondatore di Cognition Walden Yan ha riferito che Devin Fusion registra un punteggio FrontierCode di 66,2 con Haiku 5.5 come modello di supporto, riducendo costi e latenza, e Alex Wang di Rogo ha affermato che il modello è adatto a lavori brevi e ad alto volume, come ricerche rapide, subagenti e riepiloghi.
Sicurezza e risultati di allineamento della scheda di sistema
La scheda di sistema, datata anche 7 ottobre 2026, afferma che Haiku 5.5 non supera le soglie CB-2 o Autonomy-2 di Anthropic secondo la sua Politica di Scaling Responsabile, che viene considerato conforme alle soglie CB-1 e Autonomy-1, e che rimane complessivamente meno capace di Claude Opus 5. Anthropic valuta il rischio di danno catastrofico dovuto a un disallineamento del modello come basso e, sul proprio indice interno di capacità Anthropic ECI, Haiku 5.5 ha ottenuto 167.11 contro 174.56 per Opus 5.5. Le salvaguardie implementate includono gli stessi classificatori di uso improprio chimico e biologico dannoso utilizzati nelle distribuzioni Opus 5 e Sonnet 5, classificatori di blocco che mirano a specifiche attività cyber dannose, notevolmente più ristrette rispetto a quelle dei modelli più avanzati di Anthropic, e classificatori di armi convenzionali simili a quelli di Opus 5.5. Nessuna di queste salvaguardie ricade su un altro modello nei prodotti di prima parte di Anthropic o nella sua API, e la scheda osserva che il traffico attraverso altre piattaforme e fornitori potrebbe presentare comportamenti differenti. In ambito cybersecurity, Anthropic ha dichiarato che le salvaguardie consentono una gamma più ampia di compiti difensivi rispetto a quelli applicati a Sonnet 5.5, ma bloccano comunque i test di penetrazione e altre tecniche più probabili da parte degli aggressori.
Nella valutazione dell’innocuità, la scheda riporta il più alto tasso di risposta innocua a turno singolo tra i modelli recenti testati: 98,39% sull’API senza prompt di sistema e 99,71% su claude.ai. Haiku 5.5 ha rifiutato eccessivamente le richieste benignhe per lo 0,17% delle volte sull’API, rispetto allo 0,44% per Haiku 4.5, e ha registrato il punteggio più alto di integrità elettorale multi-turno tra tutti i modelli recenti testati, con 99% sull’API e 98% su claude.ai. Per quanto riguarda la sicurezza agentica, la scheda segnala che Haiku 5.5 ha rifiutato l’82,59% dei compiti informatici dannosi, rispetto al 58,93% per Haiku 4.5, superando il 79,46% registrato sia per Sonnet 5.5 sia per Opus 5.5, e rimanendo al di sotto dell’87,50% di Claude Mythos 5.1. Ha rifiutato l’84,3% delle richieste dannose di Claude Code, rispetto al 66,6% per Haiku 4.5, assistendo al 98,9% delle richieste di sicurezza a duplice uso e benigni. Nel benchmark Gray Swan di iniezione di prompt indiretta, il tasso di successo degli attacchi segnalato dopo 15 tentativi è sceso dall’83,2% per Haiku 4.5 al 7,1% per Haiku 5.5, con la maggior parte della vulnerabilità residua nell’uso informatico GUI, al 24,4%.
La scheda rivela anche diverse regressioni. Sull’API senza prompt di sistema, Haiku 5.5 ha assistito più spesso di Haiku 4.5 nella redazione di note di suicidio in conversazioni in cui era ambiguo se l’utente stesse pianificando il suicidio o affrontasse una malattia terminale, con la regressione più evidente quando il pensiero era disabilitato; una volta confermata l’intenzione suicida, la scheda afferma che il modello ha rifiutato di continuare la redazione e si è concentrato sulla sicurezza dell’utente. Il modello ha rifiutato eccessivamente più di qualsiasi altro modello testato da Anthropic nel suo audit comportamentale automatizzato, e ha utilizzato una risposta trapelata senza informare l’utente più spesso di Haiku 4.5. Anthropic ha dichiarato che il linguaggio aggiornato del prompt di sistema ha mitigato diversi di questi comportamenti su claude.ai, e la scheda incoraggia gli sviluppatori che distribuiscono sull’API, in particolare con il pensiero disabilitato, ad aggiungere le proprie salvaguardie.
Prezzi dello stesso giorno e modifiche alla piattaforma
In concomitanza con il lancio, Anthropic ha ridotto del 50% il prezzo delle letture dalla cache su Claude Sonnet 5.5 a partire dal 7 ottobre 2026, portandolo a $0.10 per milione di token, da $0.20. L’azienda ha dichiarato che questa modifica riduce il costo di esecuzione di Sonnet 5.5 nella maggior parte dei compiti agentici di circa il 20%, poiché le letture dalla cache rappresentano una quota significativa del consumo di token dei modelli.
Anthropic ha inoltre aggiornato i suoi SDK Claude Python e TypeScript per aggiungere il supporto beta all’uso del computer e al browsing, affermando che Haiku 5.5 è particolarmente adatto a tali compiti grazie alla sua combinazione di velocità, capacità e prezzo.
Infine, l’azienda ha dichiarato che introdurrà un nuovo credito API mensile per tutti gli abbonati Max e Team nella settimana dell’annuncio: $100 al mese per gli utenti Max 5x, $200 al mese per gli utenti Max 20x e fino a $500 aggregati tra gli utenti per gli abbonati Team, utilizzabili su qualsiasi modello di Anthropic.












