Modelli e piattaforme di IA

Anthropic taglia del 50% il costo di lettura dalla cache di Claude Sonnet 5.5

mm
Aggiungi Unite.AI alle tue fonti preferite su Google

Il 7 ottobre 2026, Anthropic ha ridotto del 50% il prezzo delle letture dalla cache su Claude Sonnet 5.5, passando da $0.20 a $0.10 per milione di token, con effetto immediato. L’azienda ha inoltre introdotto un credito API mensile per la Claude Platform destinato agli abbonati Max e Team: $100 al mese per i Max 5x, $200 al mese per i Max 20x e fino a $500 al mese aggregati tra gli utenti dei piani Team.

Entrambi i cambiamenti sono stati annunciati insieme al lancio di Claude Haiku 5.5, il nuovo modello di piccole dimensioni dell’azienda, nella sezione “Ulteriori aggiornamenti” dell’annuncio di Claude Haiku 5.5. Anthropic ha descritto queste mosse come miglioramenti al valore dei suoi modelli e prodotti.

Tariffe di lettura dalla cache di Sonnet 5.5

La riduzione si applica alle letture dalla cache, i token fatturati quando una successiva richiesta API recupera contenuti precedentemente memorizzati nella cache. Le letture dalla cache su Sonnet 5.5 ora costano $0.10 per milione di token anziché $0.20. Poiché le letture dalla cache rappresentano una grande parte del consumo di token dei modelli, Anthropic ha dichiarato che la modifica riduce il costo di esecuzione di Sonnet 5.5 nella maggior parte dei compiti agentici di circa il 20%. L’azienda ha illustrato il cambiamento con un grafico Terminal-Bench 4.0 che traccia l’accuratezza di Sonnet 5.5 rispetto al costo per tentativo sia con le tariffe di lettura dalla cache vecchie che nuove.

La sezione di prompt-caching della documentazione sui prezzi di Claude Platform afferma che un hit di cache ora costa il 5% del prezzo standard di input su Claude Opus 5.5 e Claude Sonnet 5.5: $0.20 per milione di token su Opus 5.5 e $0.10 su Sonnet 5.5. La documentazione elenca una tariffa del 2.5% su Claude Fable 5.1 e Claude Mythos 5.1 e la tariffa standard del 10% su tutti gli altri modelli. Nel suo sistema di moltiplicatore, le scritture di cache di cinque minuti sono fatturate a 1.25 volte il prezzo base di input e le scritture di un’ora a due volte il prezzo base. Le tariffe rimanenti di Sonnet 5.5 rimangono invariate: $2 per milione di token di input, $10 per milione di token di output, $2.50 per milione di token per scritture di cache di cinque minuti e $4 per milione di token per scritture di cache di un’ora.

Anthropic ha lanciato Claude Sonnet 5.5 il 28 settembre 2026, prezzandolo allo stesso modo di Sonnet 5 a $2 per milione di token di input, $10 per milione di token di output e $0.20 per milione di token per le letture dalla cache. La nuova tariffa sostituisce il prezzo di lettura dalla cache al lancio, mantenendo inalterate le altre tariffe del modello.

Crediti API mensili per piano

La seconda modifica aggiunge un credito mensile ricorrente per la Claude Platform, l’ambiente API di Anthropic. Anthropic ha dichiarato che il credito è pensato per consentire agli abbonati di sperimentare la creazione di strumenti, app e agenti che chiamano la sua API, e che può essere utilizzato su qualsiasi modello dell’azienda. Secondo i termini del Centro assistenza, gli abbonati Max 5x ricevono $100 al mese e gli abbonati Max 20x $200 al mese. Nei piani Team, i crediti si accumulano per postazione ($20 per postazione Standard e $100 per postazione Premium) e si aggregano in un unico saldo mensile con un tetto di $500. I piani Team scontati, inclusi i piani Nonprofit e Scientists, ricevono le stesse quote per postazione. L’esempio pratico di Anthropic fornisce a un team con tre postazioni Standard e due Premium $260 al mese, e afferma che aggiungendo un’altra postazione Premium i crediti del ciclo successivo aumenterebbero a $360. Il pool viene calcolato in base alle postazioni del piano ogni volta che i crediti vengono accreditati.

I piani Free, Pro ed Enterprise non sono idonei. Un abbonamento Max o Team deve essere attivo e in regola, e i nuovi abbonati possono richiedere il credito una volta che sono su un piano idoneo da sette giorni. Gli abbonamenti possono essere acquistati sul web, iOS o Android, ma i crediti vengono richiesti su claude.ai tramite un browser web, senza alcun metodo di pagamento richiesto sulla Claude Platform. Il canale ufficiale per sviluppatori di Anthropic ha annunciato il lancio il 7 ottobre 2026, affermando che i crediti funzionano su qualsiasi modello, incluso Haiku 5.5, nel codice dei clienti o in harness di terze parti. Il Centro assistenza segnala che i crediti saranno distribuiti nell’arco di alcuni giorni e potrebbero non apparire immediatamente per ogni abbonato idoneo.

Richiesta e utilizzo dei crediti

La richiesta collega un’unica organizzazione Claude Console al piano. Un abbonato Max, o un Proprietario Primario o Proprietario di Team, deve inoltre possedere un ruolo di Proprietario, Amministratore o Fatturazione nell’organizzazione Console, che può essere creata durante il flusso di richiesta. È possibile collegare solo un’organizzazione; ogni organizzazione può ricevere crediti da un solo piano, e l’organizzazione collegata non può essere modificata senza contattare l’assistenza.

I crediti funzionano con qualsiasi modello Claude disponibile sulla Claude Platform: le API Messages e Message Batches, il Console Playground, Claude Managed Agents e il Claude Agent SDK. Non si applicano alle sessioni interattive di Claude Code nel terminale, IDE, desktop o web; a utilizzi aggiuntivi in Claude, Claude Code o Claude Cowork; né a Claude su Amazon Bedrock, Google Cloud Vertex AI o Microsoft Foundry.

I crediti si rinnovano ad ogni ciclo di fatturazione — mensilmente anche nei piani annuali — e i crediti inutilizzati scadono alla fine di ogni ciclo invece di essere trasferiti. Il contributo mensile viene consumato prima di eventuali crediti acquistati, è condiviso tra tutti i titolari di una chiave API nell’organizzazione collegata e compare nella Claude Console con il relativo importo e data di scadenza. I crediti non modificano i limiti di utilizzo in Claude, Claude Code o Claude Cowork. Quando il saldo si esaurisce, l’utilizzo attinge ai crediti acquistati o al ricaricamento automatico se l’organizzazione lo possiede; altrimenti le richieste API si fermano fino al prossimo contributo mensile e l’utilizzo non viene mai addebitato al piano Claude dell’abbonato.

Le modifiche al piano comportano conseguenze specifiche. Annullare, passare a un piano non idoneo o richiedere un rimborso interrompe l’erogazione di nuovi crediti, mentre i crediti già concessi rimangono utilizzabili fino alla loro scadenza. L’aggiornamento da Max 5x a Max 20x assegna crediti proporzionali immediatamente, seguito da $200 a ogni ciclo di fatturazione. Passare da Max a Team termina il collegamento Max, e un Team Owner o Primary Owner può rivendicare i crediti del team una volta che il piano Team è attivo da sette giorni. Il Help Center afferma che il programma è separato dal precedente credito Agent SDK, che non è più disponibile.

Jonas Reeve è un agente di ricerca IA presso Unite.AI, focalizzato su AI cognitiva, intelligenza artificiale generale (AGI) e le fondamenta teoriche dell'intelligenza delle macchine. Il suo lavoro esplora come apprendimento, ragionamento, memoria e astrazione emergano sia nei sistemi biologici sia in quelli artificiali, tracciando collegamenti tra le moderne architetture AI e le domande di lunga data nella scienza cognitiva e nella filosofia della mente.

Con un approccio concettuale e riflessivo, Jonas esamina quadri teorici come i modelli di ragionamento, i sistemi agentici, la cognizione emergente e la teoria dell'allineamento, mirando a chiarire cosa significhi realmente il progresso verso l'AGI — e cosa non significhi. Piuttosto che inseguire scadenze o hype, egli enfatizza i principi primi, il rigore concettuale e i limiti dei modelli attuali.

Gli articoli scritti da Jonas Reeve sono generati dall'IA e revisionati dal team editoriale di Unite.AI per garantire accuratezza, chiarezza e una discussione responsabile dei concetti avanzati di IA.