ai agentica

Claude Haiku 5.5: Anthropic cala i prezzi per sfidare OpenAI


Indirizzo copiato

Il costo medio scende del 75% rispetto a Haiku 4.5, mentre crescono le prestazioni nei benchmark. Arrivano sconti sulla cache di Sonnet 5.5 e crediti API mensili per Max e Team. I prezzi sono in concorrenza con GPT-6 Luna e rilanciano la competizione sull’automazione aziendale

Pubblicato il 8 ott 2026



AI Questions Icon
Chiedi all'AI
Riassumi questo articolo
Approfondisci con altre fonti
Claude Haiku 5.5


Punti chiave

  • Anthropic lancia Claude Haiku 5.5: modello più economico e veloce per compiti ad alto volume; tariffe $0.10/$0.50 per milione di token fino a 100mila token; contesto fino a 1 milione di token.
  • Risparmio medio dichiarato 75% rispetto a Haiku 4.5, ma il guadagno reale dipende da tokenizzazione, uso della cache, lunghezza dei prompt e completamento delle pratiche.
  • Anthropic offre anche Opus 5.5 e Sonnet 5.5, sfida GPT-6 Luna; disponibilità su Amazon Web Services, Google Cloud e Microsoft; test e clienti segnalano miglioramenti variabili.
Riassunto generato con AI


Anthropic presenta Claude Haiku 5.5, il più economico e veloce dei suoi modelli di piccola taglia. L’obiettivo è ridurre la spesa per le aziende che interrogano l’intelligenza artificiale milioni di volte: servizi clienti, analisi documentale, classificazione di informazioni e agenti software incaricati di eseguire attività ripetitive. Secondo l’azienda, il costo medio per completare un lavoro diminuisce del 75% rispetto a Haiku 4.5.

La novità arriva il 7 ottobre 2026, dopo i lanci di Opus 5.5, il 22 settembre, e Sonnet 5.5, il 28 settembre. Con tre modelli rivolti a esigenze diverse, Anthropic punta a vendere capacità di calcolo in base alla complessità di ciascun compito, mentre la concorrenza con OpenAI si concentra sui prezzi delle API e sull’efficienza degli agenti AI.

Quanto costa Haiku 5.5 e perché la soglia di 100mila token conta

La tariffa di Haiku 5.5 parte da 0,10 dollari per milione di token in ingresso e 0,50 dollari per milione di token generati, per richieste con prompt fino a 100mila token. I token sono le unità con cui i fornitori misurano il testo elaborato e fatturano il servizio.

Rispetto a Haiku 4.5, che costa rispettivamente un dollaro e cinque dollari, il listino scende del 90%. Le letture dalla cache, che permettono di riutilizzare informazioni già elaborate, costano 0,01 dollari per milione di token; la scrittura nella cache di cinque minuti costa 0,125 dollari.

Oltre i 100mila token di prompt, i prezzi cambiano: 0,50 dollari per l’input e 2,50 per l’output. La soglia riguarda la lunghezza della singola richiesta e non l’intero volume mensile di un cliente. Anthropic sostiene che circa il 90% delle richieste al precedente Haiku rientrava nella fascia agevolata.

Il risparmio effettivo dipende dal lavoro

A parità di token fatturati, un’applicazione che consuma dieci milioni di token in ingresso e ne produce due milioni in uscita spenderebbe 2 dollari con Haiku 5.5 nella fascia inferiore, contro 20 dollari con Haiku 4.5. È un calcolo illustrativo: nell’uso reale contano anche cache, lunghezza dei prompt e quantità di risposte prodotte.

La riduzione media del 75% dichiarata da Anthropic è inferiore al taglio nominale del 90% perché tiene conto dei diversi profili d’uso e del nuovo sistema di tokenizzazione. La documentazione tecnica avverte che lo stesso testo può corrispondere a circa il 30% di token in più rispetto a Haiku 4.5.

Per valutare il risparmio, quindi, un’impresa deve misurare il costo per pratica completata, anziché fermarsi alla tariffa per milione di token.

I benchmark: più capacità, ma non su ogni compito

Nei test pubblicati da Anthropic, Haiku 5.5 ottiene 1.620 punti su GDPval-AA 2.1, dedicato al lavoro professionale, contro 735 del predecessore e 1.437 di GPT-6 Luna.

Su OSWorld 2.1, che misura la capacità di usare un computer per portare a termine procedure articolate, raggiunge il 72,4% nel sottoinsieme offline: Haiku 4.5 si ferma al 15,7%, GPT-6 Luna al 48,9% e Sonnet 5.5 arriva all’83,9%.

La graduatoria cambia nel coding autonomo. Su Terminal-Bench 4.0 Haiku 5.5 registra il 39,2%, mentre Sonnet 5.5 raggiunge il 70,6%. Nel test Humanity’s Last Exam, senza strumenti esterni, Haiku arriva al 45,9%, contro il 56,9% di Sonnet.

Sono risultati riportati dal produttore, legati a configurazioni e protocolli specifici: non costituiscono una garanzia di accuratezza nelle applicazioni aziendali.

La regolazione dello sforzo e il ruolo dei subagenti

Per la prima volta un modello Haiku dispone di un parametro che regola lo sforzo di ragionamento. Un livello ridotto privilegia rapidità e consumi contenuti; livelli superiori consentono al modello di dedicare più risorse ai problemi difficili.

La strategia di Anthropic prevede anche sistemi composti da più agenti. Opus o Sonnet possono pianificare un incarico complesso e affidare a Haiku operazioni delimitate, come estrarre un dato da un documento, riassumere una ricerca o interrogare un archivio.

Il vantaggio economico deriva dal trasferire molte chiamate verso il modello meno costoso senza compromettere il risultato complessivo. La qualità finale dipende però da come sono progettati controlli, verifiche e passaggi di consegne.

I primi clienti misurano velocità e risultati

Le prove preliminari diffuse con il lancio offrono indicazioni su impieghi già vicini alla produzione.

Asana riferisce una riduzione superiore al 30% della latenza nel completamento di alcune attività dei propri agenti e una velocità di inferenza fino a 2,5 volte maggiore per turno.

HubSpot dichiara un punteggio medio del 92,8% in tre esecuzioni di una suite dedicata alle operazioni sui sistemi di gestione dei clienti.

AlphaSense, che dichiara circa otto milioni di chiamate settimanali per il servizio di domande sui documenti, ha testato 400 richieste: il punteggio è salito da 0,76 con Haiku 4.5 a 0,84 con la nuova versione.

Box segnala undici punti di miglioramento nelle proprie prove con una latenza circa dimezzata.

Sono valutazioni comunicate da aziende coinvolte nei test iniziali: descrivono casi d’uso specifici e non equivalgono a una verifica indipendente delle prestazioni generali.

Anche Sonnet 5.5 diventa meno caro

L’annuncio non riguarda soltanto Haiku. Dal 7 ottobre Anthropic dimezza il prezzo delle letture dalla cache di Sonnet 5.5, da 0,20 a 0,10 dollari per milione di token.

Secondo la società, poiché gli agenti riutilizzano spesso istruzioni e informazioni già elaborate, questa modifica riduce di circa il 20% il costo della maggior parte dei carichi di lavoro agentici.

Sonnet conserva tariffe base superiori: 2 dollari per milione di token in ingresso e 10 in uscita. Per lo sviluppo software articolato, però, Anthropic continua a indicare Sonnet e Opus come opzioni preferibili.

Pagare meno una singola chiamata non significa risparmiare se il sistema richiede più tentativi, revisioni o interventi umani per completare il lavoro.

La sfida a GPT-6 Luna passa dai listini

Il concorrente diretto è GPT-6 Luna, presentato da OpenAI il 22 settembre.

La documentazione ufficiale OpenAI indica, nel livello standard e per prompt entro 272mila token, gli stessi prezzi base di Haiku nella fascia fino a 100mila: 0,10 dollari per milione di token in ingresso e 0,50 in uscita. Anche le letture di input dalla cache costano 0,01 dollari.

Sopra le rispettive soglie, tuttavia, i meccanismi tariffari divergono e il confronto richiede di specificare la dimensione della richiesta.

I risultati pubblicati da Anthropic favoriscono Haiku 5.5 in diversi test, ma un confronto economico credibile deve considerare precisione, latenza, consumo di token e tasso di completamento sullo stesso insieme di attività.

La pressione sui prezzi rende meno costosa l’automazione di processi ad alto volume, ma rende anche più difficile distinguersi vendendo soltanto accesso a un modello.

Un milione di token di contesto e distribuzione sui cloud

Haiku 5.5 supporta una finestra di contesto fino a un milione di token e risposte fino a 128mila token, secondo la documentazione della Claude Platform. Può quindi elaborare richieste molto estese, pur applicando tariffe più alte oltre la soglia dei 100mila token.

La disponibilità comprende la piattaforma Anthropic e i servizi di Amazon Web Services, Google Cloud e Microsoft.

Amazon ha annunciato l’integrazione in Bedrock e nella Claude Platform su AWS il 7 ottobre. Bedrock permette alle aziende di utilizzare controlli già presenti nell’infrastruttura Amazon, come gestione delle identità, registri di audit e strumenti di monitoraggio.

Google Cloud documenta anche endpoint multiregionali europei. Localizzazione del trattamento, sicurezza e conformità normativa richiedono comunque una verifica delle impostazioni contrattuali e tecniche adottate.

Crediti API per attrarre sviluppatori e imprese

Anthropic accompagna il modello con crediti mensili destinati agli abbonati Max e Team.

Il piano Max 5x riceve 100 dollari, Max 20x ne riceve 200. Per Team sono previsti 20 dollari per postazione Standard e 100 per Premium, raccolti in un saldo condiviso con un limite di 500 dollari al mese. Non sono inclusi i piani Free, Pro ed Enterprise.

Il credito si usa per creare applicazioni e agenti attraverso la Claude Platform, dopo aver collegato l’organizzazione nella console. Non copre le chiamate effettuate attraverso Bedrock, Google Cloud o Microsoft Foundry, né le sessioni interattive di Claude Code.

I crediti non utilizzati scadono al termine del ciclo di fatturazione. Per gli sviluppatori arrivano inoltre aggiornamenti, ancora in beta, degli SDK Python e TypeScript per l’uso del computer e del browser.

Sicurezza e automazione nei settori regolamentati

Anthropic dichiara progressi nei test di allineamento rispetto a Haiku 4.5, con minore disponibilità ad assecondare richieste abusive.

Le protezioni informatiche consentono alcune attività difensive ma bloccano il penetration testing e procedure più facilmente sfruttabili dagli attaccanti. Per le attività biologiche restano restrizioni analoghe a quelle previste per modelli più grandi.

Il 6 ottobre, il giorno precedente al lancio, Anthropic aveva ampliato il Cyber Verification Program per offrire accessi differenziati a professionisti e organizzazioni verificati.

La distinzione conta per banche, sanità e pubblica amministrazione, dove il valore dell’automazione deve essere confrontato con costi di vigilanza, audit e gestione dei dati. Un prezzo API contenuto non elimina questi oneri.

L’economia dell’AI aziendale si misura sui processi

Il primo ottobre Anthropic e Barclays hanno annunciato l’ampliamento della loro collaborazione. La banca afferma che i modelli Claude sono già impiegati per classificare e instradare circa 120mila email al giorno e che oltre 16mila dipendenti utilizzano un assistente per la ricerca di informazioni.

Non si tratta di risultati attribuiti a Haiku 5.5, appena lanciato, ma di un esempio della scala alla quale il costo per operazione può incidere sui conti.

Il 2 ottobre Anthropic ha annunciato anche un investimento di 100 milioni di dollari per formare diecimila ingegneri specializzati nell’adozione aziendale dell’AI entro il 2027.

Riduzione dei listini e formazione procedono nella stessa direzione: ampliare il numero di applicazioni realizzabili e il bacino di clienti. Per le imprese, il criterio decisivo sarà il rapporto tra spesa complessiva, pratiche completate correttamente e lavoro umano risparmiato.

Per maggiori informazioni si può consultare la system card

Fonti principali

  • L’articolo utilizza gli annunci ufficiali di Anthropic del 7 ottobre 2026, la documentazione tecnica della Claude Platform e i risultati dei test pubblicati dall’azienda.
  • Per il confronto competitivo sono stati verificati i listini e la documentazione di GPT-6 Luna di OpenAI, oltre alle comunicazioni di Amazon Web Services e Google Cloud sulla distribuzione del nuovo modello.
  • Le notizie sui crediti API, sul programma di verifica per la cybersicurezza, sulla collaborazione con Barclays e sugli investimenti nella formazione provengono dalle comunicazioni ufficiali pubblicate tra il 1° e il 7 ottobre 2026.

Partecipa alla community

guest

0 Commenti
Più recenti
Più votati
Inline Feedback
Vedi tutti i commenti

Articoli correlati

0
Lascia un commento, la tua opinione conta.x