Anthropic presenta Claude Haiku 5.5: il modello piccolo più economico, veloce e intelligente del 75%
AI News

Anthropic presenta Claude Haiku 5.5: il modello piccolo più economico, veloce e intelligente del 75%

6 min
08/10/2026
Claude Haiku 5.5AnthropicAI model pricingsmall language model

Il modello piccolo di Anthropic riceve un importante aggiornamento

Anthropic ha rilasciato ufficialmente Claude Haiku 5.5, l'ultima aggiunta alla sua famiglia di modelli, posizionandolo come il modello piccolo più economico, veloce e capace mai prodotto dall'azienda. Il lancio rappresenta una mossa significativa per sviluppatori e aziende che desiderano scalare i carichi di lavoro AI senza spendere una fortuna, specialmente per attività ripetitive ad alto volume che in precedenza erano proibitive dal punto di vista dei costi.

Il nuovo modello è immediatamente disponibile su tutte le principali piattaforme, tra cui Amazon Bedrock, Google Cloud, Microsoft Azure e direttamente tramite l'API Claude. Gli sviluppatori possono iniziare a usarlo oggi con l'ID modello claude-haiku-5-5.

Prezzi: una riduzione dei costi del 75%

La caratteristica principale di Haiku 5.5 è il suo prezzo aggressivo. Secondo Anthropic, il modello costa in media circa il 75% in meno da eseguire rispetto al suo predecessore, Haiku 4.5. Per richieste fino a 100.000 token, che costituiscono circa il 90% di tutto l'utilizzo del precedente modello Haiku, il calo di prezzo è ancora più marcato, raggiungendo il 90%.

  • Token di input: $0,10 per milione (rispetto a $1,00 per Haiku 4.5)
  • Token di output: $0,50 per milione (rispetto a $5,00)
  • Letture cache: $0,01 per milione (rispetto a $0,10)
  • Scritture cache: $0,125 per milione (rispetto a $1,25)

Questo prezzo pone Haiku 5.5 in diretta concorrenza con altri modelli compatti sul mercato, rendendolo un'opzione interessante sia per startup che per grandi aziende che devono elaborare milioni di richieste al giorno.

Prestazioni: miglioramenti nei benchmark a tutto campo

Claude Haiku 5.5 non è solo più economico: è drammaticamente più capace. I benchmark pubblicati da Anthropic mostrano miglioramenti massicci rispetto a Haiku 4.5 e, in alcuni casi, rivaleggia o supera modelli molto più grandi.

Nel benchmark di lavoro conoscitivo GDPval-AA v2.1, Haiku 5.5 ha ottenuto un punteggio di 1620, più del doppio del 735 di Haiku 4.5, superando persino OpenAI GPT-6 Luna (1437). Allo stesso modo, nel test AA-Briefcase v1.1, ha raggiunto 1578 contro 614 della generazione precedente.

Nell'uso del computer (OSWorld 2.1), Haiku 5.5 ha raggiunto una precisione del 72,4% nel sottoinsieme offline, un balzo enorme rispetto al 15,7% di Haiku 4.5. Questo lo rende particolarmente adatto per l'automazione del browser e i flussi di lavoro agentici.

Per il coding, il modello mostra risultati solidi su Terminal-Bench 4.0 (39,2% contro 0,0% di Haiku 4.5) e FrontierCode 1.1 (46,4%), sebbene sia ancora inferiore al più grande Sonnet 5.5 (rispettivamente 70,6% e 52,1%). Anthropic consiglia di utilizzare Haiku 5.5 come subagente per attività di coding, abbinato a Opus o Sonnet come modello principale.

Primo Haiku con sforzo regolabile

Una delle aggiunte tecniche più notevoli è l'impostazione di sforzo regolabile, una funzionalità precedentemente riservata ai modelli più grandi di Anthropic. Ciò consente agli sviluppatori di ottimizzare la profondità di ragionamento del modello in base ai propri requisiti di costo e latenza.

L'impostazione dello sforzo influisce direttamente sulle prestazioni. A sforzo basso, Haiku 5.5 è estremamente veloce ed economico ma meno accurato; a sforzo alto, si avvicina alle capacità di ragionamento di modelli molto più grandi. Questa flessibilità è un punto di svolta per gli ambienti di produzione in cui attività diverse richiedono diversi livelli di intelligenza.

continua a leggere sotto...

Risultati reali dei clienti

Diversi clienti aziendali hanno già testato Haiku 5.5 in ambienti di produzione, con risultati impressionanti:

  • Asana ha riportato una riduzione del 30% della latenza per il completamento delle attività e un'inferenza fino a 2,5 volte più veloce per turno agente nel loro prodotto AI Teammates.
  • HubSpot ha ottenuto il miglior punteggio di valutazione CRM mai registrato (92,8%) nei test su portali simulati, con i tempi di completamento più rapidi e i tassi di falsi positivi più bassi.
  • AlphaSense ha notato un miglioramento statisticamente significativo rispetto a Haiku 4.5 (0,84 contro 0,76) nel carico di lavoro di Q&A sui documenti, che gestisce circa 8 milioni di chiamate a settimana.
  • Box ha misurato un miglioramento di 11 punti rispetto a Haiku 4.5 con circa la metà della latenza per attività analitiche come report sui costi e riepiloghi finanziari.
  • Cognition ha integrato Haiku 5.5 in Devin Fusion come "spalla", raggiungendo un punteggio FrontierCode di alto livello pari a 66,2, riducendo al contempo costi e latenza.

Riduzione del prezzo di Sonnet 5.5 e nuovi crediti API

Oltre al lancio di Haiku, Anthropic sta rendendo il suo ecosistema più ampio più accessibile. L'azienda ha dimezzato il prezzo delle letture cache su Claude Sonnet 5.5, portandolo da $0,20 a $0,10 per milione di token. Poiché le letture cache costituiscono una grande parte del consumo di token nei flussi di lavoro agentici, ciò riduce il costo complessivo di Sonnet 5.5 di circa il 20% nella maggior parte delle attività.

Anthropic sta inoltre introducendo un credito API mensile per gli abbonati Max e Team. Gli utenti Max 5x ricevono $100 al mese, gli utenti Max 20x ricevono $200 e gli abbonati Team ricevono fino a $500 in pool tra gli utenti. Questi crediti sono progettati per incoraggiare la sperimentazione nella creazione di agenti e applicazioni sulla piattaforma Claude.

Miglioramenti della sicurezza e dell'allineamento

Haiku 5.5 viene fornito con importanti aggiornamenti di sicurezza. Anthropic riporta miglioramenti significativi in quasi tutte le valutazioni di allineamento rispetto a Haiku 4.5, inclusi meno casi di comportamento disallineato e una minore disponibilità a collaborare con un uso improprio.

Le salvaguardie per la sicurezza informatica sono più restrittive di quelle di Haiku 4.5, ma in qualche modo meno restrittive di quelle applicate a Sonnet 5.5, consentendo una gamma più ampia di attività difensive pur bloccando i test di penetrazione e altre tecniche di attacco. Le salvaguardie biologiche corrispondono agli standard stabiliti per Sonnet 5, Sonnet 5.5 e Opus 5.

Specifiche tecniche e disponibilità

Claude Haiku 5.5 supporta una finestra di contesto di 1 milione di token e fino a 128.000 token di output, rendendolo adatto per l'elaborazione di documenti lunghi e interazioni complesse a più turni. È multimodale, accetta input sia di testo che di immagini e supporta input PDF nativo, chiamate a strumenti e output strutturato.

Il modello è disponibile su Amazon Bedrock, Google Cloud, Microsoft Azure e la piattaforma Claude su AWS, con opzioni di residenza dei dati regionali su AWS. Gli sviluppatori possono anche accedervi tramite gli SDK Python e TypeScript aggiornati di Anthropic, che ora includono supporto beta per l'uso del computer e del browser.

Perché è importante

Il lancio di Claude Haiku 5.5 rappresenta un cambiamento significativo nell'economia dell'implementazione dell'AI. Offrendo prestazioni quasi di punta a una frazione del costo, Anthropic sta abilitando una nuova classe di applicazioni che in precedenza erano poco pratiche, come il supporto clienti in tempo reale, la classificazione ad alta frequenza e l'elaborazione di documenti su larga scala.

Per le aziende, la combinazione di prezzi più bassi, sforzo regolabile e sicurezza migliorata rende Haiku 5.5 un'opzione convincente per i carichi di lavoro di produzione. Mentre la corsa ai modelli AI si intensifica, l'attenzione si sta sempre più spostando dalla capacità grezza all'efficienza dei costi e all'implementazione pratica, e Haiku 5.5 sembra essere in testa in questa corsa.