Riassunto:
Anthropic rilascia ufficialmente Claude Haiku 5.5, che è il terzo modello della serie Claude 5.5 e la nuova generazione del modello Haiku lanciato quasi un anno dopo Claude Haiku 4.5. Anthropic lo posiziona come un modello leggero per attività ad alta concorrenza, bassa latenza e sensibili ai costi e, riducendo significativamente il prezzo dell'API, Haiku 5.5 entra direttamente nei ranghi competitivi degli attuali modelli di intelligenza artificiale a basso costo.

Secondo i prezzi annunciati da Anthropic, per richieste entro 100.000 token, il prezzo di input di Claude Haiku 5.5 è di 0,10 USD per milione di token e il prezzo di output è di 0,50 USD per milione di token. Rispetto ai prezzi della generazione precedente Haiku 4.5, che erano rispettivamente di 1 e 5 dollari, il prezzo del libro è stato ridotto direttamente del 90%.
Se la richiesta supera i 100.000 token, il prezzo di Haiku 5.5 aumenterà in modo significativo, con i prezzi di input e output che aumenteranno rispettivamente a 0,50 USD e 2,50 USD per milione di token. In altre parole, una volta superata la soglia dei 100.000 Token, i prezzi di input e output diventeranno 5 volte il prezzo base.
Anthropic ha dichiarato che, in base ai calcoli del carico di lavoro effettivo, il costo operativo medio di Haiku 5.5 è inferiore di circa il 75% rispetto a quello di Haiku 4.5. Uno dei motivi importanti per cui il calo medio non ha raggiunto il 90% del prezzo pubblicizzato è che Haiku 5.5 utilizza un nuovo segmentatore di parole.
Il nuovo tokenizzatore è simile al metodo di tokenizzazione utilizzato da Claude Sonnet 5.5 e Opus 5.5. La stessa porzione di testo può essere calcolata come più Gettoni nell'Haiku 5.5. Le istruzioni di Anthropic mostrano che il nuovo metodo di segmentazione delle parole aumenterà leggermente il numero di token generati quando si completa la stessa attività; alcuni test reali hanno rilevato che lo stesso testo lungo può consumare circa dal 25% al 30% in più di token in Haiku 5.5 rispetto a Haiku 4.5.
Ciò significa che Haiku 5.5 ha un "costo nascosto" che viene facilmente trascurato. Sebbene il prezzo per milione di token sia diminuito in modo significativo, la tariffa effettiva pagata dagli utenti dipende anche dalla quantità di token consumati dal modello per completare l’attività. Pertanto, il semplice confronto del prezzo per milione di token non può riflettere pienamente i costi operativi effettivi delle due generazioni di modelli.
Haiku 5.5 ha ancora una finestra di contesto molto ampia, che supporta fino a 1 milione di token e la lunghezza massima dell'output raggiunge 128.000 token. Supporta inoltre capacità di pensiero adattivo che possono decidere dinamicamente quante risorse di ragionamento devono essere investite in base alla complessità del compito.
Anthropic ha sottolineato specificamente che l'obiettivo di Haiku 5.5 non è quello di competere con Opus 5.5 o Sonnet 5.5 per tutti i compiti complessi, ma di intraprendere un gran numero di lavori ad alta frequenza, ripetitivi e sensibili alla velocità di risposta. Ad esempio, il riepilogo del testo, la classificazione dei dati, l'estrazione delle informazioni, l'interrogazione del database, l'instradamento delle richieste, la compressione del contesto, ecc. sono tutti scenari applicativi adatti per Haiku 5.5.
Nel campo dell'AI Agent, Haiku 5.5 è progettato anche come modello ausiliario per modelli di grandi dimensioni. Anthropic consiglia agli sviluppatori di lasciare che Sonnet 5.5 o Opus 5.5 siano responsabili di compiti principali complessi, e poi lasciare che Haiku 5.5 serva come sub-agente per gestire un gran numero di semplici operazioni ripetitive, riducendo così i costi operativi dell'intero sistema di agenti.

Lo sviluppo del codice è anche una delle direzioni applicative più importanti di Haiku 5.5. Anthropic ha affermato che il modello può essere utilizzato come sottoagente di codifica del grande modello Claude per gestire ricerche di codice, semplici modifiche e altre attività ripetitive che possono essere suddivise. Tuttavia, nelle complesse attività di programmazione dell'agente in più fasi, Sonnet 5.5 e Opus 5.5 presentano ancora vantaggi più evidenti.
La velocità è un altro grande punto di forza di Haiku 5.5. Anthropic afferma che questo è il modello più reattivo dell'azienda fino ad ora, rendendolo particolarmente adatto per il servizio clienti in tempo reale, le operazioni del browser e le applicazioni che richiedono un feedback rapido.
Oltre ad abbassare il prezzo dello stesso Haiku 5.5, Anthropic ha contemporaneamente modificato anche il prezzo di lettura della cache di Claude Sonnet 5.5. La tariffa per la lettura della cache è ridotta da 0,20 USD a 0,10 USD per milione di token, con una diminuzione del 50%. Anthropic ritiene che questo cambiamento possa ridurre il costo effettivo di Sonnet 5.5 nella maggior parte dei carichi di lavoro degli agenti di circa il 20%, poiché le attività degli agenti spesso leggono ripetutamente il contenuto della cache.
La cosa più interessante dell'Haiku 5.5, però, è la sua concorrenza con i modelli a basso prezzo. Basandosi sul prezzo standard inferiore a 100.000 token, Haiku 5.5 si colloca già nella stessa fascia di prezzo dell’ultimo modello low cost di OpenAI. Ciò significa che gli sviluppatori possono ora ottenere un modello con una finestra di contesto di milioni di token, supporto per il ragionamento adattivo e forti capacità di codifica a un prezzo di token molto basso.
D'altra parte, anche la linea di divisione del prezzo di 100.000 token potrebbe diventare un problema a cui gli sviluppatori devono prestare particolare attenzione. Per le richieste ordinarie di SMS brevi, questa soglia solitamente non ha alcun impatto; ma per scenari che implicano una lunga elaborazione di documenti, agenti complessi, più cicli di attività di codice e una grande quantità di input di contesto allo stesso tempo, il modello può facilmente avvicinarsi o addirittura superare i 100.000 token. Una volta superato questo limite, sia i prezzi di input che quelli di output aumenteranno direttamente di 5 volte.
Ciò rende anche l'efficienza stessa dei token sempre più importante. Poiché il prezzo dei modelli di intelligenza artificiale continua a diminuire, gli sviluppatori che prima dovevano concentrarsi solo su “quanto costa per milione di token” devono ora considerare anche quanti token consuma il modello per completare la stessa attività. Un modello che ha un prezzo unitario inferiore ma richiede la generazione di più token per completare l'attività potrebbe non avere sempre un costo finale effettivo inferiore.
Anthropic attualmente fornisce Haiku 5.5 sulla piattaforma Claude e su canali come Amazon Web Services, Google Cloud e Microsoft Foundry e lo ha anche aggiunto a Claude Code. Gli utenti ordinari possono utilizzare Haiku 5.5 sulla pagina web di Claude e sulle app iOS e Android.
Osservando l'intera linea di prodotti Claude 5.5, Anthropic ha formato una divisione del lavoro relativamente chiara: Opus 5.5 è responsabile del ragionamento e dei compiti degli agenti più complessi, Sonnet 5.5 è responsabile dell'equilibrio tra prestazioni e costi e Haiku 5.5 è ulteriormente focalizzato su scenari ad alta concorrenza, bassa latenza e basso costo.
Pertanto, la vera competitività di Haiku 5.5 non è solo la "economicità", ma il tentativo di Anthropic di utilizzare un prezzo unitario inferiore per spingere un modello con forti capacità di ragionamento e di agente in scenari di chiamata su larga scala. Tuttavia, il nuovo metodo di misurazione dei token e l’aumento dei prezzi dopo 100.000 token significano anche che le aziende devono calcolare il costo totale in base al carico di lavoro effettivo prima della distribuzione, anziché limitarsi a guardare il prezzo pubblicizzato per milione di token.
Se gli agenti IA saranno ulteriormente diffusi in futuro, un gran numero di chiamate modello passeranno da una domanda e risposta di oggi a dozzine o addirittura centinaia di chiamate continue. In questo caso, il prezzo della singola chiamata, la velocità di risposta e l’efficienza nel consumo dei Token influiranno direttamente sui costi operativi dell’intero sistema AI. Haiku 5.5 è stato lanciato in questo contesto. Il suo vero obiettivo probabilmente non è quello di diventare il modello Claude più potente, ma quello di diventare il "motore a basso costo" che sopporta il maggior volume di chiamate nell'intero ecosistema AI di Anthropic.
Commenti