News

Claude Haiku 5.5: Anthropic taglia i prezzi API fino al 90%

Anthropic ha lanciato Claude Haiku 5.5, il nuovo modello compatto della famiglia Claude, accompagnandolo con un drastico taglio dei prezzi per gli sviluppatori. Le API partono da 0,10 dollari per milione di token in ingresso e 0,50 dollari per milione di token in uscita per prompt fino a 100.000 token. In questo intervallo, il costo unitario è inferiore del 90% rispetto a Claude Haiku 4.5. Anthropic stima invece una riduzione media dei costi di circa il 75% considerando le diverse tipologie di utilizzo.

Il modello, presentato il 7 ottobre 2026, è progettato per attività frequenti e sensibili ai tempi di risposta: assistenza clienti, classificazione di informazioni, riepiloghi, interrogazioni di database e piccoli compiti affidati ad agenti di intelligenza artificiale.

Claude Haiku 5.5: quanto costano le nuove API

La struttura dei prezzi prevede due fasce, determinate dalla lunghezza del prompt. Fino a 100.000 token, il costo è di 0,10 dollari per milione di token di input e 0,50 dollari per milione di token di output. Superata quella soglia, le tariffe salgono rispettivamente a 0,50 e 2,50 dollari per milione di token.

Per confronto, Haiku 4.5 prevedeva un prezzo di 1 dollaro per milione di token in ingresso e 5 dollari per milione di token in uscita. Il taglio massimo del 90% riguarda quindi la fascia più economica del nuovo modello, non ogni possibile richiesta.

Anche la cache può ridurre le spese. Per i prompt entro 100.000 token, la lettura dei dati già memorizzati costa 0,01 dollari per milione di token, mentre la scrittura nella cache di cinque minuti costa 0,125 dollari. Le elaborazioni tramite API Batch possono beneficiare di uno sconto del 50% sui token di ingresso e uscita.

Un milione di token di contesto e ragionamento adattivo

Claude Haiku 5.5 dispone di una finestra di contesto da un milione di token e può generare fino a 128.000 token di output nelle condizioni standard previste dalla piattaforma. Questo consente di elaborare documenti estesi e grandi quantità di informazioni senza suddividerli necessariamente in molte richieste.

Tra le novità compare il ragionamento adattivo, che regola l’impegno computazionale in funzione del compito e del parametro di sforzo impostato dallo sviluppatore. L’obiettivo è evitare di utilizzare sempre la massima potenza di elaborazione per operazioni semplici e ripetitive.

Anthropic descrive Haiku 5.5 come il suo modello più rapido alle velocità standard. Per attività particolarmente complesse di programmazione autonoma, tuttavia, continua a indicare Sonnet 5.5 e Opus 5.5 come soluzioni più adatte.

Leggi anche:

Dove è disponibile Claude Haiku 5.5

Il nuovo modello è accessibile sulla Claude Platform con l’identificativo API claude-haiku-5-5. È disponibile anche tramite Amazon Web Services, Google Cloud e Microsoft Azure, oltre che in Claude Code.

Gli utenti di Claude possono selezionare Haiku 5.5 anche nell’applicazione web e nelle app mobili, compreso il piano gratuito. La disponibilità concreta delle funzioni può comunque dipendere dal piano e dai limiti di utilizzo.

Per chi sviluppa software, il modello può essere impiegato come subagente al fianco di sistemi più potenti: per esempio, un agente principale può delegare a Haiku attività circoscritte come classificare richieste, riassumere conversazioni o individuare informazioni in documenti.

Anthropic riduce anche i costi di Claude Sonnet 5.5

Il lancio di Haiku 5.5 porta un’altra novità per gli sviluppatori: il prezzo delle letture dalla cache di Claude Sonnet 5.5 viene dimezzato, passando da 0,20 a 0,10 dollari per milione di token. Secondo Anthropic, questo cambiamento può ridurre di circa il 20% il costo di molte attività svolte da agenti.

Sono inoltre previsti crediti API mensili per gli abbonati Claude Max e Team: 100 dollari per Max 5x, 200 dollari per Max 20x e fino a 500 dollari condivisi per gli utenti Team, secondo le condizioni indicate dall’azienda.

Il nuovo listino rende Haiku 5.5 particolarmente interessante per servizi che effettuano migliaia di richieste ogni giorno. Per valutare il risparmio reale, però, occorre considerare non soltanto il prezzo per token, ma anche la lunghezza dei prompt, l’eventuale utilizzo della cache e la quantità di testo generato.

Fonte

Ti potrebbe interessare:
Segui guruhitech su:

Esprimi il tuo parere!

Ti è piaciuta questa notizia? Lascia un commento nell’apposita sezione che trovi più in basso e se ti va, iscriviti alla newsletter.

Per qualsiasi domanda, informazione o assistenza nel mondo della tecnologia, puoi inviare una email all’indirizzo [email protected].

Esprimi il tuo parere!

Che ne pensi di questa notizia? Lascia un commento nell’apposita sezione che trovi più in basso e se ti va, iscriviti alla newsletter.

Per qualsiasi domanda, informazione o assistenza nel mondo della tecnologia, puoi inviare una email all’indirizzo [email protected].

Condividi l'articolo

Scopri di più da GuruHiTech

Abbonati per ricevere gli ultimi articoli inviati alla tua e-mail.

0 0 voti
Article Rating
Iscriviti
Notificami
guest
0 Commenti
Più recenti
Vecchi Le più votate