Vai al contenuto
Luca Masrè Passaro
Laboratorio AI

luca@masrepassaro.com WhatsApp

home / blog

Claude Haiku 5.5: tre numeri per lo stesso sconto

Claude Haiku 5.5 è il nuovo modello piccolo di Anthropic, anche su Claude Free. Costa il 90% in meno, o il 75%, o qualcosa di diverso: ecco come leggerlo.

LMP Luca Masrè Passaro
·
08.10.2026
Illustrazione in stile anime: un giovane fattorino in bicicletta carico di pacchetti scende per un paese sul mare, in primo piano una bilancia d'ottone con monetine e foglietti e una lente su una lunga pergamena

Un titolo dice «meno 90%». Apri l’annuncio, e l’azienda scrive un’altra cifra: in media, circa il 75% in meno, con una nota che spiega il conto. Apri la documentazione per chi programma, e trovi un terzo numero. Sono tutti veri. Misurano cose diverse.

Il 7 ottobre 2026, poco dopo le 20 ora italiana, Anthropic ha presentato Claude Haiku 5.5, il modello più piccolo della nuova famiglia di Claude. È veloce, costa molto meno del precedente e da subito si può scegliere anche su Claude.ai, compreso il piano Free, quello senza abbonamento.

La notizia è il modello. Ma la parte che mi interessa di più sono quei tre numeri: 90%, 75% e, nella documentazione, un 30% di cui si parla poco.

E il numero che resta in testa, di solito, è il primo che leggi.

In breve

Il 7 ottobre 2026 Anthropic ha rilasciato Claude Haiku 5.5, il suo modello piccolo, pensato per lavori veloci e ripetitivi: riassunti, classificazioni, assistenza ai clienti in tempo reale. Si può scegliere su Claude.ai, sul web e nelle app, in tutti i piani compreso Free. Per chi lo usa attraverso l’API, il collegamento per i programmi, il prezzo di listino scende del 90% rispetto a Haiku 4.5 sulle richieste con un testo in entrata fino a 100.000 token, le unità con cui si conta il testo, e del 50% su quelle più lunghe; Anthropic stima un costo medio più basso di circa il 75%, anche perché il nuovo modello conta circa il 30% di token in più per lo stesso testo. Nello stesso annuncio: letture dalla cache di Sonnet 5.5, la memoria delle parti già elaborate, a metà prezzo e un credito mensile per l’API agli abbonati Max e Team.

Cosa ha annunciato Anthropic

Claude ha tre taglie. Opus è il più grande, Sonnet sta nel mezzo, Haiku è il più piccolo. Opus 5.5 era uscito il 22 settembre, Sonnet 5.5 il 28. Il 7 ottobre si è chiusa la serie con Haiku 5.5, che Anthropic presenta come «il modello piccolo più economico, veloce e capace» che abbia mai rilasciato.

Anthropic lo pensa per i lavori in grande quantità, dove il costo conta: riassunti, ricerche in una banca dati, classificazioni, cioè mettere ogni richiesta nel cassetto giusto. Lo indica anche per le cose in cui la velocità pesa di più, come l’assistenza ai clienti in tempo reale e l’uso del browser. E lo propone come aiutante dei modelli grandi: Opus o Sonnet pianificano il lavoro e gli passano i pezzi più semplici.

Dove lo trovi:

  • Su Claude.ai, sul web e nelle app per iPhone e Android: lo possono scegliere gli utenti Free, Pro, Max, Team ed Enterprise.
  • In Claude Code, lo strumento di Anthropic per programmare.
  • Per gli sviluppatori, sulla piattaforma di Claude e sui servizi informatici online di Amazon, Google e Microsoft.

Qualche dettaglio tecnico, tradotto. Haiku 5.5 può considerare in una volta sola fino a un milione di token, cioè di pezzetti di testo, e scriverne fino a 128.000 in una risposta: Haiku 4.5 si fermava a 200.000 e 64.000. Legge testo e immagini, risponde solo con testo, e le sue conoscenze arrivano a giugno 2026. Ed è il primo Haiku con l’impostazione dell’impegno regolabile: chi lo usa può decidere se privilegiare il risparmio o l’intelligenza, cioè quanto il modello deve ragionare prima di rispondere.

Insieme a Haiku, Anthropic ha annunciato altre due cose. La prima: da subito le letture dalla cache di Sonnet 5.5, cioè i pezzi di testo già elaborati che il modello riusa, costano la metà, 0,10 dollari per milione di token invece di 0,20. Secondo Anthropic questo rende Sonnet 5.5 più economico di circa il 20% nella maggior parte dei lavori svolti dagli agenti, i programmi che fanno compiti in più passaggi da soli. La seconda: in questa settimana arriva un credito mensile per l’API agli abbonati Max e Team.

Il piccolo di casa, per una volta, è finito in vetrina.

A cosa serve un modello piccolo

Pensa a uno studio professionale. C’è il titolare, che segue i casi difficili. C’è il collaboratore esperto. E c’è chi smista la posta, compila i moduli, prepara i riassunti delle pratiche. Se mandi tutto al titolare, il lavoro viene bene, ma costa una fortuna e arriva tardi.

Haiku è quella terza persona. Anthropic lo presenta come veloce, economico e affidabile sui compiti chiari e ripetuti. La pagina di Anthropic elenca proprio questi: compilare moduli, inserire dati, spostare informazioni da un’applicazione all’altra, classificare, riassumere, rispondere in una chat di assistenza dove chi scrive vuole una risposta subito.

Quanto è bravo? Anthropic pubblica una tabella di test, e conviene leggerla per quello che è: risultati dichiarati dal produttore. Nel test GDPval-AA, che misura il lavoro professionale in 44 mestieri, Haiku 5.5 prende 1620 punti, contro i 735 di Haiku 4.5 e i 1437 di GPT-6 Luna, il modello piccolo di OpenAI. Sonnet 5.5, messo lì come riferimento, arriva a 1840. In un test sull’uso del computer, OSWorld, nella versione ridotta che Anthropic usa, passa dal 15,7% di Haiku 4.5 al 72,4%. Alcune aziende che l’hanno provato in anteprima, come Asana e Box, raccontano di risposte più rapide e risultati migliori.

Sulla velocità c’è una nota, e la cito perché è un buon esempio di onestà nei dettagli: Haiku 5.5 è il modello più veloce di Anthropic alla velocità normale di ciascun modello, ma è più lento di Opus quando Opus gira in modalità veloce, «Fast Mode».

Il modello piccolo, scelto bene, fa le cose piccole. E le fa in fretta.

Tre numeri per lo stesso sconto

Arriviamo al prezzo. Qui serve una parola: token. È il pezzetto di testo con cui i modelli leggono e scrivono, e con cui si paga quando li si usa attraverso l’API. Il prezzo si dà in dollari per milione di token, separando quelli che mandi al modello (in entrata) da quelli che il modello scrive (in uscita).

Il primo numero è il 90%. Per le richieste con un testo in entrata fino a 100.000 token, Haiku 5.5 costa 0,10 dollari per milione di token in entrata e 0,50 in uscita. Haiku 4.5 costava 1 e 5. Il listino, su quella fascia, scende davvero del 90%. Sopra la soglia il prezzo sale a 0,50 e 2,50 dollari: rispetto a Haiku 4.5, la metà. Anthropic precisa che con Haiku 4.5 circa il 90% delle richieste stava sotto quella soglia.

Il secondo numero è il 75%. È la stima di Anthropic su quanto costa in media far lavorare Haiku 5.5 rispetto al predecessore: «circa il 75% in meno». Ed è il numero che Anthropic mette in evidenza nel testo dell’annuncio.

Perché il risparmio medio stimato è più basso del 90%? La nota a piè di pagina lo spiega. Oltre alle due fasce di prezzo, c’è il tokenizzatore, cioè il sistema che taglia il testo in token. Haiku 5.5 usa quello nuovo, lo stesso tipo di Sonnet 5.5 e Opus 5.5, che per fare lo stesso lavoro consuma, scrive Anthropic, «leggermente più token».

Quanto leggermente? Qui entra il terzo numero, quello di cui si parla poco. La documentazione di Anthropic sui prezzi dice che il tokenizzatore nuovo produce «circa il 30% di token in più per lo stesso testo», e che l’aumento esatto dipende dal contenuto. Lo ha fatto notare MIXED, un sito di notizie di tecnologia, che ha messo le due frasi una accanto all’altra.

Faccio un conto semplificato, mio, solo per vedere il meccanismo, e lo limito al testo che mandi al modello, senza cache. Metti che in un mese le tue richieste brevi ti costassero, con Haiku 4.5, 100 euro di testo in entrata. A listino, con Haiku 5.5, scendono a 10 euro. Ma se gli stessi testi diventano circa il 30% di token in più, e ogni richiesta resta comunque sotto la soglia, il conto torna intorno ai 13 euro. Risparmi comunque tantissimo: circa l’87% invece del 90%. Con le stesse ipotesi, sopra i 100.000 token il risparmio passa dal 50% di listino a circa il 35%. Le risposte del modello possono cambiare di lunghezza, e quindi il conto vero lo fai solo sui tuoi testi. Il 75% è la stima di Anthropic, che tiene insieme le due fasce di prezzo e il cambio di tokenizzatore.

Era tutto scritto, e da Anthropic stessa. MIXED lo riconosce chiaramente: le due affermazioni vengono entrambe da Anthropic, lo stesso giorno, solo che descrivono la stessa cosa in due modi diversi. E per chi deve fare un preventivo, il numero su cui ragionare è il 30%.

Tre numeri veri, uno solo nel titolo.

Perché il primo numero vince

Qui la notizia diventa una lezione di comunicazione, ed è la ragione per cui ne scrivo.

Anthropic, va detto, ha fatto le cose per bene: il 75% è nel testo, la spiegazione è nella nota, il 30% è nella documentazione. Ma guarda i titoli. Diversi di quelli che ho raccolto mettono il 90% in apertura: «costa il 90% in meno rispetto a Haiku 4.5 per le richieste fino a 100.000 token», scrive PPC Land, con la sua precisazione; «prezzi tagliati fino al 90%», scrive Startup Fortune. MIXED invece richiama subito la nota già nel titolo. Il numero più grande, in quel campione, è finito in prima fila. E una volta lì, diventa il riferimento contro cui misuri tutto il resto.

Si chiama effetto ancoraggio: il primo numero che ti arriva diventa l’àncora, e le informazioni successive le giudichi in relazione a quello. Se leggi prima «90%», il 75% ti sembra un dettaglio. Se leggessi prima «30% di token in più», lo stesso modello ti sembrerebbe meno conveniente di quanto è. I numeri sono gli stessi. Cambia l’ordine, e con l’ordine cambia l’impressione.

Funziona anche nelle trattative, ed è per questo che chi negozia bene prova a dire per primo il suo numero: ne ho parlato in perché il primo numero decide la trattativa.

La lezione vale in due direzioni. Quando compri, cerca la nota a piè di pagina prima di festeggiare il titolo. Quando vendi, ricorda che il tuo cliente si ricorderà il numero che hai messo per primo, e che il giorno in cui scopre la nota giudicherà anche te.

Il titolo ti fa entrare. La nota ti dice quanto spendi.

Cosa cambia per chi lavora

Dipende da come usi Claude.

Se usi Claude.ai, anche senza abbonamento, hai un modello in più da scegliere. Per le cose veloci e chiare ha senso: riassumere una mail lunga, mettere in ordine un elenco di contatti, smistare le richieste arrivate dal sito per argomento, preparare una prima bozza di risposta a un cliente. Per i ragionamenti difficili, un contratto da analizzare, una strategia da costruire, i modelli più grandi restano la scelta giusta, dove il tuo piano li prevede. La regola dello studio professionale vale anche qui: il lavoro giusto alla persona giusta.

Se la tua azienda usa Claude attraverso l’API, per esempio un assistente sul sito che risponde ai clienti o un’automazione che legge le email e le smista, la notizia è un taglio dei costi vero. PPC Land lo dice così: conta per ogni azienda il cui software manda a Claude migliaia di lavori brevi e ripetitivi al giorno. Prima di cambiare modello, però, fai quello che chiede la stessa documentazione di Anthropic: riconta i token dei tuoi testi, rivedi i limiti di lunghezza delle risposte e rifai i conti. E guarda la soglia dei 100.000 token: le richieste con un testo in entrata sotto quella soglia, contato con il nuovo modello, pagano la tariffa bassa.

Se hai un abbonamento Max o Team, controlla il tuo account in questi giorni. Anthropic distribuirà in questa settimana un credito mensile per l’API: 100 dollari al mese per Max 5x, 200 per Max 20x, fino a 500 per Team, come credito condiviso fra gli utenti. Si può usare con tutti i modelli, e serve a sperimentare: costruire uno strumento interno, un piccolo agente, un’automazione da provare prima di metterci soldi veri. È un’altra cosa rispetto al credito fino a 250 dollari per Claude Code sul web di fine settembre.

E poi c’è il quadro. Nella stessa settimana OpenAI ha portato GPT-6 anche a chi usa ChatGPT senza abbonamento, con il modello piccolo Luna, e Google dal 9 ottobre lascia a chi non paga solo il modello Flash-Lite di Gemini. La mia lettura è che i modelli piccoli siano diventati il terreno su cui le aziende si giocano chi usa l’AI tutti i giorni senza pagare, e chi la mette dentro i propri programmi. Anthropic, nella sua tabella, mette Haiku 5.5 direttamente accanto a GPT-6 Luna.

Per chi lavora, la conseguenza è semplice. Il modello piccolo è diventato uno strumento da scegliere apposta, per i lavori giusti.

Come portarlo nel tuo lavoro

  1. Provalo sui compiti ripetuti. In Claude.ai scegli Haiku 5.5 dal menu dei modelli e dagli il lavoro che fai tutti i giorni: riassunti, smistamento, prime bozze. Confronta il risultato con il modello che usi di solito.
  2. Tieni i lavori difficili ai modelli grandi. Analisi, strategia, testi delicati: lì la velocità conta meno della profondità.
  3. Se paghi l’API, rifai i conti con i token veri. Prendi dieci richieste tipiche, contale con il modello nuovo e calcola il costo con i prezzi nuovi. Il numero che esce è il tuo, più utile di qualsiasi titolo.
  4. Resta sotto i 100.000 token in entrata quando puoi. Sopra quella soglia il prezzo per token è cinque volte più alto.
  5. Prova la manopola dell’impegno. Se lo strumento che usi la mette a disposizione, prova impostazioni più basse sui compiti semplici e confronta qualità, consumo e tempi.
  6. Sfrutta cache ed elaborazione in blocco. Secondo Anthropic, riusare le parti fisse delle richieste e mandare i lavori non urgenti tutti insieme fa risparmiare fino al 90% e al 50%.
  7. Se hai Max o Team, usa il credito. Puoi sperimentare un’automazione e valutarne utilità e costi prima di metterci soldi tuoi.
  8. Quando scrivi i tuoi prezzi, pensa a quale numero metti per primo. E fai in modo che la nota a piè di pagina confermi il titolo.

Lo sconto vero è quello che leggi sulla tua fattura, a fine mese.

Domande frequenti

Che cos’è Claude Haiku 5.5?

È il modello più piccolo della famiglia Claude 5.5 di Anthropic, rilasciato il 7 ottobre 2026. È pensato per lavori veloci e ripetitivi, come riassunti, classificazioni e assistenza ai clienti in tempo reale, e Anthropic lo presenta come il suo modello piccolo più economico, veloce e capace.

Si può usare Haiku 5.5 senza abbonamento?

Sì. Secondo Anthropic, gli utenti dei piani Free, Pro, Max, Team ed Enterprise possono sceglierlo su Claude.ai, sul web e nelle app per iPhone e Android.

Quanto costa Haiku 5.5 con l’API?

Per le richieste con un testo in entrata fino a 100.000 token, 0,10 dollari per milione di token in entrata e 0,50 in uscita. Sopra quella soglia, 0,50 e 2,50 dollari. Haiku 4.5 costava 1 e 5 dollari.

Allora costa il 90% o il 75% in meno?

Tutti e due, a seconda di cosa misuri. Il 90% è il taglio del prezzo di listino sulle richieste con un testo in entrata fino a 100.000 token. Il 75% è la stima di Anthropic sul costo medio reale, che tiene conto anche delle richieste più lunghe e del fatto che il nuovo modello usa più token per lo stesso lavoro: circa il 30% in più per lo stesso testo, secondo la documentazione.

Che cos’è un token?

È il pezzetto di testo con cui i modelli leggono e scrivono, spesso più piccolo di una parola. Quando si usa un modello attraverso l’API si paga in base ai token mandati e ricevuti.

Cos’è il credito mensile per Max e Team?

È un credito per usare l’API di Claude che Anthropic distribuisce in questa settimana agli abbonati: 100 dollari al mese per Max 5x, 200 per Max 20x e fino a 500 per Team, come credito condiviso fra gli utenti. Vale per tutti i modelli.

Fonti

Manuale di sopravvivenza alla stupidità umana — Luca Masrè Passaro
// dal libro
Ti è piaciuto? Nel libro vado più a fondo.

31 capitoli su come funzioniamo. In uscita 16 settembre 2026.

Scopri il libro →
Luca Masrè Passaro
// scritto da
Luca Masrè Passaro

Comunicazione, psicologia e persuasione. Autore del Manuale di sopravvivenza alla stupidità umana.

leggi la mia storia →
// LA MAIL

Hai letto fino a qui.

Continua sulla mail.

Una al mese, al massimo. Solo quando ho qualcosa di buono da dirti.

// continua a leggere

Altri pezzi dalla stessa categoria