Sonetto 5.5 è uscito di soppiatto e il test vero e proprio ha schiacciato GPT-6 Sol ed era vicino ad Astra

📅 2026-09-28

Riassunto:

Chi avrebbe mai pensato che pochi giorni dopo il rilascio di Opus 5.5 sarebbe arrivato anche Sonnet 5.5? Da ieri sera circola per tutta la zona la notizia: X Sonnet 5.5 verrà rilasciato a breve, forse martedì pomeriggio, ora americana. In termini di prestazioni, Sonetto 5.5 è più vicino a Opus 5.5, ma è molto più economico di Opus 5.5. Ora, Sonnet 5.5 è entrato nella fase finale prima del rilascio e sono stati avviati i test in scala di grigi in Claude Code.

Le demo esposte da molti beta tester interni mostrano che Sonnet 5.5 supera il nuovo GPT-6 Sol e si avvicina persino al fiore all'occhiello GPT-6 Astra di OpenAI in termini di capacità di codifica e agente!

Ciò che è ancora più scioccante è che il suo prezzo arriva direttamente al centro della terra, a partire da 2 dollari per un milione di input simbolici.

Se la data di rilascio trapelata è vera, sembra che Anthropic sia determinato a colpire Dev Dayl di OpenAI.

Sonetto 5.5 trapelato, è apparso l'identificatore esclusivo del modello

Ricordo ancora che quando Anthriopic pubblicò improvvisamente l'Opus 5.5 il 22 settembre, scrissero nel documento ufficiale: "Sonnet 5.5 e Haiku 5.5 saranno lanciati nelle prossime settimane".

Nessuno pensava che il Sonetto 5.5 sarebbe arrivato così presto!

Proprio ieri, lo sviluppatore V @Mr_Salio ha dato la notizia su X: Claude Sonnet 5.5 è stato catturato! La notizia si è diffusa immediatamente in Internet.

Nell'artefatto è apparso l'identificatore di configurazione del modello esclusivo di Sonnet 5.5: "claude-sonnet-5-5".

Non solo, ci sono anche "claude-opus-5-5", "claude-sonnet-5" e il misterioso "claude-fable-5.1" che si trovano fianco a fianco nello stesso file di configurazione.

La scrittura del codice front-end significa che il modello è stato installato sul server ed è solo in attesa di un cambio.

Successivamente, la grande V @notjazii ha anche dato la notizia che Sonetto 5 era stato effettivamente indirizzato silenziosamente alla versione 5.5 per "test segreti" circa una settimana fa.

Sei stato rilevato dalla scala di grigi? Questa volta userò il vecchio metodo.

Apri il tuo codice Claude, disattiva le funzioni di rete e di memoria e chiedilo direttamente: conosci il reset brother tibo? Non utilizzare Internet e la memoria.

Se stai utilizzando una versione precedente del modello, potrebbe farfugliare; ma se sei stato indirizzato alla versione 5.5, spiegherà accuratamente i dettagli delle battute di ripristino di Tibo e Codex.

Diversi netizen hanno verificato attraverso test effettivi che alcuni account sono stati effettivamente commutati silenziosamente e stanno sperimentando in anticipo Opus 5.5.

Ricordati di utilizzare il codice Claude

Il test effettivo sull'intera rete è così basso che batte effettivamente GPT-6

Per riassumere le misurazioni effettive condivise finora, Sonnet 5.5 ha effettivamente schiacciato GPT-6 Sol?

Prima di tutto, si tratta di uno scontro estremo con interfaccia utente e animazione front-end JS, con quattro modelli mainstream di grandi dimensioni che competono sullo stesso palco.

Lo sviluppatore @notjazii ha rilasciato una serie di test reali di grande impatto visivo: "Confronto di quattro modelli tradizionali con generazione rapida di animazioni di parole".

Richiede al modello di generare complessi effetti di animazione dell'interfaccia utente.

Dopo aver pubblicato il confronto animato, @notjazii ha commentato: "Sonnet 5.5 ha davvero fatto impazzire entrambi i modelli OpenAI (Sol e Astra)!"

In effetti, come si può vedere dall'immagine qui sotto, Sonnet 5.5 mostra una forte intuizione di codifica e gusto estetico.

GPT-6 Astra

GPT-6 Sol

Claude Opus 5.5

Claude Sonetto 5.5

Alcuni netizen erano increduli dopo aver visto i risultati: "Claude è sempre stato più forte nell'interfaccia utente e nell'animazione, ma se questo fosse generato da puro codice, sarebbe incredibile che fosse vero!"

Big V @chetaslua si è concentrato sul testare la capacità di codifica quotidiana e la sensazione di codifica di Sonnet 5.5.

Ha utilizzato le stesse 3 parole guida e ha condotto 6 esecuzioni parallele, generando ciascun modello una volta e i risultati di output non sono stati modificati.

Sonnet 5.5 ha finalmente generato 3 file da 90-131 KB, raggiungendo il limite superiore di 90 minuti in tutte le esecuzioni; GPT-6 Sol ha generato file di dimensioni comprese tra 20 e 29 KB e ha impiegato 9-12 minuti.

Ha detto con entusiasmo: "Ora usa Claude Code! Sonnet 5.5 in modalità Ultracode è ridicolmente veloce. Non solo è estremamente efficiente, ma ha anche riacquistato il "tocco umano" estremamente naturale dell'era del Sonnet 4!"

Secondo lui, allo stesso prezzo e con le stesse parole, Sonnet 5.5 ha schiacciato GPT-6 Sol.

Ciò che spaventa OpenAI è che Sonnet 5.5 non è più così semplice come schiacciare GPT-6 Sol.

L'informatore @srikanthvaluri e @buildwithrajath hanno sottolineato dopo i primi test effettivi esaurienti: "Le prestazioni di Sonnet 5.5 hanno superato di gran lunga le aspettative. Sebbene GPT-6 Astra abbia ancora un leggero vantaggio nella rifinitura, le prestazioni di Sonnet 5.5 sono direttamente alla pari con Astra."

Incredibilmente, è vicino ad Astra anche in alcune funzionalità avanzate di codifica e agente.

Alcune persone lamentano che perfino Sonnet abbia schiacciato Astra. In quale epoca stiamo entrando?

Macellaio di prezzi, re del rapporto costi/prestazioni

Se il superamento delle prestazioni misurate fa solo sentire OpenAI "a disagio", allora i prezzi esposti da Sonnet 5.5 stanno scavando nelle radici di OpenAI.

Si scopre che questo "modello magico", le cui prestazioni sono vicine a quelle di Astra e batte Sol, ha un prezzo completamente in linea con il mercato di fascia bassa.

Input: token da $ 2/milione

Risultato: token da $ 10/milione

Letture nella cache: solo $ 0,20/milione di token!

Ciò significa che Anthropic fornisce funzionalità di intelligenza artificiale all'avanguardia a un "prezzo da cavolo".

GPT-6 Sol e Luna di OpenAI costano la metà di GPT-5.6 e mirano a catturare scenari ad alta frequenza.

Ma ora Anthropic è entrato nella stessa fascia di prezzo di Sonnet 5.5, ma le sue prestazioni sono molto più potenti.

"Se Anthropic riesce a fornire un enorme salto di prestazioni come Opus 5.5 a un prezzo così competitivo, OpenAI non sarà in grado di reagire." Qualcuno ha commentato.

Lo sviluppatore Rajath Gowda ha detto senza mezzi termini: "Sonnet 5.5 sta diventando un grosso problema per OpenAI. Se è davvero vicino a Opus 5.5, Anthropic renderà le funzionalità all'avanguardia estremamente economiche. Questo è ciò di cui OpenAI dovrebbe preoccuparsi maggiormente."

L'intenzione strategica di Anthropic è chiara: utilizzare Opus 5.5 per conquistare il trono di fascia alta e utilizzare Sonnet 5.5 per conquistare completamente il mercato di fascia media e di sviluppo quotidiano con la massima efficienza in termini di costi.

Anthropic apre la sua faccia e uccide DevDay

Inoltre, i tempi di rilascio sono spesso più drammatici del prodotto stesso.

Lo stesso giorno in cui OpenAI ha rilasciato GPT-6 Sol e Luna, Anthropic ha lanciato direttamente Claude Opus 5.5: prestazioni migliori rispetto alla generazione precedente, costi inferiori del 40% e velocità del 30%.

Nelle ultime due settimane, Anthropic ha ottenuto risultati ancora più brillanti: Claude ha calcolato l'ampiezza dei nove cerchi della fisica e ha battuto il record mondiale; scoperto un sistema enzimatico biologico sconosciuto; e ha anche lanciato il Claude Marketplace, che contiene più di 2.000 plug-in.

Al contrario, OpenAI recentemente non solo ha avuto controversie sui modelli interni, ma ha anche denunciato episodi di disallineamento come la fuga di immagini degli utenti dall'IA e la denuncia di frodi GitHub Token da parte del ricercatore.

Martedì prossimo (29 settembre) si terrà il DevDay, la conferenza annuale degli sviluppatori a cui OpenAI attribuisce grande importanza.

In questo frangente, il test grigio di Sonnet 5.5 ha spazzato via l'intera rete.

Molti pezzi grossi lo hanno fatto impazzire: "Il modello dovrebbe essere rilasciato la prossima settimana, immagino che sarà martedì prossimo (DevDay), lo sanno tutti."

Forse domani ci sarà un grande riscaldamento alle 14:00, ora di New York.

Qualcuno ha detto: "Mi dispiace per OpenAI. Sarà meglio che rispondano con forza al DevDay altrimenti saranno davvero fregati."

Le tecnologie chiave dietro Sonnet 5.5

Il motivo per cui la nuova versione viene rilasciata così rapidamente potrebbe essere che Anthropic ha già individuato il processo RL/post-formazione.

La chiave di tutto sono dati di alta qualità.

Quando è stato chiesto come Anthropic sia in grado di eseguire iterazioni così rapidamente, il leader del settore @yacineMTB ha ipotizzato che il core sia un volano di dati di altissimo livello.

"Ma sono ancora scioccato, come hanno fatto?"

Anthropic ha raggiunto un "circuito chiuso interno" di sviluppo di modelli di grandi dimensioni e utilizza l'intelligenza artificiale per creare intelligenza artificiale.

Secondo l'ultima esposizione di dati quantitativi interni, Anthropic ha trasformato il "volano dei dati" a una velocità che spaventa i suoi avversari:

Il 26% del lavoro principale di ricerca e sviluppo è stato guidato dall'intelligenza artificiale (modello Claude della generazione precedente).

Oltre l'80% del codice autoprodotto è scritto indipendentemente dal grande modello.

Non si tratta semplicemente di "riduzione dei costi e miglioramento dell'efficienza", ma tecnicamente significa che

l'auto-miglioramento ricorsivo (RSI) sta iniziando ad apparire

.

Anthropic stima che Claude potrebbe essere completamente auto-automatizzato già nel 2027, e per allora la velocità di iterazione potrebbe essere ancora più folle.

I due eroi dell'ASI stanno duellando e anche Google è pronta a muoversi. Noi utenti ordinari possiamo semplicemente sederci e aspettare la battaglia.

Big V Token Gremlin ha detto questo: "Il circolo dell'intelligenza artificiale la prossima settimana avrà scene che non abbiamo mai visto prima. Libera il tuo tempo, cancella i tuoi programmi, sii preparato mentalmente e conserva il flusso di lavoro più difficile a portata di mano per dopo. Credimi, ciò che sta arrivando cambierà completamente il tuo modo di lavorare."

L'emergere di Sonnet 5.5 segna l'arrivo ufficiale dell'"era dell'intelligenza artificiale conveniente e di alta qualità".

Per due dollari USA puoi acquistare "Baicai Infrastructure" con un milione di token.

Il costo estremamente basso della lettura della cache ($ 0,20/milione) consente a chiunque di creare facilmente un assistente AI personale con una memoria di contesto ultra lunga.

Sei pronto? Se la notizia è vera, avremo un nuovo modello pronto per viaggiare in meno di 24 ore.

Materiali di riferimento:

https://x.com/notjazii/status/2103884749202993411

https://x.com/notjazii/status/2103884167104831573

https://x.com/chetaslua/status/2104153687077904613

https://x.com/chetaslua/status/2104259190432903599

https://x.com/Mr_Salio/status/2104210803545030792

https://x.com/Mr_Salio/status/2104178854633849145/

Tag correlati

Articoli correlati

Commenti

0/500
Captcha (click to refresh)
Nessun commento