- xAI ha lanciato Grok 4.5, addestrato su decine di migliaia di GPU Nvidia GB300 e orientato verso la programmazione, gli Agent e le attività basate sulla conoscenza.
- Su Terminal Bench 2.1, Grok 4.5 ha ottenuto l’83,3%, posizionandosi quasi alla pari con GPT 5.5 all’83,4% e risultando solo leggermente inferiore a Fable 5 all’84,3%.
- Su DeepSWE 1.1, Grok 4.5 ha registrato il 53%, un punteggio inferiore rispetto a GPT 5.5 al 67% e a Fable 5 al 70% nelle capacità di risoluzione di bug reali su GitHub.
- Su SWE Bench Pro, Grok 4.5 ha raggiunto il 64,7%, superando GLM 5.2 al 62,1% ma posizionandosi al di sotto di Opus 4.8 al 69,2% e di Fable 5 all’80,4%.
- xAI ha dichiarato che il modello è stato addestrato mediante un rigoroso processo de filtraggio dei dati, rimuovendo le informazioni duplicate e selezionando dati specifici per settore per migliorarne la qualità.
- La fase di apprendimento per rinforzo ha utilizzato centinaia di migliaia di task, principalmente riguardanti l’ingegneria del software, con un sistema di valutazione automatizzato e un’infrastruttura di addestramento asincrona per Agent che operano per molte ore.
- Grok 4.5 ha un prezzo di 2 USD per milione di token di input e 6 USD per milione di token di output, risultando il più economico all’interno del gruppo di modelli ad alte prestazioni.
- Al contrario, Opus 4.8 ha un prezzo di 5 USD e 25 USD, GPT 5.5 insieme a GPT 5.6 costano 5 USD e 30 USD, mentre Fable 5 arriva fino a 10 USD e 50 USD per milione di token rispettivamente di input e di output.
- xAI ha riferito che Grok 4.5 consuma circa 4,2 volte meno token rispetto a Opus 4.8 nei test SWE Bench Pro e raggiunge una velocità di circa 80 token al secondo.
- La strategia di xAI è simile a quella di aziende cinesi come Zhipu e DeepSeek: colmare il divario di prestazioni per poi competere facendo leva sui prezzi bassi.
- Grok 4.5 è già disponibile su Grok Build, Cursor e sulla piattaforma xAI Console, e supporta inoltre i plugin per Word, PowerPoint ed Excel.
- Il modello non è ancora stato rilasciato nell’Unione Europea, con un lancio previsto per metà luglio; viene sviluppato in parallelo con l’editor Cursor dopo che SpaceX ha acquisito l’azienda in un’operazione interamente in azioni del valore di 60 miliardi di dollari USD.
- 📌 Conclusione: Grok 4.5 non guida tutte le classifiche dei benchmark, ma esercita una forte pressione grazie a una strategia di prezzi estremamente competitiva. Le tariffe pari a solo il 20% circa di Fable 5, e notevolmente inferiori rispetto a GPT 5.5, abbinate a un minor consumo di token, consentono di ridurre drasticamente i costi operativi. Se l’efficienza reale corrisponderà a quanto dichiarato, Grok 4.5 potrebbe trasformarsi in una scelta attraente per le aziende che hanno bisogno di bilanciare prestazioni e costi, anziché inseguire il modello con il punteggio di benchmark più elevato.
Grok 4.5 sconvolge con prezzi diverse volte inferiori rispetto a GPT 5.5 e Fable 5; lo scarto dei punteggi è ancora così importante?
Related Posts
CONTATTI
Email: info@vietmetric.vn
Indirizzo: Numero 34, Vicolo 91, Via Tran Duy Hung, Quartiere Yen Hoa, Città di Hanoi
© 2026 Vietmetric

