Grok 4.7: xAI lancia il suo modello più potente per il coding e il lavoro agentico
xAI ha rilasciato Grok 4.7, il suo modello più capace per coding e task agentici: 2,1 trilioni di parametri, contesto da 500K token e prezzi invariati.

xAI ha alzato di nuovo l’asticella. Il 21 settembre 2026 il laboratorio guidato da Elon Musk ha rilasciato Grok 4.7, quello che l’azienda definisce il suo modello più capace di sempre per la scrittura di codice, il lavoro agentico e i compiti di conoscenza più impegnativi. L’annuncio, pubblicato sul blog ufficiale di xAI, arriva a poche settimane dalla tabella di marcia condivisa ad agosto e conferma un ritmo di aggiornamenti che ormai non concede pause.
La cosa che salta subito all’occhio non è una funzione appariscente, ma un dato di scala. Grok 4.7 porta con sé un modello di base più grande e una finestra di contesto ampliata, senza però ritoccare il listino. In un mercato dove ogni salto di qualità di solito si paga, è una scelta che pesa.
Cosa cambia davvero con Grok 4.7
Il salto più evidente riguarda le dimensioni del modello. Secondo quanto dichiarato da Elon Musk, Grok 4.7 arriva a 2,1 trilioni di parametri, circa il 40% in più rispetto agli 1,5 trilioni di Grok 4.6. Non è solo una questione di numeri: un modello di base più ampio, allenato più a lungo e su compiti più difficili, tende a ragionare meglio sui problemi lunghi e articolati, quelli in cui le versioni precedenti si perdevano dopo qualche passaggio.
Dietro questi numeri c’è un cambiamento nel modo in cui il modello è stato addestrato. xAI parla di una fase di apprendimento per rinforzo più lunga e di un allenamento concentrato sui compiti più ostici, quelli che mettono in crisi anche i sistemi più avanzati. È un approccio che privilegia la profondità rispetto alla semplice ampiezza: non basta sapere tante cose, serve saperle usare per arrivare fino in fondo a un problema.
A fare la differenza è anche la finestra di contesto, che sale a 500.000 token. Tradotto in pratica, significa che puoi dare in pasto al modello interi repository di codice, documentazioni corpose o lunghe conversazioni senza che perda il filo. Per chi lavora su basi di codice reali, e non su esempi giocattolo, è proprio qui che un modello dimostra il suo valore.
Grok 4.7 accetta input multimodali e introduce quattro livelli di ragionamento, chiamati low, medium, high e xhigh. L’idea è semplice e utile: puoi decidere quanto far ragionare il modello a seconda del compito. Una domanda veloce non ha bisogno dello stesso sforzo di un refactoring complesso, e ora puoi calibrare tu il compromesso tra costo, velocità e profondità.
xAI parla anche di miglioramenti meno vistosi ma concreti: un autocontrollo più affidabile, una migliore gestione del contesto lungo e risultati più solidi nella produzione di documenti e presentazioni. Sono i dettagli che, nell’uso quotidiano, fanno la differenza tra un assistente promettente e uno su cui puoi davvero contare.
Prezzi invariati, ed è la notizia nella notizia
Il dato che rende Grok 4.7 particolarmente interessante è il prezzo. Nonostante il modello più grande e il contesto più ampio, xAI ha mantenuto lo stesso listino di Grok 4.6.
Per i prompt sotto i 200.000 token, il costo resta di 2 dollari per milione di token in input, 0,50 dollari per i token memorizzati nella cache e 6 dollari per milione di token in output. Oltre quella soglia si sale a 4, 1 e 12 dollari. In un settore in cui la potenza in più di solito si traduce in bollette più salate, offrire un salto di capacità a parità di spesa è una leva competitiva notevole.
È una strategia che conosciamo bene: abbassare il rapporto tra costo e prestazioni per spingere sviluppatori e aziende a provare il modello. E funziona, perché quando la qualità cresce ma il conto rimane fermo, la barriera all’adozione crolla.
I benchmark: coding e compiti agentici in forte crescita
Sui numeri delle prove tecniche, xAI rivendica progressi ampi rispetto alla versione precedente. I guadagni più marcati arrivano proprio nell’area che il modello vuole presidiare, quella dello sviluppo software.
Ecco i risultati principali dichiarati dall’azienda, sempre nel confronto con Grok 4.6:
- CursorBench 4.0, che misura i compiti di coding più lunghi, sale dal 40,4% al 46,3%.
- Terminal-Bench 4.0 fa un balzo dal 20,3% al 38,0%.
- SWE-Marathon passa dal 31,9% al 46,0%.
Il salto su Terminal-Bench è quello che dice di più. Misura la capacità del modello di operare direttamente da riga di comando, un ambiente ostile dove un singolo errore fa fallire l’intera catena di azioni. Quasi raddoppiare il punteggio significa un modello che sbaglia meno e recupera meglio quando qualcosa va storto.
Sul fronte del lavoro agentico, cioè la capacità di portare a termine compiti complessi in autonomia, Grok 4.7 tocca 1657 Elo su AA-Briefcase, con un guadagno di 111 punti rispetto a Grok 4.6, e 1695 Elo su GDPval, il test che valuta le prestazioni su attività professionali reali.
Vale sempre la solita cautela con i benchmark: sono indicazioni, non verità assolute, e ogni azienda tende a scegliere i test in cui brilla di più. Detto questo, il quadro è coerente. Grok 4.7 non punta a stupire con la conversazione brillante, ma a diventare uno strumento di lavoro affidabile per chi programma e automatizza processi.
Sicurezza: un nuovo stack di salvaguardie
Insieme alla potenza, xAI ha rivisto l’impianto di sicurezza. Il nuovo stack di salvaguardie è pensato per bilanciare due esigenze che spesso vanno in conflitto: bloccare gli usi pericolosi senza però ostacolare la ricerca legittima, soprattutto in ambito cybersicurezza.
Sui test dichiarati, il modello ha raggiunto il 62,4% sul benchmark di biosicurezza di LatchBio, il valore più alto rivendicato dall’azienda. Su HackerBench v0.3, la prova interna sui rischi informatici, Grok 4.7 avrebbe bloccato tutti i prompt a doppio uso pericolosi tranne il 3,3%, senza penalizzare le richieste di sicurezza legittime.
È un equilibrio delicato. Un modello troppo prudente diventa inutile per i professionisti della sicurezza, uno troppo permissivo diventa un rischio. La direzione presa da xAI, almeno sulla carta, prova a tenere insieme le due cose.
Dove usare Grok 4.7 e come si colloca
La disponibilità è immediata e pensata soprattutto per chi sviluppa. Grok 4.7 è accessibile tramite l’API di xAI, dentro Grok Build, in Cursor e attraverso i principali ambienti di coding di terze parti e le piattaforme cloud. Chi già usava Grok 4.6 può passare alla nuova versione senza cambiare flusso di lavoro.
Il posizionamento è chiaro. Con Grok 4.7 xAI si getta a capofitto nella competizione più calda del momento, quella dei modelli per programmatori, dove negli ultimi mesi si sono affacciati rivali agguerriti come SWE-2 di Cognition, capace di avvicinarsi alla frontiera a una frazione del costo. La battaglia non si gioca più solo sulla qualità pura, ma sul rapporto tra prestazioni e prezzo, ed è esattamente il terreno su cui xAI ha deciso di puntare.
Non è un caso isolato. Nel frattempo l’ecosistema si è allargato: pensa all’integrazione che ha portato Grok dentro Microsoft Copilot, e quindi dentro Word, Excel e PowerPoint. Ogni nuovo modello, oggi, nasce già collegato a una rete di strumenti che ne moltiplica gli usi e ne accelera l’adozione nelle aziende.
Se ad agosto l’azienda aveva soltanto promesso, con il lancio odierno mantiene. Chi vuole ripercorrere le premesse può rileggere l’annuncio di date e specifiche di Grok 4.6 e 4.7 e confrontarlo con ciò che è arrivato davvero.
Cosa significa per te
Se scrivi codice, automatizzi processi o costruisci agenti, Grok 4.7 merita una prova concreta. Il vantaggio più tangibile non è il numero di parametri, ma il fatto di ottenere più potenza allo stesso prezzo, con una finestra di contesto abbastanza ampia da gestire progetti reali.
Il consiglio è pragmatico: non fermarti alle tabelle dei benchmark. Mettilo alla prova sui tuoi compiti reali, quelli lunghi e ripetitivi in cui i modelli precedenti inciampavano, e valuta se i quattro livelli di ragionamento ti permettono di risparmiare senza perdere qualità.
Il ritmo, intanto, non rallenta. xAI ha già lasciato intendere quale sarà il prossimo passo, e chi vuole capire dove sta andando può dare un’occhiata a cosa si dice su Grok 4.8. Una cosa è certa: la corsa dei modelli per il coding è appena entrata in una fase nuova, e conviene tenerla d’occhio.