OpenAI Riduce la Finestra di Contesto di Codex a 272K Token in un Aggiornamento a Sorpresa
AI News

OpenAI Riduce la Finestra di Contesto di Codex a 272K Token in un Aggiornamento a Sorpresa

5 min
20/07/2026
OpenAICodexcontext windowAI coding

La Finestra di Contesto di Codex si Riduce di 100.000 Token

OpenAI ha silenziosamente ridotto la finestra di contesto per il suo assistente di codifica AI Codex, portandola da 372.000 token a 272.000 token. La modifica è stata introdotta tramite un aggiornamento backportato alla versione 0.144 del software Codex, unito il 18 luglio 2026, tramite una pull request intitolata "Backport refreshed bundled model metadata to 0.144."

La pull request, scritta dall'ingegnere OpenAI sayan-oai, mostra una modifica netta di +64 e -54 righe di codice. Tuttavia, la motivazione esatta della riduzione rimane inspiegata nel messaggio di commit. L'aggiornamento sembra essere un hotfix, suggerendo che la precedente dimensione di contesto di 372K potrebbe essere stata un bug o una configurazione non intenzionale.

Realtà e Compromessi della Finestra di Contesto

Le grandi finestre di contesto sono state un'arma a doppio taglio per i modelli AI. Sebbene consentano agli agenti di elaborare interi codebase in una singola sessione, le prestazioni degradano bruscamente man mano che il contesto si riempie. Un recente rapporto pratico di XDA ha dettagliato come un modello locale da 284 miliardi di parametri sia passato da 3.000 token al secondo a meno di 10 token al secondo dopo aver elaborato 100.000 token di codice.

"Quando gli avevo fornito ben oltre 100.000 token di codebase, il prefill era sceso a circa 200 token al secondo e la generazione era sotto i 10," nota il rapporto. "Ogni nuovo token ora deve prestare attenzione a una cache molto più grande, e ogni checkpoint che il motore scriveva su disco era cresciuto oltre un gigabyte." Questo problema di scalabilità rende le finestre di contesto massicce poco pratiche per i cicli di codifica in tempo reale.

La riduzione di OpenAI a 272K token si allinea con una tendenza più ampia del settore verso l'ottimizzazione per costi e prestazioni piuttosto che inseguire la dimensione grezza del contesto. La mossa arriva anche mentre l'azienda affronta una concorrenza intensa nella guerra dei prezzi AI, con Meta e xAI di Elon Musk che tagliano i costi dei modelli.

Codex Micro e Ambizioni Hardware

La riduzione della finestra di contesto coincide con l'ingresso di OpenAI nel mercato hardware. L'azienda ha recentemente svelato il Codex Micro, una tastiera specializzata da $230 progettata per utenti esperti. Prodotta in collaborazione con Work Louder, il dispositivo presenta tasti meccanici nelle varianti "clicky" e "silent".

Business Insider ha riportato che il Codex Micro fa parte di una spinta più ampia per integrare Codex più a fondo nei flussi di lavoro degli sviluppatori. OpenAI ha anche fuso Codex nell'app desktop ChatGPT, e Codex insieme a ChatGPT Work vantano ora 8 milioni di utenti attivi, secondo il responsabile dell'ingegneria di Codex Thibault Sottiaux.

Il lancio hardware segnala che OpenAI sta scommettendo forte su Codex come piattaforma, anche mentre fa compromessi tecnici come la riduzione della finestra di contesto. La tastiera è progettata per accorciare le "side quest" e mantenere gli sviluppatori bloccati nel flusso di codifica.

continua a leggere sotto...

Contesto della Guerra dei Prezzi

Il cambiamento della finestra di contesto deve essere visto sullo sfondo della guerra dei prezzi AI in corso. L'amministratore delegato di OpenAI Sam Altman ha recentemente detto a CNBC, "Ogni azienda ora sta pensando alla spesa e al valore che ottiene in cambio dell'AI." L'ultimo modello di punta dell'azienda, GPT-5.6, è progettato per utilizzare significativamente meno token, rendendolo più efficiente in termini di costi per i clienti.

L'amministratore delegato di Meta Mark Zuckerberg è stato altrettanto aggressivo sui prezzi, affermando: "I prezzi di alcuni altri laboratori sono molto estremi e hanno margini molto alti. Pensiamo che ci sia una reale capacità di offrire intelligenza di frontiera o di altissimo livello a un costo molto più accessibile."

Riducendo la finestra di contesto, OpenAI potrebbe dare priorità alla velocità di inferenza e al risparmio sui costi rispetto alla capacità di elaborare codebase massicci in un unico passaggio. Questo si allinea con la strategia dell'azienda di rendere Codex più accessibile e conveniente per le imprese.

Implicazioni Tecniche per gli Sviluppatori

Per gli sviluppatori che utilizzano Codex, la riduzione da 372K a 272K token significa che ora possono inserire circa 200.000 parole di codice o documentazione in un singolo prompt, rispetto a circa 280.000. Sebbene sia ancora sostanziale, il cambiamento potrebbe influenzare i flussi di lavoro che si basano sul caricamento di interi repository di grandi dimensioni nel contesto.

Tuttavia, il compromesso potrebbe essere accettabile se il contesto ridotto porta a tempi di risposta più rapidi e latenza inferiore. Il rapporto XDA ha evidenziato che anche con una quantizzazione aggressiva (fino a 2 bit per peso), le prestazioni degradano significativamente con contesti grandi. La mossa di OpenAI suggerisce che l'azienda ritiene che 272K token sia il punto ottimale per la sua attuale architettura di modello.

Gli sviluppatori che necessitano di finestre di contesto più grandi potrebbero dover adottare strategie di chunking o utilizzare sistemi esterni di generazione aumentata da recupero (RAG) per compensare.

Reazioni del Settore e Prospettive

La natura silenziosa dell'aggiornamento ha sollevato sopracciglia nella comunità degli sviluppatori. Alcuni ipotizzano che la dimensione di contesto di 372K fosse un bug introdotto in una versione precedente, mentre altri credono fosse una funzionalità sperimentale che si è rivelata troppo costosa da mantenere.

OpenAI non ha rilasciato una dichiarazione pubblica che spiega il cambiamento. La pull request è stata unita senza discussione, e il messaggio di commit non offre dettagli oltre a "Backport refreshed bundled model metadata."

Mentre il mercato degli assistenti di codifica AI si surriscalda, con concorrenti come GitHub Copilot e Claude di Anthropic che guadagnano terreno, la decisione di OpenAI di dare priorità all'efficienza rispetto alla capacità grezza potrebbe rivelarsi strategica. L'azienda sta chiaramente scommettendo che un Codex più veloce, più economico e più affidabile conquisterà i clienti aziendali, anche se ciò significa una finestra di contesto più piccola.