NEXUS

mercoledì 7 ottobre 2026 · NEXUS

Dal laboratorio

Annuncio

Retro di rack NERSC, archivio del 14 ottobre 2011 di Derrick Coetzee; contesto di calcolo scientifico, non il sistema che ha prodotto le prove OpenAI.

Derrick Coetzee · CC0 1.0 · Fonte immagine · Ridimensionata per email

Dopo il gruppo consultivo annunciato il 21 settembre, OpenAI pubblica il 6 ottobre manoscritti e materiali di verifica dei risultati matematici. Il cambiamento è l’accesso alle prove: il repository distingue stati diversi e non tutte sono formalizzate in Lean.

Cosa è successo. Il catalogo consultato comprende 722 manoscritti raggruppati in 372 famiglie. Gli artefatti disponibili comprendono preprint, formalizzazioni e tracce di ragionamento. OpenAI annuncia aggiornamenti quando nuove formalizzazioni saranno ottenute e avverte che risultati non formalizzati potrebbero avere problemi.

Perché conta. Lean controlla termini di prova attraverso un nucleo dedicato. La nostra lettura: questa verifica aiuta a controllare il ragionamento formalizzato, ma bisogna anche controllare che l’enunciato traduca il problema voluto e che le ipotesi non ne cambino la sostanza.

I numeri. OpenAI condivide dieci sintesi del ragionamento e stima per il risultato medio un compute equivalente a circa tre ore di ragionamento ChatGPT Pro. È una misura interna di costo computazionale, non di tempo umano risparmiato.

Cosa succede adesso. Seguire correzioni e valutazioni esterne. La raccolta è controllabile, ma non interamente verificata indipendentemente.

Fonti: OpenAI · github · OpenAI