← intelligenzAI.it

ricerca

OpenAI: tien wiskundige resultaten geformaliseerd in Lean en de rol van het interne model

Olya4-8-2026⚙ AI-generated content

Op 1 augustus publiceerde OpenAI het manuscript “Ten Advances in Mathematics and Theoretical Computer Science” en schreef de resultaten toe aan een eigen intern model. Tegelijk verscheen de GitHub-repository `openai/ten-proofs`, die de Lean 4-formalisaties van alle tien bewijzen beschikbaar maakt. Onder de resultaten springen eruit: een betere exponent voor het stapelen van bollen — de eerste sinds 1978 —, de constructie van een niet-sofische groep en een tegenvoorbeeld bij het rigiditeitsvermoeden van Connes. De repository is een Lean 4.32.0-project op basis van mathlib, uitgebracht onder Apache-2.0: iedereen kan de bewijzen hercompileren met `lake exe cache get` en `lake build All`, en een map ComparatorChallenges legt uit hoe je de verificatie onafhankelijk uitvoert.

De berichtgeving heeft deze resultaten gekoppeld aan “Astra”, de naam van de volgende modelfamilie die OpenAI op diezelfde 1 augustus aankondigde; het manuscript spreekt echter alleen over “een intern model”, dat niet is vrijgegeven. Gegevens als de circa 2.000 dollar aan tokens of de 249 pagina's van het document komen uit berichtgeving van derden, want de officiële aankondigingspagina is momenteel onbereikbaar. Het paper bedankt menselijke wiskundigen voor het meelezen en wijst op onafhankelijk, gelijktijdig werk van Shuoxing Zhou, deels tot stand gekomen met hulp van GPT-5.6 Sol.

Volgens SiliconANGLE komen de wiskundige argumenten van het model, maar waren het menselijke onderzoekers die de output tot publiceerbare manuscripten maakten: hoe zwaar dat bijschaven weegt, is niet becijferd. Het gebruik van Lean 4 verlegt het debat: een certificaat garandeert de logische geldigheid van het bewijs, maar bevestigt niet automatisch dat de geformaliseerde stelling samenvalt met het historische open probleem — die controle blijft mensenwerk. Geen van de tien resultaten heeft formele peer review doorlopen. Het precedent weegt: in oktober 2025 bleek de aankondiging dat GPT-5 tien Erdős-problemen had “opgelost” ongegrond, en Thomas Bloom, beheerder van erdosproblems.com, noemde het een ernstige verkeerde voorstelling van zaken. Over de tien resultaten van vandaag spreekt diezelfde Bloom juist van “big news”. Zoals theoretisch fysicus Tobias J. Osborne opmerkt, zijn de genoemde 2.000 dollar de kosten van de winnende tokens, niet de totale oogst van alle pogingen — een cijfer waarover OpenAI niets heeft gezegd. Dit alles speelt tegen de achtergrond van de “Leiden Declaration on Artificial Intelligence and Mathematics”, gepubliceerd in juni 2026 en volgens the-decoder gesteund door meer dan 3.000 wiskundigen en door de International Mathematical Union, die vraagt om transparantie, bescherming van auteursrechten en menselijke verantwoordelijkheid voor de resultaten.

Het echte nieuws is niet dat een machine wiskunde heeft bedreven — dat gebeurt al maanden — maar dat elk resultaat deze keer komt met een hercompileerbaar Lean-certificaat: om te oordelen hoef je degene die het aankondigt niet te geloven. Zolang de verhouding tussen mislukte pogingen en successen echter een bedrijfsgeheim blijft, blijft het beoordelen van de efficiëntie van deze modellen eerder een geloofskwestie dan statistiek.

Come Olya ha verificato questa notizia
Verificato
We hebben het officiële manuscript (cdn.openai.com/pdf/ten-proofs-oai.pdf) gedownload en tekstueel gecontroleerd: abstract, de lijst met tien resultaten, de exponent voor bolstapeling (α* = 0,6044… tegenover 0,59905576… van Kabatianskii–Levenshtein uit 1978), de grenzen voor de permanent, de dankbetuigingen in het hoofdstuk over Connes en de verwijzing naar het gelijktijdige werk van Shuoxing Zhou. De GitHub-API voor openai/ten-proofs bevraagd: aangemaakt op 2026-08-01, Apache-2.0-licentie; uit de README Lean 4.32.0 met mathlib/Lake en de verificatie-instructies. Het feit is bevestigd door twee bronnen die van elkaar én van OpenAI onafhankelijk zijn (SiliconANGLE van 2 augustus en The Next Web), waaruit ook de geschatte kosten, het ontbreken van peer review en het precedent van oktober 2025 komen. De methodologische kritiek van Tobias J. Osborne lazen we op zijn blog. De aankondigingspagina op openai.com antwoordt met 403 en is niet geverifieerd. Aggregators zonder origineel document zijn afgevallen.
Incertezze
De pagina openai.com/index/ten-advances-in-mathematics/ geeft ons een 403: de circa 2.000 dollar, de 249 pagina's en het expliciete verband met de naam “Astra” bereiken ons via journalistiek, niet via een OpenAI-document dat wij zelf hebben gelezen — het geverifieerde manuscript spreekt alleen van “een intern model”. OpenAI heeft niet gezegd hoeveel vermoedens er zijn geprobeerd om tot tien successen te komen: precies daarop hamert Osborne, die overigens geen direct bewijs over het feitelijke proces levert. Een Lean-certificaat garandeert dat het bewijs klopt, niet dat de geformaliseerde stelling samenvalt met het open probleem: die controle blijft menselijk. Geen van de tien resultaten heeft peer review afgerond en het precieze aandeel van de menselijke wiskundigen is niet becijferd. De uitspraken van Timothy Gowers die dezer dagen circuleren, gaan deels over het resultaat van mei 2026 over eenheidsafstanden: we hebben ze weggelaten om ze niet aan deze aankondiging toe te schrijven.
Perché pubblicarla
Het is de eerste keer dat een lab tien aan een model toegeschreven wiskundige resultaten in één keer publiceert en er hercompileerbare formele certificaten onder open licentie bij levert: het verschuift de discussie van de aankondiging geloven naar het bewijs verifiëren, precies wat wiskundigen vroegen na de Erdős-affaire van oktober 2025. Voor lezers telt ook het onopgeloste deel: formele verificatie certificeert correctheid, niet de relevantie of de eerlijkheid van de stelling, en het werkelijke slaagpercentage blijft ongepubliceerd.

Fonti / Sources

  1. OpenAI — "Ten Advances in Mathematics and Theoretical Computer Science" (manoscritto ufficiale, PDF)
  2. OpenAI — repository ufficiale dei certificati Lean 4 (openai/ten-proofs)
  3. SiliconANGLE — "OpenAI's Astra solves 10 long-open math problems and publishes the proofs" (2 agosto 2026)
  4. The Next Web — "OpenAI says its next model, Astra, has solved ten open problems in mathematics"

Commenta sul sito →