AI vyřešila stovky matematických problémů, tvrdí OpenAI. Teď řeší, jak o tom mluvit
OpenAI zveřejnila 722 matematických rukopisů, které vygeneroval její interní model. Matematická obec je nadšená i rozzlobená zároveň, protože se řeší, jak se takové výsledky mají vůbec oznamovat.

AI vyřešila stovky matematických problémů, tvrdí OpenAI. Teď řeší, jak o tom mluvit
Šestého října zveřejnila OpenAI na svém blogu příspěvek nazvaný „Sharing AI progress in mathematics“ a k němu veřejné úložiště na GitHubu s názvem openai/math. Obsahuje 722 matematických rukopisů rozdělených do 372 rodin, tedy skupin příbuzných prací. Podle firmy je vygeneroval její interní model, který ještě nebyl vydán. Nejde o produkt ani o novou verzi chatbota. Jde o hromadu důkazů a výsledků z oblasti matematiky, které do té doby nikdo nezvládl.
Zpráva přišla po měsících, kdy se matematická obec bouřila nad tím, jak laboratoře oznamují své výsledky. OpenAI tentokrát zvolila opatrnější cestu a část práce nechala posoudit nezávislou skupinou matematiků. Přesto zůstává řada otázek otevřená a část odborníků mluví o etickém problému, který tím teprve začíná.
Co v úložišti vlastně je
Rukopisy jsou volně dostupné pod licencí Apache 2.0, takže si je může kdokoli stáhnout a číst. Ke každému jsou přiložené i formalizace v jazyce Lean. Lean je nástroj, ve kterém se matematický důkaz zapíše tak přesně, že ho počítač dokáže krok za krokem ověřit. Není to tedy jen text, kterému se musí věřit, ale zápis, u kterého stroj potvrdí, že v něm není logická díra.
Ne všechny výsledky ale takovou kontrolou prošly. V popisu úložiště OpenAI sama přiznává, že u části rukopisů formalizace chybí a že některé z nich mohou mít problémy. Slibuje, že je bude postupně doplňovat a opravovat. Kromě důkazů firma zveřejnila i deset zkrácených popisů toho, jak model uvažoval, a odhady výpočetního výkonu, který na to padl.
Podle popisu byla modelu předložena zhruba čtyři tisíce problémů. Průměrný výsledek prý spotřeboval tolik výpočtu, kolik odpovídá asi třem hodinám přemýšlení v placené verzi ChatGPT. Dvě práce se z procedury vymykají a jsou pojmenované: oblast bez nul Riemannovy zeta funkce, kde text kvůli čitelnosti upravil člověk, a důkaz Hodgeovy domněnky pro takzvané CM abelovské variety.
Kontext, který tomu dává váhu
Není to první velký matematický výsledek, který OpenAI letos oznámila. Už osmého září firma uvedla, že její interní systém vyprodukoval důkaz, podle kterého mohou Navierovy a Stokesovy rovnice, tedy matematický popis pohybu tekutin, dospět ke stavu, kdy rychlost roste nade všechny meze v konečném čase. Šlo by o jednu ze sedmi takzvaných problémů tisíciletí, které Clayův institut vyhlásil v roce 2000 a na každou vypsal milion dolarů. Firma tehdy uvedla, že na výsledku pracovalo zhruba deset tisíc souběžných agentů a že ověření v jazyce Lean zabralo dalších sedmnáct hodin. Cenu prý nárokovat nehodlá.
Říjnová dávka na tento výsledek navazuje. V září OpenAI uvedla, že její model „vyřešil více než sto dlouho otevřených problémů napříč většinou oblastí matematiky“. Nyní k tomu přidala stovky dalších rukopisů. Podle nezávislé poradní skupiny AGMAI, kterou firma k posouzení přizvala, jde o řešení „stovek“ otevřených otázek. Jak velký je jejich skutečný dopad, se ale teprve ukáže, až je matematici prostudují. To může trvat měsíce.
Proč to část obce rozčiluje
Poradní skupina AGMAI vznikla při Institutu pro pokročilé studium v Princetonu a své doporučení zveřejnila devětadvacátého září, po více než šesti stech odpovědích od matematické komunity. V dokumentu mimo jiné stojí, že laboratoře nemají výsledky používat jako reklamu na své modely. Právě to je jádro sporu. Když firma vypustí stovky důkazů najednou bez podrobností, těžko se rozlišuje mezi skutečným vědeckým přínosem a marketingovým tahem.
AGMAI proto doporučuje konkrétní pravidla. Výsledky mají být uložené v odborných úložištích, která nekontroluje žádná AI laboratoř, s trvalými odkazy. U každého výsledku má být veřejně uvedené jméno modelu, použité zadání, shrnutý postup uvažování, čas a odhad nákladů na výpočet. Důkazy se mají co nejvíc formalizovat. A když firma zveřejní mnoho výsledků naráz, má dodat dokument, který vysvětlí, kolik srovnatelně těžkých problémů model zkusil a nezvládl, a jak byly problémy vybrány. Zajímavý je i požadavek, aby laboratoře finančně podpořily lidské chápání toho, co jejich modely vyprodukovaly, tedy konference, letní školy nebo delší odborné texty.
Za tím vším stojí nepříjemná otázka, kterou si část matematiků klade už delší dobu. Modely se trénují na práci lidských matematiků, jejichž výsledky pak používají jako stavební kámen. Kdo je za takový výsledek vlastně oceněný a kdo ho vůbec smí ověřit, když je model uzavřený, zůstává otevřené.
Co si z toho vzít
Pro běžného čtenáře je podstatné tohle. Umělá inteligence už není jen nástroj na psaní textů nebo obrázků. Dostala se do oblasti, kde se roky pracuje na jediném důkazu a kde se výsledek pozná podle toho, jestli ho ostatní matematici uznají. Právě proto je tak zajímavé, že se teď řeší nejen to, co modely dokážou, ale i jak se o tom má mluvit.
OpenAI slíbila, že u dalších vydání zlepší citace, výklad i prezentaci výsledků. Zároveň uvedla, že dál hledá i jiná komunitní úložiště, která by odpovídala doporučením poradní skupiny. Jestli se tím spor uklidní, ukáže až čas a hlavně to, kolik z těch stovek důkazů obstojí před zkoumáním skutečných matematiků.