Anthropic ilitangaza Alhamisi, Septemba 4, 2026, kwamba Claude ametoa uthibitisho kamili wa kwanza uliokaguliwa kwa kompyuta wa Nadharia ya Mwisho ya Fermat, mojawapo ya matokeo maarufu zaidi katika hisabati, ikifanya kazi kwa uhuru zaidi ya siku 11 na kuandika mistari milioni 13 ya msimbo katika lugha ya programu Lean, kulingana na tangazo rasmi la kampuni.
Hatua hiyo ilivuta hisia za haraka katika jumuiya yote ya watafiti, ikiongoza kwa Habari za Hacker ndani ya saa chache baada ya kuchapishwa. Uthibitisho rasmi wa nadharia hiyo ulitarajiwa kuchukua juhudi za miaka mingi za jumuiya; badala yake, timu ya mawakala kadhaa walioshirikiana na Claude walikamilisha kazi hiyo chini ya wiki mbili. Kwa muktadha zaidi kuhusu mahali ambapo uwezo wa AI unasimama leo, angalia maendeleo yetu ya hivi punde ya AI.
Nadharia ya Mwisho ya Fermat Ni Nini — na Kwa Nini Ilipinga Uthibitisho kwa Miaka 350
Nadharia ya Mwisho ya Fermat inasema kwamba hakuna nambari kamili za a, b, na c zinazoweza kutosheleza mlinganyo aⁿ + bⁿ = cⁿ kwa thamani yoyote ya n kubwa kuliko 2. Pierre de Fermat aliandika dai hilo karibu 1637 ukingoni mwa nakala yake ya Arithmetica ya Diophantus, akiongeza kwamba uthibitisho wake wa sasa ulikuwa na uthibitisho mkubwa sana. nyembamba ili kujumuisha.
Kwa zaidi ya karne tatu dhana hiyo ilidumu kwa kila jaribio la kuthibitisha hilo. Kulingana na akaunti ya Anthropic, zawadi ya alama 100,000 za dhahabu za Ujerumani iliyotangazwa mwaka wa 1908 ilifanya majaribio 621 yasiyo sahihi katika mwaka wake wa kwanza pekee. Sir Andrew Wiles hatimaye aliwasilisha uthibitisho sahihi mwaka wa 1993 - kwa wakaguzi pekee kufichua pengo muhimu la miezi miwili katika uthibitishaji. Wiles alitumia mwaka mmoja kurekebisha uthibitisho huo na mwanafunzi wake wa zamani Richard Taylor kabla ya kuchapisha toleo la uhakika la kurasa 129 mnamo Mei 1995, ambalo lilichukua miezi ya kazi kubwa kuthibitisha.
Jinsi Claude Alivyojenga Uthibitisho wa Mstari wa Milioni 13
Mradi huu ulianzishwa na Tianyi Peng, mtafiti wa Anthropic ambaye kikundi chake katika Chuo Kikuu cha Columbia kinaunda zana za urasimishaji wa AI, ambaye aliamua kujaribu kama Claude angeweza kufanya maendeleo katika kubadilisha uthibitisho wa Wiles kuwa fomu ya kukaguliwa na mashine.
Jitihada ilifanikiwa tu baada ya mabadiliko ya mbinu. Ripoti za kianthropic kwamba majaribio ya awali ya mawakala yalishindwa kwani walipoteza hali ya mradi na kuacha kushirikiana kwa ufanisi. Mafanikio hayo yalikuja na Prove2Me, jukwaa la ushirikiano lililo wazi la kurasimisha hisabati iliyoundwa na Peng na washirika huko Columbia. Jukwaa hudumisha grafu iliyoelekezwa ya kauli za nadharia ambayo mawakala hutumia kuamua nini cha kuthibitisha kifuatacho, huharakisha mkusanyiko wa Lean kwa kutenganisha taarifa na uthibitisho, na huwaruhusu mawakala kutafuta na kutumia tena matokeo kupitia maelezo ya lugha asilia ya kila nadharia.
Kwa kutumia zana ya wakala nyingi yenye msingi wa Kanuni ya Claude, timu ya mawakala ilitumia takriban tokeni bilioni sita kutoka kwa modeli ya utafiti wa ndani ambayo Anthropic inaelezea kuwa inaweza kulinganishwa na Claude Fable 5.1. Maoni ya kibinadamu yalipunguzwa kwa maagizo ya mara kwa mara ya kiwango cha juu - Anthropic inataja ujumbe kama "Jacobian kama mpango unaosikika kuwa wa kipaumbele" na ombi la kushinikiza nadharia ya Mazur ifanyike hivi karibuni. Uthibitishaji ulikamilika saa 02:00 UTC mnamo Agosti 18, wakati nadharia ya msingi ya jukwaa ilipogeuzwa hadi Imethibitishwa.
Wakati huo huo, Claude alithibitisha nadharia 30,300, akitumia 29,500 kati yao katika uthibitisho wa mwisho. Katika mistari milioni 13 ya Lean, matokeo ni zaidi ya mara tano ya ukubwa wa Mathlib, maktaba kuu ya jamii ya hisabati iliyorasimishwa. Uthibitisho unafuata ufafanuzi uliorahisishwa wa hoja ya Wiles na Henri Darmon, Fred Diamond, na Richard Taylor, na kurekebisha vipande vya mradi wa urasimishaji wa Chuo cha Imperial cha London unaoongozwa na Kevin Buzzard.
Kwa Nini Uthibitisho Mdogo Hutatua Swali
Kinachofanya matokeo kuwa maamuzi ni mwamuzi. Visaidizi vya uthibitisho kama vile Lean huthibitisha mantiki ya uthibitisho kwa njia ya algoriti, na Anthropic inasema kwamba uthibitisho wa Claude unatumia tu viambishi vitatu vya kawaida vya Lean, huku kilinganishi kikithibitisha kuwa taarifa ya nadharia hiyo inalingana na uundaji wa nadharia ya Mathlib mwenyewe. Kampuni pia imechapisha uthibitisho huo katika hazina ya umma kwenye GitHub.
Buzzard, ambaye alikagua matokeo, hakuwa na shaka: "Mafanikio haya ya ajabu ya urasimishaji wa kiotomatiki, ambayo watafiti wa Anthropic wanasema yalichukua siku 11 tu, inathibitisha Nadharia ya Mwisho ya Fermat bila mawazo yoyote isipokuwa axioms ya hisabati."
Anthropic ni mwangalifu kuweka riwaya kwa usahihi. Tofauti na kazi ya hivi majuzi inayoendeshwa na AI kwenye nadharia ya Riemann, ambayo ilitoa hisabati ya riwaya, hakuna hesabu mpya hapa - mafanikio ni uthibitishaji, kuangalia uthibitisho uliopo jinsi kikokotoo hukagua hesabu. Ikizingatiwa kwamba Lean - sio Anthropic - ndiye mamlaka ya mwisho juu ya usahihi, dai halitegemei tathmini ya kampuni yenyewe ya muundo wake.
Inamaanisha Nini kwa Hisabati na Utafiti wa AI
Athari hukata pande zote mbili. Kwa wanahisabati, urasimishaji kiotomatiki unaweza kupata makosa katika mkusanyiko wa maarifa uliopo na kupunguza kwa kiasi kikubwa mzigo wa waamuzi kwa matokeo mapya, mchakato ambao unaweza kuchukua miaka. "Ikiwa urasimishaji wa kiotomatiki wa FLT unawezekana sasa, basi tumepiga hatua kubwa kuelekea urasimishaji kiotomatiki wa fasihi ya kisasa ya hisabati," Buzzard aliandika katika chapisho lililofuata la blogu lenye kichwa "Anthropic imenishinda," akikiri kwamba juhudi zake za kuongozwa na jamii, zilizoanza mnamo 2024, zilikuwa zimepitwa.
Kwa maabara za AI, matokeo yanapendekeza kuwa zana rasmi zinaweza kudhibiti udhaifu mmoja wa teknolojia. Anthropic inabainisha kuwa uandishi wa Lean unaonekana kumsaidia Claude kuthibitisha matokeo ya riwaya, huku mawakala wakitumia uthibitisho rasmi ili kuangalia dhahania kwa hiari wanapoandika simulizi za nambari. Kampuni hiyo pia inadai kuwa kizuizi cha kuingia kinaporomoka: katika jaribio dogo, mipango mitatu ya kibinafsi ya Claude Max ilitosha kwa mawakala wanaoshirikiana kurasimisha Theorem ya Vinogradov's Three Primes katika siku tatu.
Matangazo yanabaki kuwa ya kweli. Uthibitisho ulihitaji jukwaa lililoundwa kwa madhumuni, mabilioni ya tokeni, na kigezo safi kisicho cha kawaida cha mafanikio - kuangalia ufunguo wa jibu ambao tayari upo ni rahisi kuliko kugundua nadharia mpya. Lakini kama onyesho kwamba mifumo ya AI sasa inaweza kurasimisha hisabati kwenye mipaka, siku 11 dhidi ya tatizo la miaka 358 hufanya hoja kuwa wazi iwezekanavyo.
---
Kaa Mbele ya AIPata habari za hivi punde za AI, uchanganuzi na mafanikio - yote katika sehemu moja.
Soma habari zaidi za AI →