Google- och OpenAI-chatbotar vinner guld på internationella matematikolympiaden

Google- och OpenAI-chatbotar vinner guld på internationella matematikolympiaden

I en anmärkningsvärd prestation har artificiell intelligens som skapats av Googles DeepMind och OpenAI nyligen överträffat gymnasieelever inom matematik. Årets Internationella Matematikolympiaden (IMO) såg båda företagen stolt tillkänna ge sina guldmedaljvinster i denna prestigefyllda tävling, som är känd för att utmana de mest begåvade unga matematikerna världen över.

IMO bjuder in elitstudenter från hela världen att ta sig an en serie intrikata, flerstegs matematikproblem. Deltagarna deltar i två intensiva prov på fyra och en halv timme över två dagar, där de måste lösa totalt sex komplexa frågor. DeepMinds och OpenAIs modeller lyckades var och en lösa fem av dessa frågor felfritt, vilket resulterade i ett poäng på 35 av de potentiella 42 poängen som krävs. Denna imponerande prestation placerar dem tillsammans med 67 mänskliga deltagare, av 630 tävlande, som också säkerställde guldmedaljer.

Det finns dock en intressant aspekt att notera angående påståendena från dessa teknikjättar. DeepMind deltog formellt i IMO och gjorde sin tillkännagivelse i ett blogginlägg efter publiceringen av de officiella studentresultaten. I kontrast deltog OpenAI faktiskt inte i tävlingen. Istället använde det offentligt tillgängliga problem efter publiceringen för att demonstrera sina kapabiliteter och deklarerade guldnivåprestationer som IMO inte kan verifiera på grund av sin icke-deltagande status. Dessutom kom OpenAIs tillkännagivande för tidigt under helgen, i strid med IMOs önskemål att företag ska respektera studenternas prestationer genom att vänta tills officiella poäng publicerades på måndagen.

Båda AI-modellerna angrep provet precis som de deltagande studenterna, i enlighet med en strikt tidsram på 4,5 timmar per prov utan hjälp av externa verktyg eller internetanslutning. Noterbart är att båda företagen valde för allmänna AI-lösningar snarare än mer skräddarsydda modeller, som historiskt har gett bättre resultat.

Ändå finns det en överraskande vinkel: ingen av de guldvinnande modellerna är offentligt tillgängliga. Faktum är att när forskare testade offentliga modeller som Gemini 2.5 Pro, Grok-4 och OpenAI o4, översteg ingen en poäng på 13, vilket var otillräckligt för de 19 poäng som krävs för en bronsmedalj.

Det finns pågående skepsis kring dessa resultat. Den dystra prestationen hos offentliga tillgängliga modeller väcker viktiga frågor om ojämlikheten mellan tillgängliga verktyg och vad avancerade modeller kan uppnå. Varför kan inte dessa överlägsna modeller skalas för offentlig användning? Trots dessa bekymmer framträder två betydande insikter: den kontinuerliga förbättringen av laboratoriemodeller i att lösa resonemangsproblem och känslan av att OpenAI kanske opportunistiskt har sökt uppmärksamhet på bekostnad av unga framgångar.

Vad betyder AI-modellers framsteg i tävlingar som IMO för utbildning och framtida matematiker? Det tyder på att medan AI blir allt mer skicklig på problemlösning, kan det förändra hur vi närmar oss lärande och tävlingar inom den akademiska världen.

Är AI troligt att ersätta mänskliga matematiker i tävlingar som IMO? Medan AI kan ge enastående verktyg för att lösa komplexa problem, förblir den kreativitet och innovativa tänkande hos mänskliga sinnen oersättliga, vilket tyder på att samarbete mellan AI och studenter kan vara framtiden.

Hur jämför sig AI-modeller med mänskliga deltagare i realtidsproblemlösning? Medan AI kan utmärka sig i strukturerade scenarier, resulterar de unika tillvägagångssätt och insikter som studenterna bidrar med till utmanande problem ofta i olika lösningar som förbättrar lärandeupplevelsen.

Kan denna utveckling påverka den framtida formatet på matematiktävlingar? Givet den snabba utvecklingen inom AI, är det troligt att tävlingar kan utvecklas för att inkludera AI-assisterade divisioner, vilket främjar en ny våg av utmanare samtidigt som mänskliga kategorier bevaras.

För att sammanfatta, betonar utvecklingen på IMO de imponerande förmågorna hos AI samtidigt som den belyser klyftan mellan banbrytande modeller och de som är tillgängliga för allmänheten. Står vi på tröskeln till en ny era inom matematik, där AI assisterar snarare än konkurrerar? Håll dig nyfiken och fortsätt utforska dessa fascinerande samband mellan teknik och utbildning. För mer insikter, kolla in Moyens I/O.

Stöd vårt arbete ❤️

Om du gillade den här artikeln, överväg att lämna dricks för att hjälpa oss fortsätta publicera bra innehåll.

Säker betalning med PayPal
Se även:  USA:s finansminister hotar med sanktioner mot kinesiska AI-labb på grund av IP-stöld