by Oh! Semput
Keputusan sempurna dalam pertandingan matematik paling berprestij di dunia dahulunya hanya mampu dicapai oleh sekelompok kecil minda muda yang bijak setiap tahun, namun buat julung kalinya, kecerdasan buatan (AI) turut mencatatkan markah penuh.
Dua syarikat teknologi China, Huawei dan Xiaohongshu, menyatakan bahawa model AI masing-masing telah mencapai 100 peratus bagi soalan-soalan yang diberikan kepada calon-calon manusia dalam Olimpiad Matematik Antarabangsa (IMO) bulan ini.
Mereka merupakan makmal AI pertama yang mengumumkan skor masing-masing, tetapi pihak lain dari seluruh dunia dijangka mengikut jejak langkah yang sama dalam masa beberapa hari akan datang.
“Kami amat gembira dengan keputusan ini, kerana mencapai skor sempurna di IMO adalah sesuatu yang amat mencabar,” kata Xiaohongshu dalam satu kenyataan minggu ini.
“Sebelum ini, tiada model bahasa besar yang pernah mencapai skor sempurna di bawah proses pengadilan rasmi IMO,” tambah syarikat itu, merujuk kepada teknologi yang menjadi teras kepada alatan AI seperti chatbot.
Pada tahun 2025, model-model buatan syarikat seperti Google dan OpenAI telah mencapai skor peringkat pingat emas buat kali pertama — namun masih belum mampu tandingi keupayaan lima peserta manusia yang memperoleh skor 100 peratus.
Tahun ini, seramai 666 peserta dari pelbagai negara telah mengambil bahagian di Shanghai.
Hanya tujuh daripada mereka yang berjaya memperoleh markah penuh, menurut papan skor rasmi IMO.
Peserta di IMO, yang dianjurkan di lokasi berbeza setiap tahun, mestilah berumur di bawah 20 tahun.
Huawei pada hari Rabu menyatakan bahawa sistem AI miliknya, “Celia”, telah menunjukkan “keupayaan penyelesaian masalah yang menyeluruh” merentasi pelbagai bidang matematik.
Xiaohongshu, yang dikenali sebagai RedNote dalam bahasa Inggeris, pula memaklumkan bahawa modelnya “dots-note-3.0” telah menyertai IMO buat kali pertama pada tahun ini.
Syarikat-syarikat teknologi hanya dibekalkan dengan soalan IMO selepas peserta manusia selesai menduduki peperiksaan tersebut, dengan penyerahan jawapan perlu dibuat dalam tempoh masa yang ditetapkan.
“Sewaktu ujian dijalankan, sebarang bentuk campur tangan manusia adalah dilarang sama sekali,” dan penyelesaian AI telah diserahkan kepada penganjur IMO untuk penilaian, kata Xiaohongshu.
Kemajuan AI berlaku dengan begitu pantas: pada IMO 2024, Google mencapai skor peringkat pingat perak dengan menyelesaikan empat daripada enam soalan dalam tempoh dua hingga tiga hari.
Deedy Das, rakan kongsi di syarikat pelaburan yang berpangkalan di AS, Menlo Ventures, berkata beliau sendiri telah memberikan soalan IMO tahun ini kepada empat model AI yang paling canggih.
Kesemua empat model tersebut — daripada makmal terkemuka AS iaitu OpenAI dan Anthropic, syarikat pemula Axiom Math, serta “Kimi K3” daripada syarikat China Moonshot AI — telah mendapat skor 42 mata daripada 42 mata, katanya di LinkedIn.
“Sempadan terhadapan AI (frontier of AI) secara rasminya telah jauh melampaui aras matematik IMO,” tulis Das.
– AFP
{suggest}
Huawei “Celia” Skor 100% Dalam Pertandingan Matematik Paling Sukar Di Dunia WISER.MY.