Home Teknologi Kecerdasan buatan (AI) Huawei dan Xiaohongshu capai skor sempurna 100% di Olympiad...

Kecerdasan buatan (AI) Huawei dan Xiaohongshu capai skor sempurna 100% di Olympiad Matematik

0
0

Dua syarikat teknologi China, Huawei dan Xiaohongshu, mengumumkan pada 23 Julai bahawa model kecerdasan buatan (AI) mereka masing-masing memperoleh markah sempurna 100% dalam soalan yang diberikan kepada peserta manusia pada International Mathematical Olympiad (IMO) yang diadakan di Shanghai. Keputusan itu menandakan kali pertama AI mencapai skor penuh dalam pertandingan matematik antarabangsa yang berprestij.

Huawei berkata sistem AI mereka, Celia, mempamerkan “comprehensive problem-solving capabilities” merangkumi pelbagai bidang matematik. Xiaohongshu, yang dikenali sebagai RedNote dalam bahasa Inggeris, berkata modelnya dots-note-3.0 menyertai IMO buat pertama kali dan “kami gembira dengan keputusan ini,” sambil menambah sebelum ini tiada large language model yang pernah mencapai skor sempurna di bawah proses penghakiman rasmi IMO.

Menurut kedua-dua syarikat, penganjur IMO hanya menyediakan soalan kepada makmal AI selepas peserta manusia selesai mengambil peperiksaan. Model dikehendaki mengemukakan penyelesaian dalam had masa yang ditetapkan, dan “semasa ujian, sebarang bentuk campur tangan manusia adalah dilarang,” dengan penyelesaian AI dihantar kepada penganjur IMO untuk dinilai, menurut kenyataan Xiaohongshu.

Perincian pertandingan: tahun ini IMO mengumpulkan 666 peserta dari pelbagai negara, dan hanya tujuh daripada mereka mencapai markah penuh, menurut papan skor rasmi. Peraturan pertandingan juga menetapkan peserta mesti berumur di bawah 20 tahun.

Perkembangan ini mengukuhkan trend peningkatan prestasi AI dalam matematik kompetitif. Pada 2025, model-model dari Google dan OpenAI mencapai skor setaraf pingat emas untuk kali pertama tetapi masih belum menandingi lima peserta manusia yang memperoleh 100%. Pada 2024, Google merekodkan skor setaraf pingat perak dengan menyelesaikan empat daripada enam soalan dalam tempoh dua hingga tiga hari.

Deedy Das, rakan kongsi di Menlo Ventures yang berkata beliau sendiri memberikan soalan IMO tahun ini kepada empat model terkemuka, menulis di LinkedIn bahawa keempat-empat model — dari OpenAI, Anthropic, startup Axiom Math dan Kimi K3 dari Moonshot AI — mencatatkan 42 mata daripada 42. Dalam catatannya beliau menulis: “The frontier of AI has officially moved well past IMO math.”

Huawei dan Xiaohongshu antara makmal pertama mengumumkan pencapaian ini; penganalisis dan pihak penyelidikan lain mungkin mengeluarkan keputusan serupa dalam beberapa hari akan datang. Pengumuman ini sekali lagi menempatkan matematik kompetitif sebagai penanda aras bagi kebolehan pemecahan masalah lanjutan AI dan meningkatkan perbincangan mengenai batas keupayaan model bahasa besar dalam tugasan berstruktur tinggi.

LEAVE A REPLY

Please enter your comment!
Please enter your name here