czwartek, 23 lipca 2026

Nowości

Nie tylko RedNote: kolejne modele AI zdobywają komplet punktów na olimpiadzie matematycznej

ModelePatryk Raba
Nie tylko RedNote: kolejne modele AI zdobywają komplet punktów na olimpiadzie matematycznej
Fot. Z3144228, Wikimedia Commons (CC BY-SA 4.0)
Spis treści
  1. Test niezależny od producentów
  2. Huawei dokłada własny wynik
  3. Skala postępu w trzy lata
  4. Co to oznacza dla branży

Okazuje się, że wynik chińskiego RedNote, który jako pierwszy ogłosił komplet punktów na Międzynarodowej Olimpiadzie Matematycznej (IMO) 2026, nie był odosobnionym przypadkiem. Niezależny test przeprowadzony przez inwestora z Menlo Ventures pokazał, że dokładnie ten sam wynik, 42 na 42 punkty, osiągnęły też modele OpenAI, Anthropic, chińskiego Moonshot AI oraz startupu Axiom Math. Do tego doszedł system Celia od Huawei, który firma ogłosiła osobno.

Test niezależny od producentów

Kluczowa różnica względem wcześniejszego ogłoszenia RedNote polega na tym, skąd pochodzi informacja o kolejnych czterech modelach. Deedy Das, partner w funduszu Menlo Ventures, sam podał tegoroczne zadania IMO czterem czołowym modelom AI i sprawdził ich rozwiązania. Wszystkie cztery, modele OpenAI i Anthropic, startup Axiom Math oraz Kimi K3 od Moonshot AI, uzyskały maksymalny wynik.

Granica możliwości AI oficjalnie przesunęła się daleko poza matematykę na poziomie IMO - Deedy Das, partner, Menlo Ventures

To nieoficjalny test, inny niż proces, przez jaki przeszło RedNote, które zgłosiło swój wynik bezpośrednio jako uczestnik rundy dla systemów AI. Mimo to wynik jest spójny z tym, co ogłosiła firma, i pokazuje, że zdobycie kompletu punktów nie było jednorazowym osiągnięciem jednego zespołu, lecz zjawiskiem obejmującym kilku czołowych graczy branży naraz.

Huawei dokłada własny wynik

Osobno komplet punktów ogłosił też Huawei, którego system o nazwie Celia miał wykazać się, jak podano, wszechstronnymi zdolnościami rozwiązywania zadań z różnych działów matematyki. To już drugi chiński gigant technologiczny obok RedNote, który w tym roku deklaruje maksymalny wynik na IMO.

Model dots-note-3.0 od RedNote, spółki znanej z platformy Xiaohongshu, wziął udział w IMO po raz pierwszy i od razu zaliczył komplet punktów. Firma podkreśliła, że wcześniej żaden duży model językowy nie osiągnął pełnego wyniku w ramach oficjalnego procesu oceniania IMO, w którym liczy się nie tylko poprawna odpowiedź, ale rygorystyczny dowód bez błędów logicznych.

Skala postępu w trzy lata

Zestawienie wyników z ostatnich trzech edycji pokazuje tempo, w jakim modele językowe doganiały najlepszych ludzkich matematyków. W 2024 roku Google potrzebowało 2-3 dni, by rozwiązać 4 z 6 zadań, co odpowiadało wynikowi srebrnego medalu. Rok później modele Google i OpenAI osiągnęły już poziom złota, 35 punktów na 42, ale wciąż ustępowały pięciu ludzkim zawodnikom z kompletem punktów. W 2026 roku ta granica została przekroczona przez kilka systemów naraz.

Zawody IMO w Szanghaju zgromadziły 666 zawodników z różnych krajów, wszyscy poniżej 20. roku życia. Tylko siedmiu z nich zdobyło maksymalne 42 punkty, co pokazuje, jak trudne pozostają zadania olimpijskie nawet dla najzdolniejszych młodych matematyków na świecie.

Co to oznacza dla branży

Dla firm AI olimpiada matematyczna od lat pełni rolę nieformalnego testu granicznego, pokazującego zdolność modeli do wielokrotnego rozumowania i konstruowania dowodów, a nie tylko podawania gotowych odpowiedzi. Fakt, że w 2026 roku komplet punktów zdobyło jednocześnie sześć różnych systemów z laboratoriów w USA i Chinach, sugeruje, że zdolności matematyczne najlepszych modeli wyrównały się szybciej, niż wskazywały na to wyniki sprzed roku.

Warto zaznaczyć różnicę w wiarygodności ogłoszeń: wyniki RedNote i Huawei to oficjalne komunikaty samych firm, natomiast wyniki OpenAI, Anthropic, Axiom Math i Kimi K3 pochodzą z niezależnego testu przeprowadzonego przez inwestora, a nie z oficjalnego zgłoszenia tych laboratoriów do rundy AI przy IMO. Różnica metodologii nie zmienia jednak ogólnego obrazu, w którym granica ludzkich i maszynowych wyników na tym poziomie matematyki właśnie się zatarła.

Udostępnij: