Модель штучного інтелекту DeepseekMath-V2 досягла рівня золотої медалі на Міжнародній математичній олімпіаді

30 ноября 2025

Китайський стартап DeepSeek представив нову ШІ-модель DeepseekMath-V2, яка демонструє вражаючі результати при розв'язанні складних математичних задач. Алгоритм впорався з багатьма завданнями Міжнародної математичної олімпіади (IMO 2025) та Китайської математичної олімпіади (CMO 2024), показавши при цьому результат на рівні золотої медалі.

Джерело зображення: the-decoder.com

Джерело зображень: the-decoder.com

У повідомленні зазначено, що DeepseekMath-V2 набрала 118 з 120 балів у задачах Putnam, що суттєво вище найкращого результату людини в 90 балів. DeepSeek підкреслює, що раніше ШІ-моделі часто давали правильні відповіді на складні математичні задачі, але при цьому не демонстрували правильного ходу розв'язання. Для виправлення ситуації ШІ-модель використовує багатоетапний процес з окремим верифікатором для оцінки коректності кроків розв'язання задачі та необхідності їх переперевірки. Така структура дозволяє алгоритму перевіряти та вдосконалювати свої рішення в режимі реального часу.

З технічної точки зору DeepseekMath-V2 побудована на основі базової моделі Deepseek-V3.2-Exp-Base. У описі DeepSeek жодного разу не згадується використання зовнішніх інструментів, таких як калькулятори чи інтерпретатори коду. У ключових експериментах одна й та ж модель DeepseekMath-V2 використовується як для генерації доказів, так і для їх перевірки. Висока продуктивність алгоритму обумовлена здатністю критикувати та покращувати власні висновки замість того, щоб залучати зовнішнє програмне забезпечення. Для розв'язання більш складних задач модель нарощує обчислювальні потужності на етапі тестування, паралельно створюючи та перевіряючи безліч можливих доказів, щоб підвищити рівень впевненості в правильності кінцевої відповіді.

Реліз DeepSeek відбувся після анонсу ще не випущених ШІ-моделей OpenAI та Google Deepmind, які досягли схожих результатів у розв'язанні складних математичних задач. Примітно, що ці алгоритми досягли такого результату завдяки здатності до міркування, а не цільовій оптимізації для математичних олімпіад. Якщо насправді успіхи цих алгоритмів виявляться такими вражаючими, це означатиме, що мовні моделі наблизилися до моменту, коли вони зможуть розв'язувати складні, абстрактні задачі, що традиційно вважалося виключно людським умінням.

Зазначимо, що рішення DeepSeek розкрити технічні деталі моделі DeepseekMath-V2 різко контрастує з секретністю, яку дотримуються Google та OpenAI. Американські компанії тримають у таємниці деталі архітектури власних ШІ-моделей, тоді як китайський стартап буквально розкриває всі карти, наочно демонструючи, що компанія йде в ногу з провідними представниками галузі.

Хочеш дізнатися більше — читай відгуки

← Вернуться на предыдущую страницу

Читайте также:

Консервовані овочі можуть бути і шкідливими, і корисними 10 сентября 2026

Лікар: іноді консервовані овочі є не менш корисними для здоров’я, ніж свіжі. Медик нагадала в…

Комета 3I/ATLAS прибула з екзотичної інопланетної системи, що виникла задовго до Сонячної 10 сентября 2026

Міжзоряна комета 3I/ATLAS стала третім підтвердженим міжзоряним об'єктом, зафіксованим астрономами, поряд з 1I/Oumuamua та 2I/Borisov. 3I/ATLAS виявилася надзвичайно яскравою та хімічно унікальною, надавши дослідникам рідкісну можливість заглянути в процеси формування планет і крижаних тіл навколо далеких зірок. На думку вчених, комета може бути вдвічі старшою за Сонячну систему, вік якої становить 4,6 мільярда років.

Одна з найбільших арабських авіакомпаній скасувала рейси до Росії 9 сентября 2026

Скасування рейсів Air Arabia відбулося після заяви президента України Володимира Зеленського про небезпеку польотів над Росією.

 

Вас могут заинтересовать эти отзывы

Бандик О.А. 5.0
Бандик О.А.

Отзывов: 1

Каталог отзывов





×

Выберите область поиска

  • Авто
  • Одяг / аксесуари
  • Роботодавці
  • Інше