НОВИНИ

Штучний інтелект не вміє грати в «Маріо» (поки що) — яка модель впоралась краще

Аудіо версія новини

Слухати

TechChrunch пише, що дослідники з Каліфорнійського університету в Сан-Дієго використовують гру Super Mario Bros. для тестування штучного інтелекту. Розповідаємо про результати дослідження.

Що сталося

Дослідники з Каліфорнійського університету в Сан-Дієго використовують гру Super Mario Bros. для тестування штучного інтелекту. Вони виявили, що ця гра є складнішим випробуванням для ШІ, ніж Pokеmon, в який штучний інтелект грав доволі повільно.

Для експерименту залучали різні моделі ШІ:

  • Claude 3.7;
  • Gemini 1.5 Pro;
  • GPT-4o;

Claude 3.7 показав найкращі результати, тоді як інші моделі мали труднощі.

Для тестування використовувалася модифікована версія гри, запущена в емуляторі та інтегрована з фреймворком GamingAgent. Цей фреймворк надавав ШІ базові інструкції та знімки екрана, а ШІ, своєю чергою, генерував код Python для керування Маріо.

У чому різниця між іграми

Дослідження показало, що моделі ШІ, які використовують покрокове міркування, показали гірші результати в цій грі, оскільки їм потрібен час для прийняття рішень, що є критичним фактором у Super Mario Bros. порівняно з Pokеmon.

Хоча ігри вже давно використовуються для тестування ШІ, досі немає чіткого зв’язку між ігровими навичками ШІ та реальним прогресом. Нібито ігри є абстрактними та спрощеними в порівнянні з реальним світом. Проте, експеримент з Super Mario Bros. дозволяє спостерігати за тим, як ШІ справляється зі складними завданнями в реальному часі.

ЧИТАЙТЕ ТАКОЖ

НОВИНИ
Ось, як виглядала транспортна система Римської імперії — відео

15 Листопада 2025, 18:00

КРЕАТИВ
Як українські СМО планують маркетинговий рік: головне з виступів на «Тактичній пʼятниці в КАМА»

15 Листопада 2025, 13:29

НОВИНИ
Ці 5 звичок прискорюють старіння мозку — дослідження

15 Листопада 2025, 09:00

НОВИНИ
Вчені виявили планету, на якій можуть існувати умови для життя

14 Листопада 2025, 18:04

НОВИНИ
Сем Альтман разом з чоловіком інвестують у створення «ідеального ембріона»

14 Листопада 2025, 17:10

НОВИНИ
Цей застосунок дає змогу «поспілкуватися» зі своїми померлими родичами — ось як

14 Листопада 2025, 16:13

НОВИНИ
OpenAI презентувала GPT-5.1 — ось, що потрібно знати про цю модель

14 Листопада 2025, 15:02

НОВИНИ
Cursor став одним із найдорожчих AI-стартапів — його оцінка зросла майже до $30 млрд

14 Листопада 2025, 14:01

НОВИНИ
У Tesla заявили, що 2026 стане найважчим роком для команди ШІ — вгадайте через що

14 Листопада 2025, 13:09

НОВИНИ
У NotebookLM нова фіча — він сам шукатиме джерела і формуватиме дослідницькі звіти

14 Листопада 2025, 11:27