🇺🇦 Українською · для роботи, навчання та бізнесу
До новин
DOU·
7 червня 2026 р. о 13:00

У одному з найскладніших бенчмарків для AI моделям просто треба грати в міні-ігри, але без мети та правил - їх вони повинні з'ясувати самостійно. Справа у тому, що люди зазвичай проходять цей тест на 100%, а ось у AI поки що не дуже видатні результати. Наприклад, Claude Opus 4.8 поставила рекорд серед інших моделей, набравши... 1,5%. 👉 https://dou.ua/goto/plkZ

У одному з найскладніших бенчмарків для AI моделям просто треба грати в міні-ігри, але без мети та правил - їх вони повинні з'ясувати самостійно. Справа у тому, що люди зазвичай проходять цей тест на 100%, а ось у AI поки що не дуже видатні результати. Наприклад, Claude Opus 4.8 поставила рекорд серед інших моделей, набравши... 1,5%. 👉 https://dou.ua/goto/plkZ
Читати повну статтю на DOU

Це короткий огляд. Натисніть кнопку вище, щоб прочитати оригінал.