AI RADARМоделі
239•09.07.2026, 11:15•3 хв читання
OpenAI: SWE-Bench Pro більше не підходить для оцінки моделей
#OpenAI#benchmarks#AI models#SWE-Bench Pro

OpenAI оголосили, що SWE-Bench Pro має серйозні проблеми, які ставлять під сумнів його ефективність. Вони закликають до розробки нових бенчмарків для тестування моделей.
AI Radar • Рівень Plus
Повний інженерний розбір доступний для підписників Plus
Щоденні технічні огляди оновлень моделей, аналіз бенчмарків, практичні висновки та вайб-кодинг кейси відкриваються у підписці Plus.
Обговорити новину у спільноті
Діліться своїм досвідом та думками з ШІ-розробниками
Читайте також
Всі новиниМоделі295
OpenAI: внутрішня модель ШІ розв'язала понад 100 відкритих математичних задач за менш ніж місяць навчання
22.09.2026, 07:33
Моделі185
Xiaomi випустила MiMo-V2.6: нова відкрита модель ШІ, що перевершила конкурентів
22.09.2026, 04:54
Моделі223
Конспекти дослідниці OpenAI для підготовки до співбесід у AI
22.09.2026, 04:17