🌟 Epoch AI обновила оценку возможностей моделей через свой Epoch…
🌟 Epoch AI обновила оценку возможностей моделей через свой Epoch Capabilities Index. GPT-6 Astra сейчас получает 166 баллов — выше Claude Fable 5.1 с 164 и GPT-5.6 Sol с 162.
Особенно сильно Astra показывает себя в математике: её Math-ECI достиг 170 — это новый максимум. Но в программировании ситуация обратная: SWE-ECI Astra составляет 164 балла против 167 у Claude Fable 5.1.
🔥 Интересно и то, как меняется оценка после появления новых тестов. При запуске Astra получила 169 баллов, но после добавления результатов по программированию показатель снизился до 166. При этом Epoch AI отдельно предупреждает: по профильным направлениям пока мало бенчмарков, поэтому интервалы неопределённости довольно широкие.
Получается, одного общего рейтинга уже недостаточно — разные модели могут заметно отличаться в конкретных задачах.
Похожие записи
Оцените материал:
Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
