xAI выпустили новую флагманскую модель для кода и агентных задач….
xAI выпустили новую флагманскую модель для кода и агентных задач. И здесь интересен не ценник, а то, что за ним стоит
👀Что изменилось
⭐️ новая, более крупная базовая модель и более длинный цикл обучения с упором на сложные задачи, которые занимают часы
⭐️ лучше самопроверка и работа с длинным контекстом — то, что реально важно в рабочих процессах, а не в коротких запросах
⭐️ контекст 500 000 токенов, ввод текстом и картинками
⭐️ четыре уровня усилий: low, medium, high, xhigh — по умолчанию high
✨ Доступна в Cursor, Grok Build, Grok API, роутерах и облачных платформах
💎Цены
⭐️ до 200K токенов в запросе — $2 / $6 за млн, кэш $0.50
⭐️ свыше 200K — $4 / $12, кэш $1
⚡️Порог считается на каждый запрос. Длинная сессия, которая переползла за 200K, удваивает все три ставки разом
✨ Есть ещё Grok 4.7 Fast — вдвое быстрее за вдвое большую цену, но только в Cursor и Grok Build, в публичном API его нет
⌨️ Честно о результатах
⭐️ на собственной таблице xAI модель обходит Grok 4.6 во всех семи тестах и GPT-5.6 Sol Max — в четырёх
⭐️ ведёт на EEBench и юридическом бенчмарке Harvey
📌 уступает Fable 5.1 Max на CursorBench, Terminal-Bench, GDPval и HealthBench
📌 независимый индекс Artificial Analysis — 46, ниже Fable 5.1 и GPT-6 Astra (по 53)
✅ Хорошая новость: уровень галлюцинаций снизился с 34% до 29%
⚡️ Главный нюанс — многословность
Независимые замеры: Grok 4.7 тратит около 81 000 выходных токенов на задачу — против 36 000 у Grok 4.6 и 27 000 у GPT-6 Astra
✨ Цена за токен не изменилась. Но если модель думает вдвое дольше, задача, стоившая одну условную единицу, теперь стоит примерно две
✨ Независимая оценка стоимости задачи на xHigh — около $3.74. Это уже середина рынка, а не дешёвый вариант
❔ Кому подойдёт
✅ юридическим и инженерным задачам, где важны рассуждения и бюджет
✅ длинным агентным сценариям, где модель работает часами
👉 если нужен максимум в кодинге — Fable 5.1 и Opus 5.5 пока впереди
👉 если важна скорость — независимые тесты называют модель медленной
✨ Cursor оставили Grok 4.6 в меню — честный ход для тех, чьим задачам лишние размышления не нужны
💭 Вывод
Grok 4.7 — не рывок на вершину, а крепкая модель со своей нишей: там, где нужны длинные рассуждения при умеренном бюджете
И главный урок этого релиза: считайте не цену за токен, а стоимость выполненной задачи. Это не одно и то же
Похожие записи
Оцените материал:
Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
