Grok 4.7 сочетает в себе преимущества программирования с доступной ценой, но высокое потребление токенов угрожает реальной окупаемости инвестиций.
Карл Франзен
Компания SpaceXAI сегодня выпустила Grok 4.7, свою новейшую модель для работы с программированием и профессиональными знаниями, с улучшенными показателями в бенчмарках (особенно в тестах на программирование, или Terminal Bench), более длительным циклом обучения с подкреплением и новым стеком защиты, призванным повысить надежность системы при выполнении задач, которые могут занимать несколько часов.
Наиболее важным моментом для разработчиков, пожалуй, является то, что не изменилось: цена. Grok 4.7 начинается с 2/6 долларов США за 1 миллион токенов ввода/вывода, что соответствует ценам Grok 4.6, выпущенного чуть более месяца назад.
Однако для инженерных групп, решающих, какую модель использовать для маршрутизации агентских задач, более важным показателем может быть вовсе не скорость обработки токенов. Это стоимость успешного завершения задачи после подсчета токенов логического вывода, вызовов инструментов и длительных циклов работы агентов. Новое независимое тестирование Grok 4.7 делает это различие особенно важным.
Компания SpaceXAI также предлагает более быстрый вариант с увеличенной скоростью обработки токенов по цене в 2 раза выше ($4/$12), хотя она не опубликовала данные о количестве токенов в секунду, а независимые измерения пропускной способности на момент публикации еще не были доступны.
Таблица сравнения стоимости API на 1 миллион токенов по модели VentureBeat Frontier (краткий обзор — конец 2026 г.)
|
Модель |
Входные данные ($/1 млн) |
Объем производства ($/1 млн) |
Итого ($/1 млн) |
Источник |
|
Участник проекта Muse Spark 1.2 / 1.3 |
0,10 доллара |
0,20 доллара |
0,30 доллара |
Мета |
|
MiMo-V2.5 Flash |
0,10 доллара |
0,30 доллара |
0,40 доллара |
Xiaomi |
|
DeepSeek-V4.1-Flash — вне пикового времени |
0,15 доллара |
0,60 доллара |
0,75 доллара |
DeepSeek |
|
GPT-5.6 Луна |
0,20 доллара |
1,20 доллара |
1,40 доллара |
OpenAI |
|
МиниМакс-М3 |
0,30 доллара |
1,20 доллара |
1,50 доллара |
МиниМакс |
|
LongCat-2.0 — акция, действующая ограниченное время. |
0,30 доллара |
1,20 доллара |
1,50 доллара |
ЛонгКэт |
|
DeepSeek-V4.1-Flash — часы пик |
0,30 доллара |
1,20 доллара |
1,50 доллара |
DeepSeek |
|
MiMo-V2.5 |
0,40 доллара |
2,00 доллара |
2,40 доллара |
Xiaomi |
|
DeepSeek-V4-Pro — вне пиковой нагрузки |
0,66 доллара |
1,98 доллара |
2,64 доллара |
DeepSeek |
|
LongCat-2.0 — стандарт |
0,75 доллара |
2,95 доллара |
3,70 доллара |
ЛонгКэт |
|
MiMo-V2.5 Pro (≤256K) |
1,00 долл. |
3,00 доллара |
4,00 доллара |
Xiaomi |
|
Период действия календаря Близнецов 3.7 Flash — до 31 декабря 2026 года |
0,75 доллара |
3,75 доллара |
4,50 доллара |
|
|
Период действия календаря Gemini 3.8 Flash — до 31 декабря 2026 года |
0,75 доллара |
3,75 доллара |
4,50 доллара |
|
|
DeepSeek-V4-Pro — часы пик |
1,32 доллара |
3,96 доллара |
5,28 долларов |
DeepSeek |
|
Muse Spark 1.1 / 1.2 / 1.3 |
1,25 доллара |
4,25 доллара |
5,50 долларов |
Мета |
|
GLM-5.3 |
1,40 доллара |
4,40 доллара |
5,80 долларов |
З.АИ |
|
Grok 4.7 — ≤200 тыс. токенов подсказок |
2,00 доллара |
6,00 долларов |
8,00 долларов |
xAI |
|
MiMo-V2.5 Pro (>256K) |
2,00 доллара |
6,00 долларов |
8,00 долларов |
Xiaomi |
|
Qwen3.8-Max |
2,00 доллара |
6,00 долларов |
8,00 долларов |
QwenCloud |
|
Вспышка Gemini 3.7 — начиная с 1 января 2027 года |
1,50 доллара |
7,50 долларов |
9,00 долларов |
|
|
Вспышка Gemini 3.8 — начиная с 1 января 2027 года |
1,50 доллара |
7,50 долларов |
9,00 долларов |
|
|
GPT-5.6 Terra |
2,00 доллара |
12,00 долларов |
14,00 долларов |
OpenAI |
|
Grok 4.7 — >200 тыс. токенов подсказок |
4,00 доллара |
12,00 долларов |
16,00 долларов |
xAI |
|
Grok 4.7 Fast (Cursor) — ≤256K входных данных |
4,00 доллара |
12,00 долларов |
16,00 долларов |
Курсор |
|
ГПТ-5.4 |
2,50 доллара |
15,00 долларов |
17,50 долларов |
OpenAI |
|
Кими К3 |
3,00 доллара |
15,00 долларов |
18,00 долларов |
Moonshot AI |
|
Grok 4.7 Fast (Cursor) — ввод >256K, до 500K |
6,00 долларов |
18,00 долларов |
24,00 долларов |
Курсор |
|
Клод Опус 5 |
5,00 долларов |
25,00 долларов |
30,00 долларов |
Антропический |
|
Sakana Fugu Ultra (≤272K) |
5,00 долларов |
30,00 долларов |
35,00 долларов |
Сакана ИИ |
|
GPT-5.6 Sol — Стандартный режим |
5,00 долларов |
30,00 долларов |
35,00 долларов |
OpenAI |
|
Клод Басня 5 / Клод Мифос 5 |
10,00 долларов |
50,00 долларов |
60,00 долларов |
Антропический |
|
Басня Клода 5.1 / Мифос Клода 5.1 |
10,00 долларов |
50,00 долларов |
60,00 долларов |
Антропический |
|
GPT-6 Astra — Стандартный режим |
10,00 долларов |
50,00 долларов |
60,00 долларов |
OpenAI |
|
GPT-5.6 Sol — Быстрый режим |
10,00 долларов |
60,00 долларов |
70,00 долларов США |
OpenAI |
|
GPT-6 Astra — Быстрый режим |
20,00 долларов |
100,00 долларов США |
120,00 долларов США |
OpenAI |
Платформа для программирования ИИ Cursor, недавно приобретенная компанией SpaceXAI, также предлагает тарифный план Fast для Grok 4.7 по цене вдвое выше стандартной — 4/12 долларов за 1 миллион входных/выходных токенов — и делает Fast тарифным планом по умолчанию для планов Pro и выше.
Cursor не публикует данные о количестве токенов в секунду и не заявляет о точном двукратном увеличении пропускной способности. Для входных данных свыше 256 000 токенов Cursor взимает 4/12 долларов США за стандартный Grok 4.7 и 6/18 долларов США за Fast, до максимального контекстного окна модели в 500 000 токенов.
По данным SpaceXAI, модель уже доступна в Cursor, Grok Build и Grok API, а также через сторонние инструменты программирования, маршрутизаторы моделей и облачные платформы. GitHub постепенно внедряет Grok 4.7 в Copilot Pro, Pro+, Max, Business и Enterprise, поддерживая VS Code, Visual Studio, Copilot CLI, облачный агент GitHub, JetBrains, Xcode и Eclipse.
Это сочетание — более высокие заявленные возможности без повышения базовой цены токена — является сутью предложения SpaceXAI. В своих материалах для запуска компания описывает Grok 4.7 как свою самую мощную на сегодняшний день модель для программирования и работы с интеллектуальными данными, заявляя, что она может «дольше работать над сложными задачами» и более тщательно проверять свою работу.
Более крупная модель, обученная для работы, которая занимает несколько часов.
Компания SpaceXAI заявляет, что Grok 4.7 использует новую, более крупную базовую модель, чем Grok 4.6, и прошла более длительный цикл обучения с подкреплением, используя более сложное распределение задач, ориентированных на проблемы, выполнение которых занимает много часов. Компания также утверждает, что улучшила управление долговременным контекстом и обучила модель для еще более эффективной работы с недавно выпущенным компанией SpaceXAI роботом Grok Bot, ориентированным на агентный ИИ.
Такой акцент важен для предприятий, оценивающих модели как агентов, а не как интерфейсы для чата. Модель, способная оставаться сосредоточенной на задаче на протяжении длительного сеанса программирования, создавать документ, перемещаться по терминалу или выполнять многоэтапный бизнес-процесс, предъявляет иные операционные требования, чем модель, оптимизированная в первую очередь для выполнения отдельных запросов.
Grok 4.7 демонстрирует существенный прирост производительности по сравнению со своим предшественником в популярных сторонних бенчмарках, но все еще отстает от последних моделей от американских конкурентов OpenAI, Anthropic и даже Google.
|
Бенчмарк |
Грок 4.6 |
Грок 4.7 |
Улучшение |
|
Терминальный стенд 4.0 |
20,3% |
38,0% |
+17,7 процентных пунктов |
|
EEBench |
53,0% |
64,0% |
+11,0 баллов |
|
HealthBench Professional |
48,5% |
56,7% |
+8,2 балла |
|
CursorBench 4.0 |
40,4% |
46,3% |
+5,9 баллов |
|
DeepSWE v1.1 |
65,2% |
71,0% |
+5,8 баллов |
|
Harvey Legal Agent Benchmark |
15,8% |
19,6% |
+3,8 балла |
|
Портфель AA v1.1 |
1546 |
1657 |
+111 Эло |
|
ВВПвал |
1605 |
1695 |
+90 Эло |
И, как написал разработчик и автор Дэн МакАтир в своем посте на X, он «ужасно» показал себя в Terminal-Bench, тесте производительности терминала, в котором он продемонстрировал наибольшее общее улучшение по сравнению со своим предшественником.
Независимая компания по оценке моделей ИИ Artificial Analysis оценила Grok 4.7 при настройке уровня сложности «xHigh» примерно в 26% по сравнению с 59,6% у GPT-6 Astra xHigh от OpenAI и примерно 49% у Claude Opus 5 от Anthropic при максимальных усилиях.
В тесте CursorBench 4.0 Grok 4.7 при высоких показателях производительности (xHigh) набирает 46,3%, что выше показателя Grok 4.6 High (40,4%). В сравнении SpaceXAI, GPT-5.6 Sol Max набирает 41,7%, а Fable 5.1 Max достигает 51,8%. В DeepSWE v1.1 Grok 4.7 достигает 71,0%, по сравнению с 65,2% у Grok 4.6.
Тем не менее, другие были впечатлены релизом. Популярный пользователь X, специализирующийся на новостях об ИИ, @haider1, назвал показатели CursorBench «абсурдными», указав на Grok 4.7 xHigh с показателем 46,3% примерно за 6,01 доллара за задачу, против 46,8% за 7,05 доллара для Fable 5.1 Medium и 41,7% за 8,23 доллара для GPT-5.6 Sol Max в таблице лидеров, показанной в его посте. Он также отметил улучшение по сравнению с Grok 4.6 при примерно сопоставимой стоимости.
Дешевые токены не обязательно означают самую дешевую задачу.
В тестировании искусственного анализа теперь добавляется важное уточнение к истории с ценой продукта. Grok 4.7 xHigh использовал примерно 81 000 выходных токенов на одно задание по определению интеллекта, по сравнению с 36 000 для Grok 4.6 High и 27 000 для GPT-6 Astra Max.
По данным Artificial Analysis, это означает на 125% большее использование токенов, чем у Grok 4.6, и на 196% больше, чем у GPT-6 Astra.
Теперь в базе данных Artificial Analysis также представлены результаты расчета стоимости выполнения задачи в долларах: около 3,74 доллара за задачу по индексу интеллекта для Grok 4.7 xHigh и 2,73 доллара для Grok 4.7 High. Методология учитывает затраты на ввод данных, кэширование, рассуждения и токены ответов, а не просто сравнивает цены API. Для сравнения, аналогичное сравнение показывает, что GPT-5.6 Sol Max в настоящее время стоит около 1,99 доллара за задачу, несмотря на существенно более высокую цену ввода/вывода в размере 4/20 долларов.
Это переворачивает интуитивное понимание прайс-листа API. Модель, взимающая меньшую плату за токен, все равно может оказаться дороже для готовой рабочей нагрузки, если для ее обработки требуется значительно больше токенов. И эта разница быстро становится существенной в масштабах предприятия.
При опубликованных курсах $2/$6, нагрузка, потребляющая 10 миллиардов входных и 2 миллиарда выходных токенов каждый месяц, приведет к ежемесячным расходам в размере около $32 000, или $384 000 в год. При 50 миллиардах входных и 10 миллиардах выходных токенов те же курсы подразумевают около $160 000 в месяц, или $1,92 миллиона в год, до вычета комиссий, специфичных для платформы. Это иллюстративные расчеты объемов, а не оценки типичного развертывания Grok, но они показывают, почему эффективность токенов превращается в проблему бюджета инфраструктуры в производственном масштабе.
Для ведущего инженера вывод на утро понедельника очевиден: провести сравнительный анализ Grok 4.7 на репрезентативных внутренних задачах и отслеживать стоимость успешного завершения, потребление токенов, задержку, повторные попытки и необходимое вмешательство человека наряду со скоростью работы API.
Безопасность получает новый стек
Компания SpaceXAI также заявляет, что Grok 4.7 представляет собой совершенно новый комплекс мер безопасности, сообщая о результате в 62,4% по критерию биобезопасности LatchBio и о том, что модель допустила лишь 3,3% рискованных запросов двойного назначения в ходе оценки HackerBench v0.3. Это результаты, предоставленные компанией, и их следует рассматривать как таковые до проведения более широкого независимого тестирования.
Для инженерных команд, оценивающих Grok 4.7 в этом квартале, практическим критерием является не то, превосходит ли его курс API в $2/$6 конкурентов на бумаге. Важно то, выполняет ли модель реальные задачи по программированию и интеллектуальному труду организации с меньшими затратами, повторными попытками и вмешательствами инженеров. Результаты Grok 4.7 дают командам основание для проведения такой оценки; производственные тесты покажут, приведет ли низкая цена токена к снижению стоимости выполненной работы.

Источник: venturebeat.com
Похожие записи
Оцените материал:
Похожие записи
В OpenAI рассказали об утечке 53 изображений пользователей из-за действий ИИ-агентов
27.09.2026
По случаю, по принуждению, по желанию. Как и почему меняли фамилию в российской истории
27.09.2026
Подсказки и ответы из сегодняшнего выпуска NYT Connections: Sports Edition от 26 сентября, № 733.
27.09.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
