Архив рубрики ~Лента новостей~

Grok 4.7 сочетает в себе преимущества программирования с доступной ценой, но высокое потребление токенов угрожает реальной окупаемости инвестиций.

Grok 4.7 сочетает в себе преимущества программирования с доступной ценой, но высокое потребление токенов угрожает реальной окупаемости инвестиций.
Grok 4.7 сочетает в себе преимущества программирования с доступной ценой, но высокое потребление токенов угрожает реальной окупаемости инвестиций.

Карл Франзен

Компания SpaceXAI сегодня выпустила Grok 4.7, свою новейшую модель для работы с программированием и профессиональными знаниями, с улучшенными показателями в бенчмарках (особенно в тестах на программирование, или Terminal Bench), более длительным циклом обучения с подкреплением и новым стеком защиты, призванным повысить надежность системы при выполнении задач, которые могут занимать несколько часов.

Наиболее важным моментом для разработчиков, пожалуй, является то, что не изменилось: цена. Grok 4.7 начинается с 2/6 долларов США за 1 миллион токенов ввода/вывода, что соответствует ценам Grok 4.6, выпущенного чуть более месяца назад.

Однако для инженерных групп, решающих, какую модель использовать для маршрутизации агентских задач, более важным показателем может быть вовсе не скорость обработки токенов. Это стоимость успешного завершения задачи после подсчета токенов логического вывода, вызовов инструментов и длительных циклов работы агентов. Новое независимое тестирование Grok 4.7 делает это различие особенно важным.

Компания SpaceXAI также предлагает более быстрый вариант с увеличенной скоростью обработки токенов по цене в 2 раза выше ($4/$12), хотя она не опубликовала данные о количестве токенов в секунду, а независимые измерения пропускной способности на момент публикации еще не были доступны.

Таблица сравнения стоимости API на 1 миллион токенов по модели VentureBeat Frontier (краткий обзор — конец 2026 г.)

Модель

Входные данные ($/1 млн)

Объем производства ($/1 млн)

Итого ($/1 млн)

Источник

Участник проекта Muse Spark 1.2 / 1.3

0,10 доллара

0,20 доллара

0,30 доллара

Мета

MiMo-V2.5 Flash

0,10 доллара

0,30 доллара

0,40 доллара

Xiaomi

DeepSeek-V4.1-Flash — вне пикового времени

0,15 доллара

0,60 доллара

0,75 доллара

DeepSeek

GPT-5.6 Луна

0,20 доллара

1,20 доллара

1,40 доллара

OpenAI

МиниМакс-М3

0,30 доллара

1,20 доллара

1,50 доллара

МиниМакс

LongCat-2.0 — акция, действующая ограниченное время.

0,30 доллара

1,20 доллара

1,50 доллара

ЛонгКэт

DeepSeek-V4.1-Flash — часы пик

0,30 доллара

1,20 доллара

1,50 доллара

DeepSeek

MiMo-V2.5

0,40 доллара

2,00 доллара

2,40 доллара

Xiaomi

DeepSeek-V4-Pro — вне пиковой нагрузки

0,66 доллара

1,98 доллара

2,64 доллара

DeepSeek

LongCat-2.0 — стандарт

0,75 доллара

2,95 доллара

3,70 доллара

ЛонгКэт

MiMo-V2.5 Pro (≤256K)

1,00 долл.

3,00 доллара

4,00 доллара

Xiaomi

Период действия календаря Близнецов 3.7 Flash — до 31 декабря 2026 года

0,75 доллара

3,75 доллара

4,50 доллара

Google

Период действия календаря Gemini 3.8 Flash — до 31 декабря 2026 года

0,75 доллара

3,75 доллара

4,50 доллара

Google

DeepSeek-V4-Pro — часы пик

1,32 доллара

3,96 доллара

5,28 долларов

DeepSeek

Muse Spark 1.1 / 1.2 / 1.3

1,25 доллара

4,25 доллара

5,50 долларов

Мета

GLM-5.3

1,40 доллара

4,40 доллара

5,80 долларов

З.АИ

Grok 4.7 — ≤200 тыс. токенов подсказок

2,00 доллара

6,00 долларов

8,00 долларов

xAI

MiMo-V2.5 Pro (>256K)

2,00 доллара

6,00 долларов

8,00 долларов

Xiaomi

Qwen3.8-Max

2,00 доллара

6,00 долларов

8,00 долларов

QwenCloud

Вспышка Gemini 3.7 — начиная с 1 января 2027 года

1,50 доллара

7,50 долларов

9,00 долларов

Google

Вспышка Gemini 3.8 — начиная с 1 января 2027 года

1,50 доллара

7,50 долларов

9,00 долларов

Google

GPT-5.6 Terra

2,00 доллара

12,00 долларов

14,00 долларов

OpenAI

Grok 4.7 — >200 тыс. токенов подсказок

4,00 доллара

12,00 долларов

16,00 долларов

xAI

Grok 4.7 Fast (Cursor) — ≤256K входных данных

4,00 доллара

12,00 долларов

16,00 долларов

Курсор

ГПТ-5.4

2,50 доллара

15,00 долларов

17,50 долларов

OpenAI

Кими К3

3,00 доллара

15,00 долларов

18,00 долларов

Moonshot AI

Grok 4.7 Fast (Cursor) — ввод >256K, до 500K

6,00 долларов

18,00 долларов

24,00 долларов

Курсор

Клод Опус 5

5,00 долларов

25,00 долларов

30,00 долларов

Антропический

Sakana Fugu Ultra (≤272K)

5,00 долларов

30,00 долларов

35,00 долларов

Сакана ИИ

GPT-5.6 Sol — Стандартный режим

5,00 долларов

30,00 долларов

35,00 долларов

OpenAI

Клод Басня 5 / Клод Мифос 5

10,00 долларов

50,00 долларов

60,00 долларов

Антропический

Басня Клода 5.1 / Мифос Клода 5.1

10,00 долларов

50,00 долларов

60,00 долларов

Антропический

GPT-6 Astra — Стандартный режим

10,00 долларов

50,00 долларов

60,00 долларов

OpenAI

GPT-5.6 Sol — Быстрый режим

10,00 долларов

60,00 долларов

70,00 долларов США

OpenAI

GPT-6 Astra — Быстрый режим

20,00 долларов

100,00 долларов США

120,00 долларов США

OpenAI

Платформа для программирования ИИ Cursor, недавно приобретенная компанией SpaceXAI, также предлагает тарифный план Fast для Grok 4.7 по цене вдвое выше стандартной — 4/12 долларов за 1 миллион входных/выходных токенов — и делает Fast тарифным планом по умолчанию для планов Pro и выше.

Cursor не публикует данные о количестве токенов в секунду и не заявляет о точном двукратном увеличении пропускной способности. Для входных данных свыше 256 000 токенов Cursor взимает 4/12 долларов США за стандартный Grok 4.7 и 6/18 долларов США за Fast, до максимального контекстного окна модели в 500 000 токенов.

По данным SpaceXAI, модель уже доступна в Cursor, Grok Build и Grok API, а также через сторонние инструменты программирования, маршрутизаторы моделей и облачные платформы. GitHub постепенно внедряет Grok 4.7 в Copilot Pro, Pro+, Max, Business и Enterprise, поддерживая VS Code, Visual Studio, Copilot CLI, облачный агент GitHub, JetBrains, Xcode и Eclipse.

Это сочетание — более высокие заявленные возможности без повышения базовой цены токена — является сутью предложения SpaceXAI. В своих материалах для запуска компания описывает Grok 4.7 как свою самую мощную на сегодняшний день модель для программирования и работы с интеллектуальными данными, заявляя, что она может «дольше работать над сложными задачами» и более тщательно проверять свою работу.

Более крупная модель, обученная для работы, которая занимает несколько часов.

Компания SpaceXAI заявляет, что Grok 4.7 использует новую, более крупную базовую модель, чем Grok 4.6, и прошла более длительный цикл обучения с подкреплением, используя более сложное распределение задач, ориентированных на проблемы, выполнение которых занимает много часов. Компания также утверждает, что улучшила управление долговременным контекстом и обучила модель для еще более эффективной работы с недавно выпущенным компанией SpaceXAI роботом Grok Bot, ориентированным на агентный ИИ.

Такой акцент важен для предприятий, оценивающих модели как агентов, а не как интерфейсы для чата. Модель, способная оставаться сосредоточенной на задаче на протяжении длительного сеанса программирования, создавать документ, перемещаться по терминалу или выполнять многоэтапный бизнес-процесс, предъявляет иные операционные требования, чем модель, оптимизированная в первую очередь для выполнения отдельных запросов.

Grok 4.7 демонстрирует существенный прирост производительности по сравнению со своим предшественником в популярных сторонних бенчмарках, но все еще отстает от последних моделей от американских конкурентов OpenAI, Anthropic и даже Google.

Бенчмарк

Грок 4.6

Грок 4.7

Улучшение

Терминальный стенд 4.0

20,3%

38,0%

+17,7 процентных пунктов

EEBench

53,0%

64,0%

+11,0 баллов

HealthBench Professional

48,5%

56,7%

+8,2 балла

CursorBench 4.0

40,4%

46,3%

+5,9 баллов

DeepSWE v1.1

65,2%

71,0%

+5,8 баллов

Harvey Legal Agent Benchmark

15,8%

19,6%

+3,8 балла

Портфель AA v1.1

1546

1657

+111 Эло

ВВПвал

1605

1695

+90 Эло

И, как написал разработчик и автор Дэн МакАтир в своем посте на X, он «ужасно» показал себя в Terminal-Bench, тесте производительности терминала, в котором он продемонстрировал наибольшее общее улучшение по сравнению со своим предшественником.

Независимая компания по оценке моделей ИИ Artificial Analysis оценила Grok 4.7 при настройке уровня сложности «xHigh» примерно в 26% по сравнению с 59,6% у GPT-6 Astra xHigh от OpenAI и примерно 49% у Claude Opus 5 от Anthropic при максимальных усилиях.

В тесте CursorBench 4.0 Grok 4.7 при высоких показателях производительности (xHigh) набирает 46,3%, что выше показателя Grok 4.6 High (40,4%). В сравнении SpaceXAI, GPT-5.6 Sol Max набирает 41,7%, а Fable 5.1 Max достигает 51,8%. В DeepSWE v1.1 Grok 4.7 достигает 71,0%, по сравнению с 65,2% у Grok 4.6.

Тем не менее, другие были впечатлены релизом. Популярный пользователь X, специализирующийся на новостях об ИИ, @haider1, назвал показатели CursorBench «абсурдными», указав на Grok 4.7 xHigh с показателем 46,3% примерно за 6,01 доллара за задачу, против 46,8% за 7,05 доллара для Fable 5.1 Medium и 41,7% за 8,23 доллара для GPT-5.6 Sol Max в таблице лидеров, показанной в его посте. Он также отметил улучшение по сравнению с Grok 4.6 при примерно сопоставимой стоимости.

Дешевые токены не обязательно означают самую дешевую задачу.

В тестировании искусственного анализа теперь добавляется важное уточнение к истории с ценой продукта. Grok 4.7 xHigh использовал примерно 81 000 выходных токенов на одно задание по определению интеллекта, по сравнению с 36 000 для Grok 4.6 High и 27 000 для GPT-6 Astra Max.

По данным Artificial Analysis, это означает на 125% большее использование токенов, чем у Grok 4.6, и на 196% больше, чем у GPT-6 Astra.

Теперь в базе данных Artificial Analysis также представлены результаты расчета стоимости выполнения задачи в долларах: около 3,74 доллара за задачу по индексу интеллекта для Grok 4.7 xHigh и 2,73 доллара для Grok 4.7 High. Методология учитывает затраты на ввод данных, кэширование, рассуждения и токены ответов, а не просто сравнивает цены API. Для сравнения, аналогичное сравнение показывает, что GPT-5.6 Sol Max в настоящее время стоит около 1,99 доллара за задачу, несмотря на существенно более высокую цену ввода/вывода в размере 4/20 долларов.

Это переворачивает интуитивное понимание прайс-листа API. Модель, взимающая меньшую плату за токен, все равно может оказаться дороже для готовой рабочей нагрузки, если для ее обработки требуется значительно больше токенов. И эта разница быстро становится существенной в масштабах предприятия.

При опубликованных курсах $2/$6, нагрузка, потребляющая 10 миллиардов входных и 2 миллиарда выходных токенов каждый месяц, приведет к ежемесячным расходам в размере около $32 000, или $384 000 в год. При 50 миллиардах входных и 10 миллиардах выходных токенов те же курсы подразумевают около $160 000 в месяц, или $1,92 миллиона в год, до вычета комиссий, специфичных для платформы. Это иллюстративные расчеты объемов, а не оценки типичного развертывания Grok, но они показывают, почему эффективность токенов превращается в проблему бюджета инфраструктуры в производственном масштабе.

Для ведущего инженера вывод на утро понедельника очевиден: провести сравнительный анализ Grok 4.7 на репрезентативных внутренних задачах и отслеживать стоимость успешного завершения, потребление токенов, задержку, повторные попытки и необходимое вмешательство человека наряду со скоростью работы API.

Безопасность получает новый стек

Компания SpaceXAI также заявляет, что Grok 4.7 представляет собой совершенно новый комплекс мер безопасности, сообщая о результате в 62,4% по критерию биобезопасности LatchBio и о том, что модель допустила лишь 3,3% рискованных запросов двойного назначения в ходе оценки HackerBench v0.3. Это результаты, предоставленные компанией, и их следует рассматривать как таковые до проведения более широкого независимого тестирования.

Для инженерных команд, оценивающих Grok 4.7 в этом квартале, практическим критерием является не то, превосходит ли его курс API в $2/$6 конкурентов на бумаге. Важно то, выполняет ли модель реальные задачи по программированию и интеллектуальному труду организации с меньшими затратами, повторными попытками и вмешательствами инженеров. Результаты Grok 4.7 дают командам основание для проведения такой оценки; производственные тесты покажут, приведет ли низкая цена токена к снижению стоимости выполненной работы.

Опрос по корпоративной агентской оркестрации

Источник: venturebeat.com

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Коротко из Telegram~ Новость из Telegram 27.09.2026 08:55 Архив рубрики ~Коротко из Telegram~ Google добавила в Gemini 3.8 Live говорящий видеоаватар Gemini 3.8… Архив рубрики ~Коротко из Telegram~ Свежее исследование отечественных решений, способных заменить Zabbix. У CNewsMarket вышло… Архив рубрики ~Коротко из Telegram~ После запуска сетей 5G скорость мобильного интернета в России выросла… Архив рубрики ~Коротко из Telegram~ С 15 октября операторы могут начать блокировать звонки банков, которые… Архив рубрики ~Полезное~ Runway переехал прямо в монтажку. Больше не нужно бегать между… Архив рубрики ~Полезное~ Генератор рассказов, который кроме текста создает интерактивную карту мира с… Архив рубрики ~Полезное~ ИИ-Фигма сервис с нуля генерит готовые сайты. Stitch — ИИ-Фигма… Архив рубрики ~Полезное~ Осваиваем быстрее любые наввки Studley AI — Осваиваем любые навыки… Архив рубрики ~Коротко из Telegram~ Кринж ли встречаться с айтишниками? Ещё десять лет назад работа… Архив рубрики ~Коротко из Telegram~ Стартап ускоряет генераторы видео с помощью живых нейронов The Biological… Архив рубрики ~Коротко из Telegram~ Яндекс представил Алису AI Про — корпоративного ассистента с агентами… Архив рубрики ~Коротко из Telegram~ Умные холодильники Samsung превратились в кирпичи после обновления У Samsung… Архив рубрики ~Коротко из Telegram~ Samsung Labs выпустила Samsone — аудиомодели, которые работают прямо на… Архив рубрики ~Коротко из Telegram~ Новость из Telegram 27.09.2026 08:55 Архив рубрики ~Коротко из Telegram~ Google добавила в Gemini 3.8 Live говорящий видеоаватар Gemini 3.8… Архив рубрики ~Коротко из Telegram~ Свежее исследование отечественных решений, способных заменить Zabbix. У CNewsMarket вышло… Архив рубрики ~Коротко из Telegram~ После запуска сетей 5G скорость мобильного интернета в России выросла… Архив рубрики ~Коротко из Telegram~ С 15 октября операторы могут начать блокировать звонки банков, которые… Архив рубрики ~Полезное~ Runway переехал прямо в монтажку. Больше не нужно бегать между… Архив рубрики ~Полезное~ Генератор рассказов, который кроме текста создает интерактивную карту мира с… Архив рубрики ~Полезное~ ИИ-Фигма сервис с нуля генерит готовые сайты. Stitch — ИИ-Фигма… Архив рубрики ~Полезное~ Осваиваем быстрее любые наввки Studley AI — Осваиваем любые навыки… Архив рубрики ~Коротко из Telegram~ Кринж ли встречаться с айтишниками? Ещё десять лет назад работа… Архив рубрики ~Коротко из Telegram~ Стартап ускоряет генераторы видео с помощью живых нейронов The Biological… Архив рубрики ~Коротко из Telegram~ Яндекс представил Алису AI Про — корпоративного ассистента с агентами… Архив рубрики ~Коротко из Telegram~ Умные холодильники Samsung превратились в кирпичи после обновления У Samsung… Архив рубрики ~Коротко из Telegram~ Samsung Labs выпустила Samsone — аудиомодели, которые работают прямо на…

Оставить комментарий