GLM-5.3-Flash, вероятно, справится с 45% ваших задач по искусственному интеллекту.
Парвез Сайед Мохамед
Неделю назад на OpenRouter появилась загадочная модель под названием Ox Alpha — ещё один участник среди более чем 400 моделей, причём примерно 10 новых запускаются каждую неделю. Её выделяла не только бесплатная цена; она была незаметно хороша. Любители и независимые разработчики быстро это заметили, ежедневно через неё проходило несколько триллионов токенов, а оценки сообщества за неделю варьировались от однозначных чисел до более чем 20 триллионов.
В течение следующих шести дней энтузиасты ИИ занимались анализом данных и гадали, кто мог создать этот продукт и у кого могла быть инфраструктура для бесплатного предоставления такого количества токенов. Сначала предполагали американскую лабораторию: долгожданный Gemini, или Anthropic, выпускающая достаточно хороший продукт среднего уровня, или Илон Маск, располагающий такими большими мощностями, что отказался от Ox Alpha (обратите внимание на название). Люди проводили трассировку токенизаторов и сетевой анализ. Настоящая неделя загадок Шерлока Холмса.
26 августа компания Z.ai зарегистрировала свой проект. Ox Alpha получил название GLM-5.3-Flash. Они намеренно запускали его на общедоступном трафике, но настоящим сюрпризом стало не то, насколько хороша оказалась модель (она действительно хороша). Проект полностью работал на китайских чипах и инфраструктуре. Цена составляет 15 центов / 50 центов за миллион токенов. В рамках акции OpenRouter действует скидка 50% — 7,5 центов / 25 центов — до 9 сентября. Весовые коэффициенты открыты (MIT), а вывод данных осуществляется Z.ai, а также GMI Cloud, Cloudflare и другими американскими поставщиками услуг вывода данных.
В тот же день компания Artificial Analysis включила эту модель в свой график соотношения интеллекта и стоимости. GLM-5.3-Flash занимает 57-е место в индексе, примерно по девять центов за задачу. Американский средний уровень, такой как GPT-5.6 Sol (max), находится около 59-го места, по цене 67 центов, что означает, что за два пункта интеллекта вы платите примерно в 7,4 раза больше. Далее, Grok 4.6 находится на 61-м месте, по цене 94 цента за задачу, или примерно в 10 раз больше за прирост в четыре пункта. На этом этапе экономика токенов сильно влияет на расчеты потребления. На верхнем уровне кривая выровнялась. Если мы клюнем на эту приманку с открытым весом, что произойдет с крупными инвестициями в инфраструктуру, которые мы сделали, не учитывая сильного китайского конкурента в области интеллекта?
Американские предприятия уже ощущают давление из-за роста затрат. Возьмем, к примеру, Uber. В апреле технический директор Правеен Неппалли Нага рассказал изданию The Information, что он «возвращается к исходной точке, потому что бюджет, который, как я думал, мне понадобится, уже исчерпан»: весь бюджет компании на разработку программного обеспечения на 2026 год был потрачен за четыре месяца, при этом Нага лично потратил 1200 долларов на одну двухчасовую демонстрацию. К июню Uber установил ограничение в 1500 долларов на человека за один инструмент. Инструменты были полезны, но полезность и ценность — это не одно и то же. Операционный директор Uber Эндрю Макдональд по-прежнему не мог провести параллель между этими панелями управления и «на 25% большим количеством полезных функций для потребителей».
Согласно опросу McKinsey «Состояние ИИ в 2026 году», 80% людей говорят, что они работают быстрее, 37% компаний получают некоторую прибыль до вычета налогов и процентов (EBIT), а 32% отказались как минимум от одной покупки программного обеспечения, потому что могли разработать эту функцию собственными силами с помощью программистов. Организации хотят сократить расходы. Они не могут позволить себе отказаться от ИИ. Задача сейчас — оптимизировать его использование во всей организации.
Мы не можем игнорировать китайских разработчиков моделей, таких как Zhipu, Qwen, DeepSeek и других. Они снова и снова демонстрируют свою изобретательность, бросая вызов современным лабораториям и снижая затраты. На OpenRouter китайские модели в начале июня обогнали американские по доле токенов, и вершина этого списка по-прежнему в основном состоит из китайских лабораторий. Мир независимых разработчиков уже выглядит как GLM Flash, DeepSeek Flash, MiniMax, Kimi, а иногда и Grok или Claude, если они уже оплатили дорогостоящую подписку. Если вы уже подписаны на Grok или OpenAI через свою компанию, это уже невозвратные затраты. Финансовый сектор начнет задаваться вопросом, имеют ли эти подписки смысл, если оплата по мере использования становится такой дешевой.
Итак, какие варианты остаются? Рассмотрите свою работу по программированию и агентской деятельности в трех категориях, разделенных по доле задач и токенов, обрабатываемых на каждом уровне — не в долларах, поскольку гораздо более низкая цена GLM-5.3-Flash за токен означает, что при равномерном распределении в долларах большая часть вашего объема уже будет направлена туда. На самом верху находятся Fable и Opus. Если вам нужно проанализировать сложную стратегию или написать подробный план выполнения, дополнительные баллы интеллекта имеют значение, и вам следует потратить максимальную сумму, но только на те редкие задачи, на которых нельзя экономить — вероятно, 5% от объема задач. Средний уровень — это Kimi K3, Gemini 3.7 Flash, GPT-5.6 Sol и Grok 4.6, все они имеют около 60 баллов по индексу интеллекта. Kimi — это мощный инструмент для программирования и любимец публики; Grok 4.6 — на втором месте, хотя его меньшее контекстное окно ограничивает его возможности. Вложите сюда около 50% объема. Что касается оставшихся 45%, настоятельно рекомендуем использовать GLM-5.3-Flash в качестве основного инструмента для обработки больших объемов данных. Ваша система инструментов, ваше сочетание (программирование, контент и маркетинг) и ваши оценки определят ваши собственные границы. Китайские модели с открытым исходным кодом позволят вам сэкономить деньги — и их необходимо учитывать в ваших расчетах затрат.
Сентябрь обещает стать месяцем новых моделей — Google, xAI, Anthropic, OpenAI и DeepSeek планируют выпустить свои релизы. Граница Парето может снова сдвинуться. Но направление уже определено: больше интеллекта за меньшие деньги. Лаборатории, которые не смогут снизить затраты на обслуживание, потеряют объем работы — а вместе с ним и аудиторию, которую этот объем создает.
Перед сентябрем нужно выполнить небольшое домашнее задание:
-
Подсчитайте свои токены . Можете ли вы соотнести расходы с каким-либо ключевым показателем, например, ростом числа клиентов или выручки? Если нет, то хотя бы с темпами разработки или производительностью? Без четких целей будет сложно обосновать расходы.
-
Пересмотрите свой бюджет на ИИ . Определите, какие расходы на ИИ запланированы для каждой организации? Смогут ли руководители подготовить и обосновать свои предложения?
-
Определите стратегию вашей модели для каждой команды. Выделите три уровня. Высокий уровень — для необратимых решений и стратегий. Средний уровень — для платной лицензии и ежедневного программирования. Низкий уровень (GLM-5.3-Flash) — для большого объема работы.
В следующем месяце модели снова станут дешевле. Ваши команды станут более амбициозными. Компании, которые выйдут из этой ситуации, будут делать ставки целенаправленно, и они не позволят этим агентам думать об Opus или Fable, если задача действительно того не стоит.
Парвез Сайед Мохамед — руководитель продуктового направления, занимавшийся разработкой платформ интеграции API и агентских систем в Salesforce (MuleSoft), Oracle и AgentPaaS.ai . Он работает над производственными агентскими системами. Некоторые из его мыслей о создании программного обеспечения с использованием агентов можно найти здесь: https://github.com/parvezsyed
Добро пожаловать в сообщество VentureBeat!
Наша программа гостевых публикаций — это площадка, где технические эксперты делятся своими знаниями и предоставляют нейтральные, непредвзятые аналитические материалы по искусственному интеллекту, инфраструктуре данных, кибербезопасности и другим передовым технологиям, формирующим будущее предприятий.
Узнайте больше о нашей программе гостевых публикаций — и ознакомьтесь с нашими рекомендациями, если вы заинтересованы в написании собственной статьи!
Источник: venturebeat.com
Похожие записи
Оцените материал:
Похожие записи
Используя искусственный интеллект: эффективная подготовка к экзамену
18.05.2026
Результаты третьей фазы клинических испытаний препарата Xenon для лечения эпилепсии превзошли все ожидания, акции компании взлетели.
10.03.2026
Смещенный генеральный директор Luminar Остин Рассел хочет купить компанию
17.10.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
