Расширение границ соотношения цены и производительности с помощью GPT-5.6 | OpenAI
Вчера мы рассказали о том, как GPT-5.6 повысил свою эффективность . Сегодня мы передаем эти преимущества клиентам, предлагая более низкие цены на GPT-5.6 Luna .(откроется в новом окне)и Терра(откроется в новом окне)а также более высокая производительность благодаря GPT-5.6 Sol в API. В совокупности эти обновления помогают клиентам извлекать больше пользы из каждого доллара, вложенного в ИИ, и действовать быстрее, когда время имеет значение .
Начиная с сегодняшнего дня, GPT-5.6 Luna, наша самая быстрая и доступная модель, будет стоить на 80% дешевле, а GPT-5.6 Terra, наша сбалансированная модель для повседневной работы, — на 20% дешевле. Снижение цен на Luna и Terra также отражается на том, как учитывается использование платных подписок при использовании Codex и ChatGPT Work. Luna предоставляет предприятиям гораздо более экономичный способ обработки больших объемов работы с очень высоким уровнем качества. Она может использовать инструменты и выполнять многоэтапные рабочие процессы, что делает более широкий спектр приложений ИИ практичным для масштабируемого применения.

Обеспечение доступности и широкого распространения передового интеллекта является важнейшей задачей OpenAI, направленной на то, чтобы общий искусственный интеллект приносил пользу всему человечеству. Эти изменения воплощают данное обязательство на практике. Они отражают многолетние улучшения в том, как создаются, предоставляются и используются наши модели.
Мы также вводим в API режим «Быстрая обработка» , который заменяет наше предложение «Приоритетная обработка». Для GPT-5.6 Sol режим «Быстрая обработка» теперь обеспечивает до 2,5 раз более высокую скорость, чем стандартная обработка, при вдвое большей цене, без изменения интеллектуальных функций. Режим «Быстрая обработка» обратно совместим: запросы с пометкой «Приоритетный» будут автоматически использовать режим «Быстрая обработка».
«GPT-5.6 Luna — это самая близкая к реальности интеллектуальная система, которую мы когда-либо встречали, настолько дешевая, что ее невозможно измерить. Я никогда не видел модели, настолько доступной по цене и обладающей такой мощностью — она открывает для Replit новые возможности, о которых мы долгое время и не ожидали .

Сопоставление разведывательных данных с результатом
Эффективное использование ИИ начинается с результата. Ставки, стоимость ошибок, срочность и масштаб определяют правильный баланс интеллекта, скорости, надежности и стоимости. Этот баланс может меняться от одного этапа рабочего процесса к другому.
GPT-5.6 предоставляет компаниям гораздо больше возможностей для оптимизации этого уравнения. Luna демонстрирует производительность, сопоставимую с моделями, которые год назад считались передовыми, при стоимости примерно в 6 центов за доллар за задачу и почти в девять раз большей скорости. В профессиональной работе, согласно оценке Agents’ Last Exam, Luna превосходит Fable 5 при расчетной стоимости задачи почти на 99% ниже.
На практике компании могут определить необходимый результат и стандарт качества, а затем использовать оценки, чтобы определить, где дополнительные интеллектуальные функции существенно улучшают результат, а где более быстрая и дешевая обработка может обеспечить то же качество. Например, в рабочем процессе кодирования Sol может использоваться для разрешения неопределенностей и определения плана, а затем Luna — для внесения четко определенных изменений, написания и запуска тестов и оценки результатов. Другой рабочий процесс может потребовать иного баланса.
Семейство GPT-5.6 расширяет спектр этих возможностей. Предприятия могут применять максимум полезных интеллектуальных решений на каждом этапе, платя при этом справедливую цену за создаваемую ими ценность.
Обеспечение такой гибкости начинается с повышения эффективности каждого уровня, лежащего в основе моделей.
Как мы продвигаем границы эффективности
Наше преимущество в эффективности достигается за счет улучшения моделей, систем вывода, которые их запускают, и агентной инфраструктуры, которая связывает их с инструментами и контекстом. Модели GPT-5.6 выбирают более прямой путь выполнения работы. Улучшенная маршрутизация повышает производительность оборудования, оптимизированное производственное программное обеспечение генерирует токены более эффективно, а более интеллектуальное управление контекстом помогает агентам избегать повторного выполнения уже выполненной работы. В совокупности эти улучшения позволяют нам выполнять больше полезной работы с теми же вычислительными ресурсами, сокращая время, токены и затраты, необходимые для получения каждого результата.
GPT-5.6 Sol все больше помогает нам находить и внедрять следующие этапы повышения эффективности. В рамках управляемого человеком процесса Sol автономно переписал и оптимизировал производственные ядра, разработал и провел сотни экспериментов для улучшения генерации токенов, а также отслеживал обучение, вмешиваясь при возникновении проблем. Работа над ядром помогла снизить общую стоимость обслуживания модели на 20%, а эксперименты повысили эффективность генерации токенов более чем на 15%. Эта работа продолжается, создавая более тесную обратную связь: по мере улучшения наших моделей и повышения их автономности, наша способность повышать эффективность ускоряется. Подробнее об инженерных решениях, лежащих в основе GPT-5.6, читайте здесь .
Стратегия вычислений, разработанная для масштабируемости.
Для удовлетворения спроса на высокопроизводительные вычислительные ресурсы требуется как больше вычислительных мощностей, так и более производительные вычислительные ресурсы. Мы создаем отказоустойчивый портфель инфраструктуры и подбираем для каждой рабочей нагрузки системы, наиболее подходящие для ее выполнения. Такой подход поддерживает оба конца кривой соотношения цены и производительности. В нижнем ценовом сегменте новые цены на Luna и Terra делают экономически выгодными высокообъемные задачи в гораздо больших масштабах. В нижнем сегменте режим Fast обеспечивает клиентам API более быстрый доступ к Sol, когда время отклика имеет важное значение.
Предприятия могут внедрять больше ИИ в повседневные операции, не жертвуя скоростью выполнения наиболее важных задач. Крупномасштабный анализ документов, классификация взаимодействий с клиентами и рутинная реализация могут стать экономически выгодными в широком масштабе, в то время как сложные задачи в области солнечной энергетики могут выполняться быстрее, если это оправдано.
Преимущества могут накапливаться. В рамках процесса, управляемого человеком, более совершенные модели помогают нашей технической команде находить улучшения следующего поколения, сокращая путь к повышению производительности и снижению затрат. Наша стратегия по-прежнему сосредоточена на развитии как возможностей, так и эффективности, чтобы каждое поколение интеллекта могло выполнять больше работы с меньшими затратами.
Наличие и цены
GPT-5.6 Terra и Luna остаются доступными в ChatGPT Work, Codex и OpenAI API. В ChatGPT Work и Codex пользователи Free и Go могут получить доступ к Terra, а пользователи Plus, Pro, Business и Enterprise могут выбрать Terra и Luna.
Начиная с 30 июля, стоимость API для Terra составляет 2 доллара за миллион входных токенов и 12 долларов за миллион выходных токенов, а для Luna — 0,20 доллара за миллион входных токенов и 1,20 доллара за миллион выходных токенов. Цена Sol остается без изменений. Цены на подписку и квоты ChatGPT и Codex также остаются без изменений, в то время как использование Terra и Luna теперь потребляет меньше кредитов. Изменения в ценах начнут внедряться в AWS позже сегодня.
Быстрый режим для GPT-5.6 Sol заменяет приоритетную обработку в API и соответствует параметру /fast в Codex. Существующие запросы API с меткой «приоритет» будут продолжать работать. Полную информацию о ценах на API можно посмотреть здесь .
Похожие записи
- COPA-DATA инвестирует 15 миллионов евро в проведение штаб-квартир исследований и разработок в Зальцбурге
- Судья заявил, что у администрации Трампа по-прежнему нет доказательств для присвоения антропогенному фактору статуса «риска в цепочке поставок».
- Концепция Science One: проверяемая автономная исследовательская модель на основе цепочки доказательств.
Оцените материал:
Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
