Архив рубрики ~Лента новостей~

Расширение границ соотношения цены и производительности с помощью GPT-5.6 | OpenAI

Расширение границ соотношения цены и производительности с помощью GPT-5.6 | OpenAI
Расширение границ соотношения цены и производительности с помощью GPT-5.6 | OpenAI

Вчера мы рассказали о том, как GPT-5.6 повысил свою эффективность . Сегодня мы передаем эти преимущества клиентам, предлагая более низкие цены на GPT-5.6 Luna .(откроется в новом окне)и Терра(откроется в новом окне)а также более высокая производительность благодаря GPT-5.6 Sol в API. В совокупности эти обновления помогают клиентам извлекать больше пользы из каждого доллара, вложенного в ИИ, и действовать быстрее, когда время имеет значение .

Начиная с сегодняшнего дня, GPT-5.6 Luna, наша самая быстрая и доступная модель, будет стоить на 80% дешевле, а GPT-5.6 Terra, наша сбалансированная модель для повседневной работы, — на 20% дешевле. Снижение цен на Luna и Terra также отражается на том, как учитывается использование платных подписок при использовании Codex и ChatGPT Work. Luna предоставляет предприятиям гораздо более экономичный способ обработки больших объемов работы с очень высоким уровнем качества. Она может использовать инструменты и выполнять многоэтапные рабочие процессы, что делает более широкий спектр приложений ИИ практичным для масштабируемого применения.

Индекс искусственного интеллекта v4.1
Расширение границ соотношения цены и производительности с помощью GPT-5.6 | OpenAI
Расширение границ соотношения цены и производительности с помощью GPT-5.6 | OpenAI

Обеспечение доступности и широкого распространения передового интеллекта является важнейшей задачей OpenAI, направленной на то, чтобы общий искусственный интеллект приносил пользу всему человечеству. Эти изменения воплощают данное обязательство на практике. Они отражают многолетние улучшения в том, как создаются, предоставляются и используются наши модели.

Мы также вводим в API режим «Быстрая обработка» , который заменяет наше предложение «Приоритетная обработка». Для GPT-5.6 Sol режим «Быстрая обработка» теперь обеспечивает до 2,5 раз более высокую скорость, чем стандартная обработка, при вдвое большей цене, без изменения интеллектуальных функций. Режим «Быстрая обработка» обратно совместим: запросы с пометкой «Приоритетный» будут автоматически использовать режим «Быстрая обработка».

1 из 6

«GPT-5.6 Luna — это самая близкая к реальности интеллектуальная система, которую мы когда-либо встречали, настолько дешевая, что ее невозможно измерить. Я никогда не видел модели, настолько доступной по цене и обладающей такой мощностью — она открывает для Replit новые возможности, о которых мы долгое время и не ожидали .

Мишель Катаста, президент и руководитель отдела искусственного интеллекта, Replit

Сопоставление разведывательных данных с результатом

Эффективное использование ИИ начинается с результата. Ставки, стоимость ошибок, срочность и масштаб определяют правильный баланс интеллекта, скорости, надежности и стоимости. Этот баланс может меняться от одного этапа рабочего процесса к другому.

GPT-5.6 предоставляет компаниям гораздо больше возможностей для оптимизации этого уравнения. Luna демонстрирует производительность, сопоставимую с моделями, которые год назад считались передовыми, при стоимости примерно в 6 центов за доллар за задачу и почти в девять раз большей скорости. В профессиональной работе, согласно оценке Agents’ Last Exam, Luna превосходит Fable 5 при расчетной стоимости задачи почти на 99% ниже.

На практике компании могут определить необходимый результат и стандарт качества, а затем использовать оценки, чтобы определить, где дополнительные интеллектуальные функции существенно улучшают результат, а где более быстрая и дешевая обработка может обеспечить то же качество. Например, в рабочем процессе кодирования Sol может использоваться для разрешения неопределенностей и определения плана, а затем Luna — для внесения четко определенных изменений, написания и запуска тестов и оценки результатов. Другой рабочий процесс может потребовать иного баланса.

Семейство GPT-5.6 расширяет спектр этих возможностей. Предприятия могут применять максимум полезных интеллектуальных решений на каждом этапе, платя при этом справедливую цену за создаваемую ими ценность.

Обеспечение такой гибкости начинается с повышения эффективности каждого уровня, лежащего в основе моделей.

Как мы продвигаем границы эффективности

Наше преимущество в эффективности достигается за счет улучшения моделей, систем вывода, которые их запускают, и агентной инфраструктуры, которая связывает их с инструментами и контекстом. Модели GPT-5.6 выбирают более прямой путь выполнения работы. Улучшенная маршрутизация повышает производительность оборудования, оптимизированное производственное программное обеспечение генерирует токены более эффективно, а более интеллектуальное управление контекстом помогает агентам избегать повторного выполнения уже выполненной работы. В совокупности эти улучшения позволяют нам выполнять больше полезной работы с теми же вычислительными ресурсами, сокращая время, токены и затраты, необходимые для получения каждого результата.

GPT-5.6 Sol все больше помогает нам находить и внедрять следующие этапы повышения эффективности. В рамках управляемого человеком процесса Sol автономно переписал и оптимизировал производственные ядра, разработал и провел сотни экспериментов для улучшения генерации токенов, а также отслеживал обучение, вмешиваясь при возникновении проблем. Работа над ядром помогла снизить общую стоимость обслуживания модели на 20%, а эксперименты повысили эффективность генерации токенов более чем на 15%. Эта работа продолжается, создавая более тесную обратную связь: по мере улучшения наших моделей и повышения их автономности, наша способность повышать эффективность ускоряется. Подробнее об инженерных решениях, лежащих в основе GPT-5.6, читайте здесь .

Стратегия вычислений, разработанная для масштабируемости.

Для удовлетворения спроса на высокопроизводительные вычислительные ресурсы требуется как больше вычислительных мощностей, так и более производительные вычислительные ресурсы. Мы создаем отказоустойчивый портфель инфраструктуры и подбираем для каждой рабочей нагрузки системы, наиболее подходящие для ее выполнения. Такой подход поддерживает оба конца кривой соотношения цены и производительности. В нижнем ценовом сегменте новые цены на Luna и Terra делают экономически выгодными высокообъемные задачи в гораздо больших масштабах. В нижнем сегменте режим Fast обеспечивает клиентам API более быстрый доступ к Sol, когда время отклика имеет важное значение.

Предприятия могут внедрять больше ИИ в повседневные операции, не жертвуя скоростью выполнения наиболее важных задач. Крупномасштабный анализ документов, классификация взаимодействий с клиентами и рутинная реализация могут стать экономически выгодными в широком масштабе, в то время как сложные задачи в области солнечной энергетики могут выполняться быстрее, если это оправдано.

Преимущества могут накапливаться. В рамках процесса, управляемого человеком, более совершенные модели помогают нашей технической команде находить улучшения следующего поколения, сокращая путь к повышению производительности и снижению затрат. Наша стратегия по-прежнему сосредоточена на развитии как возможностей, так и эффективности, чтобы каждое поколение интеллекта могло выполнять больше работы с меньшими затратами.

Наличие и цены

GPT-5.6 Terra и Luna остаются доступными в ChatGPT Work, Codex и OpenAI API. В ChatGPT Work и Codex пользователи Free и Go могут получить доступ к Terra, а пользователи Plus, Pro, Business и Enterprise могут выбрать Terra и Luna.

Начиная с 30 июля, стоимость API для Terra составляет 2 доллара за миллион входных токенов и 12 долларов за миллион выходных токенов, а для Luna — 0,20 доллара за миллион входных токенов и 1,20 доллара за миллион выходных токенов. Цена Sol остается без изменений. Цены на подписку и квоты ChatGPT и Codex также остаются без изменений, в то время как использование Terra и Luna теперь потребляет меньше кредитов. Изменения в ценах начнут внедряться в AWS позже сегодня.

Быстрый режим для GPT-5.6 Sol заменяет приоритетную обработку в API и соответствует параметру /fast в Codex. Существующие запросы API с меткой «приоритет» будут продолжать работать. Полную информацию о ценах на API можно посмотреть здесь .

Источник

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Новости робототехники DoorDash получила сертификат FAA на реализацию собственной программы доставки дронами. Архив рубрики ~Коротко из Telegram~ В Сан-Франциско запускают уборку домов андроидами — но есть нюанс… Архив рубрики ~Коротко из Telegram~ Художница почти бросила Fallout-новеллу из-за ИИ — но Reddit её… Новости робототехники Как искусственный интеллект сокращает сроки разработки лекарств в Китае Архив рубрики ~Обо всем~ Теннант сокращает выбросы при использовании продукции на 30 процентов за счет расширения автономной розетки Архив рубрики ~Коротко из Telegram~ Американский стартап Veterans Recovery Network Inc. анонсировал концепт проекта «цифрового… Архив рубрики ~Коротко из Telegram~ Энергетики «нанимают» овец, а технологии спасают экосистему На пустынном плато… Архив рубрики ~Коротко из Telegram~ Подборку топовых курсов по ИИ от Microsoft нашли в сети… Архив рубрики ~Коротко из Telegram~ Roblox запускает Build Roblox анонсировал Build — новый AI-инструмент, встроенный прямо в… Архив рубрики ~Коротко из Telegram~ Microsoft представила два новых ИИ-движка: MAI Image 2.5 Pro и… Архив рубрики ~Коротко из Telegram~ Как тестируют ИИ-модели — и почему рейтингам верить с… Архив рубрики ~Коротко из Telegram~ Runway упростил жизнь контент-мейкерам: Media Router выбирает модель за вас… Архив рубрики ~Коротко из Telegram~ Suno подвинули от колонки — Google пару часов назад выкатили модель… Архив рубрики ~Коротко из Telegram~ Xiaomi представила свой «Range Rover» — внедорожник Skynomad N90 Max… Новости робототехники DoorDash получила сертификат FAA на реализацию собственной программы доставки дронами. Архив рубрики ~Коротко из Telegram~ В Сан-Франциско запускают уборку домов андроидами — но есть нюанс… Архив рубрики ~Коротко из Telegram~ Художница почти бросила Fallout-новеллу из-за ИИ — но Reddit её… Новости робототехники Как искусственный интеллект сокращает сроки разработки лекарств в Китае Архив рубрики ~Обо всем~ Теннант сокращает выбросы при использовании продукции на 30 процентов за счет расширения автономной розетки Архив рубрики ~Коротко из Telegram~ Американский стартап Veterans Recovery Network Inc. анонсировал концепт проекта «цифрового… Архив рубрики ~Коротко из Telegram~ Энергетики «нанимают» овец, а технологии спасают экосистему На пустынном плато… Архив рубрики ~Коротко из Telegram~ Подборку топовых курсов по ИИ от Microsoft нашли в сети… Архив рубрики ~Коротко из Telegram~ Roblox запускает Build Roblox анонсировал Build — новый AI-инструмент, встроенный прямо в… Архив рубрики ~Коротко из Telegram~ Microsoft представила два новых ИИ-движка: MAI Image 2.5 Pro и… Архив рубрики ~Коротко из Telegram~ Как тестируют ИИ-модели — и почему рейтингам верить с… Архив рубрики ~Коротко из Telegram~ Runway упростил жизнь контент-мейкерам: Media Router выбирает модель за вас… Архив рубрики ~Коротко из Telegram~ Suno подвинули от колонки — Google пару часов назад выкатили модель… Архив рубрики ~Коротко из Telegram~ Xiaomi представила свой «Range Rover» — внедорожник Skynomad N90 Max…

Оставить комментарий