Архив рубрики ~Лента новостей~

«Бесплатный» Kimi K3 может потребовать железа на миллионы рублей. Так за что мы вообще платим нейросетям?

«Бесплатный» Kimi K3 может потребовать железа на миллионы рублей. Так за что мы вообще платим нейросетям?
«Бесплатный» Kimi K3 может потребовать железа на миллионы рублей. Так за что мы вообще платим нейросетям?

За последние годы мы привыкли к простой модели: хотите хороший ИИ — оформляете подписку.

ChatGPT, Claude, Perplexity и другие сервисы продают расширенные лимиты, доступ к более сильным моделям и дополнительным инструментам.

А потом появляется Kimi K3. И занимает Топ 2 в вопросе какая нейросеть самая мощная?

Модель с открытыми весами, 2,8 трлн параметров и контекстом до 1 млн токенов. На отдельных тестах K3 показывает результаты на уровне сильнейших закрытых моделей и иногда их обходит.

И в интернете закономерно появляются заголовки примерно одного содержания:

«Бесплатная нейросеть обошла ChatGPT и Claude».

Технически в этой фразе есть доля истины.

Практически — она создаёт совершенно неправильное впечатление.

Kimi открытый. Но это не значит, что вычисления бесплатные

Moonshot AI действительно опубликовала веса Kimi K3. Их можно получить и развернуть самостоятельно. Репозиторий и модель распространяются по лицензии Kimi K3.

То есть между Kimi и полностью закрытой моделью действительно есть принципиальная разница.

Но дальше начинается физика.

У Kimi K3 2,8 трлн параметров. Модель использует MXFP4-веса.

Если очень грубо посчитать объём хранения 2,8 трлн параметров при четырёх битах на параметр, получаем около: 1,4 ТБ.

И это только сами веса модели.

Без нормального запаса под остальные компоненты инференса, контекст и инфраструктуру.

Давайте попробуем собрать «бесплатный Kimi» дома

Возьмём понятную всем RTX 5090. У неё 32 ГБ видеопамяти.

Чтобы получить теоретические 1,4 ТБ VRAM:

1 400 / 32 ≈ 44 видеокарты.

Конечно, никто не предлагает собирать рабочий сервер Kimi K3 именно из 44 RTX 5090. Такая система сама по себе была бы инженерным кошмаром.

Это просто хороший способ почувствовать масштаб модели.

Тем более что в середине 2026 года RTX 5090 продаётся на рынке уже более чем за $4 200.

44 × $4 200 = $184 800.

При официальном курсе Банка России около 82,17 ₽ за доллар на 10 августа это примерно: 15,2 млн рублей.

И мы ещё не купили процессоры, платы, память, накопители, питание, сеть, стойки и охлаждение.

Вот за что на самом деле берёт деньги ChatGPT

Когда мы покупаем ChatGPT Plus или другую облачную подписку, мы часто психологически воспринимаем это так:

«Отдал деньги за доступ к нейросети».

На самом деле мы покупаем гораздо больше.

Где-то в дата-центре уже:

— купили GPU;

— построили инфраструктуру;

— провели сеть;

— обеспечили электропитание;

— организовали охлаждение;

— настроили распределённый инференс;

— оптимизировали модель;

— следят за отказами;

— масштабируют мощности в часы пик.

А пользователь просто открывает браузер и пишет:

«Составь мне коммерческое предложение» или «Сгенерируй котика»

Это и есть продукт. Не файл модели. А готовое вычисление как сервис.

И Kimi работает точно по той же экономике

Сам факт публикации весов не мешает Moonshot зарабатывать на Kimi.

Компания предоставляет собственный облачный сервис и коммерческий API.

Для Kimi K3 сейчас заявлена тарификация API: $0,30 за 1 млн cached input tokens, $3 за 1 млн обычных входных токенов и $15 за 1 млн выходных токенов.

И здесь нет никакого противоречия.

Можно бесплатно получить технологию.

Но кто-то всё равно должен заплатить за её выполнение.

С Linux примерно та же логика: операционная система может быть бесплатной, но сервер в дата-центре почему-то никто бесплатно не выдаёт.

Значит ли это, что открытые модели бессмысленны?

Наоборот.

Для компаний возможность запустить модель внутри собственной инфраструктуры может быть огромным преимуществом.

Например, когда критичны:

— контроль данных;

— приватность;

— интеграция со своей инфраструктурой;

— массовый API-инференс;

— дообучение;

— отсутствие зависимости от одного облачного поставщика.

При больших объёмах собственная инфраструктура действительно может оказаться экономически выгоднее API.

Но для обычного пользователя арифметика совершенно другая.

Если человеку нужно написать статью, разобрать договор, проанализировать Excel или помочь с кодом, покупка облачной подписки почти всегда рациональнее строительства собственного мини-дата-центра.

Тогда какой ИИ покупать?

Вот здесь рынок наконец становится интересным.

Вопрос «какая нейросеть самая мощная?» постепенно теряет смысл.

Сегодня правильнее спрашивать:

какая модель лучше решает мою конкретную задачу за приемлемые деньги?

Одному нужен ChatGPT.

Другому — Claude для работы с кодом и текстами.

Третьему — Perplexity для поиска.

Четвёртому действительно будет достаточно Kimi.

А разработчику иногда вообще выгоднее платить за API по фактическому использованию.

Универсального победителя здесь нет.

Остаётся проблема оплаты

Для российского пользователя появляется дополнительный слой: даже если нужный зарубежный сервис выбран, оплатить его российской картой зачастую проблематично.

И здесь уже начинается наша работа в YouKey AI.

Мы помогаем получать доступ и оплачивать зарубежные AI-сервисы, включая популярные подписки:

1www.youkeyai.comyoukey — премиум-доступ к нейросетям

Но есть ещё одна проблема, которая мне кажется даже интереснее оплаты.

Можно купить самую дорогую модель и продолжать получать плохие ответы

Пользователь оформляет подписку, открывает новый мощный ИИ и пишет:

«Проанализируй мой бизнес и предложи стратегию роста».

Получает десять красивых пунктов.

Читает.

И понимает, что половину из этого можно было написать без нейросети.

Потому что качество модели и качество задания модели — разные вещи.

Именно поэтому мы отдельно собираем библиотеку готовых промптов для маркетинга, контента, продаж, бизнеса, обучения и повседневных задач:

Открыть базу готовых запросов (промптов) для ИИ

Чтобы после покупки доступа к ИИ не начинать каждый диалог с:

«Ты эксперт с двадцатилетним опытом…»

Вывод

Kimi K3 — отличный пример того, куда движется рынок.

Очень мощные модели становятся открытыми. Конкуренция растёт. Стоимость интеллекта снижается.Стоимость интеллекта снижается. Но стоимость вычислений никуда не исчезает.

Поэтому фраза:

«Зачем платить за ChatGPT, если Kimi бесплатный?»

звучит примерно как:

«Зачем платить за такси, если чертежи автомобиля можно бесплатно скачать из интернета?»

Чертежи действительно бесплатные. Теперь осталось построить автомобиль.

Спасибо за внимание.
Следите за новостями в нашем ТГ

1t.meYoukey AI Lab

Источник: vc.ru

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Коротко из Telegram~ Wildberries & Russ тестирует собственный мессенджер, который изначально создавался как… Архив рубрики ~Коротко из Telegram~ 🎬 Alibaba выкатила Wan 3.0 Вслед за Wan 2.7, которая давала… Архив рубрики ~Коротко из Telegram~ Научный директор Google рассказал 6000 человек, чем стоит заняться в… Архив рубрики ~Коротко из Telegram~ Alibaba выкатила Wan 3.0 Вслед за Wan 2.7, которая давала… Архив рубрики ~Коротко из Telegram~ Про слухи о превращении «Госуслуг» в мессенджер. Глава Минцифры Максут… Архив рубрики ~Коротко из Telegram~ Firecrawl выпустила сверхбыстрый PDF-парсер Новый инструмент обрабатывает страницу примерно за… Архив рубрики ~Полезное~ GitHub случайно превратился в склад бесплатных API-ключей — вайбкодеры продолжают забывать… Архив рубрики ~Коротко из Telegram~ Похоже, OpenAI заранее строит инфраструктуру для безопасного выпуска GPT‑6 и… Архив рубрики ~Коротко из Telegram~ Wildberries & Russ тестирует собственный мессенджер, который изначально создавался как… Новости робототехники VicOne выпускает бесплатное расширение кибербезопасности NVIDIA Isaac Sim на основе исследования DEF CON 34 Архив рубрики ~Обо всем~ Невероятно быстрый алгоритм нахождения простых делителей огромных составных чисел Архив рубрики ~Коротко из Telegram~ Grok Imagine Video 1.5 — разбираем полностью Мы уже упоминали… Архив рубрики ~Обо всем~ Забытые воспоминания могут оставлять в мозге безмолвные следы Архив рубрики ~Коротко из Telegram~ OpenAI совместно с Джони Айвом разрабатывают умную колонку без дисплея, размером… Архив рубрики ~Коротко из Telegram~ Wildberries & Russ тестирует собственный мессенджер, который изначально создавался как… Архив рубрики ~Коротко из Telegram~ 🎬 Alibaba выкатила Wan 3.0 Вслед за Wan 2.7, которая давала… Архив рубрики ~Коротко из Telegram~ Научный директор Google рассказал 6000 человек, чем стоит заняться в… Архив рубрики ~Коротко из Telegram~ Alibaba выкатила Wan 3.0 Вслед за Wan 2.7, которая давала… Архив рубрики ~Коротко из Telegram~ Про слухи о превращении «Госуслуг» в мессенджер. Глава Минцифры Максут… Архив рубрики ~Коротко из Telegram~ Firecrawl выпустила сверхбыстрый PDF-парсер Новый инструмент обрабатывает страницу примерно за… Архив рубрики ~Полезное~ GitHub случайно превратился в склад бесплатных API-ключей — вайбкодеры продолжают забывать… Архив рубрики ~Коротко из Telegram~ Похоже, OpenAI заранее строит инфраструктуру для безопасного выпуска GPT‑6 и… Архив рубрики ~Коротко из Telegram~ Wildberries & Russ тестирует собственный мессенджер, который изначально создавался как… Новости робототехники VicOne выпускает бесплатное расширение кибербезопасности NVIDIA Isaac Sim на основе исследования DEF CON 34 Архив рубрики ~Обо всем~ Невероятно быстрый алгоритм нахождения простых делителей огромных составных чисел Архив рубрики ~Коротко из Telegram~ Grok Imagine Video 1.5 — разбираем полностью Мы уже упоминали… Архив рубрики ~Обо всем~ Забытые воспоминания могут оставлять в мозге безмолвные следы Архив рубрики ~Коротко из Telegram~ OpenAI совместно с Джони Айвом разрабатывают умную колонку без дисплея, размером…

Оставить комментарий