Архив рубрики ~Лента новостей~

«Заведите себе ИИ» — совет, который бизнесу сейчас дают со всех сторон.

«Заведите себе ИИ» — совет, который бизнесу сейчас дают со всех сторон.
«Заведите себе ИИ» — совет, который бизнесу сейчас дают со всех сторон.

СОВЕТ, КОТОРЫЙ ДАЮТ ВСЕ

Откройте любую конференцию, любой отраслевой канал: «внедряйте ИИ», «заводите свою модель», «кто не успел — опоздал». Звучит убедительно, особенно когда рядом ставят цифры роста.

Проблема в том, что между советом и его исполнением лежит огромная пропасть, которую не перепрыгнуть на раз-два и о которой говорят гораздо реже.

Ветка первая: взять готовое. Практически все решения по ИИ — это открытый исходный код: копируй и работай. Быстро, дёшево, готово завтра.

Но возникает главный вопрос — база данных компании и внутренняя настройка работы с ней.

Для розничного магазина это обычный проект, примерно как настройка бухучёта в новой программе. Для банка, промышленного холдинга или компании с коммерческой тайной — нет. Встаёт вопрос защиты данных: от коммерческой тайны до государственной.

То есть доступ к конфиденциальным данным должен оставаться во внутреннем контуре и строго охраняться. А если случится утечка за пределы контура — это уже по-настоящему опасно.

И поэтому дать сотрудникам рабочий доступ к ИИ мирового масштаба, у которого иностранные акционеры, на данном этапе практически невозможно.

Ветка вторая: построить своё. Данные остаются внутри собственного контура. Но тут выясняется, что «своё» — это не про модель.

МОДЕЛИ ДАВНО ПЕРЕСТАЛИ БЫТЬ ПРОБЛЕМОЙ

Это изменение последнего года.

Сбер выложил GigaChat 3.5 Ultra — 432 миллиарда параметров, веса под лицензией MIT, самой либеральной среди крупных открытых моделей мира. «Т-Технологии» открыли T-Pro и T-Lite, они обошли открытые российские и зарубежные аналоги на индустриальных бенчмарках. Есть YandexGPT 5 Lite, есть A-Vibe от Авито.

Инфраструктурный слой тоже зрелый: vLLM для инференса, LangChain и LlamaIndex для оркестрации, Qdrant и Milvus для поиска по своим документам.

То есть модель мирового уровня можно поставить у себя, не заплатив за лицензию ни рубля.

Вопрос: почему тогда почти никто этого не сделал?

ПОТОМУ ЧТО УПИРАЕТСЯ В ЖЕЛЕЗО

Вот цифры, которые редко ставят рядом.

91% российских организаций не имеют серверов с графическими процессорами — тех самых, без которых модель не запустить. Индекс готовности ИИ-инфраструктуры российских компаний — 38 из 100.

Поставки GPU-серверов через параллельный импорт упали с тысяч в 2024 году до десятков в 2026-м. Разрыв в вычислительных мощностях между США и Россией оценивают как 660-кратный.

Оборудование идёт через Китай, без официальных гарантий, дороже и дольше. При этом сам Китай с госбюджетом в 98 миллиардов долларов перехватывает поставки, переплачивая в два-три раза.

И отрезвляющая деталь для тех, кто ждёт снятия ограничений: на начало июня 2026 года в Китай не поставлено ни одного H200 — при разрешениях с обеих сторон. Очередь глобальная, дефицит мировой, а не только санкционный.

Российского промышленного ускорителя под обучение больших моделей не существует. Есть отечественные ПАК от Сбера, серверы «Аквариуса» и YADRO с поддержкой до восьми GPU — но начинка в них импортная.

И ДОРОЖАЕТ НЕ ТОЛЬКО ЖЕЛЕЗО

Пока все смотрят на чипы, дорожает всё остальное.

Аренда земли под дата-центры в Московской области за 2026 год подорожала в 68 раз. Стойка на 5 кВт в Москве стоит 170,8 тысячи рублей в месяц — плюс 15,7% за год. Новых стойко-мест за 2025 год ввели вдвое меньше, чем годом раньше: 4,6 тысячи против 10,9.

При этом инвестиции в сектор дата-центров за год составили 53,5 миллиарда рублей, а число новых проектов выросло на 27%.

Деньги в отрасль идут, а физически не растёт ничего — ни земли, ни мощности, ни ускорителей. Отсюда рост цен по всем позициям сразу.

ГЛАВНАЯ АРИФМЕТИКА, О КОТОРОЙ НЕ ГОВОРЯТ

Теперь самое неприятное.

Серверная видеокарта живёт три-пять лет, потом морально устаревает. При этом окупаемость собственного GPU-парка при реалистичной загрузке — шесть и больше лет.

Железо устаревает раньше, чем окупается.

Это не гипотеза. Смотрите на Сбер: два суперкомпьютера, Christofari и Christofari Neo, уже не входят в топ-100 мира. Поэтому в феврале 2026 объявлен третий — за 500 миллиардов рублей. А в марте Сбер и Яндекс запросили у государства 400–450 миллиардов ежегодно на развитие ИИ.

Если компании такого масштаба не могут вытянуть собственную инфраструктуру без господдержки, вопрос «а не построить ли нам свой ИИ» для среднего бизнеса имеет очевидный ответ.

ЧТО ПРЕДЛАГАЕТ ГОСУДАРСТВО

И вот здесь масштабы становятся особенно наглядными.

10 августа 2026 «Коммерсантъ» сообщил: правительство обсуждает налоговые льготы и субсидии для малого и среднего бизнеса за использование отечественных ИИ-решений. Это подзаконные акты к новому закону о поддержке технологий ИИ.

Механизм такой. Компания уменьшает налог на прибыль или платёж по упрощёнке на сумму покупки российского ПО. Базовый вычет — 200 тысяч рублей в год, до 500 тысяч при подтверждённом росте производительности.

Альтернатива — субсидировать разработчиков: государство компенсирует им скидку для бизнеса в течение трёх лет. Первый год до 100% стоимости, но не более 200 тысяч, дальше 50% и 25%.

В аппарате вице-премьера Дмитрия Григоренко подчёркивают: говорить о конкретных решениях преждевременно.

Сопоставьте цифры. Вычет 200–500 тысяч рублей — и стойка в московском ЦОДе за 170 тысяч в месяц. Один сервер с восемью ускорителями — от 30 миллионов.

Это поддержка покупки софта, а не строительства инфраструктуры. Она полезна малому бизнесу, который берёт готовый сервис. Она никак не помогает тому, кто хочет «свой ИИ».

Отраслевые эксперты, кстати, говорят о том же: финансировать надо не закупку софта, а проекты с обоснованной методологией внедрения. И напоминают про действующие гранты до 20 миллионов.

Для полноты: базовые ИТ-льготы в 2026 году сохранены — налог на прибыль 5%, страховые взносы 15 и 7,6%, НДС не начисляется на продажу собственного ПО при аккредитации в Минцифры. Но это льготы для тех, кто ИИ разрабатывает, а не для тех, кто внедряет.

А ЕСЛИ СДАВАТЬ МОЩНОСТИ В АРЕНДУ? ПРОВЕРЯЛИ — НЕ РАБОТАЕТ

Идея, которая регулярно всплывает: собрать простаивающие мощности — хоть домашние компьютеры — и пустить их в дело.

В мире это работает: Salad, Vast.ai, io.net, Akash. Есть даже прорыв в распределённом обучении — Prime Intellect обучила модель на 32 миллиарда параметров на глобальном пуле GPU, Nous Research координирует обучение через блокчейн.

В России этот мост не строится, и вот почему.

Экономика таких сетей держится на видеокартах уровня RTX 4090 и выше. Если 91% организаций не имеет GPU-серверов, у частных лиц ситуация не лучше.

Перепрофилировать майнинговые фермы тоже не выйдет: ASIC-майнеры не пересобираются в GPU-кластеры, это разное железо под разные задачи.

Площадки и дешёвая энергия на востоке есть — Приморье, Хабаровский край, Иркутская область, Красноярск. Доля региональных проектов дата-центров превысила 15%. Ставить туда нечего.

ТАК ЧТО ЖЕ ДЕЛАТЬ

Здесь начинается практическая часть. Ответ есть, но он не в формулировке «свой или чужой ИИ».

Правильный вопрос — какие данные куда.

Не вся информация в компании одинаково чувствительна. Разделите её на три контура, и решение соберётся само.

Контур первый — публичный. Черновики писем, переводы, генерация текстов, работа с открытыми документами. Здесь не нужен свой ИИ. Российское облако с готовыми моделями закрывает задачу за копейки: инференс в Cloud.ru стоит от 35 рублей за миллион входных токенов.

Контур второй — коммерческий. Клиентская база, договоры, финансы, внутренняя переписка. Открытая модель на арендованных выделенных мощностях в российском облаке, с изоляцией. Данные не покидают юрисдикцию, инфраструктура не ваша — и не ваша головная боль.

Контур третий — критический. Объекты КИИ, банковская тайна, R&D. Только программно-аппаратный комплекс в собственном контуре. Дорого, но здесь других вариантов нет — Сбер, «Аквариус» и другие как раз это и продают.

И ключевое: большинству компаний нужен только первый и второй контуры. Третий — это не про размер бизнеса, а про регуляторный режим.

АРЕНДОВАТЬ ИЛИ ПОКУПАТЬ

Отдельная развилка, и она считается просто.

Пока железо дорожает, а срок его жизни три-пять лет, аренда выгоднее покупки всем, у кого загрузка ниже постоянной.

Покупка окупается только при одном условии: вы держите кластер загруженным близко к 100% несколько лет подряд. Если задачи идут волнами — а у большинства именно так — вы платите за простой самого быстро дешевеющего актива на рынке.

Российский рынок это подтверждает: аренда GPU-серверов выросла до 17 миллиардов рублей и удваивается, а сегмент on-premise решений — 33 миллиарда против 2 миллиардов облачных. Заказчик хочет ИИ у себя, но за железо платить не готов.

ДЛЯ КОГО «СВОЁ» ДЕЙСТВИТЕЛЬНО ИМЕЕТ СМЫСЛ

Есть одна конфигурация, где вложения окупаются: холдинг или группа компаний.

Одна инфраструктура на десять компаний вместо десяти отдельных попыток. По отдельности никто не окупит кластер, группа — окупит. Данные не смешиваются между компаниями, контуры изолированы, а модель «общий сервис для группы» большинству холдингов уже привычна: бухгалтерия, кадры и закупки у них давно общие.

Любопытно, что готового продукта под эту задачу на рынке я не нашла. Есть облачные ИИ-фабрики, есть программно-аппаратные комплексы, есть интеграторы. А единой платформы на группу компаний, с изоляцией контуров и внутренним биллингом, как коробочного решения — нет. Каждый раз это собирают вручную.

ЧТО В СУХОМ ОСТАТКЕ

Модели бесплатны. Дефицитны вычисления. Если вам продают «внедрение ИИ» и не начинают разговор с того, где будут крутиться модели, — вам продают презентацию.

Своё железо покупать не надо почти никому. Оно устаревает раньше, чем окупается, и это подтверждается на примере компаний с бюджетами в сотни миллиардов.

Государственная поддержка есть, но она про софт. Вычет 200–500 тысяч рублей помогает купить продукт, а не построить инфраструктуру.

Главный вопрос — не «свой ИИ или чужой», а какие данные в каком контуре. Разделите информацию по чувствительности, и три четверти задач закроются арендой.

И самое неудобное. Из тех компаний, что тратят деньги на ИИ, стратегию внедрения имеют только 26%. Используют технологию 55–71%. Разрыв между этими числами и есть та самая иллюзия: покупают пилоты, а не результат.

На всех встречах с бизнесом возникает горячий и модный вопрос — как поставить ИИ на службу бизнесу.

Вчера в Телеграме был опрос от уважаемого бизнес-издания: напишите, как ИИ поменял ваш бизнес. У меня есть личный ответ — мне открылась огромная и потрясающая история для исследований. Про то, как ИИ меняет жизнь каждого человека, как ИИ видят бизнес и как бизнес видит ИИ. Причём то, чем сами модели отличаются друг от друга, тоже невероятно интересно.

Раньше на сбор и анализ материала у меня уходили бы месяцы — теперь дни, и готово. ИИ буквально дали мне новый шанс исследовать мир человека и бизнеса. В итоге у меня новые друзья и партнёры — и их много.

А в вашей компании разговор про ИИ начинался с того, где будут храниться данные? Или сразу с того, какую модель выбрать?

Независимый аналитик. Личное мнение. Обзор рынка из открытых источников, не рекомендация продуктов и решений. Проект «Резонанс», Нина Баталова.

Источник: vc.ru

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Полезное~ Бесплатные ИИ-инструменты вместо платных подписок: гайд для вайбкодера Новости робототехники Институт ARM привлечен к проектам в области технологий оборонного производства Новости робототехники Заказы на роботов во втором квартале выросли до 622 миллионов долларов, поскольку спрос на автоматизацию расширения растет во всех отраслях. Новости робототехники Новый гуманоидный робот Хонда «Аватар» предполагает, что дух ASIMO очень жив. Новости робототехники Робот-космический механик от Northrop — это новый способ продлить срок службы спутников. Новости робототехники Celona запускает агентную беспроводную платформу Orion, созданную для физического искусственного интеллекта и робототехники. Архив рубрики ~Коротко из Telegram~ Российская соцсеть Looky, позиционирующая себя как альтернатива Instagram*, готовит собственный… Архив рубрики ~Коротко из Telegram~ «Ростелеком» планирует закупить 2,57 млн российских SIM-карт на сумму до… Архив рубрики ~Коротко из Telegram~ НейроFOMO вызывает у юзеров симптомы тревожности и депрессии: психологи заметили,… Архив рубрики ~Коротко из Telegram~ ‼️ Минюст США объявил, что OpenAI и её бывшая «дочка»… Архив рубрики ~Коротко из Telegram~ Suno вводит лимиты на скачивание музыки С 3 сентября сервис… Архив рубрики ~Коротко из Telegram~ 🎬 Новый расклад в ИИ-видео: кто кого Свежий обзор видеогенераторов… Архив рубрики ~Коротко из Telegram~ 🔋 🎧 В коде iOS 27 beta найдена функция, которая… Архив рубрики ~Коротко из Telegram~ DeepSeek V4 Pro показывает примерно уровень Opus/Fable, но генерация ответа… Архив рубрики ~Полезное~ Бесплатные ИИ-инструменты вместо платных подписок: гайд для вайбкодера Новости робототехники Институт ARM привлечен к проектам в области технологий оборонного производства Новости робототехники Заказы на роботов во втором квартале выросли до 622 миллионов долларов, поскольку спрос на автоматизацию расширения растет во всех отраслях. Новости робототехники Новый гуманоидный робот Хонда «Аватар» предполагает, что дух ASIMO очень жив. Новости робототехники Робот-космический механик от Northrop — это новый способ продлить срок службы спутников. Новости робототехники Celona запускает агентную беспроводную платформу Orion, созданную для физического искусственного интеллекта и робототехники. Архив рубрики ~Коротко из Telegram~ Российская соцсеть Looky, позиционирующая себя как альтернатива Instagram*, готовит собственный… Архив рубрики ~Коротко из Telegram~ «Ростелеком» планирует закупить 2,57 млн российских SIM-карт на сумму до… Архив рубрики ~Коротко из Telegram~ НейроFOMO вызывает у юзеров симптомы тревожности и депрессии: психологи заметили,… Архив рубрики ~Коротко из Telegram~ ‼️ Минюст США объявил, что OpenAI и её бывшая «дочка»… Архив рубрики ~Коротко из Telegram~ Suno вводит лимиты на скачивание музыки С 3 сентября сервис… Архив рубрики ~Коротко из Telegram~ 🎬 Новый расклад в ИИ-видео: кто кого Свежий обзор видеогенераторов… Архив рубрики ~Коротко из Telegram~ 🔋 🎧 В коде iOS 27 beta найдена функция, которая… Архив рубрики ~Коротко из Telegram~ DeepSeek V4 Pro показывает примерно уровень Opus/Fable, но генерация ответа…

Оставить комментарий