Букмарклет вычисляющий скорость gguf модели в llama.cpp на hf
С приходом нейросетей теперь можно решать задачи гораздо проще, правда и задачи бы такой не стояло не будь нейросетей и llama.cpp, и huggingface. В общем смысл статьи в том чтобы попытаться математически вычислить теоретическую скорость генерации токенов в программе llama.cpp для моделей на hugginface, просто открыв карточку модели и нажав на закладку (букмарклет).
В интеренете таких калькуляторв довольно много, и в этом калькуляторе нет никаких новых идей, он работает как и все остальные — вычисляет скорость исходя из пропускной способности видеопамяти пользователя. Но как выяснилось просто поделить одно число на другое (вес модели на пропускную способность видеокарты) не совсем правильно, когда я сказал что в реале у меня другая скорость, нейронки стали вводить поправочные коэффициент в виде эффективности видеокарты (60-80%).
Читать далее
Источник: habr.com
Похожие записи
- Компания Magna увеличивает свои инвестиции в индийский рынок систем замены батарей, приобретя компанию Yuma за 35 миллионов долларов.
- Instagram* обязал авторов маркировать профили с ИИ-персонажами, чтобы их не путали с реальными людьми
- OpenClaw 2.0 уже здесь, открывая эру «многопользовательского» программирования ИИ: что это значит для предприятий.
Оцените материал:
Похожие записи
Найдено самое длинное слово русского языка? Давайте разбираться
16.11.2025
Редкого попугая с индонезийского острова Буру встретили впервые за 11 лет. Ради этого орнитологам пришлось подняться на высочайшую гору острова
11.06.2026
Википедия приостанавливает пилотную версию ИИ-резюме после протеста редакторов
14.06.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
