Kimi поймали на следах Claude: модель могла обучаться на его…
Kimi поймали на следах Claude: модель могла обучаться на его скрытых рассуждениях
Исследователи нашли способ восстанавливать зашифрованные reasoning-блоки закрытых моделей и решили проверить, помнят ли другие LLM эти скрытые цепочки.
Самая сильная аномалия оказалась у Kimi-K3.
Если дать Kimi начало конкретного рассуждения Claude, модель продолжает его намного точнее, чем другие LLM. В некоторых тестах разница доходила примерно до шести порядков.
На примере с Opus 4.8 это видно особенно хорошо: Kimi получает несколько первых токенов скрытого reasoning и дальше идёт почти по той же логике решения. Без этой подсказки рассуждает иначе.
Исследователи сначала восстановили скрытые reasoning-трассы Claude Opus 4.8 и GPT-5.6 Sol, а затем подставили первые токены этих цепочек в Kimi.
Иногда хватало меньше 1% исходного reasoning, чтобы Kimi начинал рассуждать заметно ближе к Opus или Sol, а финальный ответ тоже смещался в ту же сторону.
Дальше выяснилось, что конкретные фрагменты reasoning Claude и GPT извлекались из Kimi примерно на шесть порядков легче, чем из большинства других открытых моделей.
Но это всё ещё не прямое доказательство дистилляции, но сигнал выглядит очень сильным.
Это ещё не доказательство того, что Moonshot напрямую использовала приватные данные Claude. Но выглядит так, будто Kimi могла видеть похожие скрытые траектории во время обучения.
Модель могла перенять сам способ решения задач.
https://x.com/kotekjedi_ml/status/2087147093735714919
Похожие записи
Оцените материал:
Похожие записи
В 1986-м учителя боялись калькуляторов. Звучит знакомо В апреле 1986…
26.07.2026
🌍 Карта мировых исследований ИИ: все ключевые работы и нейросети…
28.10.2025
Рынок облачных сервисов для бизнеса в России к 2030 году…
01.08.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
