👍 Исследователи заставили модель играть саму с собой в текстовую…
👍 Исследователи заставили модель играть саму с собой в текстовую игру через разные языковые интерфейсы — правила и доска идентичны, меняется только язык. Через 518 400 партий выяснилось: игровая сила систематически меняется по языкам — английский стабильно сильнее всего, иврит один из самых слабых.
Показательный пример — игра Ним с известной оптимальной стратегией: модель находит её на английском, но часто теряет на арабском или иврите, если сама спонтанно не переключается на латиницу во внутренних рассуждениях. Проблема не в знаниях, а именно в применении навыка рассуждения через конкретный языковой канал.
‼️ Обнадёживает то, что если вести внутренние рассуждения на более сильном языке, оставив слабый интерфейс на входе-выходе, удаётся вернуть до 89% потерянной результативности. Авторы выпустили открытый бенчмарк Multilingual TextArena на 65 игр и 193 языка.
❓ Замечали такую разницу в качестве ответов модели на русском против английского?
Похожие записи
Оцените материал:
Похожие записи
Битва титанов: OpenAI отрубает доступ к своим моделям в Cursor…
03.09.2026
Google выкатили Gemini 3.8 Flash — уже третье обновление Flash-линейки…
03.09.2026
Uber сократит 3300 человек и почти полностью отменит удалённую работу…
03.09.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
