Новое исследование выявило подозрительное сходство Kimi K3 с логикой Claude Opus
Один из самых острых споров в мире ИИ прямо сейчас имеет далеко идущие геополитические последствия. Дистиллировала ли Moonshot свою модель Kimi K3 из модели Anthropic?
Критики указывают на промежуток примерно в две недели между публичным запуском Fable и Kimi K3, утверждая, что масштабная дистилляция за такой срок практически невозможна.
Однако недавно обнаруженная уязвимость в API может стать той самой уликой, которую искали американские лаборатории ИИ.
Модели ИИ "думают" внутри себя перед ответом, но лаборатории обычно запирают эту цепочку рассуждений внутри зашифрованного текстового блока, так что пользователь видит лишь финальный ответ. Эти зашифрованные фрагменты пересылаются между сервером и браузером, экономя серверную память.
Новая научная работа выявила серьёзную уязвимость в этой схеме. Оказалось, что провайдеры моделей, включая OpenAI, Anthropic и Google, использовали глобальные ключи шифрования во всей своей экосистеме.
Более того, хотя более умные модели (например, Claude Opus) обучены отказываться раскрывать свои скрытые мысли, зашифрованный блок мыслей Opus можно скопировать и подать более слабой и дешёвой родственной модели (например, Claude Haiku). Слабая модель лишена строгих ограничителей, расшифровывает блок и выводит точные мысли умной модели.
Это опасно по трём причинам:
Утечки данных и учётных данных – разработчики регулярно публикуют логи сессий онлайн, не подозревая, что чувствительные данные заперты внутри зашифрованных блоков. Исследователи расшифровали публичные логи и обнаружили 367 фрагментов персональной информации и 182 секретных учётных данных, включая API-ключи и пароли.
Обход мер безопасности – даже если ИИ отказывается выдать опасный финальный ответ, его расшифрованный процесс мышления часто раскрывает вредоносные шаги, которые модель обдумывала внутри себя.
Скрытые инъекции – злоумышленники могут спрятать вредоносные команды прямо внутри этих невидимых зашифрованных блоков, чтобы перехватить рабочие процессы ИИ.
Кроме того, авторы исследования отмечают, что "дистилляция цепочек рассуждений могла быть возможна долгое время без взлома криптографии".
В качестве любопытного эксперимента авторы подали в Kimi K3 всего 1 процент расшифрованных рассуждений Claude Opus 4.8. Неожиданно последующее мышление и финальный ответ Kimi K3 резко сместились так, чтобы соответствовать стилю и формулировкам Claude.
Фактически "конкретные отрезки рассуждений Claude и GPT примерно на шесть порядков легче извлечь из Kimi-K3, чем из следующей ближайшей модели".
По словам авторов исследования, Kimi K3 продемонстрировала необычно высокую статистическую вероятность предсказания и продолжения текста Claude по сравнению с другими открытыми моделями вроде DeepSeek-V4-Flash. Это указывает на сильную поведенческую совместимость с паттернами рассуждений Claude Opus.
Конечно, окончательно доказать дистилляцию вряд ли удастся, если только глава Moonshot внезапно сам об этом не скажет. За исключением такого крайне маловероятного исхода, это может стать лучшим доступным аргументом, чтобы развеять сомнения в статусе дистилляции Kimi K3.
США давно подозревают, что китайские инженеры часто вывозят жёсткие диски с моделями в дружественные Америке страны, чтобы наделить свои модели передовыми возможностями с помощью методов обучения с подкреплением на новейших GPU от NVIDIA.
Согласно недавним обвинениям одного из чиновников администрации Трампа, Moonshot не только тайно владеет несколькими серверами NVIDIA GB300, но и получила доступ к дополнительным GB300 через Таиланд.
- Семья в Китае создала ИИ-клона умершего сына, чтобы утешить пожилую мать
- Сотня беспилотных роботакси заблокировала улицы Уханя из-за массового сбоя системы
- Китай представил новый пятилетний план с курсом на ИИ и технологическую независимость от США