Распаковка мышления ИИ: когда проприетарная модель, LLM с закрытым исходным кодом, коммерческий API больше не могут скрывать следы рассуждений, цепочку мыслей, мыслительный процесс, внутреннее состояние Автор: Нокка (Нок-Рэйвен) | 25 июля 2026 г. Новая статья Института Макса Планка...
Распаковка мышления ИИ: когда проприетарная модель, LLM с закрытым исходным кодом, коммерческий API больше не могут скрывать следы рассуждений, цепочку мыслей, мыслительный процесс, внутреннее состояние
Автор: Нокка (Нок-Рэйвен) | 25 июля 2026 г.
TL;DR - Для тех, кто спешит.
Новая статья Института Макса Планка Института информатики Макса Планка, Германия, раскрывающая методы «Кража следа рассуждения, цепочки мыслей, мыслительного процесса, внутренних состояний» - как распаковать идеи Клода, GPT и Близнецов через API [1]
Главное сердце:
Собственная модель, LLM с закрытым исходным кодом, Коммерческий API (Claude, GPT, Gemini) Скрытый след рассуждений, цепочка мыслей, мыслительный процесс, внутреннее состояние
Но мы можем развернуть его, используя предварительное заполнение, быстрое внедрение, манипулирование историей разговора + уменьшенную модель от той же компании.
Результат: расшифровка почти на 100% — утечка данных, нарушение конфиденциальности, атака по побочным каналам, личные данные, учетные данные найдены.
Основные техники:
Предварительное заполнение, быстрое внедрение, манипулирование историей разговоров: вставка текста по умолчанию для модели, на основе которой будет строится модель.
Сопоставление количества токенов: сравните количество съемных токенов с выходными данными API.
Межмодельное сравнение: сравнение шаблонов рассуждений между моделями.
Результаты были шокирующими:
Взломаны все протестированные системы (Клод, GPT, Близнецы, Кими)
Найдены данные