Утечка промпта GPT-6 Astra: 320 тысяч символов системных инструкций на GitHub

Скриншот страницы GitHub с утечкой промпта GPT-6 Astra

В открытом доступе оказался системный промпт GPT-6 Astra — новой флагманской модели от OpenAI. Слив произошёл через GitHub-репозиторий CL4R1T4S, который ведёт исследователь под псевдонимом elder-plinius. Объём документа впечатляет: около 320 тысяч символов. Это не просто набор технических команд, а полноценная инструкция, описывающая роли, логику и механизмы принятия решений модели.

Что именно попало в сеть

Согласно опубликованным данным, файл содержит несколько ключевых блоков. Во-первых, это описание ролей, которые модель может принимать в зависимости от контекста. Во-вторых, детализированные команды для внутренних процессов — от обработки запросов до форматирования ответов. В-третьих, логика, которой Astra руководствуется при выборе стратегии ответа. Иными словами, утечка приоткрывает завесу над тем, как именно модель интерпретирует задачи и какие приоритеты расставляет.

Почему это важно

Системные промпты — это «конституция» языковой модели. Они определяют, что можно, что нельзя, как реагировать на провокации, какие темы обходить стороной и как выстраивать цепочки рассуждений. Утечка такого масштаба позволяет исследователям, разработчикам и просто энтузиастам лучше понять внутреннюю кухню GPT-6 Astra. Это может помочь в создании более эффективных промптов, а также в анализе уязвимостей и ограничений модели.

Реакция сообщества

Публикация уже вызвала волну обсуждений. Одни пользователи восхищаются прозрачностью и детализацией инструкций, другие указывают на потенциальные риски: злоумышленники могут использовать эту информацию для обхода защитных механизмов. Сам репозиторий CL4R1T4S позиционируется как архив утечек системных промптов различных ИИ-моделей, и случай с Astra стал одним из самых громких за последнее время.

Что дальше

OpenAI пока официально не комментировала инцидент. Однако очевидно, что утечка такого объёма — серьёзный вызов для компании. Вопросы безопасности и защиты интеллектуальной собственности в сфере ИИ становятся всё острее. Пока одни изучают 320 тысяч символов, другие задаются вопросом: насколько вообще возможно сохранить секретность системных промптов, если они становятся главной целью хакеров и исследователей?