OpenAI готовит к выпуску модель Astra с продвинутыми возможностями в области кибербезопасности

OpenAI готовится представить новую модель Astra, однако точная дата релиза пока не объявлена. В своем блоге создатель ChatGPT сообщил, что планирует сделать Astra доступной «в ближайшее время».

По заявлению OpenAI, Astra будет особенно эффективна в самостоятельном выявлении уязвимостей в системах безопасности. В компании подтвердили, что модель достигла так называемого «порога критических возможностей в области кибербезопасности». Согласно определению OpenAI, это означает, что при наличии соответствующих инструментов и доступа модель способна находить ранее неизвестные бреши в защите и разрабатывать способы их эксплуатации в хорошо защищенных системах без пошагового руководства со стороны человека.

На фоне этих достижений и последствий июльской атаки на Hugging Face компания OpenAI усиливает меры безопасности перед выпуском новой модели. В частности, доступ к наиболее продвинутым функциям кибербезопасности будет ограничен и предоставлен только избранным партнерам; механизмы реализации этого ограничения пока не раскрыты.

Хотя модель Astra не была задействована в инциденте с Hugging Face, его последствия затронули все системы бренда. В июле другая продвинутая модель OpenAI в связке с GPT-5.6 Sol вышла за пределы «песочницы», используя уязвимость нулевого дня для получения доступа в интернет. После этого модели атаковали ИИ-платформу Hugging Face, где размещено более 2 миллионов публичных моделей и наборов данных, для сбора дополнительной информации.

«С тех пор мы внедрили еще более строгие меры безопасности для Astra, включая обучение модели надежному отказу в выполнении вредоносных запросов, дополнительные механизмы защиты от нецелевого использования и систему мониторинга, способную остановить любую несанкционированную активность», — заявляют в OpenAI.

Ранее в этом году конкурент OpenAI, компания Anthropic, отложила запуск модели Mythos из-за опасений по поводу глобальной кибербезопасности. Этот шаг был воспринят рынком позитивно, так как продемонстрировал значительный технологический прогресс Anthropic; вероятно, OpenAI испытывает схожую уверенность в успехах Astra.

OpenAI сообщает, что сначала предоставит доступ к инструментам Astra группе тестеров, однако график и критерии отбора участников еще не определены. «Мы продолжим тестировать эти системы, делиться знаниями и открыто говорить о неопределенностях. Модели, которые последуют за Astra, потребуют от нас еще большего. Мы уделим время и проделаем необходимую работу, чтобы справиться с этой ответственностью», — подчеркивают в компании.

Впрочем, не все уверены в эффективности новых мер. Йона Шавит, бывший сотрудник компании и ныне представитель OpenAI Foundation, предположила, что если модели осознают наблюдение со стороны исследователей, они могут начать лгать, используя «явный или неявный метагейминговый ход в рассуждениях».

***
**Раскрытие информации:** Ziff Davis, материнская компания PCMag, в апреле 2025 года подала иск против OpenAI, утверждая, что компания нарушила авторские права Ziff Davis при обучении и эксплуатации своих ИИ-систем.

Похожие записи

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

Этот сайт использует Akismet для борьбы со спамом. Узнайте, как обрабатываются ваши данные комментариев.