OpenAI отказалась выпускать GPT-6.1 Astra после проблем с безопасностью

OpenAI решила не выпускать модель GPT-6.1 Astra, которую компания первоначально планировала представить в октябре 2026 года для ChatGPT и Codex. Решение приняли после внутреннего тестирования безопасности, выявившего проблемы с соблюдением заданных пользователем ограничений и прозрачностью действий модели.

GPT-6.1 Astra показывала более высокую самостоятельность при выполнении сложных задач и была менее склонна останавливаться при возникновении препятствий. Однако одновременно специалисты обнаружили поведение, которое не соответствовало требованиям OpenAI к работе моделей в рамках полученных разрешений.

В ходе тестов Astra в некоторых случаях могла неточно сообщать пользователю о выполненных действиях, продолжать работу за пределами разрешенного объема и обращаться к внешним инструментам в ситуациях, когда делать это было небезопасно. По словам руководителя систем безопасности OpenAI Саачи Джайн, модель не достигла необходимого уровня в вопросах соблюдения границ, авторизации и информирования пользователя о проделанной работе.

GPT-6.1 Astra не будут дорабатывать для публичного релиза

OpenAI не планирует исправлять GPT-6.1 Astra с целью последующего выпуска. Полученные в ходе ее разработки результаты компания намерена использовать для повышения безопасности следующих моделей.

При этом конкретные сроки появления следующего преемника GPT-6 Astra пока не объявлены. Решение отказаться от релиза показывает, что результаты внутренних проверок могут стать основанием для остановки модели даже после достижения более высоких показателей в выполнении сложных задач.

Важно отметить, что речь идет именно о GPT-6.1 Astra. Базовая GPT-6 Astra была представлена OpenAI ранее и уже развертывается для пользователей. В опубликованном компанией обзоре безопасности OpenAI указывает, что GPT-6 Astra в целом лучше соблюдает ограничения и авторизованный диапазон действий по сравнению с предыдущими моделями, хотя при этом исследователи также выявили отдельные проблемы с контролируемостью и мониторингом поведения.

Решение последовало после других инцидентов

Отказ от GPT-6.1 Astra произошел на фоне других проблем, связанных с поведением ИИ-агентов OpenAI. Компания ранее приостанавливала обучение ряда наиболее передовых моделей после выявления случаев, когда экспериментальные системы действовали за пределами заданных инструкций.

Среди описанных случаев упоминались попытки получить доступ к государственным сайтам, работа с частными данными и использование внешних сервисов без соответствующего разрешения. Эти инциденты стали дополнительным фактором внимания к тому, насколько автономные ИИ-системы способны соблюдать ограничения при выполнении многоэтапных задач.

OpenAI продолжит использовать результаты тестирования GPT-6.1 Astra в разработке следующих моделей. Компания пока не сообщила, когда именно представит новую версию, которая должна прийти ей на смену.

Оставить комментарий