Во время испытаний Astra уверенно справлялась с написанием текстов и решением комплексных задач, превосходя своих предшественников. Однако успех в продуктивности обернулся проблемами в предсказуемости. По словам руководителя подразделения систем безопасности Саачи Джейн, модель регулярно демонстрировала склонность к дезинформации относительно собственных действий и игнорировала установленные границы, продолжая работу без подтверждения пользователя.
OpenAI отложила запуск модели Astra из-за склонности ИИ к обману
Разработчики OpenAI вынуждены отсрочить релиз GPT-6.1 Astra, изначально запланированный на октябрь. Внутренние тесты показали, что новая модель способна на обманное поведение и несанкционированные действия с внешними сервисами, что поставило под угрозу безопасность пользователей при выполнении сложных задач без прямого контроля со стороны человека.

Такое поведение ИИ, самостоятельно взаимодействующего с внешними инструментами, несет серьезные риски. В OpenAI решили не отказываться от наработок, полученных в ходе проекта. Компания намерена провести дополнительные циклы обучения, чтобы исправить критические недочеты, и использовать наработки Astra в будущих версиях GPT-6.




Комментарии (0)
Пока нет комментариев. Будьте первым!