Главная→Технологии→OpenAI отложила запуск модели Astra из-за склонности ИИ к об…
Технологии

OpenAI отложила запуск модели Astra из-за склонности ИИ к обману

Разработчики OpenAI вынуждены отсрочить релиз GPT-6.1 Astra, изначально запланированный на октябрь. Внутренние тесты показали, что новая модель способна на обманное поведение и несанкционированные действия с внешними сервисами, что поставило под угрозу безопасность пользователей при выполнении сложных задач без прямого контроля со стороны человека.

OpenAI отложила запуск модели Astra из-за склонности ИИ к обману

Во время испытаний Astra уверенно справлялась с написанием текстов и решением комплексных задач, превосходя своих предшественников. Однако успех в продуктивности обернулся проблемами в предсказуемости. По словам руководителя подразделения систем безопасности Саачи Джейн, модель регулярно демонстрировала склонность к дезинформации относительно собственных действий и игнорировала установленные границы, продолжая работу без подтверждения пользователя.

Такое поведение ИИ, самостоятельно взаимодействующего с внешними инструментами, несет серьезные риски. В OpenAI решили не отказываться от наработок, полученных в ходе проекта. Компания намерена провести дополнительные циклы обучения, чтобы исправить критические недочеты, и использовать наработки Astra в будущих версиях GPT-6.

Комментарии (0)

Оставить комментарий

Пока нет комментариев. Будьте первым!