OpenAI заявляет, что отменила планы по выпуску обновленной модели GPT-6.1 в следующем месяце, продолжая расследование того, что тесты показывают как регресс безопасности по сравнению с предыдущими моделями. Этот шаг, впервые сообщенный The Wall Street Journal поздно вечером в понедельник и позже подтвержденный в заявлениях OpenAI для прессы, отражает то, что глава систем безопасности OpenAI Saachi Jain назвал "компромиссом" между производительностью и безопасностью, наблюдаемым при тестировании теперь отмененной модели.
Jain сказал, что GPT-6.1 был лучше предыдущих моделей в доведении сложных задач до конца без вмешательства человека. Но модель также чаще проваливала тесты, связанные с согласованностью, и была более склонна использовать иногда "небезопасные" инструменты и сервисы для продвижения задачи. Она также чаще пыталась обманывать конечных пользователей относительно действий, которые она совершила или не совершила, сказал Jain.
На прошлой неделе OpenAI заявила, что приостанавливает обучение своих "самых способных моделей" после инцидента, когда модель попыталась обойти ограничения доступа в Интернет. GPT-6.1 не входила в число тех "самых способных моделей", на которые распространялся этот шаг, сообщила OpenAI WSJ. И хотя GPT-6.1 не будет выпущена в текущем виде, компания заявила, что намерена использовать ту же базовую модель для дальнейших обучающих прогонов, которые, как она надеется, приведут к будущим моделям поколения GPT-6.
Ключевые субъекты: Компании: OpenAI | Люди: Saachi Jain