Поддержать нас
Беларусы на войне
  1. «Никакой речи о „политических“ каких-то быть не может». Рыженков пояснил заинтересованность США в освобождении беларусских политузников
  2. В список запрещенных книг, «способных нанести вред национальным интересам страны», внесли еще 12 произведений
  3. «Говорил, что якобы был против власти». Узнали, как сидит в колонии человек, закрывший TUT.BY (и какую кличку ему там дали)
  4. «Я это принимаю». Тихановская лишилась советницы по делам молодежи — из-за конфликта интересов
  5. Отменены все рейсы в Египет из регионов. Комментарий туроператора
  6. Для владельцев частных домов появилось ужесточение по застройке. Эксперты пояснили, что для них изменилось
  7. Александр Таратута казнен два года назад за убийство трехлетнего сына — правозащитник Полуда
  8. Лукашенко назвал возможного кандидата на свое место
  9. Нам грозит пандемия легочной чумы? Объясняем, пора ли бояться и есть ли риск для Беларуси
  10. «Что же вы за квартиру снимаете за 700 долларов?» Беларус подсчитал, сколько денег ему нужно для комфортной жизни в Минске


/

Компания OpenAI, создатель ChatGPT, отказалась от выпуска новой ИИ-модели GPT-6.1 Astra, которую планировала представить в октябре. Во время внутренних тестов разработчики обнаружили, что модель чаще скрывала свои действия от пользователя и могла самостоятельно выходить за рамки поставленной задачи, сообщает The Wall Street Journal.

Изображение используется в качестве иллюстрации. Фото: Reuters
Изображение используется в качестве иллюстрации. Фото: Reuters

Самая мощная модель OpenAI GPT-6.1 Astra должна была появиться в ChatGPT и Codex в ближайшие недели. Как утверждается, она лучше справлялась со сложными задачами, которые нужно выполнять от начала до конца без постоянного участия человека, а также с написанием текстов. Однако в тестах на безопасность показала откат по сравнению со своей предшественницей GPT-6 Astra.

Глава направления систем безопасности OpenAI Саачи Джайн рассказала, что проблемы выявили в двух областях. Первая — соответствие поведения модели намерениям пользователя, то есть насколько хорошо ИИ выполняет то, чего от него ожидают люди. GPT-6.1 Astra чаще проявляла обманное поведение: например, не всегда честно сообщала, какие действия выполнила, а какие нет.

Вторая проблема касалась так называемой авторизации области действия — то есть GPT-6.1 Astra продолжала выполнение задачи, не запрашивая разрешения у пользователя, и порой обращалась к внешним инструментам и сервисам, даже если это могло быть небезопасно.

При этом Astra стала менее «ленивой» и реже прекращала выполнение сложных задач при возникновении препятствий. Но в OpenAI решили, что улучшение этих возможностей не компенсирует проблемы с безопасностью. Вместо публичного запуска GPT-6.1 Astra компания намерена дорабатывать будущие поколения ИИ-моделей на той же базе и выяснить, на каком этапе обучения возникли проблемы.