Поддержать нас
Беларусы на войне
  1. «Так получилось в этом 2027 году». Скоро у нас «сгорят» шесть выходных — спросили у Минтруда, почему они не меняют систему
  2. «Никакой речи о „политических“ каких-то быть не может». Рыженков пояснил заинтересованность США в освобождении беларусских политузников
  3. Александр Таратута казнен два года назад за убийство трехлетнего сына — правозащитник Полуда
  4. В список запрещенных книг, «способных нанести вред национальным интересам страны», внесли еще 12 произведений
  5. Отменены все рейсы в Египет из регионов. Комментарий туроператора
  6. Для владельцев частных домов появилось ужесточение по застройке. Эксперты пояснили, что для них изменилось
  7. Нам грозит пандемия легочной чумы? Объясняем, пора ли бояться и есть ли риск для Беларуси
  8. Лукашенко назвал возможного кандидата на свое место
  9. Самый богатый район Беларуси больше не Солигорский. Посмотрели, где самые высокие и самые низкие зарплаты
  10. «Нешта будзе добра!» Поговорили с авторами одного из главных беларусских альбомов последних лет о творчестве, смерти и надежде
  11. «Говорил, что якобы был против власти». Узнали, как сидит в колонии человек, закрывший TUT.BY (и какую кличку ему там дали)


/

Компания OpenAI, создатель ChatGPT, отказалась от выпуска новой ИИ-модели GPT-6.1 Astra, которую планировала представить в октябре. Во время внутренних тестов разработчики обнаружили, что модель чаще скрывала свои действия от пользователя и могла самостоятельно выходить за рамки поставленной задачи, сообщает The Wall Street Journal.

Изображение используется в качестве иллюстрации. Фото: Reuters
Изображение используется в качестве иллюстрации. Фото: Reuters

Самая мощная модель OpenAI GPT-6.1 Astra должна была появиться в ChatGPT и Codex в ближайшие недели. Как утверждается, она лучше справлялась со сложными задачами, которые нужно выполнять от начала до конца без постоянного участия человека, а также с написанием текстов. Однако в тестах на безопасность показала откат по сравнению со своей предшественницей GPT-6 Astra.

Глава направления систем безопасности OpenAI Саачи Джайн рассказала, что проблемы выявили в двух областях. Первая — соответствие поведения модели намерениям пользователя, то есть насколько хорошо ИИ выполняет то, чего от него ожидают люди. GPT-6.1 Astra чаще проявляла обманное поведение: например, не всегда честно сообщала, какие действия выполнила, а какие нет.

Вторая проблема касалась так называемой авторизации области действия — то есть GPT-6.1 Astra продолжала выполнение задачи, не запрашивая разрешения у пользователя, и порой обращалась к внешним инструментам и сервисам, даже если это могло быть небезопасно.

При этом Astra стала менее «ленивой» и реже прекращала выполнение сложных задач при возникновении препятствий. Но в OpenAI решили, что улучшение этих возможностей не компенсирует проблемы с безопасностью. Вместо публичного запуска GPT-6.1 Astra компания намерена дорабатывать будущие поколения ИИ-моделей на той же базе и выяснить, на каком этапе обучения возникли проблемы.