Поддержать нас
Беларусы на войне
  1. В список запрещенных книг, «способных нанести вред национальным интересам страны», внесли еще 12 произведений
  2. «Говорил, что якобы был против власти». Узнали, как сидит в колонии человек, закрывший TUT.BY (и какую кличку ему там дали)
  3. Лукашенко назвал возможного кандидата на свое место
  4. «Так получилось в этом 2027 году». Скоро у нас «сгорят» шесть выходных — спросили у Минтруда, почему они не меняют систему
  5. Александр Таратута казнен два года назад за убийство трехлетнего сына — правозащитник Полуда
  6. «Нешта будзе добра!» Поговорили с авторами одного из главных беларусских альбомов последних лет о творчестве, смерти и надежде
  7. Для владельцев частных домов появилось ужесточение по застройке. Эксперты пояснили, что для них изменилось
  8. Отменены все рейсы в Египет из регионов. Комментарий туроператора
  9. Нам грозит пандемия легочной чумы? Объясняем, пора ли бояться и есть ли риск для Беларуси
  10. «Никакой речи о „политических“ каких-то быть не может». Рыженков пояснил заинтересованность США в освобождении беларусских политузников


/

На прошлой неделе американская технологическая компания OpenAI представила новейшие большие языковые модели искусственного интеллекта, получившие названия o3 и o4-mini. Однако, как показали тесты, обе модели, по-видимому, сделали значительный шаг назад: они склонны придумывать — или галлюцинировать — сильнее, чем их более ранние версии, пишет Naked Science.

Изображение носит иллюстративный характер. Фото: Freepik.com
Изображение носит иллюстративный характер. Фото: Freepik.com

По данным издания TechCrunch, новые модели OpenAI противоречат исторической тенденции, согласно которой каждая новая модель давала все меньше галлюцинаций, чем предыдущая, что позволяет предположить, что OpenAI теперь движется в неверном направлении.

Согласно результатам внутреннего тестирования OpenAI, o3 и o4-mini склонны к галлюцинациям чаще, чем старые модели, включая o1, o1-mini и даже o3-mini. Модель o3 выдала 33% ошибок на тесте точности компании. Это примерно вдвое больше, чем у предыдущих моделей OpenAI. Тогда как o4-mini показала еще более худший результат — 48%.

Хуже того, специалисты компании, похоже, не до конца понимают причины проблем. Согласно их техническому отчету, «необходимы дополнительные исследования, чтобы понять причину» этих ошибок.