Поддержать нас
Беларусы на войне
  1. Самый богатый район Беларуси больше не Солигорский. Посмотрели, где самые высокие и самые низкие зарплаты
  2. Лукашенко назвал возможного кандидата на свое место
  3. Нам грозит пандемия легочной чумы? Объясняем, пора ли бояться и есть ли риск для Беларуси
  4. В список запрещенных книг, «способных нанести вред национальным интересам страны», внесли еще 12 произведений
  5. «Никакой речи о „политических“ каких-то быть не может». Рыженков пояснил заинтересованность США в освобождении беларусских политузников
  6. «Говорил, что якобы был против власти». Узнали, как сидит в колонии человек, закрывший TUT.BY (и какую кличку ему там дали)
  7. Для владельцев частных домов появилось ужесточение по застройке. Эксперты пояснили, что для них изменилось
  8. Александр Таратута казнен два года назад за убийство трехлетнего сына — правозащитник Полуда
  9. «Нешта будзе добра!» Поговорили с авторами одного из главных беларусских альбомов последних лет о творчестве, смерти и надежде
  10. «Так получилось в этом 2027 году». Скоро у нас «сгорят» шесть выходных — спросили у Минтруда, почему они не меняют систему


/

На прошлой неделе американская технологическая компания OpenAI представила новейшие большие языковые модели искусственного интеллекта, получившие названия o3 и o4-mini. Однако, как показали тесты, обе модели, по-видимому, сделали значительный шаг назад: они склонны придумывать — или галлюцинировать — сильнее, чем их более ранние версии, пишет Naked Science.

Изображение носит иллюстративный характер. Фото: Freepik.com
Изображение носит иллюстративный характер. Фото: Freepik.com

По данным издания TechCrunch, новые модели OpenAI противоречат исторической тенденции, согласно которой каждая новая модель давала все меньше галлюцинаций, чем предыдущая, что позволяет предположить, что OpenAI теперь движется в неверном направлении.

Согласно результатам внутреннего тестирования OpenAI, o3 и o4-mini склонны к галлюцинациям чаще, чем старые модели, включая o1, o1-mini и даже o3-mini. Модель o3 выдала 33% ошибок на тесте точности компании. Это примерно вдвое больше, чем у предыдущих моделей OpenAI. Тогда как o4-mini показала еще более худший результат — 48%.

Хуже того, специалисты компании, похоже, не до конца понимают причины проблем. Согласно их техническому отчету, «необходимы дополнительные исследования, чтобы понять причину» этих ошибок.