Поддержать нас
Беларусы на войне
  1. Беларуске урезали пенсионный стаж из-за советского диплома
  2. Строительные леса обрушились у девятиэтажки на улице Киселева в Минске. Что известно
  3. В «узбекской истории» с трудовыми мигрантами и поставками мяса и молока — новый поворот. Рассказываем подробности
  4. Александр Лукашенко рассказал, без чего «не может жить страна». Этот «продукт как хлеб — он необходим»
  5. «Никого не осталось, завозят пачками афроамериканцев, узбеков». Режиссер Кудиненко — о том, как ему работалось в Беларуси последние годы
  6. Искали нефть — нашли древнее море и главное богатство страны. Как Беларусь стала калийным гигантом и останется ли им надолго
  7. Беларуска сняла в банкомате наличные, а потом обнаружила, что с ее счета списали 1260 рублей комиссии
  8. В этот день Менск стал Минском — всего 87 лет назад. Почему его переименовали и как на самом деле правильно?
  9. «Не думал, что доживу до того момента». Эксперт анонсировал возможную «суперновость для рынка недвижимости» — попытались узнать детали
  10. «Ничего себе». На счет беларуске неожиданно «упали» почти 10 млрд рублей: она «знатно ошалела», в банке тоже удивились
  11. «Превращаются в лакомый кусок». В Минске возник ажиотаж вокруг еще одного типа недвижимости — за нее идут «бои»
  12. «А что „тунеядец“ вкладывает в экономику страны?» В Threads обсуждают жировки работающих за границей


/

На прошлой неделе американская технологическая компания OpenAI представила новейшие большие языковые модели искусственного интеллекта, получившие названия o3 и o4-mini. Однако, как показали тесты, обе модели, по-видимому, сделали значительный шаг назад: они склонны придумывать — или галлюцинировать — сильнее, чем их более ранние версии, пишет Naked Science.

Изображение носит иллюстративный характер. Фото: Freepik.com
Изображение носит иллюстративный характер. Фото: Freepik.com

По данным издания TechCrunch, новые модели OpenAI противоречат исторической тенденции, согласно которой каждая новая модель давала все меньше галлюцинаций, чем предыдущая, что позволяет предположить, что OpenAI теперь движется в неверном направлении.

Согласно результатам внутреннего тестирования OpenAI, o3 и o4-mini склонны к галлюцинациям чаще, чем старые модели, включая o1, o1-mini и даже o3-mini. Модель o3 выдала 33% ошибок на тесте точности компании. Это примерно вдвое больше, чем у предыдущих моделей OpenAI. Тогда как o4-mini показала еще более худший результат — 48%.

Хуже того, специалисты компании, похоже, не до конца понимают причины проблем. Согласно их техническому отчету, «необходимы дополнительные исследования, чтобы понять причину» этих ошибок.