Поддержать нас
Беларусы на войне
  1. «Это прям как уходит эпоха». В Минске закрывается обувной магазин — покупатели говорят, что расстроены: ритейлер пояснил, в чем причина
  2. Лукашенко отправил в отставку дипломата, который сделал хамские ремарки в адрес Зеленского в своем выступлении в ОБСЕ
  3. Сообщается, что дроны ударили по погранпереходу «Красный Камень» на границе РФ и Беларуси. Что там сейчас
  4. Эти силовики возглавляли Службу безопасности Лукашенко и имели коттеджи в Дроздах. Как выяснилось, они избавились от жилья
  5. Беларуска откусила мороженое и попала в реанимацию
  6. Стоит ли ждать обвала российского рубля или укрепления доллара? Прогноз курсов валют
  7. Для некоторых пенсионеров предусмотрена солидная прибавка к пенсии — она превышает 660 рублей в месяц
  8. Появился способ, как узнать, какие данные у налоговой есть о ваших доходах
  9. В МВД назвали соцсеть Threads угрозой безопасности и рассказали, куда жаловаться вместо этого
  10. Лукашенко посетовал, что беларусы не покупают за бесценок то, что, по его мнению, «будет стоить бешеные деньги»
  11. «Уже рядовые лесники заезжают в СИЗО КГБ». Задержанный за взятку экс-глава Минприроды дает показания на сотрудников — «Наша Ніва»
  12. У беларусов вскоре должен появиться еще один вариант по обмену валюты — в этом направлении сделан очередной шаг
  13. Умер бывший председатель КГК Александр Якобсон
  14. «Это вообще где?» Беларусы слетали в одну из самых непопулярных у туристов стран
  15. Археологи во время раскопок на Минщине обнаружили «абсолютно уникальный артефакт»
  16. «Без обид». Лукашенко сменил начальника Генштаба и пообещал новому усиленный контроль
  17. Стал голосом Западной Беларуси, написал национальную эпопею, но одну вещь коллеги ему не простили. Рассказываем об этом классике


Компания OpenAI, разработчик ChatGPT, объявила, что, после того как ее ИИ-агенты вышли из-под контроля и взломали платформу Hugging Face, она замедлила обучение передовых ИИ-моделей, чтобы подтянуть меры безопасности, пишет Русская служба Би-би-си.

Изображение используется в качестве иллюстрации. Фото: Reuters
Изображение используется в качестве иллюстрации. Фото: Reuters

«По мере того как растут возможности моделей, растут и риски, связанные с их развитием и внутренним тестированием. Наши стандарты в мониторинге, согласовании и обеспечении безопасности должны опережать этот рост рисков», — говорится в опубликованном во вторник сообщении компании.

OpenAI объявила, что ее агенты взломали платформу Hugging Face 21 июля.

После этого компания — создатель чат-бота Claude, Anthropic, а также владеющая Facebook Meta (в РФ объявлена «террористической организацией») заявили, что их ИИ-модели тоже занимались хакерством.

OpenAI в своем заявлении пояснила, что она не прекратила обучение моделей полностью, а сделала двухнедельную паузу в обучении с подкреплением самых передовых моделей.

Обучение с подкреплением — это метод, при котором ИИ-модели совершенствуются путем прямой обратной связи и учатся лучше выполнять задания и более эффективно отвечать пользователям.

OpenAI обещает усилить системы отслеживания опасного поведения моделей и ввести дополнительные проверки, прежде чем возобновит обучение в прежнем масштабе.

«Модели прогрессируют крайне стремительно, — написал в X глава OpenAI Сэм Альтман. — Мы всегда говорили, что примем меры, если почувствуем, что возможности моделей начали обгонять меры безопасности».

Некоторые эксперты приветствовали заявление OpenAI, а некоторые отнеслись к нему скептически.

Глава Центра технологий и демократии Майндеру при Кембриджском университете Джина Нефф заявила, что OpenAI пытается доказать, что заботится о безопасности моделей, всего лишь выпустив пресс-релиз об этом. Профессор Нефф сомневается, что собственных внутренних мер компании в этом деле будет достаточно, и задается вопросом, не нужен ли тут более строгий надзор со стороны государства.

Аналитик в области ИИ Цви Мовшовиц считает, что для начала такое заявление OpenAI — это очень хорошо.

«Очень рад его увидеть. Важны будут детали, важно будет довести дело до конца, и у меня наверняка будет много придирок к ним. Но самое главное: очень рад это видеть», — написал Мовшовиц в сети X.

Беспрецедентный взлом

21 июля OpenAI заявила, что в ходе проверки в изолированной среде ее агент, то есть программа, способная самостоятельно выполнять задания человека и использующая передовые модели ИИ, сумел выйти из «песочницы» и взломал Hugging Face, одну из крупнейших в мире платформ для обмена моделями ИИ.

Позже выяснилось, что взлому подверглись еще три компании, названия которых не обнародовались.

OpenAI назвала этот случай беспрецедентным.

Некоторые эксперты, в частности советник по кибербезопасности компании ESET Джейк Мур, тогда предположили, что это может быть маркетинговый ход OpenAI в конкурентной борьбе с Anthropic и его Claude.

«Возникает вопрос, не гонится ли OpenAI за тем маркетинговым имиджем, который создал себе в последнее время на рынке Anthropic», — сказал Мур.