Поддержать нас
Беларусы на войне
  1. Еще 4 млн квадратов за МКАД. Власти рассказали, где появится главный новый жилой район Минска
  2. У ИП пенсия может быть почти вдвое меньше средней по стране. В Минтруда объяснили почему
  3. У мобильных операторов появились изменения
  4. «Вы проработали 20 лет, но столько стажа у вас нет». Беларусы обсуждают пенсионную систему
  5. Беларуска рассказала в Threads, что ее отца-спасателя избили на работе. Сначала на нападавших завели «уголовку», но потом все переиграли
  6. Кочанова назвала один из вызовов для общества и государства — собирается навести порядок
  7. Доллар обновил годовой максимум: итоги августа и прогнозы сентября
  8. Из Литвы выслали 22 беларуса, работавших в IT-компании, — их признали угрозой национальной безопасности
  9. Соучредитель архитектурной студии ZROBIM architects рассказал о четырех месяцах в СИЗО
  10. Его уволили за появление в пьяном виде, но это была провокация по приказу Лукашенко. Как сложились судьбы министров обороны Беларуси
  11. «Ажиотажный спрос». На авторынке возникли очереди за этими машинами — приходится ждать месяцами
  12. Заплатили 8000 долларов за путевку — и получили кошмар. Беларусы неудачно съездили в Турцию
  13. В 2027 году появится налоговое новшество — оно затрагивает тех, у кого зарегистрированы отношения
  14. Дожди, туман и похолодание: какой будет погода в Беларуси на следующей неделе
  15. «Повернула голову — он уже лежал». Что известно про бегуна, который умер на Минском полумарафоне
  16. «Мы об этом никогда не договаривались». Уиткофф в Кремле поблагодарил Путина за три дня без ударов по Киеву — ответ был неожиданным
  17. На следующей неделе прогнозируют до +30°С
  18. «Реклама повсюду». Кто стоит за крупнейшими казино в Беларуси
  19. Легкая температура держится неделями, а больше ничего не беспокоит? Это может быть опасный знак — объясняем
  20. «Хватит экспериментировать и трясти образование». Глава Минобра сделал заявление, которое взбудоражило людей (и это не преувеличение)
  21. В 2027 году появится новшество для тех, кто будет обращаться в посольства и консульства, — и оно явно понравится далеко не всем


Компания OpenAI, разработчик ChatGPT, объявила, что, после того как ее ИИ-агенты вышли из-под контроля и взломали платформу Hugging Face, она замедлила обучение передовых ИИ-моделей, чтобы подтянуть меры безопасности, пишет Русская служба Би-би-си.

Изображение используется в качестве иллюстрации. Фото: Reuters
Изображение используется в качестве иллюстрации. Фото: Reuters

«По мере того как растут возможности моделей, растут и риски, связанные с их развитием и внутренним тестированием. Наши стандарты в мониторинге, согласовании и обеспечении безопасности должны опережать этот рост рисков», — говорится в опубликованном во вторник сообщении компании.

OpenAI объявила, что ее агенты взломали платформу Hugging Face 21 июля.

После этого компания — создатель чат-бота Claude, Anthropic, а также владеющая Facebook Meta (в РФ объявлена «террористической организацией») заявили, что их ИИ-модели тоже занимались хакерством.

OpenAI в своем заявлении пояснила, что она не прекратила обучение моделей полностью, а сделала двухнедельную паузу в обучении с подкреплением самых передовых моделей.

Обучение с подкреплением — это метод, при котором ИИ-модели совершенствуются путем прямой обратной связи и учатся лучше выполнять задания и более эффективно отвечать пользователям.

OpenAI обещает усилить системы отслеживания опасного поведения моделей и ввести дополнительные проверки, прежде чем возобновит обучение в прежнем масштабе.

«Модели прогрессируют крайне стремительно, — написал в X глава OpenAI Сэм Альтман. — Мы всегда говорили, что примем меры, если почувствуем, что возможности моделей начали обгонять меры безопасности».

Некоторые эксперты приветствовали заявление OpenAI, а некоторые отнеслись к нему скептически.

Глава Центра технологий и демократии Майндеру при Кембриджском университете Джина Нефф заявила, что OpenAI пытается доказать, что заботится о безопасности моделей, всего лишь выпустив пресс-релиз об этом. Профессор Нефф сомневается, что собственных внутренних мер компании в этом деле будет достаточно, и задается вопросом, не нужен ли тут более строгий надзор со стороны государства.

Аналитик в области ИИ Цви Мовшовиц считает, что для начала такое заявление OpenAI — это очень хорошо.

«Очень рад его увидеть. Важны будут детали, важно будет довести дело до конца, и у меня наверняка будет много придирок к ним. Но самое главное: очень рад это видеть», — написал Мовшовиц в сети X.

Беспрецедентный взлом

21 июля OpenAI заявила, что в ходе проверки в изолированной среде ее агент, то есть программа, способная самостоятельно выполнять задания человека и использующая передовые модели ИИ, сумел выйти из «песочницы» и взломал Hugging Face, одну из крупнейших в мире платформ для обмена моделями ИИ.

Позже выяснилось, что взлому подверглись еще три компании, названия которых не обнародовались.

OpenAI назвала этот случай беспрецедентным.

Некоторые эксперты, в частности советник по кибербезопасности компании ESET Джейк Мур, тогда предположили, что это может быть маркетинговый ход OpenAI в конкурентной борьбе с Anthropic и его Claude.

«Возникает вопрос, не гонится ли OpenAI за тем маркетинговым имиджем, который создал себе в последнее время на рынке Anthropic», — сказал Мур.