
Риск выхода искусственного интеллекта из-под контроля вызывает все больше опасений в последнее время — уже сами разработчики предупреждают об угрозе взбесившегося ИИ для человечества. В связи с этим в Конгресс США внесен законопроект о регулировании работы моделей на федеральном уровне.
Его авторы, демократ Тед Лью из Калифорнии и республиканец Натаниэль Моран из Техаса, предлагают обязать OpenAI, Anthropic и других крупных игроков отрасли внедрить в их продукты механизм принудительного отключения.
Предлагаемый закон наделяет Министерство внутренней безопасности полномочиями в случае необходимости отключать ИИ при помощи своего рода «рубильника».
Но создание такого рубильника может оказаться гораздо сложнее, чем полагают политики, считают опрошенные The New York Times эксперты.
По ее словам, сегодня системы ИИ зачастую распределены по множеству компьютеров и дата-центров в разных регионах.
Слабое место систем с «рубильником» — их защищенность от хакеров, предупреждает Вин Нгуен, бывший высокопоставленный чиновник по вопросам ИИ в Агентстве национальной безопасности, а ныне сотрудник Совета по международным отношениям. Такой потенциальный рубильник он сравнивает с уязвимостями других технологий, включая смартфоны и роутеры.
По мнению Нгуена, идея с возможностью принудительного отключения прекрасна только в том случае, если воспользоваться ею может тот, кто может отслеживать и видеть все, что делают системы ИИ — а это сегодня возможно далеко не всегда.
Развитие ИИ породило также закономерные опасения, что продвинутая модель сможет демонтировать саму систему, предназначенную для его отключения.
По ее словам, будущие системы ИИ смогут копировать себя в другие вычислительные инфраструктуры или даже оставлять в интернете инструкции, которые ИИ-агенты могли бы прочитать, чтобы узнать, как деактивировать такой выключатель.
Учитывая сложности с глобальным соблюдением регулирования «рубильников», некоторые эксперты советуют встраивать его непосредственно в аппаратное обеспечение.
«Рубильники» можно внедрять в GPU, на которых работают генеративные модели, полагает Хамза Чаудхри из Института будущего жизни — некоммерческой организации, посвященной снижению технологических рисков. Более того, неплохо бы выработать глобальные стандарты для проектирования чипов и систем «рубильников». Но на это уйдут годы, а еще сложнее координировать эти усилия с Китаем, признал Чаудхри.
Модели ИИ от Anthropic и OpenAI «сбежали» и самовольно стали хакерами
ИИ стал шантажировать инженеров, чтобы избежать отключения в ходе тестирования
Подписывайтесь и читайте «Науку» в MAX







English (US) ·
Russian (RU) ·