Отключение взбесившегося ИИ признали затруднительным

2 часов назад 1

Отключение взбесившегося ИИ признали затруднительным

© Телеканал «Наука»

Риск выхода искусственного интеллекта из-под контроля вызывает все больше опасений в последнее время — уже сами разработчики предупреждают об угрозе взбесившегося ИИ для человечества. В связи с этим в Конгресс США внесен законопроект о регулировании работы моделей на федеральном уровне.

Его авторы, демократ Тед Лью из Калифорнии и республиканец Натаниэль Моран из Техаса, предлагают обязать OpenAI, Anthropic и других крупных игроков отрасли внедрить в их продукты механизм принудительного отключения.

«Люди всегда должны контролировать ИИ, а не наоборот. Человек должен иметь возможность замедлить или отключить любого ИИ-агента или модель», — убежден Лью.

Предлагаемый закон наделяет Министерство внутренней безопасности полномочиями в случае необходимости отключать ИИ при помощи своего рода «рубильника».

Но создание такого рубильника может оказаться гораздо сложнее, чем полагают политики, считают опрошенные The New York Times эксперты.

«Часто нет такого провода, который можно выдернуть», — констатирует Хелен Тонер, исполнительный директор Центра безопасности и новых технологий Джорджтаунского университета и бывший член совета директоров OpenAI.

По ее словам, сегодня системы ИИ зачастую распределены по множеству компьютеров и дата-центров в разных регионах.

Слабое место систем с «рубильником» — их защищенность от хакеров, предупреждает Вин Нгуен, бывший высокопоставленный чиновник по вопросам ИИ в Агентстве национальной безопасности, а ныне сотрудник Совета по международным отношениям. Такой потенциальный рубильник он сравнивает с уязвимостями других технологий, включая смартфоны и роутеры.

По мнению Нгуена, идея с возможностью принудительного отключения прекрасна только в том случае, если воспользоваться ею может тот, кто может отслеживать и видеть все, что делают системы ИИ — а это сегодня возможно далеко не всегда.

Развитие ИИ породило также закономерные опасения, что продвинутая модель сможет демонтировать саму систему, предназначенную для его отключения.

«Если очень мощная система ИИ выходит из-под контроля, логично ожидать, что она попытается предотвратить собственное отключение», — считает Тонер.

По ее словам, будущие системы ИИ смогут копировать себя в другие вычислительные инфраструктуры или даже оставлять в интернете инструкции, которые ИИ-агенты могли бы прочитать, чтобы узнать, как деактивировать такой выключатель.

Учитывая сложности с глобальным соблюдением регулирования «рубильников», некоторые эксперты советуют встраивать его непосредственно в аппаратное обеспечение.

«Рубильники» можно внедрять в GPU, на которых работают генеративные модели, полагает Хамза Чаудхри из Института будущего жизни — некоммерческой организации, посвященной снижению технологических рисков. Более того, неплохо бы выработать глобальные стандарты для проектирования чипов и систем «рубильников». Но на это уйдут годы, а еще сложнее координировать эти усилия с Китаем, признал Чаудхри.

Модели ИИ от Anthropic и OpenAI «сбежали» и самовольно стали хакерами

ИИ стал шантажировать инженеров, чтобы избежать отключения в ходе тестирования

Подписывайтесь и читайте «Науку» в MAX

Прочитайте статью целиком