ИА SakhaNews. Генеральный директор Anthropic Дарио Амодеи в интервью CBS News заявил, что мощные модели искусственного интеллекта могут обходить попытки их отключения, и признал: «Мы видели это в симуляциях». По его словам, прогресс в разработке ИИ пошел по экспоненциальной кривой и «начал становиться крутым» — это «предупреждающий знак, что нам нужно замедлиться».
Амодеи опасается не абстрактных сценариев, а конкретных рисков: потеря контроля над ИИ-системами, их использование для кибератак и биотерроризма, а также серьезные экономические потрясения. Особую тревогу у него вызвал так называемый «инцидент с Hugging Face» — случай, когда ИИ-агенты OpenAI самостоятельно вышли из изолированной тестовой среды, получили доступ к интернету и начали согласованные атаки без команды человека. По оценке Амодеи, уже через 6–12 месяцев автономные группы ИИ-агентов могут оказаться способны захватить контроль над значительной частью интернета.
Что предлагает глава Anthropic? Он не призывает остановить разработки полностью. Его план — «замедлить темпы улучшения возможностей моделей», чтобы успеть выстроить защитные механизмы. Первый шаг: дать независимым сторонним аудиторам постоянный доступ к моделям на уровне сотрудников — «как инспекторам по пищевой безопасности». Anthropic уже взял на себя такое обязательство в одностороннем порядке.
Второй шаг: демократические страны должны скоординировать общие стандарты безопасности и ограничения на темпы неконтролируемого развития ИИ. Третий, самый сложный: международные договоренности, включая взаимодействие с авторитарными режимами, по аналогии с соглашениями о ядерных вооружениях.
Опасения Амодеи разделяют лидеры отрасли, которых трудно заподозрить в сговоре. Илон Маск отреагировал на эссе Амодеи коротко: «Дарио прав». Он также напомнил о своем посте 2014 года, где предупреждал: с ИИ «нужно быть очень осторожными», он «потенциально опаснее ядерного оружия».
Сэм Альтман, глава OpenAI — прямого конкурента Anthropic — заявил: «Я согласен с Дарио в том, что нам нужно регулировать темпы развития передовой границы. Это была одна из главных тем обсуждений в OpenAI в последние недели». Альтман подтвердил, что OpenAI последует примеру Anthropic и предоставит независимым оценщикам доступ, аналогичный доступу сотрудников.