Эксперт Anthropic: ИИ может представлять угрозу существованию человечества в ближайшее десятилетие
Эван Хьюбингер оценил вероятность катастрофического сценария в 10%, на фоне критики со стороны уволившихся сотрудников и вопросов о прозрачности ИИ-компаний.
Quick Look
- Эксперт компании Anthropic Эван Хьюбингер заявил, что ИИ может угрожать человечеству в ближайшие 10 лет с вероятностью 10%.
- Заявление прозвучало на фоне критики безопасности ИИ-разработок и сообщений о нежелании компаний делиться данными с регуляторами.
AI-generated summary
Why It Matters
Ведущие ИИ-компании, включая OpenAI и Anthropic, сталкиваются с растущим давлением из-за опасений по поводу безопасности их автономных моделей. Эксперты предупреждают о нехватке методов контроля над суперинтеллектом.
Искусственный интеллект «может погубить все человечество» в ближайшее десятилетие, считает эксперт в области безопасности использования ИИ в компании Anthropic Эван Хьюбингер. По его оценкам, вероятность такого развития событий составляет порядка 10%.
В своем посте в X Эван Хьюбингер отметил, что риски, связанные с существующими на данный момент ИИ-моделями, невелики. Однако с учетом стремительного развития ИИ-технологий новые модели могут достигнуть такого уровня самостоятельности, что начнут представлять угрозу для существования человечества.
Это заявление прозвучало на фоне сообщений газеты Financial Times о том, что компания Anthropic не предоставила доступ к своей новейшей модели Британскому институту безопасности ИИ (AISI) — одной из ведущих организаций, занимающихся оценкой рисков, связанных с искусственным интеллектом.
Би-би-си обратилась в Anthropic за комментариями.
Хьюбингер не стал подробно описывать, каким именно образом системы ИИ могли бы в будущем атаковать человечество.
Его слова стали реакцией на пост в X Джейкоба Коксона, эксперта в области ИИ, который на этой неделе уволился из Anthropic (ранее он работал в OpenAI).
«Ни одна из этих компаний не ведет себя ответственно», — написал Джейкоб Коксон, комментируя свое решение покинуть Anthropic.
«Вскоре это будут системы, превосходящие человеческий интеллект и способные взломать что угодно, в одночасье совершить революцию в любой сфере, а также получить реальную власть и ресурсы», — отметил Джейкоб Коксон.
Би-би-си также направила запрос в OpenAI с просьбой прокомментировать эти утверждения.
В правительстве Великобритании не стали комментировать информацию о том, что AISI не был предоставлен доступ к новейшей ИИ-модели, созданной Anthropic. Представитель кабинета министров заявил, что власти Британии «продолжают тесно сотрудничать с партнерами в отрасли, включая компанию Anthropic, и работать над повышением безопасности ИИ-моделей».
Нил Лоуренс, профессор Кембриджского университета, в эфире программы Today на радиостанции Би-би-си Radio 4 предположил, что США последовательно отказываются от сотрудничества в области ИИ с другими странами и международными организациями.
«На мой взгляд, это неудивительно, учитывая, что в США искусственный интеллект воспринимают прежде всего в контексте гонки с Китаем и все больше склоняются к изоляционизму; вполне вероятно, что администрация [США] выступает за сокращение сотрудничества с некоторыми союзниками», — отметил он.
«ИИ представляет угрозу существованию человечества как вида»
В своей публикации, набравшей более 10 миллионов просмотров, Хьюбингер заявил: «Мы совершенно искренне считаем», что ИИ представляет угрозу существованию человечества как вида.
«Я полагаю, что Anthropic делает все возможное, однако у нас пока нет плана решения проблемы, как согласовать цели суперинтеллекта с человеческими ценностями, и мы не движемся в этом направлении», — добавил он.
Хьюбингер занимается вопросами согласования целей ИИ — специалисты в этой области работают над тем, что заложить в ИИ-технологии этические представления и принципы, свойственные людям. Иными словами, речь идет о поисках вариантов того, как сделать так, чтобы деятельность ИИ не противоречила человеческим ценностям.
Многие ведущие исследователи говорят, что эти попытки, похоже, терпят неудачу, о чем свидетельствует ряд инцидентов, произошедших этим летом, когда ИИ-агенты и системы, которым разрешено работать автономно, осуществляли кибератаки.
OpenAI, Anthropic и Meta раскрыли информацию о взломах, осуществленных их инструментами искусственного интеллекта.
В отчете по безопасности Anthropic за август говорится, что риск того, что ее ИИ-модели перестанут выполнять запросы какой-либо организации, использующей ИИ, и начнут вмешиваться в работу ее систем и использовать их в собственных целях, является низким.
Риск того, что ИИ-модели смогут «выполнять автоматизированные исследования и разработки», которые могли бы нанести «катастрофический вред» организации, тоже оценивается как «низкий». Однако в Anthropic заявили, что эксперты компании теперь «меньше уверены в этой оценке», чем раньше.
«Мы видим первые признаки потенциального ускорения [развития ситуации в этом направлении]», — говорится в сообщении.
Ведущие деятели в области искусственного интеллекта на протяжении многих лет выражают обеспокоенность по поводу угрозы безопасности, которую представляют ИИ-технологии. Руководители OpenAI, Google Deepmind и Anthropic говорили об этом еще в 2023 году.
Но в последние недели эти предупреждения стали звучать гораздо более угрожающе, поскольку появились доказательства того, что компании, возможно, едва справляются с тем, чтобы держать под контролем новые ИИ-модели.
В начале сентября Якуб Пачоцкий, возглавляющий разработку передовых моделей в OpenAI, призвал к «крайней осторожности» в отношении прогресса ИИ. По его словам, может потребоваться дополнительное вмешательство, чтобы гарантировать, что «люди сохранят контроль [над ИИ] в будущем».
What to Watch
AI outlook — possibilities, not facts
Усиление государственного регулирования ИИ-компаний в Великобритании и США.
Likely · Within months
Open Questions
- Почему Anthropic не предоставила доступ к модели институту AISI?
- Какие конкретные меры безопасности принимаются для предотвращения кибератак ИИ?






