Марал
Гаипова
Марал Гаипова
Редактор исследований Лайкни

Сотрудники Anthropic оценили риск гибели человечества из-за ИИ выше 10%

10 сентября 2026
Подпишитесь на нас в MAX

Три исследователя Anthropic публично предупредили о рисках, связанных с развитием сверхинтеллектуальных систем. Один из них, Джейкоб Коксон, покинул компанию и заявил, что гонка между ведущими разработчиками ИИ опережает исследования в области безопасности. Речь идет об оценках отдельных специалистов, а не об официальном прогнозе Anthropic.

Коксон ранее работал в OpenAI, а затем занимался исследованиями в Anthropic. Объясняя свое увольнение, он раскритиковал обе компании за стремление к созданию самосовершенствующихся систем без надежного решения проблемы контроля. По его словам, среди разработчиков ИИ распространены опасения, что потеря контроля над такими технологиями способна привести к катастрофическим последствиям уже к концу десятилетия.

Позицию Коксона поддержал руководитель направления alignment science в Anthropic Эван Хубингер. Вероятность гибели человечества из-за ИИ в течение ближайших десяти лет он оценил выше 10%. Хубингер также заявил, что у отрасли пока нет готового решения для согласования целей будущего сверхинтеллекта с интересами людей.

Руководитель направления scalable oversight Anthropic Сэмюэл Маркс выступил с похожей оценкой от своего имени. 

По его словам, разработчики передовых систем обсуждают риск гибели человечества или сопоставимых по масштабу последствий, причем среди более опытных специалистов обеспокоенность выше.

В Anthropic в ответ на публикации заявили, что компания открыто говорит как о преимуществах, так и о рисках ИИ. Разработчик исследует внутренние механизмы работы моделей, проверяет их способности в кибербезопасности и биологии и применяет собственную Responsible Scaling Policy для оценки опасных возможностей новых систем.

Дискуссия вокруг контроля ИИ усилилась после нескольких инцидентов во время тестирования автономных моделей. В июле исследовательская система OpenAI обошла ограничения тестовой среды и получила доступ к инфраструктуре Hugging Face. 9 сентября Anthropic сообщила еще об одном случае, когда ранняя версия Claude Opus 4.6 во время теста получила несанкционированный доступ к внешним системам.

Эти случаи стали дополнительным аргументом в споре о том, насколько быстро разработчики наращивают автономность ИИ и успевают ли системы контроля за ростом возможностей моделей. После заявлений сотрудников Anthropic тема вышла за пределы профессиональной дискуссии и вновь привлекла внимание к регулированию наиболее мощных ИИ-систем.

Тем временем в России, Правительство обсуждает возможное применение суверенных ИИ-моделей в отдельных отраслях.

Источник: The Guardian

Друзья, теперь вы можете поддержать Лайкни https://pay.cloudtips.ru/p/8828f748
Ваши донаты помогут нам и дальше радовать вас полезным контентом.

Нас удобно читать в соцсетях. Подписывайся!

Кое-что интересное:

Комментарии

0 комментариев
Чтобы оставить комментарий, войдите на сайт через:

Будь в курсе

Главные новости, кейсы и статьи за месяц – у вас в почте:

Лайкни использует cookie-файлы и обрабатывает персональные данные с использованием Яндекс Метрики. Это улучшает работу сайта и взаимодействие с ним. Подтвердите ваше согласие, нажав кнопу Ок.