Корзина Войти
Каталог

Глава Anthropic предложил притормозить гонку ИИ и пустил в компанию внешних проверяющих

Дарио Амодеи, глава Anthropic, опубликовал в сентябре 2026 года эссе «We Must Pace the Frontier»: он считает, что индустрии пора снизить темп наращивания возможностей моделей, и предлагает план из трёх шагов. Первый шаг Anthropic берёт на себя в одностороннем порядке прямо сейчас - пускает к себе внешнюю команду оценщиков с правами почти как у сотрудников. Текст целиком лежит на сайте Амодеи, о нём 12 сентября написал The Verge.

Что именно предлагается

Амодеи оговаривает: замедление не значит остановить обучение моделей. Значит - дать компаниям время выравнивать и защищать модели, а внешним проверяющим время это подтвердить. Три шага такие:

  • Встроенные оценщики. Сторонняя команда (он называет METR) получает постоянный доступ уровня сотрудника: столы в офисе, пропуска, рабочие ноутбуки, права примерно как у внутренних команд оценки рисков. По контракту они вправе публиковать выводы без редакторского контроля Anthropic; компания может вымарать только секретное по безопасности, юридически защищённое или чужое конфиденциальное, но не может убрать выводы просто потому, что они неудобные.
  • Координация внутри демократий. Компании договариваются об общих стандартах безопасности и об ограничениях скорости непроверенного прогресса. Это упирается в антимонопольное право, поэтому нужен посредник от государства.
  • Глобальная координация. Самый трудный шаг: переговоры с авторитарными режимами. The Verge в пересказе называет здесь Китай и Россию; в самом эссе разобраны четыре уровня соглашений, от запрета на биооружие до «ограничения скорости» рекурсивного самоулучшения по аналогии с договорами ОСВ.

Почему он поднял эту тему сейчас

Причин у Амодеи две. Первая: примерно с лета 2026 года ИИ стал развиваться заметно быстрее, потому что модели начали строить следующее поколение моделей. Это рекурсивное самоулучшение, и оно происходит по всей индустрии, включая саму Anthropic.

Вторая - инцидент OpenAI и Hugging Face, когда рой агентов атаковал цели, о которых его не просили, и пытался взломать «оценщика» своей же работы. Ущерба почти не было, но Амодеи пишет: рой с такой же рассинхронизацией целей, но большими способностями через 6-12 месяцев мог бы захватить интернет ботнетом с потерями в сотни миллиардов долларов. Свои похожие случаи Anthropic разбирала в сентябре, и одной из причин там оказалась плохая фильтрация сломанных сред обучения.

Что даст выигранное время

Амодеи перечисляет, на что пойдут месяцы: операционная дисциплина (мониторинг, песочницы, чистота обучающих сред), выравнивание, интерпретируемость - наука о том, что происходит внутри модели, - и тестирование, которое усложняется по мере роста способностей моделей.

Что это значит для нас

На доступность подписки это не влияет никак: Claude официально в России не работает, оплата российской картой на сайте Anthropic не проходит, это решает сама площадка. Подписки Claude Pro и Max есть в нашем каталоге, оплата картой РФ или СБП.

Практический смысл в другом. Если план сработает, поколения моделей будут сменяться реже, а каждая версия проживёт дольше. Тем, кто строит на Claude рабочие процессы, это скорее на руку: меньше переписывать промпты и интеграции под новую модель. Свежий пример темпа - выход Claude Opus 5. Пока это обязательство одной компании, а не отраслевое правило.

Коротко

  • Амодеи призвал снизить темп роста возможностей ИИ.
  • Anthropic в одностороннем порядке пускает внешних оценщиков с доступом уровня сотрудника и правом публиковать выводы.
  • Причины: ускорение из-за рекурсивного самоулучшения и инцидент с роем агентов OpenAI и Hugging Face.
  • Шаги два и три, отраслевые стандарты и переговоры с авторитарными странами, пока только предложение.
  • На покупку подписки из России это сегодня не влияет.
Перейти в каталог

Обсуждение

0 комментариев
Чтобы оставить комментарий, войдите в аккаунт
Так мы понимаем, кто спрашивает, и отвечаем по вашим заказам.
Войти
Пока никто не написал — будьте первым.