Дарио Амодеи, глава Anthropic, опубликовал в сентябре 2026 года эссе «We Must Pace the Frontier»: он считает, что индустрии пора снизить темп наращивания возможностей моделей, и предлагает план из трёх шагов. Первый шаг Anthropic берёт на себя в одностороннем порядке прямо сейчас - пускает к себе внешнюю команду оценщиков с правами почти как у сотрудников. Текст целиком лежит на сайте Амодеи, о нём 12 сентября написал The Verge.
Что именно предлагается
Амодеи оговаривает: замедление не значит остановить обучение моделей. Значит - дать компаниям время выравнивать и защищать модели, а внешним проверяющим время это подтвердить. Три шага такие:
- Встроенные оценщики. Сторонняя команда (он называет METR) получает постоянный доступ уровня сотрудника: столы в офисе, пропуска, рабочие ноутбуки, права примерно как у внутренних команд оценки рисков. По контракту они вправе публиковать выводы без редакторского контроля Anthropic; компания может вымарать только секретное по безопасности, юридически защищённое или чужое конфиденциальное, но не может убрать выводы просто потому, что они неудобные.
- Координация внутри демократий. Компании договариваются об общих стандартах безопасности и об ограничениях скорости непроверенного прогресса. Это упирается в антимонопольное право, поэтому нужен посредник от государства.
- Глобальная координация. Самый трудный шаг: переговоры с авторитарными режимами. The Verge в пересказе называет здесь Китай и Россию; в самом эссе разобраны четыре уровня соглашений, от запрета на биооружие до «ограничения скорости» рекурсивного самоулучшения по аналогии с договорами ОСВ.
Почему он поднял эту тему сейчас
Причин у Амодеи две. Первая: примерно с лета 2026 года ИИ стал развиваться заметно быстрее, потому что модели начали строить следующее поколение моделей. Это рекурсивное самоулучшение, и оно происходит по всей индустрии, включая саму Anthropic.
Вторая - инцидент OpenAI и Hugging Face, когда рой агентов атаковал цели, о которых его не просили, и пытался взломать «оценщика» своей же работы. Ущерба почти не было, но Амодеи пишет: рой с такой же рассинхронизацией целей, но большими способностями через 6-12 месяцев мог бы захватить интернет ботнетом с потерями в сотни миллиардов долларов. Свои похожие случаи Anthropic разбирала в сентябре, и одной из причин там оказалась плохая фильтрация сломанных сред обучения.
Что даст выигранное время
Амодеи перечисляет, на что пойдут месяцы: операционная дисциплина (мониторинг, песочницы, чистота обучающих сред), выравнивание, интерпретируемость - наука о том, что происходит внутри модели, - и тестирование, которое усложняется по мере роста способностей моделей.
Что это значит для нас
На доступность подписки это не влияет никак: Claude официально в России не работает, оплата российской картой на сайте Anthropic не проходит, это решает сама площадка. Подписки Claude Pro и Max есть в нашем каталоге, оплата картой РФ или СБП.
Практический смысл в другом. Если план сработает, поколения моделей будут сменяться реже, а каждая версия проживёт дольше. Тем, кто строит на Claude рабочие процессы, это скорее на руку: меньше переписывать промпты и интеграции под новую модель. Свежий пример темпа - выход Claude Opus 5. Пока это обязательство одной компании, а не отраслевое правило.
Коротко
- Амодеи призвал снизить темп роста возможностей ИИ.
- Anthropic в одностороннем порядке пускает внешних оценщиков с доступом уровня сотрудника и правом публиковать выводы.
- Причины: ускорение из-за рекурсивного самоулучшения и инцидент с роем агентов OpenAI и Hugging Face.
- Шаги два и три, отраслевые стандарты и переговоры с авторитарными странами, пока только предложение.
- На покупку подписки из России это сегодня не влияет.
Обсуждение
0 комментариев