AI 2040 Plan A: как должна выглядеть правильная регуляция ИИ по версии инсайдера
Даниэль Кокоталло из OpenAI не только описал катастрофический сценарий AI 2027 — он предложил альтернативу. AI 2040 Plan A — детальный план международной регуляции ИИ, который мог бы привести к безопасному суперинтеллекту к 2040 году.
Критик с планом действий
Большинство критиков ИИ останавливаются на описании рисков. Даниэль Кокоталло — бывший исследователь OpenAI, ушедший из компании из-за несогласия с её курсом — пошёл дальше и сформулировал конкретный план.
AI 2040 Plan A — это его рекомендация того, как мировые правительства и ИИ-компании могли бы действовать, чтобы прийти к суперинтеллекту в 2040 году вместо 2027-2030, с принципиально меньшими рисками.
Важная оговорка Кокоталло: "Это не то, что я думаю, что произойдёт. Это то, что я рекомендую. По умолчанию всё скорее всего пойдёт по сценарию AI 2027."
Четыре ключевых принципа Plan A
Принцип 1: Замедление темпов.Текущий план лабораторий — максимально быстрое достижение суперинтеллекта. Plan A предлагает намеренно снизить темп за счёт регуляции: запрет на рекурсивное самосовершенствование до решения проблемы выравнивания (alignment).
Это означает: ИИ продолжает развиваться, но не "взрывается" экспоненциально. К суперинтеллекту приходят в 2040, а не в 2028-2030.
Принцип 2: Полная научная прозрачность.Все рецепты обучения, архитектурные решения, результаты экспериментов публикуются в открытый доступ. Это контрастирует с текущей ситуацией, где компании держат методологию в тайне как конкурентное преимущество.
Логика: только в условиях прозрачности независимые исследователи могут верифицировать безопасность систем. Сейчас приходится доверять компаниям на слово.
Принцип 3: Широкое распределение доступа.Вместо поддержки монополий — активная политика, обеспечивающая конкуренцию. Несколько стран, несколько компаний, примерно одинаковый уровень возможностей. Это снижает риск того, что один игрок получит монопольный контроль над суперинтеллектом.
Прозрачность сама по себе работает на это: если методологии открыты, другие игроки могут догонять.
Принцип 4: Обратимость.Новая инфраструктура (дата-центры, чипы, вычислительные кластеры) строится с встроенным механизмом "отката": если международное соглашение нарушается и гонка возобновляется, новые мощности автоматически отключаются или уничтожаются. Это не позволяет накопленным ресурсам стать плацдармом для ещё более опасной гонки.
Международное соглашение как ключевое условие
Plan A принципиально невозможен без соглашения между США и Китаем — аналога договоров о контроле над ядерным оружием. Без этого любая страна, которая замедляется, проигрывает тем, кто продолжает гонку.
Сценарий 2029 года в Plan A: президент США договаривается с Китаем о паузе в обучении новых моделей. Инспекторы обоих государств проверяют дата-центры друг друга. Существующие модели продолжают работать (inference), но обучение новых останавливается до создания безопасной инфраструктуры.
Жизнь после замедления: сценарий 2030-2040
Даже при замедлении — не "ничего не происходит". Масштаб уже накопленных систем продолжает расти, потому что инвестиции в инфраструктуру сделаны.
Ключевые вехи в сценарии Plan A:
- 2031: 1/5 всего когнитивного труда выполняется ИИ. Большинство офисных работников управляют ИИ-агентами вместо самостоятельного выполнения задач
- 2033: "Дивиденд граждан" — выплаты из прибылей ИИ-компаний, начинаются с ~$25 тыс. на человека в год
- 2035: ИИ достигает уровня топ-экспертов (но не суперинтеллекта — это намеренная пауза)
- 2037: Роботы, построенные АИ, формируют существенную часть физического труда
- 2040: Решение проблемы выравнивания, "передача эстафеты" — ИИ-системам позволяют снова развиваться
Кокоталло: "Даже в этом, более безопасном сценарии мир к 2040 году будет неузнаваем. Но это будет трансформация без катастрофы."
Что означает "дивиденд граждан"
Один из самых необычных элементов плана — механизм распределения экономических выгод. Если ИИ автоматизирует большинство рабочих мест, ВВП растёт. Но если выгоды концентрируются у владельцев ИИ-компаний и инвесторов, социальная модель разрушается.
Plan A предлагает: государство выдаёт разрешения на использование вычислительных мощностей и роботов, получает прибыль и распределяет её среди граждан в виде дивидендов. К 2040 году, при оптимистичном сценарии — порядка $10 млн в год на человека в сегодняшних ценах.
Это не утопия, это экономический механизм, аналогичный тому, как нефтяные государства (Норвегия, ОАЭ) распределяют природную ренту.
Почему Plan A скорее всего не реализуется
Кокоталло честен: вероятность реализации Plan A по умолчанию низкая. Для этого нужно:
- Чтобы общественность "проснулась" и потребовала регуляции
- Чтобы правительства договорились поверх конкурентных интересов
- Чтобы компании приняли требования прозрачности, убивающие их конкурентное преимущество
Всё это возможно, но требует политической воли, которой пока нет.
Вывод
Plan A — это не фантазия, а детальная дорожная карта. Важна как ориентир: что конкретно нужно сделать, чтобы суперинтеллект пошёл по безопасному пути. Даже если реализация маловероятна, понимание плана помогает оценивать текущие политические решения: движутся ли они в этом направлении или нет.
Есть задача? Обсудим.
Разработка, ИИ, автоматизация, highload — подберём решение под вашу задачу.
Обсудить задачу