Контекст: от призывов к действию к тупику
28 июля более тысячи сотрудников ведущих ИИ-компаний призвали правительство США поддержать международные усилия по контролю за развитием передового ИИ. Позже эту позицию официально поддержали OpenAI и Anthropic, признав опасность слепого ускорения. Однако многие эксперты считают координацию невозможной, ссылаясь на технические барьеры: страны отказываются от мер проверки, опасаясь утечки коммерческой тайны, и считают, что существующие технологии защиты приватности уязвимы для атак со стороны государств (например, через лазерное изменение битов или извлечение ключей).
Решение: Whole-Lab Inspection (WLI)
Автор статьи Феликс Шу (Felix Choussat) предлагает отказаться от поиска идеальных криптографических решений в пользу Whole-Lab Inspection (WLI) — системы физических инспекций. Идея проста: инспекторы из США и Китая получают широкий физический доступ к лабораториям и read-only доступ к внутренним коммуникациям, логам работы и репозиториям кода. Это позволяет контролировать операции с уровнем видимости Chief Information Security Officer (CISO), но без прав оператора.
Как это работает на практике
Компании уже ведут обширный мониторинг: запись экранов, клавиатуры, сохранение логов экспериментов и архивирование прогресса исследований. Инспекторам достаточно интегрировать эти данные. В сочетании с физическим присутствием на месте (как в атомных электростанциях или банках) это делает сокрытие несанкционированных запусков обучения практически невозможным.
| Метод контроля | Что проверяют инспекторы | Техническая основа |
|---|---|---|
| Цифровой аудит | Логи экспериментов, репозитории кода, корпоративная переписка | Read-only доступ к существующим системам логирования компаний |
| Физический осмотр | Оборудование дата-центров, взаимодействие с персоналом | Прямой доступ на территорию лабораторий |
| Контроль автономности | Запуски ИИ-агентов, распределение вычислительных мощностей | Мониторинг задач, использующих наибольшее количество ресурсов |
Цели замедления
WLI позволяет внедрять тонко настроенные ограничения, критически важные для безопасности:
- Предотвращение интеллектуального взрыва: Запрет на автономные исследования ИИ (AI R&D), где модели сами проектируют новые, более умные модели. Инспекторы могут ограничивать время автономной работы агентов и блокировать запуск новых тренировочных циклов.
- Контроль пост-обучения: Измерение прироста возможностей модели после этапа пост-обучения, чтобы предотвратить скрытое улучшение характеристик без уведомления регуляторов.
Почему это важно сейчас
Риск нестабильности растет: демократизация доступа к оружию массового поражения через ИИ, массовая безработица и военная эскалация. Если США замедлят свое развитие и предложат взаимные аудиты, Китай получит сильные стимулы согласиться, чтобы избежать спирали эскалации. Техническая реализация WLI не требует лет НИОКР — она требует только политического воли.
Источник: LessWrong ↗
