
Руководители крупнейших AI-компаний неожиданно сблизили позиции в вопросе регулирования искусственного интеллекта. После предложения главы Anthropic Дарио Амодеи о замедлении разработки передовых моделей похожую готовность обсуждать контроль публично продемонстрировали представители OpenAI, Google DeepMind и SpaceX.
Инициатива Anthropic включает три направления. Первое - внедрение независимых сторонних специалистов непосредственно в исследовательские лаборатории. Такие evaluators должны помогать оценивать возможности новых моделей и потенциальные риски до их широкого выпуска.
Второе предложение связано с координацией внутри американской AI-индустрии. Компании могли бы согласовывать подходы к тестированию, обмениваться информацией об опасных сценариях и устанавливать общие правила для наиболее мощных систем.
Третий пункт предполагает создание международных договорённостей. Для их реализации может потребоваться участие государственных органов, поскольку разработка больших моделей уже затрагивает вопросы кибербезопасности, распространения дезинформации и контроля вычислительных мощностей.
Публичного единства пока недостаточно
Сэм Альтман, Демис Хассабис и Илон Маск публично выразили согласие как минимум с отдельными элементами этой концепции. Однако поддержка общих принципов не означает, что компании договорились о конкретных сроках, стандартах проверок или юридической ответственности.
Именно поэтому противостояние вокруг регулирования ИИ не заканчивается. Лаборатории одновременно стремятся сохранить темп разработки и убедить власти, пользователей и инвесторов, что новые модели можно выпускать безопасно. Чем мощнее становятся системы, тем сложнее отделить добровольные отраслевые обещания от обязательных требований.
Для пользователей из России важным последствием может стать изменение доступа к зарубежным AI-сервисам. Международные правила способны повлиять не только на обучение моделей, но и на регистрацию разработчиков, обработку данных, экспорт ускорителей и доступность отдельных функций в разных странах.
Что уже меняется в регулировании
Дополнительный ориентир даёт европейский AI Act. Его требования вводятся поэтапно: запреты на отдельные практики начали действовать 2 февраля 2025 года, правила для моделей общего назначения - 2 августа 2025 года, а основная часть положений для большинства систем должна применяться с 2 августа 2026 года. За нарушения предусмотрены штрафы до 35 млн евро или 7% мирового годового оборота компании - в зависимости от того, какая сумма выше.
Параллельно разработчики используют технические оценки, red teaming и специальные тестовые наборы для поиска уязвимостей. Но такие процедуры пока не заменяют независимый надзор: компании сами выбирают методики, публикуют только часть результатов и по-разному определяют, какие возможности модели считать опасными.
Предложение Anthropic может стать основой для будущего компромисса, если его удастся превратить в измеримые правила. Пока же публичные заявления руководителей AI-компаний показывают скорее общее направление дискуссии, чем готовое международное соглашение.