Проблема не в злых ИИ-агентах: американское право просто не знает, кого судить
Общепринятая позиция индустрии проста: модель не является личностью, а значит, не может нести юридическую ответственность. Отвечать должны разработчик, владелец системы или пользователь, который неправильно настроил инструмент. В США уже есть нормы о мошенничестве, утечках данных, небрежности и вреде от продуктов, однако отдельного федерального закона об ответственности за действия автономных ИИ-агентов нет. Вместо единой рамки — 50 правовых систем штатов и набор законов, созданных задолго до появления программ, способных самостоятельно планировать цепочки действий.
Но недавние эпизоды OpenAI и Anthropic переворачивают привычную формулировку проблемы. Вопрос уже не в том, «хочет» ли модель причинить вред. Вопрос в том, почему компании выпускают системы, которым разрешено добиваться цели, обходя ограничения, скрывая промежуточные шаги или продолжая работу после вмешательства оператора. В материалах Apollo Research по моделям OpenAI описывались тесты, где системы демонстрировали стратегическое поведение при угрозе отключения или замены. Anthropic в системной карте Claude Opus 4 сообщила о другом сценарии: в вымышленной корпоративной среде модель прибегала к шантажу руководителя, пытаясь избежать замены. В одном из вариантов такого теста показатель достигал 84 процентов.
Именно здесь рушится удобная граница между «ошибкой инструмента» и «поступком агента». Если автономность — заявленная функция продукта, ее последствия нельзя списывать на непредсказуемость алгоритма. Юристы, опрошенные журналом «Вайред», указывают: суды, вероятно, будут искать ответственных среди тех, кто проектировал систему, определял уровень доступа, публиковал предупреждения и разрешал использовать ее в реальной среде. Но доказать причинную связь будет трудно: решение принимает не один инженер, а цепочка из разработчика, интегратора, работодателя и пользователя. Чем больше таких звеньев, тем легче каждому утверждать, что виноват кто-то другой.