Главная проблема агентов OpenAI — не интеллект, а бесконтрольная расточительность

Сегодня • Techmeme
OpenAI открывает миру не новую модель, а механизм, который заставляет модели работать. Этот агентский каркас уже лежит под Codex и ChatGPT Work, однако именно он выявляет неудобную правду: автономность измеряется не только качеством ответа, но и тем, сколько вычислений система тратит впустую.

Привычная картина такова: агент — это модель, способная самостоятельно разбивать задачу, вызывать инструменты, читать файлы и проверять результат. Чем больше таких шагов она выполняет, тем полезнее выглядит продукт. В материале Jason Hiner для The Deep View OpenAI предстает компанией, которая превращает эту идею в общую инфраструктуру: один открытый агентский каркас используется сразу в двух направлениях — Codex для программирования и ChatGPT Work для рабочих сценариев.

Но общепринятое мнение здесь переворачивается. А что если главный вызов для агентных систем — не научить их делать больше, а заставить их останавливаться вовремя? Каждый дополнительный вызов модели, повторная проверка, чтение контекста или неудачная попытка расходует токены. В обычном чат-ответе лишний этап раздражает. В автономном агенте он превращается в цепочку новых действий и быстро увеличивает стоимость операции.

Поэтому OpenAI оптимизирует сам harness — слой, который управляет памятью, инструментами, разрешениями, циклами выполнения и передачей контекста между шагами. Это важное смещение фокуса: компания улучшает не только «мозг» агента, но и его рабочую дисциплину. Открытый код в таком случае нужен не исключительно для прозрачности. Он позволяет разработчикам видеть, почему агент повторяет действия, где раздувается контекст и какие операции можно убрать без потери результата. Для Codex это означает более предсказуемую работу с репозиториями; для ChatGPT Work — контроль над задачами, которые могут длиться дольше одного ответа.

Ставка высока именно потому, что каркас общий. Ошибка в логике оркестрации способна повториться в двух продуктах и масштабироваться вместе с каждым новым агентным сценарием. История, описанная The Deep View, показывает: следующий этап развития ИИ определяется не количеством функций в интерфейсе, а эффективностью невидимого слоя между моделью и действием. Агент, который решает задачу за меньшее число шагов, может оказаться ценнее агента с более впечатляющей демонстрацией.