Обновление OpenAI Codex Multi-Agent V2 вызвало вопросы к прозрачности инструкций агентов
Недавнее обновление OpenAI для Codex CLI ввело новый протокол, который, как представляется, переносит больше решений по оркестрации из пользовательской конфигурации в runtime, из-за чего разработчики начали требовать большей прозрачности в инструкциях, которыми обмениваются AI-агенты.
В подробном merged request на GitHub пользователи заявили, что архитектура CLI с Multi-Agent V2 больше не показывает инструкции, передаваемые между parent- и sub-agents, что затрудняет понимание того, как работа распределяется по системе.
«В Multi-Agent v2 инструкции агентов сейчас проходят через обычные аргументы инструментов и inter-agent context. Это значит, что parent model может выдавать текст задачи в открытом виде, Codex может сохранять его в history/rollouts, а получатель может получить его как обычный assistant-message JSON», — говорится в запросе.

«Это меняет путь v2 так, что инструкции агентов остаются зашифрованными между model calls: Responses шифрует message argument, возвращённый моделью, Codex передаёт только этот ciphertext, а Responses расшифровывает его внутри для модели-получателя», — добавили авторы.
Другие участники обсуждения также связали отсутствие видимости инструкций агентов с недавно введённым Multi-Agent V2. Один из пользователей отметил, что откат на предыдущую версию CLI временно возвращает видимость, но это лишь временное решение.
Отдельно Игнат Ремизов, CTO платёжного сервиса Zolvat, подал feature request на GitHub, предлагая постоянное решение после того, как предположил, что OpenAI могла внести изменение ради усиления безопасности.
«Возможный вариант — сохранить зашифрованное поле message для доставки модели, но добавить отдельное незашифрованное audit field с читаемым текстом задачи. Audit field должен сохраняться в rollout/history/trace metadata, чтобы пользователи и сопровождающие могли видеть, что именно было делегировано, без необходимости расшифровывать ciphertext доставки модели», — написал Ремизов.
Проблемы корпоративного управления, вероятно, станут заметнее
Хотя один из участников OpenAI заявил, что протокол всё ещё находится в разработке и отказался от дальнейших изменений по запросу, аналитики предупредили, что в случае сохранения проблемы или превращения её в долгосрочную особенность multi-agent systems она создаст сложности для отладки, governance и операционной работы в командах разработки и в их компаниях.
«Скрытые инструкции агентов снижают observability в multi-agent systems. Разработчики больше не могут понять, вызвана ли ошибка неверной делегацией задачи, плохой оркестрацией или рассуждением модели, поэтому debugging, prompt optimization и root-cause analysis становятся значительно сложнее. Следы инструкций агентов становятся столь же важными, как application logs в современном ПО», — сказал Pareekh Jain, principal analyst в Pareekh Consulting.
По словам Джайна, для CIO непрозрачные взаимодействия агентов создают проблемы в области governance.
«Без видимости того, как агенты делегировали и выполняли задачи, становится труднее проводить аудит решений, расследовать инциденты, подтверждать compliance и выстраивать доверие к AI-системам. Компании всё чаще будут ожидать защищённого, но auditable agent communication, а не полностью скрытой orchestration», — сказал Джайн.
«Любая крупная компания, особенно в регулируемых отраслях вроде банков и больниц, должна уметь доказать, что именно сделали её AI-системы и почему, особенно если что-то пошло не так. Если sub-agent сделал что-то плохое, например затронул private data, компании нужно показать, что именно ему было поручено. Если такого record нет, это серьёзная проблема для trust и legal accountability, а не просто раздражающая мелочь», — добавил он.
Кроме того, аналитик отметил, что проблемы с видимостью операций агентов могут даже замедлить production deployments критически важных AI-систем.
«Компании, как мы уже видим на GitHub у разработчиков, вероятно, будут требовать более сильной observability, audit trails и governance, прежде чем доверять автономным multi-agent systems. Это почти так же важно, как model performance», — добавил Джайн.
Запрос по электронной почте в OpenAI о планируемых изменениях протокола остался без ответа.
Материал — перевод статьи с английского.
Оригинал: Codex Multi-Agent V2 update raises developer concerns over agent transparency