Агент кодирования вернул зеленый сигнал в 02:11. Агент вызвал search_repo, а затем edit_file. хорошо. В экспорте JSONL все вызовы перечислены по порядку. Большинство записей агентов по-прежнему представляют собой простые журналы вызовов. Зеленый диапазон инструментов отвечает на один узкий вопрос. ...
Агент кодирования вернул зеленый сигнал в 02:11.
В билете просили маленького помощника по тестированию.
Эта сцена представляет собой построенный пример вызова по вызову.
Агент вызвал search_repo, а затем edit_file.
Оба диапазона инструментов закрыты со статусом «ОК».
Патч попал в неправильный пакет Python.
В экспорте JSONL все вызовы перечислены по порядку.
В нем никогда не перечислялись инструменты, которые планировщик отверг.
Оперативному штабу не удалось воспроизвести важную вилку.
Журналы выполнения не являются журналами маршрутизации.
Большинство записей агентов по-прежнему представляют собой простые журналы вызовов.
Они хранят имя, аргументы, задержку и окончательный статус.
Они опускают ранжированные варианты выбора.
Зеленый диапазон инструментов отвечает на один узкий вопрос.
Он только спрашивает, вызвал ли вызов ошибку.
Это не отвечает на вопрос, почему этот инструмент победил.
Агенты в стиле цикла часто терпят неудачу на развилке.
Неправильный поисковый запрос по-прежнему возвращает результаты.
Неправильный файл по-прежнему принимает чистое редактирование.
Эти прогоны выглядят нормально на панелях мониторинга.
Пользователь по-прежнему получает бесполезное изменение.
Вам нужен список отброшенных альтернатив.
Что должен охватывать диапазон принятия решений
Запишите свой выбор перед запуском инструмента.
Не восстанавливайте намерение на основе более поздних аргументов.
Аргументы описывают победителя, а не поле.
Каждое решение охватывает n