Сад · Побег
Замерить время и стоимость выполнения задачи агентом
«побег» · 4 карт. · 4 голос.(-а/-ов) корпуса · 66 дн. между первым и последним
агентыоркестрацияавтоматизациябезопасностьllmaiспециализациямикротестирование
4 карточек корпуса (4 голос.(-а/-ов) с учётом повторов внутри карточки) независимо друг от друга подошли к одному и тому же действию, за 66 дн. (2026-06-08 — 2026-08-13).
Как формулировали
- замерить время выполнения агента с проверкой политик и без неё (2026-06-25)
- замерить стоимость и время выполнения для задачи с тремя агентами на своей модели (2026-06-25)
- замерить время и качество выполнения задачи базовым инструментом (2026-06-08)
- замерить стоимость запуска агента на своей модели (2026-08-13)
Источники
- Микротестирование доказывает эффективность специализированных AI-инструментов · 2026-06-08 · частично
- PolyClaude: совет из шести когнитивных агентов в Claude Code · 2026-06-25 · частично
- NVIDIA NemoClaw и OpenShell: безопасность автономных агентов · 2026-06-25 · частично
- DeepSeek Harness: плагинная архитектура и Trajectory для отладки агентов · 2026-08-13 · частично
Соседние темы
- Вынести список ролей, команд и инструментов агента в конфиг — 1 общих карточек, 5 общих тега(ов)
- Настроить автоматическую оценку ответов агента: LLM-судью или эталонный набор вместо ручной проверки — 7 общих тега(ов)
- Автоматизировать рутинные задачи агента по расписанию (крон, таймер) — 6 общих тега(ов)
- Завести файл с правилами проекта для агента (CLAUDE.md, AGENTS.md, KNOWLEDGE.md) — 6 общих тега(ов)
- Явно ограничивать агента: права, число итераций, размер контекста — 6 общих тега(ов)