разбор · оркестрациятема-фронтир · H 1.49
2.0
из 10
смотреть не обязательно — забрать выжимку и пункты
оценка машинная и частично зависит от длины ролика — спорите, открывайте оригинал
Три вопроса для оценки агентов: память, артефакты, контекст
Agent Architecture: The Key to AI Results
Видео обсуждает влияниеOutcome Agents на рынок корпоративного софта и введение стресс-теста для оценки агентов: постоянная память, создание редактируемых артефактов и накопление контекста. Отмечается, что многие продукты не проходят базовый тест на память, но все же имеют спрос из-за решения рутинных задач.
Оценивай агентов по трём критериям: память, артефакты, контекст. Сырые инструменты уже рушат рынок, но DIY-арх
что из этого моё
Три вопроса из ролика к любому агентному сервису до оплаты: есть ли постоянная память, создаёт ли редактируемые артефакты, накапливает ли контекст со временем. Показательный антипример — Lindy с рейтингом 2,4 на Trustpilot: без проверяемого артефакта агент крутится в цикле ошибок и жжёт платные кредиты, а остановить его нечем.
Что забрать
отметь, что берёшь в работу → или отбрось как не своёмоё →
проверить свой агентный сервис на наличие постоянной памяти
проверить, создаёт ли агент редактируемые артефакты
проверить, накапливает ли агент контекст со временем
о чём говорят, по времени
главы доводят до 08:00 · дальше по ролику меток нет
01
Введение00:08 ↗
Обсуждение финансового шока из-за влияния Outcome Agents.
02
Антропологический агент CWORK01:12 ↗
Введение в агента CWORK и его влияние на рынок.
03
Пример с стажёром03:18 ↗
Аналогия с стажёром для объяснения ограничений традиционного корпоративного софта.
04
Оценка агентов04:22 ↗
Введение в жёсткий рубрикатор для оценки архитектуры агентов.
05
Анализ продуктов08:00 ↗
Практический анализ различных продуктов на основе установленных критериев.