← Материалы разборы Yersham
разбор · оркестрациятема-фронтир · H 1.49
2.0
из 10
смотреть не обязательно — забрать выжимку и пункты
оценка машинная и частично зависит от длины ролика — спорите, открывайте оригинал

Три вопроса для оценки агентов: память, артефакты, контекст

Agent Architecture: The Key to AI Results

Видео обсуждает влияниеOutcome Agents на рынок корпоративного софта и введение стресс-теста для оценки агентов: постоянная память, создание редактируемых артефактов и накопление контекста. Отмечается, что многие продукты не проходят базовый тест на память, но все же имеют спрос из-за решения рутинных задач.

Оценивай агентов по трём критериям: память, артефакты, контекст. Сырые инструменты уже рушат рынок, но DIY-арх

что из этого моё

Три вопроса из ролика к любому агентному сервису до оплаты: есть ли постоянная память, создаёт ли редактируемые артефакты, накапливает ли контекст со временем. Показательный антипример — Lindy с рейтингом 2,4 на Trustpilot: без проверяемого артефакта агент крутится в цикле ошибок и жжёт платные кредиты, а остановить его нечем.

Что забрать
отметь, что берёшь в работу → или отбрось как не своёмоё →
проверить свой агентный сервис на наличие постоянной памяти
проверить, создаёт ли агент редактируемые артефакты
проверить, накапливает ли агент контекст со временем
о чём говорят, по времени
главы доводят до 08:00 · дальше по ролику меток нет
01
Введение00:08
Обсуждение финансового шока из-за влияния Outcome Agents.
02
Антропологический агент CWORK01:12
Введение в агента CWORK и его влияние на рынок.
03
Пример с стажёром03:18
Аналогия с стажёром для объяснения ограничений традиционного корпоративного софта.
04
Оценка агентов04:22
Введение в жёсткий рубрикатор для оценки архитектуры агентов.
05
Анализ продуктов08:00
Практический анализ различных продуктов на основе установленных критериев.
дальше в дело
Собрать это в маршрут
все маршруты →
не хочешь разбираться сам
Сделаю это под задачу
форматы и цены →
похожие по смыслу · из облака
ещё разборы