разбор · агентытема-фронтир · H 1.51
7.0
из 10
смотреть по главам — взять две-три нужные минуты
оценка машинная и частично зависит от длины ролика — спорите, открывайте оригинал
Минимальный агентный фреймворк и string replace для SWE-bench
The new Claude 3.5 Sonnet, Computer Use, and Building SOTA Agents — with Erik Schluntz, Anthropic
Эрик Шлунц из Anthropic рассказывает о создании агентов для SWE-bench: минимальный фреймворк с инструментами и свободой модели, важность дизайна инструментов (string replace), разделение промптов для простых и сложных задач, а также ограничения бенчмарка.
Минимальный агент с хорошими инструментами и свободой действий — ключ к успеху на SWE-bench, но реальные задач
что из этого моё
Идеи применимы при построении агентов для автоматизации: используйте минимальный фреймворк с инструментами, проектируйте инструменты с примерами, разделяйте промпты по сложности. Для оператора входа в AI это поможет создавать надёжных агентов для работы с кодом и контентом.
Что забрать
отметь, что берёшь в работу → или отбрось как не своёмоё →
переписать инструмент редактирования файлов на string replace вместо генерации diff
разделить промпты для простых и сложных задач через классификацию и роутинг
добавить примеры и подробные описания в документацию инструментов для LLM
о чём говорят, по времени
главы доводят до 35:00 · дальше по ролику меток нет
01
Интро и бэкграунд00:00 ↗
Эрик рассказывает о пути от робототехники до Anthropic.
02
SWE-bench: что это05:00 ↗
Объяснение ограничений и ценности бенчмарка.
03
Путь к 92%15:00 ↗
Анализ ошибок и стратегий повышения точности.
04
Архитектура агента25:00 ↗
Минимальный фреймворк: инструменты и свобода модели.
05
Дизайн инструментов35:00 ↗
Важность удобства инструментов для LLM.