← Материалы разборы Yersham
разбор · агентытема-фронтир · H 1.51
7.0
из 10
смотреть по главам — взять две-три нужные минуты
оценка машинная и частично зависит от длины ролика — спорите, открывайте оригинал

Минимальный агентный фреймворк и string replace для SWE-bench

The new Claude 3.5 Sonnet, Computer Use, and Building SOTA Agents — with Erik Schluntz, Anthropic

Эрик Шлунц из Anthropic рассказывает о создании агентов для SWE-bench: минимальный фреймворк с инструментами и свободой модели, важность дизайна инструментов (string replace), разделение промптов для простых и сложных задач, а также ограничения бенчмарка.

Минимальный агент с хорошими инструментами и свободой действий — ключ к успеху на SWE-bench, но реальные задач

что из этого моё

Идеи применимы при построении агентов для автоматизации: используйте минимальный фреймворк с инструментами, проектируйте инструменты с примерами, разделяйте промпты по сложности. Для оператора входа в AI это поможет создавать надёжных агентов для работы с кодом и контентом.

Что забрать
отметь, что берёшь в работу → или отбрось как не своёмоё →
переписать инструмент редактирования файлов на string replace вместо генерации diff
разделить промпты для простых и сложных задач через классификацию и роутинг
добавить примеры и подробные описания в документацию инструментов для LLM
о чём говорят, по времени
главы доводят до 35:00 · дальше по ролику меток нет
01
Интро и бэкграунд00:00
Эрик рассказывает о пути от робототехники до Anthropic.
02
SWE-bench: что это05:00
Объяснение ограничений и ценности бенчмарка.
03
Путь к 92%15:00
Анализ ошибок и стратегий повышения точности.
04
Архитектура агента25:00
Минимальный фреймворк: инструменты и свобода модели.
05
Дизайн инструментов35:00
Важность удобства инструментов для LLM.
дальше в дело
Собрать это в маршрут
все маршруты →
не хочешь разбираться сам
Сделаю это под задачу
форматы и цены →
похожие по смыслу · из облака
ещё разборы