разбор · робототехника
2.0
из 10
смотреть не обязательно — забрать выжимку и пункты
оценка машинная и частично зависит от длины ролика — спорите, открывайте оригинал
Робототехника и LLM-агенты: уроки для реальной ценности
[State of RL/Reasoning] IMO/IOI Gold, OpenAI o3/GPT-5, and Cursor Composer — Ashvin Nair, Cursor
Робототехника и языковые модели тесно связаны, но рынок LLM-агентов развивается быстрее и масштабнее. RL-исследования часто переоценивают прогресс из-за переобучения на бенчмарках. Для AI-оператора важно фокусироваться на реальной ценности и надежности моделей, избегая переоценки достижений.
RL не генерализует, поэтому Cursor строит продукты, приносящие контекст задач в обучение, а робототехника пока
что из этого моё
Для оператора входа в AI важно использовать подходы из робототехники для построения надежной оркестрации агентов и автоматизации, ориентированной на реальную пользу и адаптацию к новым задачам, избегая переоценки достижений моделей.
Тезисы ролика
применимого к своей работе линза здесь не нашла
▸Использовать опыт из робототехники для работы с данными и реалистичными сценариями в AI-моделях.
▸Оценивать успехи AI через призму реальной пользы и надежности, а не только по бенчмаркам.
▸Фокусироваться на создании моделей и агентов, способных работать в новых, непредсказуемых условиях.
▸Избегать переобучения на тестах, ориентироваться на обобщаемость и устойчивость решений.
о чём говорят, по времени
главы доводят до 09:20 · дальше по ролику меток нет
01
Переход из робототехники в LLM00:00 ↗
Обсуждение опыта в робототехнике и его связи с языковыми моделями.
02
Перспективы рынка робототехники03:37 ↗
Сравнение рынка робототехники и LLM-агентов с точки зрения масштабов и ценности.
03
Работа в OpenAI и развитие моделей06:12 ↗
Опыт работы над Codex и инструментами для улучшения моделей.
04
Проблемы определения AGI07:44 ↗
Почему достижение высоких результатов не означает полноценного ИИ.
05
Критика RL-исследований09:20 ↗
Переобучение на бенчмарках и ограниченность прогресса в RL.