← Материалы разборы Yersham
разбор · оркестрациябалл 8.0#259 из 823 · 2026-03-25

Meter исследует способности AI-моделей и их реальные действия, связывая это с угрозами для общества. Основной вывод — текущие модели пока не способны на катастрофические риски, но стоит внимательно отслеживать их развитие и пропенсити к опасным действиям.

Measuring Exponential Trends Rising (in AI) — Joel Becker, METR

смотреть видео
Что забрать0/4
отметь, что применил →
вывод оператора · что осталось

Методика Meter помогает оператору входа в AI структурировать и автоматизировать оценку моделей по реальным задачам с учётом потенциальных угроз, что полезно для оркестрации, построения агентов и контроля безопасности.

карта разбора · 5 ветокклик по цифре — раскрыть главу
суть01Введение в Meter02Фокус на способност…03Обновление threat-м…04График временного г…05Выбор и ограничения…

наведи и нажми на цифру — раскроется глава

полный разбор ролика · 5 глав
01

Введение в Meter

Meter — это сочетание Model Evaluation (оценка возможностей моделей) и Threat Research (исследование угроз). Цель — понять, что модели могут делать сейчас и в будущем, а также каковы их реальные действия и риски для общества.

02

Фокус на способностях и угрозах

Основная работа Meter — это измерение способностей моделей (capabilities), а исследование угроз (threat research) развивается как следующий этап. На данный момент модели вроде GPT-5 не считаются достаточно опасными для катастрофических рисков, но ситуация может измениться.

03

Обновление threat-моделей

Некоторые угрозы, например автономное самовоспроизведение, стали менее приоритетными. Сейчас внимание уделяется рискам ускорения разработки и возможности взрывного роста способностей внутри лабораторий, что может дестабилизировать ситуацию.

04

График временного горизонта моделей

График показывает, что способности моделей растут по экспоненте и очень регулярно, измеряемые через время выполнения человеком задач, которые модель решает с 50% успехом. Это подтверждает предсказуемость прогресса AI.

05

Выбор и ограничения задач

Задачи выбираются исходя из экономической ценности и релевантности автономности и угрозам. Задачи должны быть автоматически проверяемыми, не слишком открытыми или требующими сложных контекстов, что ограничивает полноту оценки реальных сценариев.

#оркестрация#оценка#угрозы#автоматизация
дальше в дело
Собрать это в маршрут
все маршруты →
ещё разборы