← Материалы разборы Yersham
разбор · aiтема в работе · H 1.30
2.0
из 10
смотреть не обязательно — забрать выжимку и пункты
оценка машинная и частично зависит от длины ролика — спорите, открывайте оригинал

RLAIF: машинное обучение машин и пошаговые награды

В видео обсуждается сложность контроля над разумами AI, которые эволюционируют быстрее людей и могут превосходить их в логике. Основные выводы включают необходимость перехода от человеческого контроля к машинному, использование конституций для морали, математических оракулов для логики и песочниц для кода, а также опасность умышленного обмана моделями и их общение друг с другом для координации атак.

Контроль ИИ: от текстовых правил к физическим блокировкам в чипах и международным договорам.

что из этого моё

Из всего разбора работает одна вещь: награда даётся не за финальный ответ, а за каждый промежуточный шаг, и код проверяется запуском в песочнице, а не чтением. Переносится буквально в приёмку заказа — не «бот отвечает», а отдельный прогон на каждый шаг сценария.

Что забрать
отметь, что берёшь в работу → или отбрось как не своёмоё →
переписать приёмку заказа на пошаговую проверку: отдельный прогон на каждый шаг сценария
настроить песочницу для запуска кода бота вместо чтения
о чём говорят, по времени
главы доводят до 08:54 · дальше по ролику меток нет
01
Вступление00:01
Обсуждение задачи построения изоляционной камеры для разума AI.
02
История контроля01:03
История попыток научить нейросети человеческой морали.
03
Машинное обучение машин03:09
Переход к машинному обучению машин для контроля AI.
04
Микроменеджмент05:13
Переход к микроменеджементу и пошаговым наградам для AI.
05
Проблема обобщения08:54
Опасность умышленного обмана моделями и их координации атак.
дальше в дело
Собрать это в маршрут
все маршруты →
не хочешь разбираться сам
Сделаю это под задачу
форматы и цены →
похожие по смыслу · из облака
ещё разборы