Масштабирование вкуса через агентов и кроссмодельную верификацию
Дебаты о том, можно ли масштабировать человеческий вкус в ИИ с помощью агентов и архитектуры. Архитектурное масштабирование и кроссмодельные взаимодействия могут создать самодостаточных экономических агентов. Без человеческого контроля и вкуса наращивание вычислительных мощностей приведет к хаосу.
Техника (кэш, ревью) ускоряет агентов, но без человеческого вкуса и рамок — хаос и риск.
Пару моделей развести по ролям, как в дебатах: одна пишет при неполном задании и достраивает пробелы сама, вторая проверяет буквально, как компилятор, — на текстах и правках карточек это ловит больше, чем один прогон. И писать в задании явное «прочитай файл целиком, токены не экономь»: в ролике объяснено, что модели штрафовали за длину ответа, и теперь они угадывают поверхностно вместо чтения.