← Материалы разборы Yersham
разбор · оркестрациятема-фронтир · H 1.49
3.0
из 10
смотреть не обязательно — забрать выжимку и пункты
оценка машинная и частично зависит от длины ролика — спорите, открывайте оригинал

Компактная модель обходит триллионную в задаче лифта

В сравнении между MIM 2.5 Pro и Kimi K2.6 показано, что большие модели не всегда лучше. MIM 2.5 Pro демонстрирует более эффективное решение задачи с использованием стратегического планирования и самокоррекции, в то время как Kimi K2.6 страдает от перегрузки контекстного окна и неэффективного распределения внимания.

В тесте на логику MiMo 2.5 Pro (10 шагов) и компактные модели (8-9) обходят Kimi K2.6, которая падает. Размер…

что из этого моё

Малая модель в этом тесте бьёт триллионную: Qwen 3.6 с тремя миллиардами активных параметров прошла лифт за семь шагов на ноутбуке, а MiMo 2.5 Pro с триллионом и требованием в 80 ГБ видеопамяти — за десять, причём первые шесть шагов топталась. Для логики заказных ботов сначала пробовать компактную модель, флагман — только когда малая не вытянула.

Что забрать
отметь, что берёшь в работу → или отбрось как не своёмоё →
замерить число шагов и потребление памяти на своей модели при решении задачи лифта
настроить конвейер разборов на запуск компактной модели перед флагманской для экономии ресурсов
о чём говорят, по времени
главы доводят до 06:15 · дальше по ролику меток нет
01
Введение00:02
Презентация парадокса эффективности моделей
02
Архитектура MIM 2.5 Pro01:03
Особенности архитектуры MIM 2.5 Pro
03
Библиотека и библиотекарь02:07
Аналогия с библиотекой и необходимостью алгоритма
04
Тест с лифтом03:39
Описание условия теста
05
Стратегия и планирование06:15
Необходимость стратегического планирования
дальше в дело
Собрать это в маршрут
все маршруты →
не хочешь разбираться сам
Сделаю это под задачу
форматы и цены →
похожие по смыслу · из облака
ещё разборы