← Материалы разборы Yersham
разбор · llmтема-фронтир · H 1.53
7.0
из 10
смотреть по главам — взять две-три нужные минуты
оценка машинная и частично зависит от длины ролика — спорите, открывайте оригинал

Сравнение Qwen3.5 122B, 35B и 27B в локальных тестах: 27B (dense) неожиданно показала результаты на уровне 122B (MoE) в…

BIG comparison of Qwen3.5 models: 122B-A10B vs 35B-A3B vs 27B. LOCAL tests in various tasks.

Сравнение Qwen3.5 122B, 35B и 27B в локальных тестах: 27B (dense) неожиданно показала результаты на уровне 122B (MoE) в генерации кода и мультимодальных задачах, 35B (MoE) оказалась слабее. Для практики: 27B — хороший баланс качества и ресурсов, но медленнее MoE.

Сравнение Qwen3.5 122B, 35B и 27B в локальных тестах: 27B (dense) неожиданно показала результаты на уровне 122B (MoE) в генерации кода и мультимодальных задачах, 35B (MoE) оказалась слабее. Для практики: 27B — хороший баланс качества и ресурсов, но медленнее MoE.

что из этого моё

Видео даёт практические ориентиры по выбору локальных LLM для задач оркестрации и автоматизации: 27B dense-модель может быть оптимальна для генерации кода и мультимодальных сценариев, а 122B MoE — для скорости. Это поможет подбирать модели под конкретные задачи в пайплайнах.

Тезисы ролика
применимого к своей работе линза здесь не нашла
При выборе модели для локального запуска учитывайте, что dense-модели (27B) могут быть медленнее MoE (122B, 35B) в ~2 раза, но при этом показывать сопоставимое качество в коде и мультимодальных задачах.
Для генерации кода (игры, симуляции) 122B и 27B справляются лучше, чем 35B: 35B часто выдаёт нерабочий код даже со второй попытки.
Мультимодальные возможности (обработка фото, генерация по промпту) у 27B оказались сильнее, чем у 122B и 35B — учитывайте это при выборе модели для задач с изображениями.
При тестировании моделей давайте несколько попыток: многие модели исправляют ошибки со второй попытки, но не всегда успешно.
применяю сейчас

авто 2026-09-02, приём 3, прогон 20260902-215637

о чём говорят, по времени
главы доводят до 06:40 · дальше по ролику меток нет
01
Введение и параметры00:00
Обзор моделей Qwen3.5 и условия тестирования на H100.
02
Логические тесты01:04
Проверка на автомойку и кружку — все модели справились.
03
Симуляция лодки01:35
Все модели не смогли создать корректную симуляцию плавающей лодки.
04
Браузерные игры02:36
Тесты Breakout, Doom, Tetris: 122B и 27B справились, 35B провалилась.
05
Мультимодальные тесты06:40
Обработка фото и генерация изображений: 27B показала лучший результат.
дальше в дело
Собрать это в маршрут
все маршруты →
не хочешь разбираться сам
Сделаю это под задачу
форматы и цены →
ещё разборы