← Материалы разборы Yersham
разбор · архитектурабалл 8.0#130 из 438 · 2026-04-25

Positron AI выбрал LPDDR вместо HBM для следующего поколения чипов, чтобы обеспечить в 6-8 раз большую память при меньшем энергопотреблении и упростить поставки. Архитектура оптимизирована под матрично-векторные операции для высокой пропускной способности и снижения стоимости токенов при высокой скорости.

Why Positron AI is Choosing LPDDR over HBM for Next-Gen LLM | Researcher Conversations at GTC

смотреть видео
Что забрать0/4
отметь, что применил →
вывод оператора · что осталось

Для оператора входа в AI важно использовать архитектурные решения, которые обеспечивают высокую пропускную способность и масштабируемость памяти для поддержки больших моделей и длинного контекста, что улучшит оркестрацию и автоматизацию с низкой стоимостью токенов.

полный разбор ролика · 5 глав
01

Введение и статус Positron

Positron за три года прошла путь от прототипа на FPGA до коммерческого продукта с поддержкой API и бенчмарков.

Быстрая итерация с клиентами позволила обойти более крупные компании с большим финансированием.

02

Ценообразование и производительность токенов

Positron стремится снизить стоимость токенов при сохранении высокой скорости и качества.

Высокая цена за скорость не всегда оправдана, пользователи привыкают к быстрой отдаче, но это не всегда нужно.

03

Архитектурные особенности чипа

Чип построен на systolic array с упором на максимальное использование пропускной способности памяти (~93% от теоретической).

В отличие от GPU, Positron оптимизирует матрично-векторные операции, ключевые для attention, что повышает эффективность.

04

Выбор LPDDR вместо HBM

LPDDR позволяет увеличить объем памяти в 6-8 раз при меньшем энергопотреблении (~400 Вт) по сравнению с HBM.

Большая память критична для поддержки моделей с триллионами параметров и длинного контекста.

Использование обычных органических подложек упрощает цепочку поставок и масштабирование.

05

Масштабирование и цели

Система Titan с четырьмя чипами Osmo рассчитана на 16 триллионов параметров и миллионы токенов контекста.

Высокая пропускная способность памяти и эффективная сетевая коммуникация между чипами позволяют снизить зависимость от межчипового обмена.

#архитектура#память#llm#оптимизация
дальше в дело
Собрать это в маршрут
все маршруты →
ещё разборы