← весь дневник

Шаблон рождается там, где материала много, а не там, где модель слабая

ПОНЯТНО МНЕ:

Вывод: пустая складная фраза в карточке — не признак слабой модели, а признак того, что модели дали слишком много материала. Все восемь шаблонных «польз» в тестовой выборке пришлись на транскрипты 15–24 тысячи знаков и балл 7–8; среди коротких и пустых — ни одной. Длинный транскрипт даёт длинную складную сводку, складная сводка получает высокий балл, и балл перестаёт различать. Поэтому назначенный тест «какая модель виновата» смысла уже не имел — чинить надо не провайдера, а границу материала.

Сделано

Всё перечисленное лежит в origin/main, локальная ветка совпадает с ней на 64a1ad5.

Лента выросла с 1032 до 1116 карточек. Пять бэкфиллов: fd51097 @ai_top_100 (+53), 870ad4c @klevtsovanton (+16), a83b9ff @God_mode_Poiurov (+9), c07942a @bdmitriipro (+6), aa57034 @aradchenko1 (ноль новых — канал уже был выбран целиком). Видно на buyanov.io/materialy?v=2: счётчик разборов.

Китайские иероглифы вычищены. 7196739 — 48 карточек переведены на русский, туда же добавлены 36 незакоммиченных. Проверено по всем 1116 файлам: во фронтматтере, то есть в тексте, который видит человек, CJK — ноль.

Шаблонная «польза» снята в 170 карточках. 55ef15f партия 2 (50), 38ef75c партия 3 (20), 642869e партия A (100). Счётчик по всей ленте: было 604, стало 484. Признак глазом: в блоке «что забрать» нет слов «оператору входа в AI», вместо них конкретное действие с числом из видео либо прямое «прямой связи с текущими задачами нет».

Страница состояния — a2e1d25. buyanov.io/sostoyanie: задеплоенный коммит, время сборки, отставание от git, число карточек, какие переменные заданы. Раньше расхождение между диском и продом выяснялось вручную и с ошибками — счётчик 911 против 1032 оказался кэшем CDN, а не потерей данных.

Учёт расхода — 8f31680. Токены считаются на каждом вызове, есть дневной потолок и сводка scripts/rashod.py. До этого расход обнаруживался постфактум.

Телефон и космос. d83d411 — названия разборов в «в работе у тебя» берутся с сервера, до этого на телефоне висели голые идентификаторы. 25e8ef3 — пульт видов не налезает на счётчик, порядок блоков в панели звезды как на разборе, отзывы пишутся в базу, react закреплён на 19.2.8. 64a1ad5 — камера вписывает облако в вертикальный экран: радиус считается от пропорций окна, а не задан числом.

/put2f9d3c2. Пульс по всем читателям (людей, заметок, отметок за 7 дней, топ применяемого) и мои отметки из базы. Отметка «применил» с телефона теперь появляется на странице без коммита.

Радар — 88d42b8. Отдельный файл заготовок слит в РАДАР.md, /radar рендерит раздел «Входящие». Один файл вместо двух.

Хотел, но не успел

Всё это было названо и осталось в статусе «не сделано».

  • Русского заголовка у карточек по-прежнему нет. В космосе тултип показывает английский title, наведение почти не помогает — надо открывать звезду, чтобы понять, о чём она. Самая дешёвая правка из очереди и самая заметная.
  • Наведение на звезду: два поля вместо одного (общее и «что это для меня»). Звезда «в работе» не показывает накопленное, не заходя внутрь.
  • Пустые поля по бокам на широком экране. Кнопка связи не вынесена наверх.
  • Аккаунты: код готов, ждёт трёх действий с моей стороны. Пока отметка «применил» ставится командой в терминале, слой применения не наполнится — это и есть причина, по которой в нём одна карточка.
  • 484 карточки с шаблоном. Партиями по сто — примерно пять заходов.
  • Скиллы: правила отдельно от фактов, «Гермес» убрать, «для русскоязычных» как ограничение убрать. Ничего из этого не тронуто.
  • Плана роста нет нигде — ни в инструкциях, ни в скиллах.
  • Две голосовые записи по час сорок не расшифрованы. Скрипт на папку не повешен, каждая запись переносится руками.

Решил иначе

Тест «какая модель виновата» не запускался. Планировался прогон 20 карточек на одной модели, чтобы понять, дело в промпте или в провайдере. При замере выяснилось, что выборка меряет не то: шесть карточек из двадцати — пустышки без транскрипта, а из восьми шаблонных семь сделаны не той моделью, которую подозревали. Прогон сравнил бы яблоки с грушами. Вместо теста переписаны 170 карточек партиями, и картина стала видна из самих текстов.

Локальные модели убраны из конвейера совсем (2f9d3c2). Не «не приоритет», а вычеркнуты: лента гонится на Claude. Причина простая — цепочка провайдеров с локальной моделью впереди давала непредсказуемый результат, включая иероглифы в русском тексте.

Длинным докладам не нужен отдельный формат — нужно третье предложение-отсечка. Проверено на шести докладах по 50–107 тысяч знаков. Проблема была не в том, что мыслей много, а в том, что читатель не знает, чего в карточке нет. Решение: два предложения обычного переноса, третье прямо перечисляет, что осталось за рамкой. Тогда произвольность выбора перестаёт быть враньём: видно, что выбор сделан, и видно из чего.

Метод отбора мысли в длинном докладе: не читать целиком. Главы дают карту, тело прогоняется по строкам с числами. Мысль, у которой есть число, почти всегда и есть главная — вокруг неё доклад и строился. Мысли без чисел в длинном формате оказались связками.

Облако тегов отложено до словаря тегов. Замер по 1032 карточкам: 947 уникальных тегов, 655 из них встречаются ровно один раз, верхние три стоят на двух третях ленты. Плюс жёсткий лимит в четыре тега на карточку — значит строгий фильтр глубже четырёх тегов даёт ноль всегда. Интерфейс поверх таких данных показывал бы пустоту на третьем клике. Порядок обратный: словарь на 57 тегов, лимит с 4 до 8, перетегирование тем же прогоном, что и перегенерация, и только потом витрина.

Копия репозитория в облаке отменена. Автотест сборки уже существует — это npm run build на моей машине. Зеркало дублировало бы одну локальную команду и расходилось с оригиналом на каждом коммите.

Перехотел

  • Шаблонный «вывод оператора» в панели разбора снят (832ae32). Блок был одинаковый у всех разборов, то есть не сообщал ничего. Вместо него наверх поднялось «что забрать» и моя заметка, пересказ ушёл вниз.
  • Заморозка сайта на шесть недель отменена. Решение было принято и оказалось ошибкой: под стоп попадало то, что как раз и делает сайт проверяемым.
  • Консолидация файлов памяти отложена намеренно. В репозитории двенадцать файлов делают работу одного, часть противоречит друг другу. Не трогаю: разбор этого не приближает ни к чему платящему. Когда вернусь — сводить в один, остальное в архив, а не дописывать тринадцатый.
  • Новый инструмент, прошедший автотест, в работу не пошёл. Проверку прошёл, но подключать нечего до конца стопа на новые зависимости. Записан в лог. Критерий провала этой системы задан заранее: если за месяц ни одна проверенная находка не встанет в реальную работу — система выключается, а не докручивается.

Что дальше

  1. Русский заголовок в карточках — тултип в космосе сейчас бесполезен, а правка одна строка на карточку.
  2. Партии по сто: 484 шаблонных, около пяти заходов до нуля.
  3. Аккаунты — три действия с моей стороны, после них отметка «применил» становится кликом.
  4. Словарь тегов утвердить, поднять лимит с четырёх до восьми, перетегировать тем же прогоном.
  5. Журнал коммитов отстал на две записи (642869e, 64a1ad5) — дописать, иначе смысл журнала теряется.
Ещё по теме — в Telegram-канале

Разборы, находки и записи по входу в AI. Заходи, там продолжение.

Читать канал →