AI-система · Стратегия

Кардинальные апгрейды AI-системы

2026-06-28  ·  Не гигиена — где потолок и какие рычаги дают ×10 к скорости, результату, эффективности

Опыт оседает в 330 .md-файлов памяти, но в момент работы не вспоминается — один урок переучивается 2–5 раз
Фидбек уходит в память, а не в промпт-код пайплайна — видео-завод повторяет те же косяки
Ты вручную жонглируешь окнами Claude Code — нет фоновых исполнителей, ломается «поставил-ушёл-вернулся»

ТОП-3 кардинальных рычага

Рычаг 1
Семантическая память + знание-в-код
Бьёт самую дорогую утечку — рецидив фидбека и промахи recall. mem0 MCP + фидбек→промпт, не память.
Impact: высокий  ·  Effort: low→high
Рычаг 2
Фоновые агенты вместо ручного жонглирования
Из «я веду N окон» → «ставлю в очередь, агенты исполняют, смотрю результаты». Claude Dynamic Workflows + push в телегу.
Impact: высокий  ·  Effort: средний-высокий
Рычаг 3
Экономика проектов
35 проектов, 0 данных по ROI/времени. Без этого любой буст скорости разгоняет тебя в возможно неверном направлении.
Impact: высокий  ·  Effort: низкий-средний

Рычаг 1 — детали

Рычаг 1 · Память
Проблема: 330 файлов памяти, recall промахивается, фидбек не доходит до производства. 29% памяти помечено «бесит/опять» — это №1 по стоимости рецидива.
  • mem0 как MCP-сервер поверх Claude Code (~5 мин установки, free 10K памятей). Semantic recall по смыслу, а не по имени файла. НЕ выкидывает файловую память — добавка сверху.
  • Фидбек → промпт-код, а не память. Правка идёт в исполняемый промпт/конфиг пайплайна. Per-pipeline STYLE.md/PROMPT.py + гейт «сверь промпт с фидбеком до генерации».
  • Hermes Curator (Nous) — контейнер УЖЕ стоит. Автономный демон консолидации скиллов/знания. Нужен API-ключ + довести до боевого.
Оговорка

Hermes/mem0 цифры частью вендорские, версии моделей между источниками расходятся — сверить перед production-ставкой.

Impact: убирает рецидив mem0: низкий effort Hermes: высокий effort

Рычаг 2 — детали

Рычаг 2 · Скорость
Проблема: task-queue.json пустой, briefs мёртвы с 27 мая. Оркестрации по факту нет — всё в голове. Холостые ожидания, ломается «поставил-ушёл».
  • Claude Code Dynamic Workflows (research preview, июнь 2026) — авто-параллелизм агентов. Точечно (жжёт токены) на пакетных задачах: «прогони 34 кадра», «18 креативов», «аудит 5 страниц».
  • Background agents + push в телегу. Запустил задачу → агент работает в фоне → результат стучится в телегу (паттерн уже есть — server-monitor, weekly-сторож).
  • Архитектурный сдвиг: из «оператора окон» в «диспетчера». Самый большой буст скорости из всех трёх рычагов.
Impact: снимает ручную оркестрацию Effort: средний-высокий

Рычаг 3 — детали

Рычаг 3 · Эффективность
Проблема: 35 проектов, 1 имеет дедлайн, 0 — ROI / время / success-rate. Приоритизация 18 активных — вслепую. Решаешь «на данных», но данных об отдаче проектов нет.
  • Экон-поля в .meta.json: потраченное время · доход · статус монетизации · next-milestone.
  • Панель отдачи в кокпите: видишь что зарабатывает, что жрёт время впустую, что добить.
Impact: фокус на денежное Effort: низкий-средний

Матрица Impact × Effort

🟢 Быстрые победы — делать первыми
Апгрейд Что даёт Усилие
Veo 3.1 Ingredients (4 рефа + 9:16 + enhanced consistency) Бесплатный буст консистентности персонажей в твоём локе Смена эндпоинта в коде
Nano Banana Pro / NB2 (до 5 персонажей, читаемый RU текст) Качество кадров + текст на превью Смена model-id
Haiku 4.5 на субагентов (73% SWE-bench, дешевле/быстрее) Снимает лимит-боль, ускоряет fan-out 1 строка в agent-конфигах
mem0 MCP Semantic recall между окнами ~5 мин
Проверить SDK-биллинг бота Agent-SDK с 15 июня тянет отдельный кредит — бот может тихо умереть Проверка
Pre-spend scoring креативов Предсказать перформанс ДО спенда на FB Юзать / реплицировать
🎯 Большие ставки — планировать
  • Фоновые агенты + Dynamic Workflows (Рычаг 2)
  • Фидбек-в-код + Hermes Curator (Рычаг 1)
  • A/B-эталон в видео-пайплайн (терял готовую озвучку и 34 кадра)
  • Sync.so липсинк-пасс поверх Veo на лицевых CU (бьёт боль рта, лок не нарушает)
👀 Следить — рано
  • Temporal/durable execution (когда trading станет 24/7)
  • TradingAgents v0.2 · Jesse (бэктест без look-ahead)
  • Letta/MemGPT · Cursor Cloud Agents
  • Darwin Gödel Machine (забрать идею само-улучшения, не код)

По доменам — конкретика

Видео-завод (главный продукт)
  • Veo Ingredients + NB Pro в код (low effort) → Sync.so липсинк (mid)
  • A/B-эталон в пайплайн — лечит «выбрасываю готовое и регенерю»
  • Авто-монтаж Shotstack/pycaps вместо ручного ffmpeg (следить)
Trading
  • Helius LaserStream/Geyser gRPC — push-стрим вместо polling (~8 мс быстрее). Latency = деньги. Платный → апрув
  • Jesse — бэктест без look-ahead из коробки (ловил это руками в memecoin-lab)
Маркетинг / SaaS (Performante)
  • AdStellar (7 AI-агентов) и Madgicx «AI Marketer» — почти блюпринт твоего SaaS. Конкурентная разведка
  • AdCreative pre-spend scoring — киллер-фича, юзать или реплицировать в продукт
  • Лендинги: твой Claude Code лучше шаблонных билдеров — не меняй

🛑 Чего НЕ делать

Дорожная карта

Эта неделя
  • Veo 3.1 Ingredients в код
  • NB Pro смена model-id
  • Haiku 4.5 на субагентов
  • mem0 MCP (~5 мин)
  • Проверить SDK-биллинг бота
Этот месяц
  • Фоновые агенты + push-оркестрация (Рычаг 2)
  • Экон-поля проектов (Рычаг 3)
  • A/B-эталон в видео-пайплайн
Квартал
  • Фидбек-в-код механизм
  • Hermes Curator до боевого (Рычаг 1)
  • Helius gRPC в trading
Следить
  • Durable execution
  • Agent-маркетологи-конкуренты
  • Само-улучшающиеся системы
Честные оговорки

Источники: 05-frontier.md, 06-domains.md, 07-bottlenecks.md. Отдельные цифры (Haiku 73% SWE-bench, Hermes звёзды) требуют ручной сверки — помечены TBD в исходных файлах. Hermes/mem0 производительность — частично вендорские заявления.

Аудит AI-системы Тимура  ·  2026-06-28  ·  system-audit.obahoba.com