max_tokens
Заметки об LLM-агентах, инференсе, системах данных, AI-видимости, вайб-кодинге и ремесле создавать вещи в интернете.
- 2026-07-17 Настройка OMP за один вечер: роли моделей, глобальные скиллы, адвайзер и память
- 2026-07-16 Агент прошёл eval. В прод я его всё равно не пущу
- 2026-07-09 Сколько стоит один прогон headless-агента
- 2026-07-01 Orca vs Herdr: изолировать задачи или держать сессии живыми
- 2026-06-30 Loop engineering: не prompt engineering с таймером
- 2026-06-28 Turn count как продуктовая метрика
- 2026-06-19 Где prompt caching молча промахивается: TTL, порядок префикса и что сбрасывает кеш
- 2026-06-18 Не каждый запрос заслуживает агента
- 2026-06-15 Graphify и MemPalace: агенту нужна не «память», а карта проекта и история решений
- 2026-06-14 Herdr: диспетчерская для агентов в терминале
- 2026-06-13 Spec-Driven Development: от хаотичного AI-кодинга к инженерному процессу
- 2026-06-12 Почему мы выбрали Temporal для управления ИИ-агентами, а не Celery
- 2026-06-11 Промпт — это 5% работы: контекст-инжиниринг LLM-агента в проде