Блог
Здесь я пишу о фронтенде и обо всём, что связано с ИИ: агентах, LLM, RAG и инструментах разработки.
Тестирование ИИ-агента и оценка качества ответов
Зелёная сборка не говорит о качестве ответа. Как собирают золотой набор кейсов и что замеры показывают про надёжность модели-судьи.
Хранение состояния агента и восстановление после сбоев
Что остаётся от агента после перезапуска процесса, как прерванная работа продолжается с того же места и во что обходится накопленная история чекпоинтов.
Корпоративные интеграции и стандарт MCP
Стандарт MCP закрывает подключение и обнаружение инструментов; права, подтверждения и проверка результата остаются вашим кодом.
Надёжность агента и границы самоисправления
Почему длинная цепочка шагов рвётся, что измерено про петлю самоисправления и как строят лестницу деградации, когда ответ модели не годится.
Инструмент агента — это API с двумя контрактами
Вход и выход инструмента проверяют разное: где кончается гарантия схемы, как упаковать сбой сети в валидный ответ и чем кормить модель при ошибке.
Инженерия контекста и защита входа от промпт-инъекций
Сколько данных влезает в контекстное окно модели, чем платит сжатие истории и что на самом деле отсекает фильтр против промпт-инъекций — с числами из замеров.
Гарантии LangGraph кончаются на границе состояния
Что сохраняется при сбое узла, во сколько обходится снимок состояния, почему после паузы работа повторяется и как выкатывать новую версию на живых диалогах.
Мультиагентное обучение с подкреплением: устройство, ограничения и граница переноса
Академическая мультиагентность против инженерной: взрыв совместных действий, нестационарность, назначение вклада и где кончается перенос приёмов.
Мультиагентные системы в продакшене: паттерн выбирают по слабому месту
Уязвимость каждого архитектурного шаблона команды агентов, предел глубины декомпозиции, запасной путь при отказе провайдера и цена изоляции.
Протокол A2A: общий язык агентов, паспорт исполнителя и спор о зрелости
Зачем нужен слой «агент ↔ агент», как устроены паспорт агента и жизненный цикл задачи и почему протокол зрелый на синтаксисе, но сырой в управлении.
Безопасность ИИ-агентов: модель угроз, защита архитектурой и закон о данных
Почему фильтры на промпт пробиваемы, как защищаться архитектурой и изоляцией, что требует ФЗ-152 и почему высокая точность детектора инъекций обманчива.
Мультиагентные системы: когда команда агентов окупается
Почему надёжность падает экспоненциально с длиной цепочки и координация множит ошибки, какие топологии выживают в проде, фреймворки CrewAI/AutoGen/LangGraph и память Mem0 между сессиями.
AgentOps: наблюдаемость, оценка качества и контроль затрат агентов
Три зоны ответственности при эксплуатации ИИ-агентов: трассировка шагов, регресс-тесты на метриках и лимиты против неконтролируемых циклов.
LangGraph: агент как машина состояний
LangGraph описывает агента как граф: ветвления, циклы, сохранение прогресса и паузы на подтверждение человека — то, чего линейная цепочка не даёт.
Агент за рулём компьютера: как работает и где быть осторожным
Агент видит экран и кликает как человек: где он заменяет API, как читать его бенчмарки и три слоя защиты от вредных инструкций.
Структурный вывод и типизация агента: контракт вместо парсинга JSON
Схема как контракт, а не просьба в промпте: три уровня контроля вывода, рассуждение по схеме, зависимости без промпта и циклы валидации в PydanticAI.
RAG-системы: качество ответа определяет поиск, а не модель
Ответ модели хорош ровно настолько, насколько хорош поиск по вашим данным. Как собрать такой поиск, что делать со сканами и таблицами и почему на сложных вопросах слабым звеном становится не поиск, а рассуждение модели.
Управление мышлением агента: глубина рассуждения, бюджеты и роутинг
Глубина «мышления» модели имеет обратную точку: после порога качество падает, а счёт растёт. Как мерить, ограничивать и роутить — в проде, не на бумаге.
ИИ-агенты в 2026: устройство, выбор модели и провалы в проде
Лестница зрелости от чат-бота до агента, четыре компонента анатомии, обрыв контекста при росте каталога инструментов, четыре критерия выбора модели, бенчмарки 2026 с поправкой на обвязку и типология провалов агентов в проде.
Постов в этой рубрике пока нет.