Evidence Spine

Трассы, политики, подтверждения, оценки, разбор инцидента и решение о выпуске — не соседние темы, а одна эксплуатационная запись. Проверка простая: если нельзя проследить один подозрительный запуск через все эти слои, у вас не цепочка доказательств, а разрозненные контроли.

Суть

Каждый слой по отдельности выглядит осмысленно: трассировка есть, политики есть, оценки есть, канареечная выкатка есть. Проблема возникает в момент, когда нужно ответить на вопрос про конкретный запуск: почему он был разрешён, что решила политика, кто подтвердил, какой оценкой он был покрыт и повлиял ли он на решение о раскатке.

Если ответ собирается вручную сопоставлением времени между четырьмя системами, слои есть, а записи нет.

Минимальный набор идентификаторов

То, что делает один запуск проверяемым насквозь: идентификатор запуска и трассы, субъект и арендатор (Agent Identity), идентификатор решения политики, идентификатор подтверждения, ключ идемпотентности и статус побочного эффекта (Idempotency For Agents), ссылка на версии артефактов (Trusted Artifacts), связь с оценочным сценарием.

Ключевое свойство — не количество полей, а сквозная связанность: по любому из них должна собираться вся история, а не её фрагмент.

Зачем это нужно на практике

Три вопроса, ради которых цепочка и строится:

  • Разбор инцидента. Что именно произошло и на каком основании — восстанавливается, а не пересказывается (Agent Audit Log).
  • Решение о выпуске. Просадка в канареечной когорте связывается с конкретным изменением артефакта, а не с «новой версией вообще» (Change Classification Agent).
  • Ответ регулятору или заказчику. Утверждение «система работала по правилам» подкрепляется записью, а не убеждённостью команды (AI Fairness).

Признак, что цепочки нет

Полезный тест на зрелость, не требующий инструментов: взять один недавний неудачный запуск и попробовать за пять минут ответить, какая версия инструкции в нём работала, какое правило политики сработало и попал ли он в набор оценок. Если это занимает день, цепочки нет независимо от того, сколько дашбордов построено.

Связано с

  • Agent Audit Log — состав следа и связки между событиями
  • Agent SLO — измерения здоровья, опирающиеся на ту же запись
  • Canary Release LLM — решение о раскатке как звено цепочки
  • Trusted Artifacts — версии, на которые ссылается запись
  • W3C Trace Context — сквозной идентификатор как технический носитель
  • Change Classification Agent — привязка просадки к изменению
  • Incident Management AI — процесс, потребляющий цепочку