У agentic systems появляется новый архитектурный слой. Capability агента больше не обязательно должна жить внутри prompt, memory или harness. MASkills показывает, как skill можно сделать отдельным versioned artifact с measured utility, validation и rollback. Если изменение ухудшает качество, оно не попадает в активную библиотеку.
Но управляемый skill еще не гарантирует доверие к результату. Здесь появляется ClaimReceipt. Работа разделяет наличие логов и наличие достаточного evidence. Для конкретного claim нужно проверить, хватает ли сохраненных данных и покрывают ли они весь заявленный процесс. Если evidence неполно, система не должна делать уверенный вывод.
Из этих двух идей складывается полноценный lifecycle: capability создается, используется, измеряется, изменяется, проходит validation, получает evidence и только потом квалифицируется для production.
Это уже больше похоже не на «обучающегося агента», а на Agent Capability Supply Chain. Capability становится версионируемой, проверяемой и управляемой почти так же, как software component. И именно здесь начинают сходиться Skill-as-Code, Evidence-as-Code, Evals-as-Code и Architecture-as-Code.