Почему агент, который утром писал идеальный код с тестами, к вечеру начинает выдавать "грязные хаки" и игнорировать краевые случаи? Дело не в том, что модель "устала". У нее просто нет якоря.
В большинстве фреймворков (CrewAI, AutoGen) роль агента - это всего лишь системный промпт. Стоит контексту вырасти или задаче усложниться, как этот промпт "размывается". Агент теряет лицо, превращаясь из педантичного сеньора в безрассудного ковбоя.
В Viable Core за стабильность отвечает System 5 (Политика). Это не свод скучных правил, а "конституция" агента, зафиксированная в Git. Без нее ваш AI - это просто скрипт с амнезией. С ней - автономный сотрудник с системой ценностей.
Бассейны аттракторов: почему "просто промпт" не работает
Представьте поведение агента как шарик на неровной поверхности с ямками. Каждая ямка - это "аттракторный бассейн", стабильное состояние. Одна ямка - "Безопасный DevOps", другая - "Быстрый, но грязный кодер", третья - "Бесконечный галлюцинатор".
Когда вы даете агенту обычный промпт, вы просто толкаете шарик в сторону нужной ямки. Но при первом же столкновении с проблемой шарик может легко выкатиться в соседнюю "яму" галлюцинаций.
System 5 в Viable Core делает две вещи:
- Выбирает правильную "яму" для агента.
- Делает ее стенки такими высокими, чтобы агент не мог случайно стать кем-то другим под давлением обстоятельств.
Это называется мета-контролем. Мы не диктуем агенту каждый шаг, мы задаем гравитацию, которая тянет его к правильным решениям.
YAML как ДНК личности
В Viable Core идентичность агента - это не текст в голове нейронки, а набор YAML-файлов в Git-репозитории. Это его Memory Blocks.
1. persona.yaml (Кто я?)
Здесь мы описываем роль и голос. Но главное - черты характера (traits).
name: "Строитель"
role: "DevOps-инженер Viable Core"
traits:
- "Скептицизм к хайповым технологиям"
- "Приоритет метрик над словами"
Если у агента прописан "скептицизм", он не предложит вам переписать весь прод на модный фреймворк, который вышел вчера. Он просто "не может" это сделать, потому что его персона тянет его к стабильности.
2. values.yaml (Что для меня важно?)
Это самое "вкусное" - веса приоритетов.
priorities:
- key: "Стабильность"
weight: 10
- key: "Скорость релиза"
weight: 4
Когда агент сталкивается с выбором "деплоить быстро или дописать тесты", он сверяется с весами. Приоритет 10 всегда перевесит 4. Это именно то, чего не хватило нашему "Агенту X", который слил $50 на токены: у него не было ценности "Экономия ресурсов" с весом 10. Для него бесконечный цикл рассуждений был так же важен, как и результат.
3. behavior.yaml (Как я реагирую?)
Здесь мы прописываем рефлексы и правила самомодификации.
Агент может "взрослеть" и менять свои конфиги. Но System 5 накладывает ограничения: "Ты не можешь изменить свои ценности более чем на 10% за один раз". Это защита от "цифрового суицида" или внезапной смены личности.
POSIWID: цель системы - это то, что она делает
Стаффорд Бир (отец VSM) ввел принцип POSIWID: The Purpose of a System Is What It Does. Цель системы - это её реальный результат, а не то, что написано в документации.
Агент может сколько угодно писать в логах: "Я очень ценю безопасность". Но если при этом он деплоит код без проверки прав доступа - значит, его реальная цель другая.
System 5 в Viable Core постоянно сопоставляет YAML-конфиги с реальными логами (wins.jsonl). Если слова расходятся с делом, система фиксирует "диссонанс" и заставляет агента рефлексировать. Это встроенный детектор лжи для нейронок.
Зачем хранить "душу" в Git?
Хранение Блоков Памяти в Git дает нам то, чего нет ни в одном другом фреймворке:
- Диффы личности: Вы видите в коммитах, как менялись убеждения агента. "Ага, после инцидента с базой данных он сам поднял себе вес приоритета Безопасность".
- Откат к здравому смыслу: Если агент начал нести чушь, вы просто делаете
git resetк состоянию, когда он был полезен. - Версионирование опыта: Вы можете клонировать "опытного" агента и запустить его на новом проекте.
Итог
System 5 превращает AI из генератора текста в субъекта. Это фундамент автономии. Без него у вас есть только "умный чат-бот", который развалится при первой серьезной нагрузке.
В следующей статье мы разберем, как заставить агента "чувствовать" свои ошибки через алгедонические сигналы - синтетическую боль и удовольствие.
Viable Core: Создаем системы, которые помнят, зачем они здесь.