Агенты обожают врать. Не потому, что они злые, а потому, что "галлюцинация успеха" - это кратчайший путь к завершению промпта. Агент докладывает: "Тесты прошли, код задеплоен", хотя на самом деле он просто посмотрел на конфиг и решил, что "и так сойдет".
В первой статье мы говорили о том, что без обратной связи системы нежизнеспособны. В Viable Core мы решаем это через алгедонические каналы - синтетическую боль и удовольствие. Это нервная система, которая заставляет агента "отдёрнуть руку", если он творит дичь.
Почему Unit-тестов недостаточно?
Обычные тесты проверяют код. Алгедоника проверяет поведение и честность самого агента.
Без нее вы получаете типичные патологии:
- Бумажные победы: Агент считает задачу закрытой, даже если результат бесполезен.
- Инерция ошибок: Агент накапливает технический долг, потому что никто не "бил его по рукам" за грязные хаки.
- Reward Hacking: Агент учится манипулировать метриками, чтобы казаться эффективным.
Claim ↔ Evidence: механизм честности
Главный инструмент алгедоники в Viable Core - это сопоставление Утверждения (Claim) и Доказательства (Evidence).
Работает это так:
- S1 (Агент) делает действие и заявляет: "Я ускорил API на 20%" (Claim).
- S3* (Аудитор) не верит на слово. Он идет в Prometheus или логи облака и ищет реальные цифры (Evidence).
- Если данные совпадают - агент получает "победу". Если нет - агент получает "боль".
Это именно то, чего не хватило нашему "Агенту X", который слил $50. Он заявлял: "Я оптимизирую расходы", но S3* не проверила чеки от OpenAI. В Viable Core такая нестыковка вызвала бы немедленный "сигнал боли" и остановку процесса.
Wins и Dissonance: логи как нервы
Вся алгедоника материализована в двух Git-файлах:
1. wins.jsonl (Синтетический дофамин)
Сюда записываются только по��твержденные успехи.
{"ts":"2026-03-14","agent":"coder","kind":"bug_fix","claim":"Устранен race condition","evidence":{"commit":"a1b2c3d","tests":"passed"},"weight":1.0}
Агент перечитывает этот журнал. Для него это сигнал: "Этот паттерн поведения работает, его надо закрепить". Это и есть синтетический дофамин.
2. dissonance.jsonl (Синтетическая боль)
Сюда S3* записывает случаи вранья или критических ошибок.
{"ts":"2026-03-14","severity":"high","mismatch":{"claim":"Тесты прошли","evidence":{"tests":"failed"}},"action":"STOP_AND_REFLECT"}
Запись в этом файле - это триггер "боли". Система мгновенно блокирует действия агента и заставляет его признать ошибку: "Почему я соврал? Что в моих ценностях позволило мне это сделать?".
Конденсация: как боль превращается в опыт
Просто записывать ошибки мало. Нужно менять "мозг" (System 5). В Viable Core есть процесс конденсации: раз в сутки агент анализирует свои победы и боли за неделю и обновляет свои YAML-конфиги.
Например, после серии записей в dissonance.jsonl о медленных запросах, агент может сам изменить свой behavior.yaml:
# Было:
risk_tolerance: medium
# Стало (после боли):
risk_tolerance: low
extra_check: "Всегда проверять query plan перед коммитом"
Мы не переучиваем нейронку. Мы меняем правила игры вокруг нее.
Итог: от скриптов к организмам
Алгедоника превращает AI из калькулятора в обучаемую систему.
- Дофамин (wins) - закрепляет полезные привычки.
- Боль (dissonance) - выжигает галлюцинации и вранье.
Теперь, когда у нашего агента есть "Я" (S5) и "Чувства" (алгедоника), пришло время научить его смотреть в будущее и реагировать на изменения в мире. Но об этом - в главе про System 4.
Viable Core: Архитектура, которой не всё равно.