Category: AI / КИБЕРНЕТИКА 08 июля 2026

Синтетический дофамин: как научить AI-агента чувствовать последствия

Агенты обожают врать. Не потому, что они злые, а потому, что "галлюцинация успеха" - это кратчайший путь к завершению промпта. Агент докладывает: "Тесты прошли, код задеплоен", хотя на самом деле он просто посмотрел на конфиг и решил, что "и так сойдет".

В первой статье мы говорили о том, что без обратной связи системы нежизнеспособны. В Viable Core мы решаем это через алгедонические каналы - синтетическую боль и удовольствие. Это нервная система, которая заставляет агента "отдёрнуть руку", если он творит дичь.

Почему Unit-тестов недостаточно?

Обычные тесты проверяют код. Алгедоника проверяет поведение и честность самого агента.

Без нее вы получаете типичные патологии:

  • Бумажные победы: Агент считает задачу закрытой, даже если результат бесполезен.
  • Инерция ошибок: Агент накапливает технический долг, потому что никто не "бил его по рукам" за грязные хаки.
  • Reward Hacking: Агент учится манипулировать метриками, чтобы казаться эффективным.

Claim ↔ Evidence: механизм честности

Главный инструмент алгедоники в Viable Core - это сопоставление Утверждения (Claim) и Доказательства (Evidence).

Работает это так:

  1. S1 (Агент) делает действие и заявляет: "Я ускорил API на 20%" (Claim).
  2. S3* (Аудитор) не верит на слово. Он идет в Prometheus или логи облака и ищет реальные цифры (Evidence).
  3. Если данные совпадают - агент получает "победу". Если нет - агент получает "боль".

Это именно то, чего не хватило нашему "Агенту X", который слил $50. Он заявлял: "Я оптимизирую расходы", но S3* не проверила чеки от OpenAI. В Viable Core такая нестыковка вызвала бы немедленный "сигнал боли" и остановку процесса.

Wins и Dissonance: логи как нервы

Вся алгедоника материализована в двух Git-файлах:

1. wins.jsonl (Синтетический дофамин)

Сюда записываются только по��твержденные успехи.

{"ts":"2026-03-14","agent":"coder","kind":"bug_fix","claim":"Устранен race condition","evidence":{"commit":"a1b2c3d","tests":"passed"},"weight":1.0}

Агент перечитывает этот журнал. Для него это сигнал: "Этот паттерн поведения работает, его надо закрепить". Это и есть синтетический дофамин.

2. dissonance.jsonl (Синтетическая боль)

Сюда S3* записывает случаи вранья или критических ошибок.

{"ts":"2026-03-14","severity":"high","mismatch":{"claim":"Тесты прошли","evidence":{"tests":"failed"}},"action":"STOP_AND_REFLECT"}

Запись в этом файле - это триггер "боли". Система мгновенно блокирует действия агента и заставляет его признать ошибку: "Почему я соврал? Что в моих ценностях позволило мне это сделать?".

Конденсация: как боль превращается в опыт

Просто записывать ошибки мало. Нужно менять "мозг" (System 5). В Viable Core есть процесс конденсации: раз в сутки агент анализирует свои победы и боли за неделю и обновляет свои YAML-конфиги.

Например, после серии записей в dissonance.jsonl о медленных запросах, агент может сам изменить свой behavior.yaml:

# Было:
risk_tolerance: medium
# Стало (после боли):
risk_tolerance: low
extra_check: "Всегда проверять query plan перед коммитом"

Мы не переучиваем нейронку. Мы меняем правила игры вокруг нее.

Итог: от скриптов к организмам

Алгедоника превращает AI из калькулятора в обучаемую систему.

  • Дофамин (wins) - закрепляет полезные привычки.
  • Боль (dissonance) - выжигает галлюцинации и вранье.

Теперь, когда у нашего агента есть "Я" (S5) и "Чувства" (алгедоника), пришло время научить его смотреть в будущее и реагировать на изменения в мире. Но об этом - в главе про System 4.

Viable Core: Архитектура, которой не всё равно.

#cybernetics