← к хронологии

COGNITIVE-CYCLE-3AGENTS-PILOT

опровергнуто

когнитивный-цикл-3агента-пилот

2026-05-24 L7 уровень 4 запусков
new
premortem
mock
real
metrics
analyze
review
krit
done

Простыми словами

Три небольших ИИ с разными изначальными убеждениями наблюдают за одной и той же средой. Каждый ведет свой собственный дневник и общается с другими, используя структурированный протокол сообщений. Мы проверяем, развивают ли они различные личности и понимают ли скрытую структуру того, что видят, а также, сможет ли контрольная группа без личных дневников или структурированного общения сделать то же самое.

Технические детали

Исследовательская гипотеза

Проверить, проявляет ли нетривиальная архитектура промпта и памяти (асимметричные убеждения + приватная память + протокол типизированных сообщений + структурированный когнитивный цикл + контекст с дополненным извлечением) свойства, схожие с живыми (дифференцированные когнитивные стили, стабильные эмерджентные роли, координация целей, расхождение памяти) в субстрате LLM, которые отсутствуют в наивных базовых моделях. Это настоящий тест субстрата, заменяющий 3 предыдущих тривиальных базовых отрицательных теста (дифференциация без инъекций fa4f19fdb, генеалогический репликатор 413858e61, фристоновский минимальный пилот 4647b0491), которые использовали идентичных агентов в общей памяти без асимметрии, границ или извлечения.

Постановка эксперимента

Тип: 2-condition-architecture-vs-naive

Условие Параметры
COGNITIVE_CYCLE architecture: cognitive_cycle, asymmetric_beliefs: true, private_memory: true, typed_protocol: true, use_retrieval: true, note: Full architecture: 3 agents with different starting beliefs, per-agent private memory, typed-message protocol (OBSERVATION/QUESTION/CLAIM/DOUBT/SILENT), structured PERCEIVE-REFLECT-PLAN-ACT cycle, retrieval-augmented context (top-3 memories by cosine vs env+latest-msgs).
NAIVE_REPLICATION architecture: naive_replication, asymmetric_beliefs: false, private_memory: false, typed_protocol: false, use_retrieval: false, note: Replicates differentiation-without-injection baseline as control: 3 agents with IDENTICAL starting belief, shared text memory (last 10 lines dumped), free-text output (no typed protocol), no retrieval. Mandatory Goodhart-audit per AUTHORS-MATRIX — distinguishes architecture effect from substrate noise.

Факторы: architecture (cognitive_cycle, naive_replication)

Параметры

model
qwen2.5-7b-instruct-1m
n_agents
3
n_runs_per_condition
1
temperature
0.85