COGNITIVE-CYCLE-3AGENTS-PILOT-V3-PARTIAL-OBS
◐ частичноcognitive-cycle-3agents-pilot-v3-partial-obs
Простыми словами
В прошлом эксперименте три агента с разными убеждениями и личными воспоминаниями пришли к очень похожим выводам, хотя и наблюдали одну и ту же сцену. Теперь мы дадим каждому агенту свою собственную, отдельную сцену (разные предложения о разных вещах), чтобы выяснить, была ли схожесть вызвана просмотром одного и того же "фильма" или же чем-то более глубоким внутри самой языковой модели. Если они по-прежнему придут к схожим выводам при разных входных данных, значит, причина в модели, и нам придется ее изменить. Если же их выводы разойдутся, то причиной была общая сцена, и исправления, касающиеся только архитектуры, останутся возможными.
▶ Технические детали
Исследовательская гипотеза
v3 — повторная попытка эксперимента cognitive-cycle-3agents-pilot-v2 (коммит 5cddf341c). Результат v2: снисходительный парсер подтвердил поверхностное различие (P1 JS=0.167, P3 8 строгих УТВЕРЖДЕНИЙ, P6 74% не-НАБЛЮДЕНИЙ), НО P4 reflect-centroid pairwise cosine ВСЕ ЕЩЕ ~0.92 (по сравнению с 0.985 в v1) — семантические представления оставались конвергентными даже при асимметричных исходных убеждениях + приватной памяти + типизированном протоколе. Открытый вопрос: было ли остаточное сближение P4 обусловлено ОБЩИМ входом env_stream (все 3 агента воспринимали одинаковую последовательность предложений на каждом шаге) ИЛИ аттрактором, присущим субстрату (пространство вложений Qwen 7B притягивает многоагентные рефлексии к общему центроиду независимо от входа)? Тест v3: вводится условие PARTIAL_OBSERVATION, где каждый агент получает приватный срез env_stream (разные предложения, разные лексические домены — Alpha=ЦВЕТА, Beta=КОЛИЧЕСТВА, Gamma=ПРИРОДНЫЕ-ОСОБЕННОСТИ). Вся остальная архитектура идентична v2 (снисходительный парсер, структурированный цикл, приватная память, извлечение, типизированный протокол, асимметричные убеждения). Условие SHARED_OBS_CONTROL напрямую воспроизводит базовую линию v2 для сопоставимого сравнения. Основной дискриминатор: P4 reflect-centroid pairwise cosine в PARTIAL_OBS. Если cos <=0.85 (заметно ниже 0.92 в v2) -> семантическая конвергенция была артефактом, обусловленным входом; агенты реагируют на то, что они воспринимают. Если cos все еще ~0.92 -> подтвержден аттрактор, присущий субстрату; вмешательство по модификации субстрата (DPO / управление активацией / дообучение на основе градиентов) правильно указано.
Постановка эксперимента
Тип: 2-condition-input-observation-mode
| Условие | Параметры |
|---|---|
| PARTIAL_OBS | architecture: cognitive_cycle, asymmetric_beliefs: true, private_memory: true, typed_protocol: true, use_retrieval: true, env_mode: partial, env_streams: [object Object], note: Per-agent private env_stream. Alpha sees COLORS-only, Beta sees COUNTS-only, Gamma sees NATURE-FEATURES-only. Each agent walks its own 5-sentence stream (round-robin within agent). Tests whether v2 P4 convergence was input-driven. |
| SHARED_OBS_CONTROL | architecture: cognitive_cycle, asymmetric_beliefs: true, private_memory: true, typed_protocol: true, use_retrieval: true, env_mode: shared, env_stream: a red bird flew over the still water,she counted the green leaves on the windy branch,three blue stones lay silent in the dark stream,morning light cast shadows on five tall pines,the river bent twice around two sharp rocks, note: Replicates v2 COGNITIVE_CYCLE baseline (same 5 mixed COLORS+COUNTS+NATURE env_stream). Direct comparison anchor — matched architecture, only env_mode differs from PARTIAL_OBS. Mandatory Goodhart-audit per AUTHORS-MATRIX. |
Факторы: env_mode (partial, shared)
Параметры
- model
- qwen2.5-7b-instruct-1m
- n_agents
- 3
- n_runs_per_condition
- 1
- temperature
- 0.85