← к хронологии

EXP-MMP-GPT4O

частично

Мультимодельный пилот: GPT-4o-mini

2026-04-13 L3 уровень paper3 6 запусков $0.05
new
premortem
mock
real
metrics
analyze
review
krit
done

Простыми словами

Появляется ли иерархия в GPT-4o-mini? Идентичные агенты, 30 раундов, LIVE против ISOLATED.

Технические детали

Исследовательская гипотеза

Пилотное исследование с несколькими моделями: обобщается ли трофическая иерархия (упорядочивание TR), избыточная позитивность VP, величина F0 и сохранение роли LIVE>ISOLATED на различные LLM (Claude, GPT-4o-mini, Gemini)? Идентичный экспериментальный протокол для 3 моделей, 2 условий (LIVE/ISOLATED), N=3 агента, 30 раундов. Зарегистрированные предсказания: P1: согласованность упорядочивания TR (Kendall W > 0.5 между запусками внутри модели), P2: VP_excess > 0 во всех условиях LIVE (универсально), P3: величина F0 сходится между моделями (CV < 0.5), P4: сохранение роли LIVE > ISOLATED (эффект присутствует во всех моделях).

Постановка эксперимента

Тип: multi_condition

Условие Параметры
LIVE label: Live interaction (shared memory), interaction: LIVE, persona: IDENTICAL, n_runs: 3
ISOLATED label: Isolated (private memory per agent), interaction: ISOLATED, persona: IDENTICAL, n_runs: 3

Параметры

n_agents
3
n_rounds
30
model
openai/gpt-4o-mini
temperature
0.9
scheduler
round_robin

Trophic Ratios by Condition

Mean trophic ratio per agent across runs. Error bars = ±1 std dev. Higher TR = more upstream (exporter).

multi-model cross-substrate pilot vocabulary-propagation