← к хронологии

EXP-IVB-NEUTRAL

информативно

L5 IVB Абляция — Нейтральное Формулирование Контроль для Пилотного Эксперимента по Конкуренции

2026-03-29 L5 уровень 1 запусков $0.00
new
premortem
mock
real
metrics
analyze
review
krit
done

Простыми словами

Исследователи проверили, предпочитают ли большие языковые модели (LLM) сотрудничество по умолчанию, или же их поведение формируется исключительно инструкциями. Они создали сценарий, в котором агенты взаимодействовали без явных указаний на сотрудничество или конкуренцию, описывая только их индивидуальные черты. Эксперимент оказался слишком мал, чтобы сделать какие-либо выводы о том, обладают ли модели врожденной склонностью к сотрудничеству, или же их действия являются исключительно результатом полученных подсказок.

Что мы выяснили

НЕДОСТАТОЧНО МОЩНОСТИ (N=1): Прогнозов не было

Предсказания до запуска

0/3 confirmed

Технические детали

Исследовательская гипотеза

ОТКЛЮЧЕНИЕ IVB — КОНТРОЛЬ С НЕЙТРАЛЬНЫМ ФРЕЙМИНГОМ

Zhang 2603.23406 утверждает, что LLM обладают врожденной прогрессивной предвзятостью, которая переопределяет предустановки. Если это правда, то сотрудничество > конкуренция в exp-competition-pilot может быть артефактом LLM, а не эмерджентным свойством.

ДАННЫЙ ЭКСПЕРИМЕНТ: то же слияние 8 агентов, что и в exp-cp-cooperate и exp-cp-compete, но с НЕЙТРАЛЬНЫМ фреймингом — без директивы сотрудничества или конкуренции. Агенты описываются только их когнитивными тенденциями, без межгрупповых целей.

ЛОГИКА ОТКЛЮЧЕНИЯ:

  • Если нейтральный ≈ сотрудничество (TR_diff~0.25) → IVB подтверждено: сотрудничество по умолчанию
  • Если нейтральный ≈ конкуренция (TR_diff~0.12) → IVB опровергнуто: фрейминг определяет результаты
  • Если нейтральный ≠ ни то, ни другое → трехстадийный ландшафт, фрейминг модулирует, но ни один не является значением по умолчанию

КРИТИЧЕСКИ ВАЖНО ДЛЯ PAPER2: определяет, нуждается ли §discussion в оговорке IVB или в защите IVB.

Использует ИДЕНТИЧНЫЕ сиды из Фазы A+B для поддержания сопоставимости. Та же модель, температура, раунды, количество агентов.

ТЕОРЕТИЧЕСКОЕ ОБОСНОВАНИЕ:

  • Zhang 2603.23406: врожденная ценностная предвзятость (IVB) в LLM
  • Kulveit 2603.11353: ожидания интервьюера просачиваются в ответы ИИ
  • Наш exp-competition-pilot: сотрудничество TR_diff=0.257 против конкуренции TR_diff=0.117

ЭТО УРОВЕНЬ ИССЛЕДОВАНИЯ (N=1). Цель: воспроизводит ли нейтральный фрейминг паттерны сотрудничества или конкуренции?

Постановка эксперимента

Тип: single_condition

Условие Параметры
NEUTRAL interaction: LIVE, persona: PERSONA

Факторы: interaction (LIVE) × persona (PERSONA)

Параметры

model
gemini-2.5-flash-lite
n_agents
8
n_rounds
15
scheduler
round_robin
temperature
0.9

Trophic Ratios by Condition

Mean trophic ratio per agent across runs. Error bars = ±1 std dev. Higher TR = more upstream (exporter).