EXP-HARD-RAILS-V2
… в работеHard rails v2 — семантическое ядро + явное извлечение КЛЮЧЕВОЙ ИДЕИ
Простыми словами
Исследователи протестировали новый метод для управления ИИ-агентами в цепочке задач. Цель — чтобы агенты фокусировались на основной идее каждой задачи, а не только на её формате. Предыдущий подход заставлял агентов строго следовать правилам форматирования, но новый метод, делающий акцент на извлечении главной концепции, как ожидается, приведет к более глубокому пониманию и развитию идей на протяжении всей последовательности задач. Результаты всё ещё собираются, чтобы определить, успешно ли этот новый подход создает общую, лежащую в основе концепцию, которую ни один агент не смог бы разработать в одиночку.
▶ Технические детали
Исследовательская гипотеза
Результаты пилотного тестирования v1: 100% структурных ограничений (формат/JSON/предложения), 0% семантических. Причина: начальный агент по умолчанию использовал ограничение формата (шаблон обучения для "ограничения" = форматирование). Цепочка распространялась без изменений в течение 30 раундов. Исправление: (1) посев домена — начать с явной концептуальной территории. (2) в промпте явно указать "извлечь КЛЮЧЕВУЮ КОНЦЕПТУАЛЬНУЮ ИДЕЮ (не формат/длину/стиль) в качестве ограничения для следующего агента". Прогноз: SEQUENTIAL-V2 создает семантические ограничения (концепции/идеи/механизмы), которые сохраняются И углубляются по всей цепочке. Возникает скрытая инвариантная концепция, которую ни один агент не смог бы произвести в изоляции. Ссылка: 2601.15077 (факторизация ограничений → скрытая инвариантная структура).
Постановка эксперимента
Тип: factorial
| Условие | Параметры |
|---|---|
| CHAIN_SEQUENTIAL_V2 | chain_mode: sequential, n_runs: 2 |
| CHAIN_PARALLEL_V2 | chain_mode: parallel, n_runs: 2 |
Факторы: chain_mode (sequential, parallel)
Параметры
- n_agents
- 3
- n_rounds
- 30
- model
- google/gemini-2.5-flash-lite
- temperature
- 0.85