Компьютерные науки > Теория компьютерных и игр [представлена 13 сентября 2026 года] Название: Децентрализованное оптимальное обучение по сравнению с динамическими сетями Вид PDF HTML (экспериментальный) Резюме: Эта бумага изучает децентрализованное изучение социально оптимального равновесия в конечных обычных играх над динамичными сетями связи. Каждый агент видит только свои собственные реализованные выгоды, не знает игру априори и может общаться только с временно изменяющими соседями, используя низкополосные сообщения. Мы предлагаем сетевую децентрализованную оптимальную динамику обучения в области равновесия, при которой агенты генерируют случайные семантические сигналы/разрывы на основе местных сопоставлений выгод и таблиц с указанием времени обмена, а не необработанных действий, информации о результатах или местных оценок/параметров. Этот метод сочетает слияние таблиц и восстановление в режиме временного большинства для смягчения динамических связей при сохранении полностью децентрализованной деятельности. Мы устанавливаем логарифмические гарантии с последующими исследованиями для оптимального выбора равновесия в рамках утилитарных и пропорционально справедливых целей социального обеспечения. Результаты моделирования также показывают, что предлагаемый подход может эффективно отбирать социально желательные балансы по сравнению с динамическими сетями связи. История представления: Seref Taha Kyremitsci [видение электронной почты] [v1] Sun, 13 сентября 2026 09:39:19 UTC (2…
Децентрализованные оптимальные методы обучения над динамическими сетями
arXiv:2609.17601v1 Annualce Type: кросс-бюллетень: Настоящий документ посвящен децентрализованному изучению социально оптимального равновесия между играми в конечной нормальной форме и динамическими сетями связи. Каждый агент видит только свои собственные реализованные выгоды, не знает игру априори и может общаться только с временно изменяющими соседями, используя низкополосные сообщения. Мы предлагаем сетевую децентрализованную оптимальную динамику обучения в области равновесия, при которой агенты генерируют случайные семантические сигналы/разрывы на основе местных сопоставлений выгод и таблиц с указанием времени обмена, а не необработанных действий, информации о результатах или местных оценок/параметров. Этот метод сочетает слияние таблиц и восстановление в режиме временного большинства для смягчения динамических связей при сохранении полностью децентрализованной деятельности. Мы устанавливаем логарифмические гарантии ограниченного периода времени, с потрясением в фазе исследования, для оптимального выбора равновесия при утилитарном и пропорционально справедливом социальном обеспечении