Статистические данные > Машинное обучение [представлено 17 августа 2026 (v1), последний пересмотренный вариант 16 сентября 2026 года (эта версия, v2)) Название: Повышение качества анализа сожалений для параллельного гассианского процесса Bandit Оптимизации зрения PDF HTML (экспериментальное) резюме: В настоящем документе изучается анализ сожаления в связи с параллельным оптимизацией бандитизма Гауссийского процесса (GP). Известные верхние границы сожаления по широко используемой партии GP с верхней доверенностью и выборке Томпсона (GP-BTS) страдают мультипликативным коэффициентом в отношении размера партии $Q. Во избежание такого ухудшения существующего анализа в начале процесса оптимизации требуется наличие полиномического числа проб неопределенности (США) на сумму в долл. Однако на практике эта начальная фаза США зачастую является неэффективной. В настоящем документе показано, что верхняя граница сожаления без мультипликативного фактора по отношению к доллару Q может быть достигнута без начального этапа США с использованием в качестве примера ГП-ББТ. Кроме того, мы проявляем гораздо лучшее сожаление по верхним пределам в бесшумной среде, чем в шумных условиях, как и в последовательной GP-бандитской конфигурации. История представления: Shion Takeno [видение электронной почты] [v1] Mon, 17 августа 2026 12.30:40 UTC (509 KB) [ v2] Wed, 16 сентября 2026 13:14:08 UTS (490 KB). Текущий контекст просмотра: stat.ML ссылки и цитаты... Библиографический и цитационно-инструментальный…
Усовершенствованный анализ сожалений в отношении параллельного гауссианского процесса
arXiv: 2608.16492v2 Annuales Type: заменить резюме: В настоящем документе изучается анализ сожалений в целях параллельной оптимизации бандитов Гауссианского процесса. Известные верхние границы сожаления по широко используемой партии GP с верхней доверенностью и выборке Томпсона (GP-BTS) страдают мультипликативным коэффициентом в отношении размера партии $Q. Во избежание такого ухудшения существующего анализа в начале процесса оптимизации требуется наличие полиномического числа проб неопределенности (США) на сумму в долл. Однако на практике эта начальная фаза США зачастую является неэффективной. В настоящем документе показано, что верхняя граница сожаления без мультипликативного фактора по отношению к доллару Q может быть достигнута без начального этапа США с использованием в качестве примера ГП-ББТ. Кроме того, мы проявляем гораздо лучшее сожаление по верхним пределам в бесшумной среде, чем в шумных условиях, как и в последовательной GP-бандитской конфигурации.