Реклама

Эво Аллок: Саморегулирующийся агент по распределению ресурсов для обеспечения эффективной эволюции программ

#Аллок #Саморегулирующийся #Annuate #Type #Humber

arXiv: 2610.12086v1 Annuate Type: New Humber Abstract: LLM-Development опирается на обратную связь с оценкой, которая служит руководством для итеративного поиска высокоэффективных программ. Вместе с тем оценка зачастую является расчетно дорогостоящей, в связи с чем крайне важно выделять ограниченные ресурсы кандидатам, которые могут наиболее эффективно содействовать поиску. Существующие методы, основанные на УЗ, обычно основываются на фиксированных стратегиях распределения в течение всего процесса поиска, что потенциально приводит к трате ресурсов на кандидатов с низкой стоимостью и при этом не учитывает перспективные. Мы предлагаем Эво Аллоку, самодеятельному агенту по распределению ресурсов, который извлекает уроки из опыта поиска и пересматривает свою стратегию распределения вычислительных ресурсов между кандидатами. EvoAlloc периодически сводит результаты предварительного поиска и распределения в соответствие с опытом многократного использования, который служит основой для последующих пересмотров стратегии. Она также использует контрфактический механизм разведки для периодической оценки кандидатов, лишенных ресурсов распределением, с указанием их результатов в целях обогащения i