Cooperative Coevolution for Resource-Constrained Agentic LLM Post-Training
资源受限智能体大语言模型后训练的协同协同进化方法
AI总结 针对资源受限智能体LLM后训练的高内存、长耗时问题,提出CoPES方法,在GPU小时预算下,其验证准确率恢复率、内存效率均优于标准ES和LoRA-GRPO,在多任务基准上表现更优。
Comments 14 pages,9 figures, submit to AAAI 2027
期刊&会议
AAAI Conference on Artificial Intelligence · 会议 · Artificial Intelligence
资源受限智能体大语言模型后训练的协同协同进化方法
AI总结 针对资源受限智能体LLM后训练的高内存、长耗时问题,提出CoPES方法,在GPU小时预算下,其验证准确率恢复率、内存效率均优于标准ES和LoRA-GRPO,在多任务基准上表现更优。
Comments 14 pages,9 figures, submit to AAAI 2027
面向智能体工作流的组合式元路由学习:一个可执行基准
AI总结 本文提出一个智能体工作流的可执行基准和感知预算的组合式元路由器,在保留测试集上实现100%成功率,成本比静态策略低43%,但在词汇偏移挑战任务上表现不佳,凸显词汇泛化是主要限制。
Comments 7 pages, 1 figure; AAAI 2027 anonymous submission
设计剧场:生成式用户界面的一个基准
机构 * Vercel(Vercel公司) ; Claude Artifacts(Claude Artifacts公司) ; ChatGPT Canvas(ChatGPT Canvas公司) ; Firebase Studio(Firebase Studio公司) ; Bolt(Bolt公司) ; Anthropic(Anthropic公司) ; OpenAI(OpenAI公司) ; Google(谷歌公司) ; StackBlitz(StackBlitz公司)
AI总结 研究生成式UI工具中设计原理与实际界面的脱节现象(设计剧场),引入含24个任务的基准及指标,评估五个工具创建的120个界面,发现原理实现率低、工具识别原则有限,贡献概念、基准及评估结果。
Comments Accepted at AAAI/AIES
EPM-RL:电商产品映射的强化学习方法
机构 * AI Research, Enhans(AI研究,Enhans)
AI总结 本文提出EPM-RL框架,通过强化学习提升电商产品映射的准确性和效率,解决传统方法依赖外部API和高成本的问题,实现私有部署和低成本运营。
Comments preprint
Journal ref Proceedings of the AAAI Symposium Series, vol. 9, no. 1, p. 227, 2026
Comments Peer reviewed at NECO-18 (hosted at International AAAI Conference on Web and Social Media 2018)
Journal ref NECO-18 at International AAAI Conference on Web and Social Media (ICWSM) 2018