arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Meituan(美团)

2026-08-26 至 2026-08-26 共收录 3
2608.24758 2026-08-26 cs.AI 新提交

RACE: Scalable Statistical Estimation of Functional Consistency in LLM Neurons

RACE:LLM神经元中功能一致性的可扩展统计估计

Runyu Wang, Bo Liu, Xiaxin Zhang, Yu Han, Jiawei Cao, Xiaoye Zhang, Zhe Zhang, Yifan Yang, Peng Ping

机构 * Nantong University(南通大学) Chongqing University of Post and Telecommunications(重庆邮电大学) China Southern Power Grid Company Limited(中国南方电网有限责任公司) Meituan(美团)

AI总结 针对LLM神经元功能一致性的可扩展统计估计难题,提出RACE框架,其领域特异性更优、计算开销低两个数量级,可有效评估Transformer神经元的全领域功能一致性。

Comments EMNLP-26 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24485 2026-08-26 cs.RO cs.LG 新提交

NeuralParker: A Reinforcement Learning Planner for Irregular Parking Environments

NeuralParker:面向不规则停车环境的强化学习规划器

Zihan Wang, Bai Huang, Yang Guan, Xiao Li, Haoyu Xu, Naizheng Wang, Shengbo Eben Li

机构 * Tsinghua University(清华大学) Central University of Finance and Economics(中央财经大学) Meituan(美团)

AI总结 NeuralParker是面向不规则泊车环境的强化学习混合规划器,采用目标相对全局表示与终端集成器,在基准测试及实车验证中均优于基线,规划成功率与轨迹质量更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24231 2026-08-26 cs.CL 新提交

RecurSE: Bounded Recursive Self-Evaluation for LLM Rubric Judges

RecurSE:面向LLM规则评判器的有界递归自评估

Kaiyuan Liu, Ziyuan Zhuang, Rongxiang Weng, Jieping Ye

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Meituan LongCat Team(美团龙猫团队)

AI总结 本研究提出RecurSE,一种无需外部监督的LLM规则评判器优化方法,通过同步评判器与检查器的协同演化、接口解耦及PAV监控,在多基准上实现泛化提升,可增强下游策略对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏