arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

2026-01-13 至 2026-01-13 共收录 17
2601.07261 2026-01-13 cs.LG cs.AI q-bio.QM

Pseudodata-guided Invariant Representation Learning Boosts the Out-of-Distribution Generalization in Enzymatic Kinetic Parameter Prediction

伪数据引导的不变表示学习提升酶动力学参数预测的分布外泛化能力

Haomin Wu, Zhiwei Nie, Hongyu Zhang, Zhixiang Ren

机构 * Pengcheng Laboratory, Shenzhen, China(鹏城实验室,深圳,中国) Southern University of Science and Technology, Shenzhen, China(南方科技大学,深圳,中国) School of Electronic and Computer Engineering, Peking University, Shenzhen, China(北京大学电子与计算机工程学院,深圳,中国)

AI总结 O$^2$DENet通过生物化学引导的扰动增强和不变表示学习,提升酶动力学参数预测在分布外情况下的泛化能力,实现对k_cat和K_m的高准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07238 2026-01-13 cs.AI

Group Pattern Selection Optimization: Let LRMs Pick the Right Pattern for Reasoning

分组模式选择优化:让大推理模型选择正确的推理模式

Hanbin Wang, Jingwei Song, Jinpeng Li, Fei Mi, Lifeng Shang

机构 * Peking University(北京大学) The University of Hong Kong(香港大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

AI总结 GPSO通过强化学习框架优化大推理模型的推理模式选择,提升其在不同问题上的推理性能。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07023 2026-01-13 cs.AI

CloneMem: Benchmarking Long-Term Memory for AI Clones

CloneMem:用于AI克隆的长期记忆基准测试

Sen Hu, Zhiyu Zhang, Yuxiang Wei, Xueran Han, Zhenheng Tang, Huacan Wang, Ronghao Chen

机构 * Peking University(北京大学) UC Davis(加州大学戴维斯分校) Georgia Tech(佐治亚理工学院) MBZUAI(穆桑人工智能研究所) HKUST(香港科技大学) UCAS(中国科学技术大学)

AI总结 CloneMem是一个用于评估AI克隆长期记忆能力的基准,通过非对话数字痕迹数据,评估代理对个人状态演变的跟踪能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06966 2026-01-13 cs.CL cs.AI

RealMem: Benchmarking LLMs in Real-World Memory-Driven Interaction

RealMem: 在真实世界中评估大语言模型的内存驱动交互

Haonan Bian, Zhiyuan Yao, Sen Hu, Zishan Xu, Shaolei Zhang, Yifu Guo, Ziliang Yang, Xueran Han, Huacan Wang, Ronghao Chen

机构 * Xidian University(西安电子科技大学) Zhejiang University(浙江大学) Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学) Renmin University of China(中国人民大学) Sun Yat-sen University(中山大学) University of the Chinese Academy of Sciences(中国科学院大学)

AI总结 RealMem是一个基于真实项目场景的基准,评估大语言模型在长期项目导向交互中的记忆管理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03769 2026-01-13 cs.AI

EntroCoT: Enhancing Chain-of-Thought via Adaptive Entropy-Guided Segmentation

EntroCoT:通过自适应熵引导分割增强链式思考

Zihang Li, Yuhang Wang, Yikun Zong, Wenhan Yu, Xiaokun Yuan, Runhan Jiang, Zirui Liu, Tong Yang, Arthur Jiang

机构 * Peking University(北京大学) IQuest Research(IQuest研究)

AI总结 EntroCoT通过自适应熵引导分割提升链式思考的推理质量,构建高质量数据集以提高大语言模型的数学推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23027 2026-01-13 cs.LG cs.CL

Towards Stable and Effective Reinforcement Learning for Mixture-of-Experts

面向混合专家架构的稳定且有效的强化学习

Di Zhang, Xun Wu, Shaohan Huang, Lingjie Jiang, Yaru Hao, Li Dong, Zewen Chi, Zhifang Sui, Furu Wei

机构 * Microsoft Research(微软研究院) Peking University(北京大学)

AI总结 本文提出一种路由感知方法,通过优化重要性采样权重提升混合专家架构的强化学习稳定性与性能。

Comments Added additional experiments, improved analysis, and fixed minor issues

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23013 2026-01-13 cs.LG cs.AI

MoEMeta: Mixture-of-Experts Meta Learning for Few-Shot Relational Learning

MoEMeta:基于少量样本关系学习的专家混合元学习

Han Wu, Jie Yin

机构 * The University of Sydney, Australia(悉尼大学) Peking University, China(北京大学)

AI总结 MoEMeta通过混合专家模型和任务定制适应机制,提升少样本关系学习的泛化与适应能力。

Comments Appear in NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09681 2026-01-13 cs.IR cs.AI cs.CL cs.LG

DB3 Team's Solution For Meta KDD Cup' 25

DB3团队的Meta KDD杯'25解决方案

Yikuan Xia, Jiazun Chen, Yirui Zhan, Suifeng Zhao, Weipeng Jiang, Chaorui Zhang, Wei Han, Bo Bai, Jun Gao

机构 * Key Laboratory of High Confidence Software Technologies, CS, Peking University, China(高可信软件技术重点实验室,中国科学院,北京大学) Theory Lab, Central Research Institute, 2012 Labs, Huawei Technologies Co., Ltd, Shenzhen, China(理论实验室,中央研究院,2012实验室,华为技术有限公司,深圳)

AI总结 DB3团队通过多模态检索框架和拒绝训练方法,在KDD杯'25的CRAG-MM挑战中取得优异成绩,尤其在处理第一人称视角问题上表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06566 2026-01-13 q-fin.ST cs.LG q-fin.MF

Diffusion Factor Models: Generating High-Dimensional Returns with Factor Structure

扩散因子模型:利用因子结构生成高维收益率

Minshuo Chen, Renyuan Xu, Yumin Xu, Ruixun Zhang

机构 * Department of Industrial Engineering and Management Sciences, Northwestern University(西北大学工业工程与管理科学系) Department of Management Science & Engineering, Stanford University(斯坦福大学管理科学与工程系) School of Mathematical Sciences, Peking University(北京大学数学科学学院) School of Mathematical Sciences, Center for Statistical Science, Laboratory for Mathematical Economics and Quantitative Finance, and National Engineering Laboratory for Big Data Analysis and Applications, Peking University(北京大学数学科学学院)

AI总结 本文提出扩散因子模型,通过整合因子结构与生成扩散过程,解决高维金融模拟中的维度诅咒和数据稀缺问题,提供了一种在有限数据下生成高维收益率的系统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02283 2026-01-13 cs.CV cs.AI

GP-GS: Gaussian Processes Densification for 3D Gaussian Splatting

GP-GS:基于高斯过程的3D高斯点云密集化

Zhihao Guo, Jingxuan Su, Chenghao Qian, Shenglin Wang, Jinlong Fan, Jing Zhang, Wei Zhou, Hadi Amirpour, Yunlong Zhao, Liangxiu Han, Peng Wang

机构 * Manchester Metropolitan University(曼彻斯特 Metropolitan 大学) SECE, Peking University(SECE,北京大学) University of Leeds(利兹大学) Pengcheng Laboratory(鹏城实验室) Hangzhou Dianzi University(杭州电子科技大学) Wuhan University(武汉大学) Cardiff University(卡迪夫大学) University of Klagenfurt(克雷夫大学) Imperial College London(伦敦帝国学院)

AI总结 GP-GS通过高斯过程实现3D高斯点云的密集化优化,提升重建质量和渲染保真度,达到1.12 dB PSNR的改进。

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06496 2026-01-13 cs.CV

3D CoCa v2: Contrastive Learners with Test-Time Search for Generalizable Spatial Intelligence

3D CoCa v2:基于测试时间搜索的对比学习用于通用空间智能

Hao Tang, Ting Huang, Zeyu Zhang

机构 * School of Computer Science, Peking University(北京大学计算机学院)

AI总结 3D CoCa v2通过测试时间搜索提升3D场景描述的泛化能力,实现对比学习与描述生成的统一,提高鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06193 2026-01-13 cs.LG cs.AI cs.CL

MLB: A Scenario-Driven Benchmark for Evaluating Large Language Models in Clinical Applications

MLB:面向临床应用的大型语言模型评估场景驱动基准

Qing He, Dongsheng Bi, Jianrong Lu, Minghui Yang, Zixiao Chen, Jiacheng Lu, Jing Chen, Nannan Du, Xiao Cu, Sijing Wu, Peng Xiang, Yinyin Hu, Yi Guo, Chunpu Li, Shaoyang Li, Zhuo Dong, Ming Jiang, Shuai Guo, Liyun Feng, Jin Peng, Jian Wang, Jinjie Gu, Junwei Liu

机构 * Ant Group(蚂蚁集团) Zhejiang University(浙江大学) Health Information Center of Zhejiang Province(浙江省健康信息中心) Peking University(北京大学)

AI总结 MLB基准通过场景驱动的评估方法,评估大型语言模型在临床应用中的表现,揭示模型在结构化任务与患者交互场景间的性能差异。

Comments 11 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06176 2026-01-13 cs.CV

TIR-Flow: Active Video Search and Reasoning with Frozen VLMs

TIR-Flow:基于冻结视频语言模型的主动视频搜索与推理

Hongbo Jin, Siyi Xie, Jiayu Ding, Kuanwei Lin, Ge Li

机构 * School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学)

AI总结 TIR-Flow通过三个协同模块实现冻结视频语言模型的主动视频搜索与推理,显著提升性能并拓展长视界视频推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06064 2026-01-13 cs.CY cs.AI cs.MA

Socio-technical aspects of Agentic AI

群体技术视角下的代理AI

Praveen Kumar Donta, Alaa Saleh, Ying Li, Shubham Vaishnav, Kai Fang, Hailin Feng, Yuchao Xia, Thippa Reddy Gadekallu, Qiyang Zhang, Xiaodan Shi, Ali Beikmohammadi, Sindri Magnússon, Ilir Murturi, Chinmaya Kumar Dehury, Marcin Paprzycki, Lauri Loven, Sasu Tarkoma, Schahram Dustdar

机构 * Department of Computer and Systems Sciences, Stockholm University(斯德哥尔摩大学计算机与系统科学系) Center for Ubiquitous Computing, University of Oulu(奥卢大学无处不在计算中心) College of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院) Zhejiang A\&F University, Hangzhou(浙江工业大学之江学院) School of Computer Science, Peking University(北京大学计算机科学学院) Department of Mechatronics, University of Prishtina(普里什蒂纳大学机电系) Department of Computer Science, IISER Berhampur(伯尔哈普尔IISER计算机科学系) Systems Research Institute Polish Academy of Sciences(波兰科学院系统研究所) Department of Computer Science, University of Helsinki(赫尔辛基大学计算机科学系)

AI总结 本文从社会技术视角探讨代理AI,分析其技术组件与社会背景的关联,揭示伦理挑战及未来研究方向。

Comments Dear Reviewer, please note that this is not survey/review or position paper. This paper introduced new framework (MAD-BAD-SAD Framework) for Socio-technical aspects of Agentic AI, Ethical considerations, which is very important to consider beside technical development

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14817 2026-01-13 cs.CV cs.NA math.NA

Fracture interactive geodesic active contours for bone segmentation

骨折交互测地主动轮廓用于骨分割

Liheng Wang, Licheng Zhang, Hailin Xu, Jingxin Zhao, Xiuyun Su, Jiantao Li, Miutian Tang, Weilu Gao, Chong Chen

机构 * State Key Laboratory of Mathematical Sciences, Academy of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing 100190, China(数学科学国家重点实验室,数学与系统科学研究院,中国科学院,北京) University of Chinese Academy of Sciences, Beijing 100190, China(中国科学院大学,北京) Department of Orthopedics, The Fourth Medical Center of Chinese PLA General Hospital, Beijing 100048, China(中国人民解放军总医院第四医学中心骨科,北京) National Clinical Research Center for Orthopedics, Sports Medicine and Rehabilitation, Beijing 100048, China(骨科、运动医学与康复国家临床医学研究中心,北京) Department of Trauma and Orthopedics, People’s Hospital Peking University, Beijing 100044, China(北京大学人民医院创伤与骨科,北京)

AI总结 本文提出一种针对骨骨折分割的改进测地主动轮廓算法,通过结合强度和梯度范数的边缘检测函数,提升骨分割的鲁棒性和准确性。

Comments 27 pages, 10 figures, 1 table

Journal ref Pattern Recognition 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08211 2026-01-13 cs.CL cs.AI cs.LG

SAEMark: Steering Personalized Multilingual LLM Watermarks with Sparse Autoencoders

SAEMark: 通过稀疏自编码器引导个性化多语言大语言模型水印

Zhuohao Yu, Xingru Jiang, Weizheng Gu, Yidong Wang, Qingsong Wen, Shikun Zhang, Wei Ye

机构 * Peking University(北京大学)

AI总结 SAEMark通过稀疏自编码器实现多语言大语言模型的高效水印标记,无需修改模型参数,保持文本质量,适用于多种语言和领域。

Comments 24 pages, 12 figures, NeurIPS 2025, code available: https://zhuohaoyu.github.io/SAEMark

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06472 2026-01-13 cs.CL cs.AI cs.CE cs.DL

KARMA: Leveraging Multi-Agent LLMs for Automated Knowledge Graph Enrichment

KARMA:利用多智能体大语言模型实现知识图谱的自动化丰富

Yuxing Lu, Wei Wu, Xukai Zhao, Rui Peng, Jinzhuo Wang

机构 * Department of Big Data and Biomedical AI, Peking University(北京大学大数据与生物医学人工智能系) Wallace H. Coulter Department of Biomedical Engineering, Georgia Institute of Technology(佐治亚理工学院生物医学工程系) School of Architecture, Tsinghua University(清华大学建筑学院)

AI总结 KARMA通过多智能体大语言模型自动丰富知识图谱,有效识别新实体并提高正确性与一致性

Comments 24 pages, 3 figures, 2 tables

Journal ref Spotlight paper of NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏