arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

2026-01-07 至 2026-01-07 共收录 10
2601.01896 2026-01-07 cs.CL cs.AI

Tackling the Inherent Difficulty of Noise Filtering in RAG

应对RAG中噪声过滤的固有难度

Jingyu Liu, Jiaen Lin, Yong Liu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Beijing Key Laboratory of Big Data Management and Analysis Methods(北京大数据管理与分析方法重点实验室) School of Software Tsinghua University(清华大学软件学院)

AI总结 本文提出了一种新的微调方法,旨在提升LLM在RAG中对相关信息和不相关信息的区分能力,从而增强模型的鲁棒性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11078 2026-01-07 cs.AI

Patient-Zero: Scaling Synthetic Patient Agents to Real-World Distributions without Real Patient Data

Patient-Zero: 通过无需真实患者数据实现对真实世界分布的合成患者代理扩展

Yunghwei Lai, Ziyue Wang, Weizhi Ma, Yang Liu

机构 * Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University(计算机科学与技术系,人工智能学院,清华大学) Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院,清华大学)

AI总结 Patient-Zero通过无需真实患者数据的合成方法,实现了对真实世界分布的高效模拟,提升了医疗数据质量和交互保真度,且在临床任务中表现出显著的性能优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12043 2026-01-07 cs.LG

Information-Theoretic Generalization Bounds of Replay-based Continual Learning

基于回放的持续学习的信息论泛化界限

Wen Wen, Tieliang Gong, Zeyu Gao, Yunjiao Zhang, Weizhan Zhang, Yong-Jin Liu

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) Department of Oncology, University of Cambridge(剑桥大学肿瘤学系) China Telecom, China(中国电信) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

AI总结 本文提出了一种基于回放的持续学习的信息论泛化界限理论框架,通过分析内存缓冲区与当前任务的相互作用,建立了更精确的泛化性能评估方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02806 2026-01-07 cs.CV

Topology-aware Pathological Consistency Matching for Weakly-Paired IHC Virtual Staining

基于拓扑的病理一致性匹配用于弱配对IHC虚拟染色

Mingzhou Jiang, Jiaying Zhou, Nan Zeng, Mickael Li, Qijie Tang, Chao He, Huazhu Fu, Honghui He

机构 * Guangdong Research Center of Polarization Imaging and Measurement Engineering Technology(广东极化成像与测量工程研究中心) Shenzhen Key Laboratory for Minimal Invasive Medical Technologies(深圳微创医疗技术重点实验室) Institute of Biopharmaceutical and Health Engineering(生物制药与健康工程研究院) Tsinghua Shenzhen International Graduate School(清华大学深圳国际 Graduate School) Tsinghua University(清华大学)

AI总结 本文提出基于拓扑的病理一致性匹配方法,用于解决H&E到IHC虚拟染色中的弱配对问题,通过拓扑感知一致性匹配和拓扑约束病理匹配提升生成质量与临床相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02776 2026-01-07 cs.SD cs.AI cs.MM

UniSRCodec: Unified and Low-Bitrate Single Codebook Codec with Sub-Band Reconstruction

UniSRCodec:统一且低比特率单码本编解码器,支持子带重建

Zhisheng Zhang, Xiang Li, Yixuan Zhou, Jing Peng, Shengbo Cai, Guoyang Zeng, Zhiyong Wu

机构 * Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院) ModelBest Inc., Beijing, China(ModelBest公司)

AI总结 UniSRCodec是一种低比特率单码本编解码器,通过子带重建技术实现高保真度压缩,优于现有单码本方法。

Comments 6 pages, 2 figures, and 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02736 2026-01-07 cs.SE cs.AI

Hypothesize-Then-Verify: Speculative Root Cause Analysis for Microservices with Pathwise Parallelism

假设-验证:基于路径并行的微服务推测根本原因分析

Lingzhe Zhang, Tong Jia, Yunpeng Zhai, Leyi Pan, Chiming Duan, Minghua He, Pei Xiao, Ying Li

机构 * Peking University(北京大学) Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学)

AI总结 SpecRCA通过假设-验证范式提升微服务系统根本原因分析的准确性和效率。

Comments accepted by ICSE-NIER'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02732 2026-01-07 cs.SE cs.AI

Agentic Memory Enhanced Recursive Reasoning for Root Cause Localization in Microservices

基于代理记忆的递归推理用于微服务根因定位

Lingzhe Zhang, Tong Jia, Yunpeng Zhai, Leyi Pan, Chiming Duan, Minghua He, Mengxi Jia, Ying Li

机构 * Peking University(北京大学) Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学) Institute of Artificial Intelligence(人工智能研究院)

AI总结 本文提出AMER-RCL框架,通过递归推理和代理记忆提升微服务根因定位的准确性和效率。

Comments accepted by ICSE-SEIP'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02680 2026-01-07 cs.CR cs.LG

Adversarial Contrastive Learning for LLM Quantization Attacks

对抗对比学习用于大语言模型量化攻击

Dinghong Song, Zhiwei Xu, Hai Wan, Xibin Zhao, Pengfei Su, Dong Li

机构 * Tsinghua University(清华大学) University of California, Merced(加州大学默塞德分校)

AI总结 本文提出对抗对比学习方法,通过最大化良性与有害响应概率差距,有效提升大语言模型量化攻击的成功率。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02368 2026-01-07 cs.IR cs.AI

Distillation-based Scenario-Adaptive Mixture-of-Experts for the Matching Stage of Multi-scenario Recommendation

基于蒸馏的场景自适应混合专家方法用于多场景推荐的匹配阶段

Ruibing Wang, Shuhan Guo, Haotong Du, Quanming Yao

机构 * Northwestern Polytechnical University(西北工业大学) Tsinghua University(清华大学)

AI总结 本文提出DSMOE,通过场景自适应投影模块和跨架构知识蒸馏框架,提升多场景推荐中匹配阶段的检索质量,尤其在数据稀疏场景中表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19001 2026-01-07 cs.AI cs.LG

ORPR: An OR-Guided Pretrain-then-Reinforce Learning Model for Inventory Management

ORPR:一种基于OR的预训练后再强化学习模型用于库存管理

Lingjie Zhao, Xue Yu, Yongzhi Qi, Hao Hu, Jianshen Zhang, Yingzheng Ma, Shuyu Han, Wei Qi, Zuo-Jun Max Shen

机构 * Department of Industrial Engineering, Tsinghua University(清华大学工业工程系) Supply Chain Tech Team Y, JD.com(京东供应链技术团队) Faculty of Engineering and Faculty of Business and Economics, The University of Hong Kong(香港大学工程学院和商学院)

AI总结 本文提出一种基于OR的预训练后再强化学习模型,通过结合领域知识和结构化优化逻辑,提升库存管理的决策效率与成本效益。

详情

展开后加载摘要…

URL PDF HTML 收藏