arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

2026-01-27 至 2026-01-27 共收录 15
2601.18771 2026-01-27 cs.CL cs.AI cs.IR

Dep-Search: Learning Dependency-Aware Reasoning Traces with Persistent Memory

Dep-Search: 基于持久记忆的学习依赖意识推理轨迹

Yanming Liu, Xinyue Peng, Zixuan Yan, Yanxin Shen, Wenjie Xu, Yuefeng Huang, Xinyi Wang, Jiannan Cao, Jianwei Yin, Xuhong Zhang

机构 * Zhejiang University(浙江大学) Intel Corporation(英特尔公司) Tsinghua University(清华大学) Massachusetts Institute of Technology(麻省理工学院)

AI总结 Dep-Search 通过 GRPO 集成结构化推理、检索和持久记忆,提升 LLM 处理复杂多跳推理任务的能力。

Comments Dep-Search 1st version

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18625 2026-01-27 cs.CV

CONQUER: Context-Aware Representation with Query Enhancement for Text-Based Person Search

基于查询增强的上下文感知表示方法用于基于文本的人检索

Zequn Xie

机构 * Zhejiang University, Hangzhou, China(浙江大学)

AI总结 CONQUER通过增强跨模态对齐和自适应查询细化,提升基于文本的人检索的准确性和鲁棒性。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18285 2026-01-27 cs.CL

U-Fold: Dynamic Intent-Aware Context Folding for User-Centric Agents

U-Fold:面向用户中心任务的动态意图感知上下文折叠

Jin Su, Runnan Fang, Yeqiu Li, Xiaobin Wang, Shihao Cai, Pengjun Xie, Ningyu Zhang, Fajie Yuan

机构 * Zhejiang University(浙江大学) Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团) Westlake University(西湖大学)

AI总结 U-Fold通过动态意图感知上下文折叠方法,提升用户为中心任务中长上下文处理的效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18058 2026-01-27 quant-ph cs.CV

Differentiable Architecture Search for Adversarially Robust Quantum Computer Vision

可微架构搜索用于对抗鲁棒的量子计算机视觉

Mohamed Afane, Quanjiang Long, Haoting Shen, Ying Mao, Junaid Farooq, Ying Wang, Juntao Chen

机构 * Fordham University(福特汉姆大学) Zhejiang University(浙江大学) University of Michigan-Dearborn(密歇根大学-德雷本分校) Stevens Institute of Technology(史蒂文斯理工学院)

AI总结 本文提出了一种混合的量子-经典可微架构搜索框架,通过引入经典噪声层优化量子电路结构和鲁棒性,提升量子神经网络在对抗扰动和硬件噪声下的性能。

Comments Published in Quantum Machine Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15801 2026-01-27 cs.LG cs.CR

Attributing and Exploiting Safety Vectors through Global Optimization in Large Language Models

通过全局优化在大语言模型中归因和利用安全向量

Fengheng Chu, Jiahao Chen, Yuhong Wang, Jun Wang, Zhihui Fu, Shouling Ji, Songze Li

机构 * Southeast University(东南大学) Zhejiang University(浙江大学) OPPO Research Institute(OPPO研究院)

AI总结 通过全局优化方法识别大语言模型中的安全向量,揭示安全机制的协作交互,并提出新的白盒劫持方法提升攻击效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16943 2026-01-27 cs.IR cs.AI

RASTP: Representation-Aware Semantic Token Pruning for Generative Recommendation with Semantic Identifiers

RASTP: 基于语义标识符的生成推荐系统中的表示感知语义标记修剪

Tianyu Zhan, Kairui Fu, Zheqi Lv, Shengyu Zhang

机构 * Zhejiang University(浙江大学)

AI总结 RASTP通过动态修剪低信息语义token,减少生成推荐系统的训练时间并保持推荐性能。

Comments 4 pages, WWW 2026 short paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17743 2026-01-27 cs.CV

VideoPro: Adaptive Program Reasoning for Long Video Understanding

VideoPro: 针对长视频理解的自适应程序推理

Chenglin Li, Feng Han, Yikun Wang, Ruilin Li, Shuai Dong, Haowen Hou, Haitao Li, Qianglong Chen, Feng Tao, Jingqi Tong, Yin Zhang, Jiaqi Wang

机构 * Zhejiang University(浙江大学) Fudan University(复旦大学) Wuhan University(武汉大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 VideoPro通过自适应程序推理框架提升长视频理解的效率和可靠性,利用快慢推理机制和参数优化在视觉任务中取得更高准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17977 2026-01-27 cs.LG cs.DB

SliceGX: Layer-wise GNN Explanation with Model-slicing

SliceGX: 图神经网络的分层解释方法

Tingting Zhu, Tingyang Chen, Yinghui Wu, Arijit Khan, Xiangyu Ke

机构 * Zhejiang University(浙江大学) Case Western Reserve University(凯斯西储大学) Bowling Green State University(布里奇沃特州立大学)

AI总结 SliceGX是一种通过分层分析生成图神经网络解释的方法,能够逐步构建并维护子图以解释模型输出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17467 2026-01-27 cs.LG

Harnessing Reasoning Trajectories for Hallucination Detection via Answer-agreement Representation Shaping

通过答案一致性表示塑造进行推理轨迹的幻觉检测

Jianxiong Zhang, Bing Guo, Yuming Jiang, Haobo Wang, Bo An, Xuefeng Du

机构 * College of Computer Science, Sichuan University, China(四川大学计算机学院) School of Software Technology, Zhejiang University, China(浙江大学软件学院) College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学 computing and Data Science学院)

AI总结 本文提出ARS方法,通过塑造答案一致性表示来提高推理轨迹中幻觉检测的准确性,无需人工标注即可提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17426 2026-01-27 cs.AI cs.LO

A Syllogistic Probe: Tracing the Evolution of Logic Reasoning in Large Language Models

直言探针:追踪大型语言模型中逻辑推理的演变

Zhengqing Zang, Yuqi Ding, Yanmei Gu, Changkai Song, Zhengkai Yang, Guoping Du, Junbo Zhao, Haobo Wang

机构 * Zhejiang University(浙江大学) University of Chinese Academy of Social Sciences(中国社会科学院大学) Ant Group(蚂蚁集团) Chinese Academy of Social Sciences(中国社会科学院)

AI总结 本研究通过三段论测试揭示大型语言模型在逻辑推理演变中的特性,发现模型规模、思考机制和基础模型对逻辑发展有重要影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25204 2026-01-27 cs.LG cs.AI cs.CL

Spectral Logit Sculpting: Adaptive Low-Rank Logit Transformation for Controlled Text Generation

谱logit雕刻:一种自适应低秩logit变换用于受控文本生成

Jin Li, Zhebo Wang, Tianliang Lu, Mohan Li, Wenpeng Xing, Meng Han

机构 * Zhejiang University(浙江大学) Binjiang Institute of Zhejiang University(浙江大学滨江学院) Hangzhou Dianzi University(杭州电子科技大学) People’s Public Security University of China(中国人民公安大学) Guangzhou University(广州大学)

AI总结 SLS通过自适应低秩logit变换优化文本生成,提升输出分布的尖锐度并保持上下文一致性。

Comments Accepted by IEEE ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20347 2026-01-27 cs.CL cs.AI

SeRL: Self-Play Reinforcement Learning for Large Language Models with Limited Data

SeRL:基于有限数据的大型语言模型自我对抗强化学习

Wenkai Fang, Shunyu Liu, Yang Zhou, Kongcheng Zhang, Tongya Zheng, Kaixuan Chen, Mingli Song, Dacheng Tao

机构 * Zhejiang University(浙江大学) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算机与数据科学学院) Hangzhou City University(杭州城市大学) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院)

AI总结 SeRL通过自我指令和自我奖励机制,在有限数据条件下提升大型语言模型的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12138 2026-01-27 cs.CV

FLARE: Feed-forward Geometry, Appearance and Camera Estimation from Uncalibrated Sparse Views

FLARE:从未校准的稀疏视角推断前馈几何、外观和相机姿态

Shangzhan Zhang, Jianyuan Wang, Yinghao Xu, Nan Xue, Christian Rupprecht, Xiaowei Zhou, Yujun Shen, Gordon Wetzstein

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) University of Oxford(牛津大学) Stanford University(斯坦福大学)

AI总结 FLARE通过前馈模型从少量未校准稀疏视角图像中高效推断出高质量的相机姿态、3D几何和新视角合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17076 2026-01-27 cs.LG cs.AI

E2PL: Effective and Efficient Prompt Learning for Incomplete Multi-view Multi-Label Class Incremental Learning

E2PL: 有效且高效的提示学习用于不完整多视图多标签类别增量学习

Jiajun Chen, Yue Wu, Kai Huang, Wen Xi, Yangyang Wu, Xiaoye Miao, Mengying Zhu, Meng Xi, Guanjie Cheng

机构 * Zhejiang University Center for Data Science(浙江大学数据科学中心) Zhejiang University School of Software Technology(浙江大学软件技术学院) Zhejiang University(浙江大学)

AI总结 E2PL通过任务定制化和缺失感知的提示设计,有效解决不完整多视图多标签类别增量学习中的缺失视图和动态类别扩展问题,提升模型鲁棒性和效率。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16987 2026-01-27 cs.CL cs.AI

Evaluating Reward Model Generalization via Pairwise Maximum Discrepancy Competitions

通过成对最大分歧竞赛评估奖励模型泛化能力

Shunyang Luo, Peibei Cao, Zhihui Zhu, Kehua Feng, Zhihua Wang, Keyan Ding

机构 * ZJU-UIUC Institute, Zhejiang University(浙江大学ZJU-UIUC研究院) School of Artificial Intelligence, Nanjing University of Information Science and Technology(南京信息工程大学人工智能学院) ZJU-Hangzhou Global Scientific and Technological Innovation Center, Zhejiang University(浙江大学Hangzhou全球科技创新中心) City University of Hong Kong(香港城市大学)

AI总结 本文提出PMDC方法,通过动态选择高争议测试案例评估奖励模型的泛化能力,并揭示了现有模型的系统性泛化失败问题。

Comments 17 pages, 6 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏