arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Alibaba(阿里巴巴)

2026-02-24 至 2026-02-24 共收录 6
2512.24943 2026-02-24 cs.IR cs.AI cs.CL cs.LG

RAIR: A Rule-Aware Benchmark Uniting Challenging Long-Tail and Visual Salience Subset for E-commerce Relevance Assessment

RAIR:一种融合长尾和视觉显著子集的规则感知基准,用于电商相关性评估

Chenji Lu, Zhuo Chen, Hui Zhao, Zhenyi Wang, Pengjie Wang, Chuan Yu, Jian Xu

机构 * Taobao \& Tmall Group of Alibaba Beijing China Taobao \& Tmall Group of Alibaba

AI总结 RAIR提出了一种融合长尾和视觉显著子集的规则感知基准,用于评估电商相关性,通过标准化框架和多子集数据提升模型评估的全面性与挑战性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23169 2026-02-24 cs.CV

REVEALER: Reinforcement-Guided Visual Reasoning for Element-Level Text-Image Alignment Evaluation

REVEALER: 基于强化引导的视觉推理的元素级文本-图像对齐评估

Fulin Shi, Wenyi Xiao, Bin Chen, Liang Din, Leilei Gan

机构 * Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团)

AI总结 REVEALER通过强化引导的视觉推理实现元素级文本-图像对齐评估,提升模型对齐判断的可解释性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18920 2026-02-24 cs.CL cs.AI

DeepInnovator: Triggering the Innovative Capabilities of LLMs

DeepInnovator: 激发大语言模型的创新能力

Tianyu Fan, Fengji Zhang, Yuxiang Zheng, Bei Chen, Xinyao Niu, Chengen Huang, Junyang Lin, Chao Huang

机构 * The University of Hong Kong(香港大学) City University of Hong Kong(城市大学) Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团)

AI总结 DeepInnovator通过自动化数据提取和猜想与反驳训练范式,提升大语言模型的创新能力,实现显著优于基线的创新想法生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18700 2026-02-24 cs.CR cs.CL

Watermarking LLM Agent Trajectories

对LLM代理轨迹进行水印标记

Wenlong Meng, Chen Gong, Terry Yue Zhuo, Fan Zhang, Kecen Li, Zheng Liu, Zhou Yang, Chengkun Wei, Wenzhi Chen

机构 * Zhejiang University, China(浙江大学) University of Virginia, USA(弗吉尼亚大学) Alibaba Qwen, China(阿里巴巴通义实验室) University of Alberta, Canada(阿尔伯塔大学)

AI总结 本文提出ActHook,一种针对LLM代理轨迹数据集的水印方法,通过在决策点插入钩子动作实现可靠的黑盒检测,实验显示其在数学推理等任务中具有高检测精度且性能影响小。

Comments 20 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17155 2026-02-24 cs.LG

Powering Up Zeroth-Order Training via Subspace Gradient Orthogonalization

通过子空间梯度正交化提升零阶训练

Yicheng Lang, Changsheng Wang, Yihua Zhang, Mingyi Hong, Zheng Zhang, Wotao Yin, Sijia Liu

机构 * Michigan State University(密歇根州立大学) University of Minnesota(明尼苏达大学) University of California, Santa Barbara(加州大学圣芭芭拉分校) DAMO Academy, Alibaba Group US(阿里巴巴集团美国达摩院) IBM Research, USA(美国IBM研究院)

AI总结 本文提出ZO-Muon方法,通过子空间梯度正交化提升零阶训练的精度和效率,显著加速收敛并实现准确性和查询效率的双赢。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20908 2026-02-24 cs.CL

Where Did This Sentence Come From? Tracing Provenance in LLM Reasoning Distillation

这个句子来自哪里?在LLM推理蒸馏中的溯源

Kaiyuan Liu, Shaotian Yan, Rui Miao, Bing Wang, Chen Shen, Jun Zhang, Jieping Ye

机构 * College of Computer Science and Technology(计算机科学与技术学院) Alibaba Cloud Computing(阿里云计算) School of Artificial Intelligence(人工智能学院) Department of Mathematics(数学系)

AI总结 本文提出了一种推理蒸馏溯源追踪框架,通过分析蒸馏模型生成动作的来源,揭示其在测试时的行为一致性,并提出教师指导的数据选择方法以提升蒸馏效果。

详情

展开后加载摘要…

URL PDF HTML 收藏