arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Alibaba(阿里巴巴)

2026-03-03 至 2026-03-03 共收录 22
2603.01801 2026-03-03 cs.AI

What Papers Don't Tell You: Recovering Tacit Knowledge for Automated Paper Reproduction

论文未告诉你什么:为自动化论文复现恢复隐性知识

Lehui Li, Ruining Wang, Haochen Song, Yaoxin Mao, Tong Zhang, Yuyao Wang, Jiayi Fan, Yitong Zhang, Jieping Ye, Chengqi Zhang, Yongshun Gong

机构 * School of Software, Shandong University China Beijing Institute of Technology China Zhejiang University China Dept.\ of Math \& Statistics, Boston University USA College of AI, Tsinghua University China Alibaba Group China The Hong Kong Polytechnic University Hong Kong SAR, China School of Software, Shandong University Beijing Institute of Technology Zhejiang University Dept.\ of Math \& Statistics, Boston University College of AI, Tsinghua University Alibaba Group The Hong Kong Polytechnic University

AI总结 本文提出一种基于图的智能体框架,通过恢复关系型、身体型和集体型隐性知识,提升自动化论文复现性能。

Comments 32 pages (+ appendix), 8 figures. Lehui Li and Ruining Wang contributed equally. Yongshun Gong is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01666 2026-03-03 cs.CL cs.IR

Beyond the Grid: Layout-Informed Multi-Vector Retrieval with Parsed Visual Document Representations

超越网格:基于解析视觉文档表示的布局感知多向量检索

Yibo Yan, Mingdong Ou, Yi Cao, Xin Zou, Shuliang Liu, Jiahao Huo, Yu Huang, James Kwok, Xuming Hu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Alibaba Cloud Computing(阿里云计算)

AI总结 ColParse通过生成布局感知的子图像嵌入和全局向量融合,实现高效多向量检索,显著降低存储需求并提升性能。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01579 2026-03-03 cs.CV cs.AI

SkeleGuide: Explicit Skeleton Reasoning for Context-Aware Human-in-Place Image Synthesis

SkeleGuide: 基于显式骨骼推理的上下文感知人体图像合成

Chuqiao Wu, Jin Song, Yiyun Fei

机构 * Alibaba Group(阿里巴巴集团)

AI总结 SkeleGuide通过显式骨骼推理提升上下文感知的人体图像合成质量,提供高保真且结构合理的生成结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01425 2026-03-03 cs.CL cs.IR

LaSER: Internalizing Explicit Reasoning into Latent Space for Dense Retrieval

LaSER: 将显式推理内化到潜在空间以实现密集检索

Jiajie Jin, Yanzhao Zhang, Mingxin Li, Dingkun Long, Pengjun Xie, Yutao Zhu, Zhicheng Dou

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高陵人工智能学院) Tongyi Lab, Alibaba Group(阿里集团通义实验室)

AI总结 LaSER通过将显式推理内化到潜在空间,提升密集检索性能,结合推理深度与推理效率。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16110 2026-03-03 cs.CV cs.AI

OmniCT: Towards a Unified Slice-Volume LVLM for Comprehensive CT Analysis

OmniCT:迈向统一的切片-体积LVLM以实现全面的CT分析

Tianwei Lin, Zhongwei Qiu, Wenqiao Zhang, Jiang Liu, Yihan Xie, Mingjian Gao, Zhenxuan Fan, Zhaocheng Li, Sijing Li, Zhongle Xie, Peng LU, Yueting Zhuang, Ling Zhang, Beng Chin Ooi, Yingda Xia

机构 * Zhejiang University(浙江大学) DAMO Academy, Alibaba Group(阿里云学术院) Hupan Lab(虎派实验室)

AI总结 OmniCT提出了一种统一的切片-体积LVLM,通过空间一致性增强、器官级语义增强和MedEval-CT数据集,实现了全面的CT分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05724 2026-03-03 cs.AI

Overcoming Joint Intractability with Lossless Hierarchical Speculative Decoding

通过无损分层推测解码克服联合不可解性

Yuxuan Zhou, Fei Huang, Heng Li, Fengyi Wu, Tianyu Wang, Jianwei Zhang, Junyang Lin, Zhi-Qi Cheng

机构 * Qwen Team, Alibaba Inc.(阿里云团队,阿里巴巴公司) University of Washington(华盛顿大学)

AI总结 本研究提出分层推测解码方法,通过平衡概率质量克服联合不可解性,提升解码效率并保持分布保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08630 2026-03-03 cs.CL

ExPO-HM: Learning to Explain-then-Detect for Hateful Meme Detection

ExPO-HM:为仇恨表情包检测学习解释-然后检测

Jingbiao Mei, Mingsheng Sun, Jinghong Chen, Pengda Qin, Yuhong Li, Da Chen, Bill Byrne

机构 * Department of Engineering, University of Cambridge(剑桥大学工程系) Xiaohongshu Inc.(小红书公司) University of Bath(巴斯大学) Tencent Company, China(腾讯公司) Alibaba Group(阿里巴巴集团)

AI总结 ExPO-HM通过结合SFT预热、GRPO与课程学习及CDE,提升仇恨表情包检测的解释性和准确性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15281 2026-03-03 cs.IR cs.LG

MMQ: Multimodal Mixture-of-Quantization Tokenization for Semantic ID Generation and User Behavioral Adaptation

MMQ: 多模态混合量化标记化用于语义ID生成和用户行为适应

Yi Xu, Moyu Zhang, Chenxuan Li, Zhihao Liao, Haibo Xing, Hao Deng, Jinxin Hu, Yu Zhang, Xiaoyi Zeng, Jing Zhang

机构 * Alibaba Group(阿里巴巴集团) Peking University(北京大学) Beijing University of Aeronautics and Astronautics(北京航空航天大学) Wuhan University, School of Computer Science(武汉大学计算机学院)

AI总结 MMQ通过多模态混合量化标记化方法,解决推荐系统中多模态协同、特定性和行为适应的挑战,提升语义ID生成和用户行为适应能力。

Journal ref Proceedings of the Nineteenth ACM International Conference on Web Search and Data Mining, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07638 2026-03-03 cs.LG

Data Selection for LLM Alignment Using Fine-Grained Preferences

利用细粒度偏好进行LLM对齐的数据选择

Jia Zhang, Yao Liu, Chen-Xi Zhang, Yi Liu, Yi-Xuan Jin, Lan-Zhe Guo, Yu-Feng Li

机构 * National Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) School of Artificial Intelligence, Nanjing University(南京大学人工智能学院) Algorithm Tech, Taobao & Tmall Group of Alibaba(阿里巴巴集团算法技术部) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院)

AI总结 本文提出了一种基于细粒度偏好的数据选择方法,通过优化偏好分歧来提升LLM对齐效果,实验表明在少量数据下也能实现显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18991 2026-03-03 cs.CL cs.AI cs.LG

Inverse Reinforcement Learning with Dynamic Reward Scaling for LLM Alignment

逆强化学习与动态奖励缩放用于大语言模型对齐

Ruoxi Cheng, Haoxuan Ma, Weixin Wang, Ranjie Duan, Jiexi Liu, Xiaoshuang Jia, Simeng Qin, Xiaochun Cao, Yang Liu, Xiaojun Jia

机构 * Beijing Electronic Science and Technology Institute(北京电子科技学院) Alibaba Group(阿里巴巴集团) Nanjing University(南京大学) Duke University(杜克大学) BraneMatrix AI Renmin University of China(中国人民大学) Northeast University(东北大学) Nanyang Technological University(南洋理工大学) Zhejiang Lab(浙江实验室) Sun Yat-sen University(中山大学)

AI总结 DR-IRL通过动态奖励缩放和逆强化学习提升大语言模型的安全对齐性能,有效解决数据不平衡和静态奖励模型的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00729 2026-03-03 cs.CL

Qwen3-Coder-Next Technical Report

Qwen3-Coder-Next 技术报告

Ruisheng Cao, Mouxiang Chen, Jiawei Chen, Zeyu Cui, Yunlong Feng, Binyuan Hui, Yuheng Jing, Kaixin Li, Mingze Li, Junyang Lin, Zeyao Ma, Kashun Shum, Xuwu Wang, Jinxi Wei, Jiaxi Yang, Jiajun Zhang, Lei Zhang, Zongmeng Zhang, Wenting Zhao, Fan Zhou

机构 * Qwen Team(通义实验室)

AI总结 Qwen3-Coder-Next通过高效推理和代理训练技术,在小参数量下实现强大的编码能力,适用于研究和实际应用。

Comments Authors are listed alphabetically by their last names

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00669 2026-03-03 cs.CL cs.AI cs.HC

SSKG Hub: An Expert-Guided Platform for LLM-Empowered Sustainability Standards Knowledge Graphs

SSKG Hub: 一个基于大语言模型的可持续性标准知识图谱专家指导平台

Chaoyue He, Xin Zhou, Xinjia Yu, Lei Zhang, Yan Zhang, Yi Wu, Lei Xiao, Liangyue Li, Di Wang, Hong Xu, Xiaoqiao Wang, Wei Liu, Chunyan Miao

机构 * Alibaba-NTU Global e-Sustainability CorpLab (ANGEL)(阿里-国立大学全球可持续性公司实验室(ANGEL)) Alibaba Group(阿里巴巴集团)

AI总结 SSKG Hub通过大语言模型和专家指导构建可持续性标准知识图谱,实现标准到可审计图谱的转化,并提供治理框架和跨图谱融合功能。

Comments 10 pages, 2 figures, 2 tables, submitted to ACL26 System Demo Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00560 2026-03-03 cs.CV cs.AI

Geometry OR Tracker: Universal Geometric Operating Room Tracking

几何手术室跟踪器:通用几何手术室跟踪

Yihua Shao, Kang Chen, Feng Xue, Siyu Chen, Long Bai, Hongyuan Yu, Hao Tang, Jinlin Wu, Nassir Navab

机构 * Centre for Artificial Intelligence and Robotics(人工智能与机器人中心) Hong Kong Institute of Science and Innovation Chinese Academy of Sciences(香港科学与创新研究院中国科学院) State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS)(多模态人工智能系统国家重点实验室) Institute of Automation Chinese Academy of Sciences (CASIA)(自动化研究所中国科学院(CASIA)) Peking University(北京大学) University of Trento, Trento, Italy(意大利特伦特大学) Alibaba DAMO Academy(阿里达摩院) Xiaomi Inc.(小米公司) Technische Universität München(慕尼黑技术大学)

AI总结 Geometry OR Tracker通过多视角几何校正和鲁棒3D点跟踪提升手术室多视角3D跟踪的几何一致性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00503 2026-03-03 cs.CV

M$^2$: Dual-Memory Augmentation for Long-Horizon Web Agents via Trajectory Summarization and Insight Retrieval

M$^2$: 通过轨迹摘要和洞察检索实现长 horizon 网络代理的双记忆增强

Dawei Yan, Haokui Zhang, Guangda Huzhang, Yang Li, Yibo Wang, Qing-Guo Chen, Zhao Xu, Weihua Luo, Ying Li, Wei Dong, Chunhua Shen

机构 * Northwestern Polytechnical University, Xi'an, China(西北工业大学) AI Business, Alibaba Group, Hangzhou, China(阿里云人工智能业务) Xi'an University of Architecture(西安建筑科技大学) Zhejiang University, Hangzhou, China(浙江大学)

AI总结 M$^2$通过双记忆机制提升长 horizon 网络代理的上下文效率和决策鲁棒性,实现更高成功率和更低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03152 2026-03-03 cs.CL

FASA: Frequency-aware Sparse Attention

FASA: 基于频率的稀疏注意力

Yifei Wang, Yueqi Wang, Zhenrui Yue, Huimin Zeng, Yong Wang, Ismini Lourentzou, Zhengzhong Tu, Xiangxiang Chu, Julian McAuley

机构 * AMAP, Alibaba Group(阿里巴巴集团AMAP) UCSD(加州大学圣迭戈分校) UIUC(伊利诺伊大学香槟分校) Texas A&M University(德克萨斯农工大学)

AI总结 FASA通过动态预测令牌重要性,实现基于频率块的稀疏注意力机制,在长上下文任务中表现出色,达到接近全缓存性能且显著提升效率。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24711 2026-03-03 cs.CV

Routing Matters in MoE: Scaling Diffusion Transformers with Explicit Routing Guidance

MoE中的路由问题:通过显式路由指导扩展扩散Transformer

Yujie Wei, Shiwei Zhang, Hangjie Yuan, Yujin Han, Zhekai Chen, Jiayu Wang, Difan Zou, Xihui Liu, Yingya Zhang, Yu Liu, Hongming Shan

机构 * Fudan University(复旦大学) Tongyi Lab, Alibaba Group(阿里云实验室,阿里巴巴集团) Zhejiang University(浙江大学) The University of Hong Kong(香港大学) MMLab Institute of Science and Technology for Brain-inspired Intelligence, MOE Frontiers Center for Brain Science, Key Laboratory of Computational Neuroscience and Brain-Inspired Intelligence, and State Key Laboratory of Brain Function and Disorders, Fudan University(脑启发智能科学技术研究院、MOE前沿脑科学中心、计算神经科学与脑启发智能重点实验室、脑功能与疾病国家重点实验室,复旦大学)

AI总结 ProMoE通过显式路由指导提升视觉MoE性能,结合两步路由策略和原型路由机制,在ImageNet基准上优于现有方法。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12586 2026-03-03 cs.CV

There is No VAE: End-to-End Pixel-Space Generative Modeling via Self-Supervised Pre-training

不存在VAE:通过自监督预训练实现端到端像素空间生成建模

Jiachen Lei, Keli Liu, Julius Berner, Haiming Yu, Hongkai Zheng, Jiahong Wu, Xiangxiang Chu

机构 * AMAP, Alibaba Group(阿里集团AMAP) Caltech(加州理工学院)

AI总结 本文提出了一种端到端像素空间生成建模框架,通过自监督预训练实现扩散和一致性模型的高性能,超越了传统VAE和扩散模型的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24332 2026-03-03 cs.LG cs.AI

Towards Generalizable PDE Dynamics Forecasting via Physics-Guided Invariant Learning

通过物理引导的不变学习实现通用的PDE动力学预测

Siyang Li, Yize Chen, Yan Guo, Ming Huang, Hui Xiong

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) University of Alberta(阿尔伯塔大学) Alibaba Cloud(阿里云)

AI总结 本文提出iMOOE方法,通过物理引导的不变学习实现PDE动态预测的通用性和零样本泛化能力。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24203 2026-03-03 cs.LG cs.AI cs.CL

Group-Relative REINFORCE Is Secretly an Off-Policy Algorithm: Demystifying Some Myths About GRPO and Its Friends

组相对REINFORCE实际上是秘密的非策略算法:解开GRPO及其朋友的一些神话

Chaorui Yao, Yanxi Chen, Yuchang Sun, Yushuo Chen, Wenhao Zhang, Xuchen Pan, Yaliang Li, Bolin Ding

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Alibaba Group(阿里巴巴集团)

AI总结 本文揭示组相对REINFORCE本质上是非策略算法,通过理论分析和实验验证,解开了GRPO及相关算法的一些神话,为LLMs的非策略强化学习提供了新的设计思路。

Comments Accepted to ICLR 2026. arXiv v2 update: add references and experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11999 2026-03-03 cs.CV cs.AI cs.IR cs.LG

MOON: Generative MLLM-based Multimodal Representation Learning for E-commerce Product Understanding

MOON: 基于生成式多模态大语言模型的电商产品理解多模态表示学习

Daoze Zhang, Chenghan Fu, Zhanheng Nie, Jianyu Liu, Wanxian Guan, Yuan Gao, Jun Song, Pengjie Wang, Jian Xu, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团)

AI总结 MOON通过生成式多模态大语言模型改进电商产品理解的多模态表示学习,引入引导的MoE模块、核心语义区域检测和负采样策略,提升零样本性能和泛化能力。

Comments Accepted by WSDM 2026 (oral). 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14894 2026-03-03 cs.CL

SASFT: Sparse Autoencoder-guided Supervised Finetuning to Mitigate Unexpected Code-Switching in LLMs

SASFT:基于稀疏自编码器的监督微调以缓解大语言模型中的意外语言混合

Boyi Deng, Yu Wan, Baosong Yang, Fei Huang, Wenjie Wang, Fuli Feng

机构 * Tongyi Lab, Alibaba Group Inc(通义实验室,阿里巴巴集团)

AI总结 SASFT通过稀疏自编码器引导监督微调,有效减少大语言模型中的意外语言混合,同时保持多语言能力。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00054 2026-03-03 cs.LG cs.AI

Expert Divergence Learning for MoE-based Language Models

专家分歧学习用于基于混合专家的语言模型

Jiaang Li, Haibin Chen, Langming Liu, Yujin Yuan, Yadao Wang, Yizhen Zhang, Chengting Yu, Xin Tong, Weidong Zhang, Shilei Liu, Wenbo Su, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团)

AI总结 专家分歧学习通过促进专家功能专业化,提升MoE模型的语言建模能力及下游任务性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏