arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

大厂专区

Alibaba(阿里巴巴)

2026-04-15 至 2026-04-15 共收录 7
2604.12668 2026-04-15 cs.CV

OFA-Diffusion Compression: Compressing Diffusion Model in One-Shot Manner

OFA-Diffusion压缩:以一次训练方式压缩扩散模型

Haoyang Jiang, Zekun Wang, Mingyang Yi, Xiuyu Li, Lanqing Hu, Junxian Cai, Qingbin Liu, Xi Chen, Ju Fan

机构 * Renmin University of China(中国人民大学) Alibaba Inc.(阿里巴巴公司) Tencent Inc.(腾讯公司) Independent researcher(独立研究者)

AI总结 本文提出OFA压缩框架,通过一次训练生成不同计算量的子网络,降低重复训练开销,实现高效压缩的扩散模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06794 2026-04-15 cs.AI

No More Stale Feedback: Co-Evolving Critics for Open-World Agent Learning

不再有陈旧的反馈:为开放世界智能体学习的共进化批评者

Zhicong Li, Lingjie Jiang, Yulan Hu, Xingchen Zeng, Yixia Li, Xiangwen Zhang, Guanhua Chen, Zheng Pan, Xin Li, Yong Liu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学 赛洛岭人工智能学院) Amap, Alibaba Group(阿里巴巴集团 阿里地图) Peking University(北京大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Southern University of Science and Technology(南方科技大学)

AI总结 本文提出ECHO框架,通过同步共进化循环联合优化策略和批评者,解决开放世界环境中策略演变导致的反馈过时问题,提升长周期任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06448 2026-04-15 cs.CL

Perception-Aware Policy Optimization for Multimodal Reasoning

面向多模态推理的感知意识策略优化

Zhenhailong Wang, Xuehang Guo, Sofia Stoica, Haiyang Xu, Hongru Wang, Hyeonjeong Ha, Xiusi Chen, Yangyi Chen, Ming Yan, Fei Huang, Heng Ji

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Alibaba Group(阿里巴巴集团)

AI总结 本文提出PAPO算法,通过引入隐式感知损失提升多模态推理性能,实现4.4%-17.5%的基准提升,尤其在视觉依赖性强的任务中表现更佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12221 2026-04-15 cs.CV

BarbieGait: An Identity-Consistent Synthetic Human Dataset with Versatile Cloth-Changing for Gait Recognition

BarbieGait: 一种具有多功能衣物变换的恒定身份合成人类数据集用于步态识别

Qingyuan Cai, Saihui Hou, Xuecai Hu, Yongzhen Huang

机构 * School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院) AMAP, Alibaba Group(阿里集团AMAP)

AI总结 本文提出BarbieGait数据集,通过虚拟引擎模拟衣物变换以保持步态身份信息,提出GaitCLIF模型提升跨衣物步态识别性能,推动相关研究进展。

Comments CVPR 2026, Project Page: https://github.com/BarbieGait/BarbieGait

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11626 2026-04-15 cs.AI cs.LG

RationalRewards: Reasoning Rewards Scale Visual Generation Both Training and Test Time

RationalRewards: 基于理性反馈的视觉生成推理奖励

Haozhe Wang, Cong Wei, Weiming Ren, Jiaming Liu, Fangzhen Lin, Wenhu Chen

机构 * HKUST(香港科技大学) University of Waterloo(滑铁卢大学) Alibaba(阿里巴巴)

AI总结 RationalRewards通过显式多维反馈提升视觉生成模型,训练时提供可解释奖励,测试时通过生成-反馈-优化循环改进输出,无需参数更新。

Comments Project Page: https://tiger-ai-lab.github.io/RationalRewards/ ; Code, Dataset, Models are released

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11246 2026-04-15 cs.CL

Judge Like Human Examiners: A Weighted Importance Multi-Point Evaluation Framework for Generative Tasks with Long-form Answers

像人类考官一样评判:一种用于生成任务的加权重要性多点评估框架

Guoxin Yu, Chulun Zhou, Lemao Liu, Qi Wang, Mo Yu, Jialong Tang, Baosong Yang, Xiang Ao, Wai Lam, Yue Yu

机构 * Pengcheng Laboratory, Shenzhen, China(鹏城实验室,深圳,中国) The Chinese University of Hong Kong(香港中文大学) Fudan University(复旦大学) Qwen team, Alibaba Group(通义实验室,阿里巴巴集团) Institute of Computing Technology, CAS(中国科学院计算技术研究所)

AI总结 本文提出WIMPE框架,通过加权重要性多点评估方法,解决生成任务中长答案评估的挑战,提升与人类标注的关联性。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09121 2026-04-15 cs.CL cs.AI cs.SD

Interactive ASR: Towards Human-Like Interaction and Semantic Coherence Evaluation for Agentic Speech Recognition

交互式语音识别:迈向人样交互和语义连贯性评估的代理语音识别

Peng Wang, Yanqiao Zhu, Zixuan Jiang, Qinyuan Chen, Xingjian Zhao, Xipeng Qiu, Wupeng Wang, Zhifu Gao, Xiangang Li, Kai Yu, Xie Chen

机构 * X-LANCE Lab, Shanghai Jiao Tong University(上海交通大学X-LANCE实验室) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Xi'an Jiaotong University(西安交通大学) Fudan University(复旦大学) Tongyi Fun Team, Alibaba Group(阿里巴巴集团 Tongyi 团队)

AI总结 本文提出基于LLM的代理框架,通过语义反馈提升语音识别的语义准确性和交互修正能力,实验验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏