arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

2026-02-16 至 2026-02-16 共收录 6
2602.13035 2026-02-16 cs.LG cs.AI cs.CL

Look Inward to Explore Outward: Learning Temperature Policy from LLM Internal States via Hierarchical RL

向内看,向外探:通过分层强化学习从LLM内部状态学习温度策略

Yixiao Zhou, Yang Li, Dongzhou Cheng, Hehe Fan, Yu Cheng

机构 * Zhejiang University(浙江大学) Southeast University(东南大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 Introspective LLM通过分层强化学习从LLM内部状态学习温度策略,提升数学推理任务中的探索效率与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12205 2026-02-16 cs.CV cs.AI

DeepGen 1.0: A Lightweight Unified Multimodal Model for Advancing Image Generation and Editing

DeepGen 1.0: 一种轻量级统一多模态模型,用于推进图像生成与编辑

Dianyi Wang, Ruihang Li, Feng Han, Chaofan Ma, Wei Song, Siyuan Wang, Yibin Wang, Yi Xin, Hongjian Liu, Zhixiong Zhang, Shengyuan Ding, Tianhang Wang, Zhenglin Cheng, Tao Lin, Cheng Jin, Kaicheng Yu, Jingjing Chen, Wenjie Wang, Zhongyu Wei, Jiaqi Wang

机构 * Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Westlake University(西湖大学) Nanjing University(南京大学) University of Southern California(南加州大学)

AI总结 DeepGen 1.0通过轻量级统一多模态模型在图像生成与编辑领域实现高性能,采用SCB框架和数据驱动训练策略,超越大参数模型表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12135 2026-02-16 cs.CL

WavBench: Benchmarking Reasoning, Colloquialism, and Paralinguistics for End-to-End Spoken Dialogue Models

WavBench: 语音对话模型推理、口语化和副语言能力的基准测试

Yangzhuo Li, Shengpeng Ji, Yifu Chen, Tianle Liang, Haorong Ying, Yule Wang, Junbo Li, Jun Fang, Zhou Zhao

机构 * Xiamen University(厦门大学) Zhejiang University(浙江大学) CUHK-Shenzhen(香港中文大学(深圳))

AI总结 WavBench通过三重框架评估语音对话模型的推理、口语化和副语言能力,推动真实场景下的对话模型发展。

Comments Open-source at https://naruto-2024.github.io/wavbench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12044 2026-02-16 cs.CV

A DMD-Based Adaptive Modulation Method for High Dynamic Range Imaging in High-Glare Environments

基于DMD的自适应调制方法用于高动态范围成像在高眩光环境中的应用

Banglei Guan, Jing Tao, Liang Xu, Dongcai Tan, Pengju Sun, Jianbing Liu, Yang Shang, Qifeng Yu

机构 * College of Aerospace Science and Engineering, National University of Defense Technology(航空航天科学与工程学院,国防科技大学) Hunan Provincial Key Laboratory of Image Measurement and Vision Navigation(湖南省图像测量与视觉导航重点实验室) College Of Optoelectric Science and Engineering, Zhejiang University(光电科学与工程学院,浙江大学)

AI总结 本文提出基于DMD的自适应调制方法,实现高动态范围成像,有效解决高眩光环境下的图像饱和问题,提升DIC精度和应变误差控制。

Comments This paper has been accepted by Experimental Mechanics

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08676 2026-02-16 cs.LG cs.AI

LLaDA2.1: Speeding Up Text Diffusion via Token Editing

LLaDA2.1: 通过令牌编辑加速文本扩散

Tiwei Bie, Maosong Cao, Xiang Cao, Bingsen Chen, Fuyuan Chen, Kun Chen, Lun Du, Daozhuo Feng, Haibo Feng, Mingliang Gong, Zhuocheng Gong, Yanmei Gu, Jian Guan, Kaiyuan Guan, Hongliang He, Zenan Huang, Juyong Jiang, Zhonghui Jiang, Zhenzhong Lan, Chengxi Li, Jianguo Li, Zehuan Li, Huabin Liu, Lin Liu, Guoshan Lu, Yuan Lu, Yuxin Ma, Xingyu Mou, Zhenxuan Pan, Kaida Qiu, Yuji Ren, Jianfeng Tan, Yiding Tian, Zian Wang, Lanning Wei, Tao Wu, Yipeng Xing, Wentao Ye, Liangyu Zha, Tianze Zhang, Xiaolu Zhang, Junbo Zhao, Da Zheng, Hao Zhong, Wanli Zhong, Jun Zhou, Junlin Zhou, Liwang Zhu, Muzhi Zhu, Yihong Zhuang

机构 * Ant Group(蚂蚁集团) Zhejiang University(浙江大学) Westlake University(西湖大学) Southern University of Science and Technology(南方科技大学)

AI总结 LLaDA2.1通过结合令牌编辑与掩码到令牌方案,实现解码速度与生成质量的平衡,展示了在大规模扩散模型上的性能提升。

Comments 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12287 2026-02-16 cs.CL cs.AI eess.AS

Retrieval-Augmented Self-Taught Reasoning Model with Adaptive Chain-of-Thought for ASR Named Entity Correction

带有自适应思维链的检索增强自教推理模型用于ASR命名实体修正

Junjie An, Jingguang Tian, Tianyi Wang, Yu Gao, Xiaofeng Mou, Yi Xu

机构 * AI Research Institute, Midea Group (Shanghai) Co.,Ltd., China(美的集团(上海)研究院) Zhejiang University, China(浙江大学)

AI总结 本文提出一种检索增强自教推理模型,用于改进ASR中命名实体修正,通过自适应思维链和音节级编辑距离提升纠错效果。

详情

展开后加载摘要…

URL PDF HTML 收藏