arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

大厂专区

Tencent(腾讯)

2026-04-15 至 2026-04-15 共收录 8
2604.12781 2026-04-15 cs.CV

Fragile Reconstruction: Adversarial Vulnerability of Reconstruction-Based Detectors for Diffusion-Generated Images

脆弱的重建:基于重建的检测器在扩散生成图像中的对抗脆弱性

Haoyang Jiang, Mingyang Yi, Shaolei Zhang, Junxian Cai, Qingbin Liu, Xi Chen, Ju Fan

机构 * Renmin University of China(中国人民大学) Tencent Inc.(腾讯公司)

AI总结 研究发现基于重建的检测器在扩散生成图像检测中存在严重对抗脆弱性,通过微小对抗扰动可使检测准确率降至近零,揭示了现有检测策略的安全隐患。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12668 2026-04-15 cs.CV

OFA-Diffusion Compression: Compressing Diffusion Model in One-Shot Manner

OFA-Diffusion压缩:以一次训练方式压缩扩散模型

Haoyang Jiang, Zekun Wang, Mingyang Yi, Xiuyu Li, Lanqing Hu, Junxian Cai, Qingbin Liu, Xi Chen, Ju Fan

机构 * Renmin University of China(中国人民大学) Alibaba Inc.(阿里巴巴公司) Tencent Inc.(腾讯公司) Independent researcher(独立研究者)

AI总结 本文提出OFA压缩框架,通过一次训练生成不同计算量的子网络,降低重复训练开销,实现高效压缩的扩散模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12506 2026-04-15 cs.CL cs.SD

Beyond Transcription: Unified Audio Schema for Perception-Aware AudioLLMs

超越转录:面向感知意识的统一音频架构

Linhao Zhang, Yuhan Song, Aiwei Liu, Chuhan Wu, Sijun Zhang, Wei Jia, Yuan Liu, Houfeng Wang, Xiao Zhou

机构 * Basic Model Technology Center, WeChat AI, Tencent Inc.(腾讯基本模型技术中心、微信AI、腾讯公司) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室、计算机学院、北京大学)

AI总结 本文提出统一音频架构(UAS),通过将音频信息划分为转录、语调和非语言事件三个组件,提升音频细粒度感知性能,同时保持推理能力。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12385 2026-04-15 cs.CL

From Myopic Selection to Long-Horizon Awareness: Sequential LLM Routing for Multi-Turn Dialogue

从短视选择到长周期意识:面向多轮对话的序列LLM路由

Jiarui Zhang, Xiangyu Liu, Yong Hu, Chaoyue Niu, Hang Zeng, Shaojie Tang, Fan Wu, Guihai Chen

机构 * School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(上海交通大学计算机科学学院) WeChat, Tencent Inc, Beijing, China(腾讯北京研发中心) University at Buffalo, New York, United States(布法罗大学)

AI总结 本文提出DialRouter,通过MCTS探索对话分支并学习轻量路由策略,实现多轮对话的高效路由,提升任务成功率并优化性能成本比。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12344 2026-04-15 astro-ph.IM cs.AI

FRTSearch: Unified Detection and Parameter Inference of Fast Radio Transients using Instance Segmentation

FRTSearch:利用实例分割实现快速射电暂现源的统一检测与参数推断

Bin Zhang, Yabiao Wang, Xiaoyao Xie, Shanping You, Xuhong Yu, Qiuhua Li, Hongwei Li, Shaowen Du, Chenchen Miao, Dengke Zhou, Jianhua Fang, Jiafu Wu, Pei Wang, Di Li

机构 * School of Mathematical Sciences, Guizhou Normal University(贵州师范大学数学学院) Guizhou Provincial Key Laboratory of Information and Computing Science(贵州省信息与计算科学重点实验室) School of Cyber Science and Technology, Guizhou Normal University(贵州师范大学网络科学与技术学院) Tencent Youtu Lab(腾讯优图实验室) College of Physics and Electronic Engineering, Qilu Normal University(青岛师范大学物理与电子工程学院) Zhejiang Lab(浙江实验室) National Astronomical Observatories, Chinese Academy of Sciences(中国科学院国家天文台) Institute for Frontiers in Astronomy and Astrophysics, Beijing Normal University(北京师范大学前沿天文与天体物理研究院) State Key Laboratory of Radio Astronomy and Technology, Chinese Academy of Sciences(中国科学院射电天文技术国家重点实验室) New Cornerstone Science Laboratory, Department of Astronomy, Tsinghua University(清华大学新基石科学实验室(天文系))

AI总结 本文提出FRTSearch框架,通过实例分割技术实现快速射电暂现源的检测与物理特性推断,利用冷等离子体色散关系,结合MASK R-CNN模型和IMPIC算法,提高了搜索效率和准确性。

Comments Accepted for publication in The Astrophysical Journal Supplement Series (ApJS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14004 2026-04-15 cs.CL

Locate, Steer, and Improve: A Practical Survey of Actionable Mechanistic Interpretability in Large Language Models

定位、引导与改进:大型语言模型中可操作机制可解释性的一项实用调查

Hengyuan Zhang, Zhihao Zhang, Mingyang Wang, Zunhai Su, Yiwei Wang, Qianli Wang, Shuzhou Yuan, Ercong Nie, Xufeng Duan, Feijiang Han, Qibo Xue, Zeping Yu, Chenming Shang, Xiao Liang, Jing Xiong, Hui Shen, Chaofan Tao, Zhengwu Liu, Senjie Jin, Zhiheng Xi, Dongdong Zhang, Sophia Ananiadou, Tao Gui, Ruobing Xie, Hayden Kwok-Hay So, Hinrich Schütze, Xuanjing Huang, Qi Zhang, Ngai Wong

机构 * The University of Hong Kong(香港大学) Fudan University(复旦大学) LMU Munich(慕尼黑大学) Tsinghua University(清华大学) Technische Universität Darmstadt(达姆施塔特技术大学) Technische Universität Berlin(柏林技术大学) Technische Universität Dresden(德累斯顿技术大学) The Chinese University of Hong Kong(香港中文大学) University of Pennsylvania(宾夕法尼亚大学) Nanjing University(南京大学) University of Manchester(曼彻斯特大学) Dartmouth College(达特茅斯学院) University of California Los Angeles(加州大学洛杉矶分校) University of Michigan(密歇根大学) Microsoft(微软) Tencent(腾讯)

AI总结 本文提出一个实用调查,围绕'定位、引导与改进'流程,系统分类定位和引导方法,展示如何通过该框架提升模型对齐、能力和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09087 2026-04-15 cs.AI

The Stackelberg Speaker: Optimizing Persuasive Communication in Social Deduction Games

Stackelberg发言者:优化社会推断游戏中的说服性沟通

Zhang Zheng, Deheng Ye, Peilin Zhao, Hao Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Tencent(腾讯) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出基于Stackelberg竞争的强化学习框架,用于优化社会推断游戏中说服性沟通,通过实验展示其在三种不同游戏中的优越性。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22220 2026-04-15 cs.CL cs.SD

StableToken: A Noise-Robust Semantic Speech Tokenizer for Resilient SpeechLLMs

StableToken:一种抗噪声的语义语音分词器用于鲁棒的语音大语言模型

Yuhan Song, Linhao Zhang, Chuhan Wu, Aiwei Liu, Wei Jia, Houfeng Wang, Xiao Zhou

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机学院,北京大学) Basic Model Technology Center, WeChat AI, Tencent Inc.(微信AI基础模型技术中心,腾讯公司)

AI总结 本文提出StableToken,通过共识机制提升语音分词器的稳定性,减少噪声下的单位编辑距离,提升语音大语言模型的鲁棒性。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏