arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Science and Technology of China(中国科学技术大学)

2026-02-02 至 2026-02-02 共收录 20
2601.23102 2026-02-02 cs.CV

Rethinking Transferable Adversarial Attacks on Point Clouds from a Compact Subspace Perspective

重新审视点云可迁移对抗攻击的紧凑子空间视角

Keke Tang, Xianheng Liu, Weilong Peng, Xiaofei Wang, Daizong Liu, Peican Zhu, Can Lu, Zhihong Tian

机构 * Cyberspace Institute of Advanced Technology, Guangzhou University(广州大学网络安全研究院) School of Computer Science and Cyber Engineering, Guangzhou University(广州大学计算机科学与网络工程学院) Department of Automation, University of Science and Technology of China(中国科学技术大学自动化系) Institute for Math & AI, Wuhan University(武汉大学数学与人工智能研究院) School of Artificial Intelligence, Optics and Electronics (iOPEN), Northwestern Polytechnical University(西北工业大学人工智能、光学与电子学院(iOPEN))

AI总结 本文提出CoSA框架,通过紧凑子空间视角提升点云对抗攻击的跨模型可迁移性,优于现有方法并保持良好的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23081 2026-02-02 cs.CL cs.AI cs.CR

Character as a Latent Variable in Large Language Models: A Mechanistic Account of Emergent Misalignment and Conditional Safety Failures

字符作为大语言模型中的潜在变量:对涌现偏差和条件安全失败的机制解释

Yanghao Su, Wenbo Zhou, Tianwei Zhang, Qiu Han, Weiming Zhang, Nenghai Yu, Jie Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Nanyang Technological University(南洋理工大学) Tsinghua University(清华大学)

AI总结 本研究揭示了大语言模型中字符层面倾向对齐风险的核心机制,指出行为倾向的稳定转变是导致涌现偏差和安全失败的关键因素,而非单纯的能力退化或提示防御。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23032 2026-02-02 cs.AI

Guided by Trajectories: Repairing and Rewarding Tool-Use Trajectories for Tool-Integrated Reasoning

轨迹引导:修复与奖励工具使用轨迹以实现工具集成推理

Siyu Gong, Linan Yue, Weibo Gao, Fangzhou Yao, Shimin Di, Lei Feng, Min-Ling Zhang

机构 * School of Computer Science and Engineering, Southeast University, Nanjing, China(东南大学计算机科学与工程学院) Key Lab. of Computer Network and Information Integration (Southeast University), MOE, China(计算机网络与信息集成重点实验室(东南大学)) State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China, Hefei, China(认知智能国家重点实验室(中国科学技术大学))

AI总结 AutoTraj通过自动修复和奖励工具使用轨迹,提升大型语言模型在工具集成推理中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22837 2026-02-02 cs.CV

NativeTok: Native Visual Tokenization for Improved Image Generation

NativeTok: 原生视觉令牌化以提升图像生成

Bin Wu, Mengqi Huang, Weinan Jia, Zhendong Mao

机构 * University of Science and Technology of China(科学技术大学)

AI总结 NativeTok通过强制因果依赖关系提升图像生成效果,采用元图像变换器和因果专家变换器实现高效重建与关系约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22779 2026-02-02 eess.AS cs.SD

Streaming Speech Recognition with Decoder-Only Large Language Models and Latency Optimization

流式语音识别与解码器-only大型语言模型及延迟优化

Genshun Wan, Wenhui Zhang, Jing-Xuan Zhang, Shifu Xiong, Jianqing Gao, Zhongfu Ye

机构 * University of Science and Technology of China(科学技术大学) iFLYTEK Research, iFLYTEK Co., Ltd.(iFLYTEK研究院,iFLYTEK有限公司) School of Artificial Intelligence and Computer Science(人工智能与计算机科学学院)

AI总结 本文提出了一种结合解码器-only大型语言模型和延迟优化的流式语音识别方法,通过动态分割语音嵌入和联合训练策略,提升了识别性能并降低了延迟。

Comments accepted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22738 2026-02-02 cs.CV

StreamSense: Streaming Social Task Detection with Selective Vision-Language Model Routing

StreamSense: 基于选择性视觉-语言模型路由的流式社交任务检测

Han Wang, Deyi Ji, Lanyun Zhu, Jiebo Luo, Roy Ka-Wei Lee

机构 * Singapore University of Technology and Design(新加坡科技设计大学) University of Science and Technology of China(中国科学技术大学) Nanyang Technological University(南洋理工大学) University of Rochester(罗切斯特大学)

AI总结 StreamSense通过轻量级编码器与选择性路由结合VLM专家,提升流式社交任务检测的准确性和效率。

Comments 10 pages, 4 figures, The Web Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08536 2026-02-02 cs.CL

DeepResearch Bench II: Diagnosing Deep Research Agents via Rubrics from Expert Report

DeepResearch Bench II:通过专家报告的评分诊断深度研究代理

Ruizhe Li, Mingxuan Du, Benfeng Xu, Chiwei Zhu, Xiaorui Wang, Zhendong Mao

机构 * University of Science and Technology of China(中国科学技术大学) Metastone Technology, Beijing, China(北京 metastone 技术有限公司)

AI总结 DeepResearch Bench II通过专家评分标准评估深度研究系统,揭示当前系统与人类专家之间存在显著差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04753 2026-02-02 cs.CL

EtCon: Edit-then-Consolidate for Reliable Knowledge Editing

EtCon:编辑后整合以实现可靠的知识编辑

Ruilin Li, Yibin Wang, Wenhong Zhu, Chenglin Li, Jinghao Zhang, Chenliang Li, Junchi Yan, Jiaqi Wang

机构 * Wuhan University(武汉大学) Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学)

AI总结 EtCon通过编辑后整合范式提升LLMs的知识编辑可靠性与现实应用能力,保留预训练能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01017 2026-02-02 cs.AI

ChartAnchor: Chart Grounding with Structural-Semantic Fidelity

ChartAnchor: 图表接地与结构-语义保真

Xinhang Li, Jingbo Zhou, Pengfei Luo, Yixiong Xiao, Tong Xu

机构 * Baidu Research(百度研究) USTC

AI总结 ChartAnchor提出一个综合图表接地基准测试,通过图表到代码生成和受控表格重建任务,评估模型在结构和数值层面的保真度,揭示MLLMs在数值精度和代码合成方面的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00665 2026-02-02 cs.CL cs.AI

SAFER: Probing Safety in Reward Models with Sparse Autoencoder

SAFER: 通过稀疏自动编码器探索奖励模型的安全性

Wei Shi, Ziyuan Xie, Sihang Li, Xiang Wang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 SAFER通过稀疏自动编码器探索奖励模型的安全性,揭示可解释特征并改进安全性对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22708 2026-02-02 cs.LG cs.CL

A Unified Study of LoRA Variants: Taxonomy, Review, Codebase, and Empirical Evaluation

LoRA变体的统一研究:分类、综述、代码库和实证评估

Haonan He, Jingqi Ye, Minglei Li, Zhengbo Wang, Tao Chen, Lei Bai, Peng Ye

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学) The Chinese University of Hong Kong(香港中文大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

AI总结 本文系统研究了LoRA变体,通过分类、理论综述、代码库和实证评估,揭示了LoRA及其变体对学习率的敏感性,并展示了其在多种任务中的性能优势。

Comments Submitted to IEEE Transactions on Pattern Analysis and Machine Intelligence, Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22532 2026-02-02 cs.LG cs.AI

Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective

解开强化微调设计选择的谜团:一种批量上下文老虎机学习的视角

Hong Xie, Xiao Hu, Tao Tan, Haoran Gu, Xin Li, Jianyu Han, Defu Lian, Enhong Chen

机构 * University of Science and Technology of China(中国科学技术大学) Daqing Oilfield Chongqing Company(重庆大庆油田公司) IFlyTek (China)(iFlytek(中国))

AI总结 本文从批量上下文老虎机学习视角,探讨强化微调中设计选择的作用与关键性,通过实验揭示各因素对学习和泛化的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22507 2026-02-02 cs.CV

DreamVAR: Taming Reinforced Visual Autoregressive Model for High-Fidelity Subject-Driven Image Generation

DreamVAR: 镇压强化视觉自回归模型以实现高保真主体驱动图像生成

Xin Jiang, Jingwen Chen, Yehao Li, Yingwei Pan, Kezhou Chen, Zechao Li, Ting Yao, Tao Mei

机构 * Nanjing University of Science and Technology(南京理工大学) University of Science and Technology of China(中国科学技术大学) HiDream.ai Inc.(HiDream.ai公司)

AI总结 DreamVAR通过改进的自回归模型和强化学习,实现高保真主体驱动图像生成,优于现有扩散方法。

Comments Accepted By ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22501 2026-02-02 cs.CV cs.SD

MIRRORTALK: Forging Personalized Avatars Via Disentangled Style and Hierarchical Motion Control

MIRRORTALK: 通过解耦的风格和分层运动控制生成个性化虚拟形象

Renjie Lu, Xulong Zhang, Xiaoyang Qu, Jianzong Wang, Shangfei Wang

机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司) University of Science and Technology of China(中国科学技术大学)

AI总结 MirrorTalk通过解耦风格与运动控制生成个性化虚拟形象,提升嘴唇同步准确性和个性化表达。

Comments Accepted to 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22483 2026-02-02 cs.CV

Head-Aware Visual Cropping: Enhancing Fine-Grained VQA with Attention-Guided Subimage

头感知视觉裁剪:通过注意力引导的子图像增强细粒度VQA

Junfei Xie, Peng Pan, Xulong Zhang

机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司) University of Science and Technology of China(中国科学技术大学)

AI总结 通过注意力引导的子图像增强细粒度VQA,提出无需训练的HAVC方法,利用优化的注意力头提升视觉定位精度。

Comments Accepted to 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22467 2026-02-02 cs.RO cs.CV

CARE: Multi-Task Pretraining for Latent Continuous Action Representation in Robot Control

CARE:用于机器人控制的潜在连续动作表示的多任务预训练

Jiaqi Shi, Xulong Zhang, Xiaoyang Qu, Jianzong Wang

机构 * Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司) University of Science and Technology of China(中国科学技术大学)

AI总结 CARE通过多任务预训练学习连续动作表示,提升机器人控制的可扩展性和可解释性。

Comments Accepted to 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10909 2026-02-02 cs.AI

PaperArena: An Evaluation Benchmark for Tool-Augmented Agentic Reasoning on Scientific Literature

PaperArena: 一个用于科学文献上工具增强代理推理的评估基准

Daoyu Wang, Mingyue Cheng, Shuo Yu, Zirui Liu, Ze Guo, Xin Li, Qi Liu

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学) Artificial Intelligence Research Institute, iFLYTEK Co., Ltd(人工智能研究院,iFLYTEK有限公司)

AI总结 PaperArena提出一个评估基准,用于评估基于LLM的代理在跨多篇论文整合信息并使用外部工具进行推理的能力,实验显示现有代理在复杂任务上的表现有限。

Comments 19 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21981 2026-02-02 cs.AI cs.MA

Collaborative Belief Reasoning with LLMs for Efficient Multi-Agent Collaboration

基于LLM的协同信念推理用于高效多智能体协作

Zhimin Wang, Duo Wu, Shaokang He, Jinghe Wang, Linjia Kang, Jing Yu, Kai Zhu, Jiawei Li, Zhi Wang

机构 * Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) Huawei Tenchnologies Co., Ltd.(华为技术有限公司) University of Science and Technology of China(中国科学技术大学)

AI总结 CoBel-World通过协同信念世界框架,提升LLM多智能体协作的效率和人类化表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06915 2026-02-02 cs.LG

QuiZSF: A Retrieval-Augmented Framework for Zero-Shot Time Series Forecasting

QuiZSF:一种用于零样本时间序列预测的检索增强框架

Shichao Ma, Zhengyang Zhou, Qihe Huang, Binwu Wang, Yang Wang

机构 * University of Science and Technology of China(中国科学技术大学) Suzhou Institute for Advanced Research, USTC(先进研究院)

AI总结 QuiZSF通过整合检索与预测功能,提升零样本时间序列预测的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04575 2026-02-02 cs.CL

Are LLMs Stable Formal Logic Translators in Logical Reasoning Across Linguistically Diversified Texts?

LLMs是否在跨语言多样化文本中的逻辑推理中是稳定的正式逻辑翻译器?

Qingchuan Li, Jiatong Li, Zirui Liu, Mingyue Cheng, Yuting Zeng, Qi Liu, Tongxuan Liu

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学) School of Computer Science and Technology, University of Science and Technology of China(计算机科学与技术学院,中国科学技术大学) School of Information Science and Technology, University of Science and Technology of China(信息科学与技术学院,中国科学技术大学)

AI总结 本文提出SoLT基准测试和MenTaL方法,揭示LLMs在跨语言多样化文本中存在符号映射不一致问题,并通过增强语言多样性提升推理稳定性。

Comments Accepted by WWW2026

详情

展开后加载摘要…

URL PDF HTML 收藏