arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-11 至 2026-03-11 共收录 232 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 15 篇

2509.15339 2026-03-11 cs.CL 57%

Quantifying Genuine Awareness in Hallucination Prediction Beyond Question-Side Shortcuts

量化超出问题侧捷径的幻觉预测中的真实意识

Yeongbin Seo, Dongha Lee, Jinyoung Yeo

机构 * Department of Artificial Intelligence(人工智能系)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

AI总结 本文提出AQE方法,用于量化幻觉预测中真实意识与问题侧信息的影响,揭示现有方法对基准黑客的依赖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13338 2026-03-11 cs.RO cs.CV cs.LG 57%

CuriousBot: Interactive Mobile Exploration via Actionable 3D Relational Object Graph

CuriousBot: 通过可操作的3D关系物体图进行交互式移动探索

Yixuan Wang, Leonor Fermoselle, Tarik Kelestemur, Jiuguang Wang, Yunzhu Li

机构 * School of Engineering and Applied Science, Columbia University(工程与应用科学学院,哥伦比亚大学) Robotics and AI Institute(机器人与人工智能研究所)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

AI总结 CuriousBot通过可操作的3D关系物体图实现交互式移动探索,优于仅依赖视觉-语言模型的方法。

Comments Accepted to IEEE Robotics and Automation Letters (RA-L). Project Page: https://curiousbot.theaiinstitute.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09466 2026-03-11 cs.CV 50%

TopoOR: A Unified Topological Scene Representation for the Operating Room

TopoOR: 一种用于手术室的统一拓扑场景表示

Tony Danjun Wang, Ka Young Kim, Tolga Birdal, Nassir Navab, Lennart Bastian

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Imperial College London(伦敦帝国理工学院) Kyung Hee University(韩国庆熙大学)

专题命中 知识编辑与模型理解 :LLM(abstract)

AI总结 TopoOR通过更高阶拓扑结构建模手术室的多模态特性,提升场景表达能力,优于传统图和LLM基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07170 2026-03-11 cs.CV 50%

Class Visualizations and Activation Atlases for Enhancing Interpretability in Deep Learning-Based Computational Pathology

基于类可视化和激活图谱的深度学习计算病理学解释性增强

Marco Gustav, Fabian Wolf, Christina Glasner, Nic G. Reitsam, Stefan Schulz, Kira Aschenbroich, Bruno Märkl, Sebastian Foersch, Jakob Nikolas Kather

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 本研究提出基于类可视化和激活图谱的深度学习计算病理学解释性增强方法,通过评估不同标签粒度下的模型表现,揭示了变压器模型中的结构化形态流形。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07071 2026-03-11 cs.CV 50%

VirtueBench: Evaluating Trustworthiness under Uncertainty in Long Video Understanding

VirtueBench: 在长视频理解中评估在不确定性下的可信度

Xueqing Yu, Bohan Li, Yan Li, Zhenheng Yang

专题命中 知识编辑与模型理解 :language model(abstract)

AI总结 VirtueBench通过评估模型在不确定性下的可信度,揭示了长视频理解中模型拒绝行为的差异及可靠性问题。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20223 2026-03-11 cs.CV 50%

V-Attack: Targeting Disentangled Value Features for Controllable Adversarial Attacks on LVLMs

V-Attack:针对解耦价值特征的可控对抗攻击LVLMs

Sen Nie, Jie Zhang, Jianxin Yan, Shiguang Shan, Xilin Chen

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院人工智能安全国家重点实验室,计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Zhejiang University(浙江大学)

专题命中 知识编辑与模型理解 :language model(abstract)

AI总结 V-Attack通过精准操控LVLMs中的价值特征,提升对抗攻击的成功率,揭示视觉语言理解的关键漏洞。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05875 2026-03-11 cs.SD 50%

LARA-Gen: Enabling Continuous Emotion Control for Music Generation Models via Latent Affective Representation Alignment

LARA-Gen:通过潜在情感表示对齐实现音乐生成模型的连续情绪控制

Jiahao Mei, Xuenan Xu, Zeyu Xie, Zihao Zheng, Ye Tao, Yue Ding, Mengyue Wu

机构 * X-LANCE Lab, Shanghai Jiao Tong University, China(上海交通大学X-LANCE实验室) Shanghai AI Lab, China(上海人工智能实验室) Shanghai Mental Health Center, Shanghai Jiao Tong University School of Medicine, China(上海交通大学医学院精神卫生中心)

专题命中 知识编辑与模型理解 :prompting(abstract)

AI总结 LARA-Gen通过潜在情感表示对齐实现音乐生成模型的连续情绪控制,提升情绪可控性和音乐质量。

Comments Submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他LLM 15 篇

2505.11790 2026-03-11 cs.LG cs.CR 89%

JULI: Jailbreak Large Language Models by Self-Introspection

通过自我反思 jailbreak 大型语言模型:JULI

Jesson Wang, Zhanhao Hu, David Wagner

机构 * University of Southern California(南加州大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 JULI 通过操纵令牌日志概率,利用微小插件块 BiasNet 实现对 API 调用 LLMs 的 jailbreak,无需模型权重或生成过程权限,且在黑盒环境下有效。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09890 2026-03-11 cs.AI cs.MA 85%

Influencing LLM Multi-Agent Dialogue via Policy-Parameterized Prompts

通过策略参数化提示影响LLM多智能体对话

Hongbo Bo, Jingyu Hu, Weiru Liu

机构 * University of Bristol(布里斯托大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出通过策略参数化提示影响LLM多智能体对话,通过动态构建提示序列影响对话动态,实验验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09536 2026-03-11 cs.HC cs.MM 85%

Dynamic Multimodal Expression Generation for LLM-Driven Pedagogical Agents: From User Experience Perspective

动态多模态表达生成用于基于大语言模型的教育代理:从用户体验视角

Ninghao Wan, Jiarun Song, Fuzheng Yang

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于大语言模型的动态多模态表达生成方法,通过生成协调的语音和手势指令,提升教育代理的沉浸感和自然表达能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08849 2026-03-11 cs.HC 85%

Investigating the Effects of LLM Use on Critical Thinking Under Time Constraints: Access Timing and Time Availability

探究LLM使用对时间限制下批判性思维的影响:访问时间与时间可用性

Jiayin Zhi, Harsh Kumar, Mina Lee

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究发现LLM访问时间与时间可用性对批判性思维表现有显著影响,早期连续访问在时间压力下提升表现,但充足时间下反而损害表现。

Comments CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17680 2026-03-11 cs.CE cs.AI 83%

Research and Prototyping Study of an LLM-Based Chatbot for Electromagnetic Simulations

基于大语言模型的电磁仿真聊天机器人研究与原型开发

Albert Piwonski, Mirsad Hadžiefendić

机构 * Theoretische Elektrotechnik, TU Berlin(柏林技术大学理论电气技术系)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出基于大语言模型的聊天机器人,用于自动生成电磁仿真模型,通过功能增强提升仿真效率和用户交互体验。

Comments This paper has been submitted to COMPEL for possible publication, published by Emerald Publishing Limited

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09180 2026-03-11 cs.CL cs.AI 81%

DuplexCascade: Full-Duplex Speech-to-Speech Dialogue with VAD-Free Cascaded ASR-LLM-TTS Pipeline and Micro-Turn Optimization

DuplexCascade: 全双工语音到语音对话的无VAD级联ASR-LLM-TTS流水线与微轮询优化

Jianing Yang, Yusuke Fujita, Yui Sudo

机构 * SB Intuitions Corp.(SB Intuitions公司) The University of Tokyo(东京大学)

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL、cs.AI

AI总结 DuplexCascade通过无VAD级联流水线和微轮询优化,实现全双工语音对话的高效交互与强对话智能。

Comments Submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09373 2026-03-11 cs.CL 77%

Quantifying and extending the coverage of spatial categorization data sets

量化和扩展空间分类数据集的覆盖范围

Wanchun Li, Alexandra Carstensen, Yang Xu, Terry Regier, Charles Kemp

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文通过LLMs生成的标签扩展TRPS数据集,提升了空间分类数据集的覆盖范围和多语言支持能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09544 2026-03-11 cs.CR 75%

Compartmentalization-Aware Automated Program Repair

具有 compartmentalization 意识的自动化程序修复

Jia Hu, Youcheng Sun, Pierre Olivier

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出了一种专门针对 compartment 接口安全的 APR 框架,通过整合 fuzzer、补丁生成和验证组件,自动化修复 cross-compartment 接口漏洞。

Comments Accepted to appear in ICSE's Journal Ahead Workshop (JAWs) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17965 2026-03-11 eess.AS 67%

Benchmarking Humans and Machines on Complex Multilingual Speech Understanding Tasks

在复杂多语言语音理解任务中评估人类与机器

Sai Samrat Kankanala, Ram Chandra, Sriram Ganapathy

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 研究在复杂多语言语音理解任务中评估人类与机器的听觉注意力能力,发现人类在母语中表现更优,而机器在单说话人条件下表现接近人类,但在双说话人设置中表现欠佳。

Comments 5 Pages, 1 Figure, 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01555 2026-03-11 eess.IV cs.CV 67%

MGCR-Net:Multimodal Graph-Conditioned Vision-Language Reconstruction Network for Remote Sensing Change Detection

MGCR-Net:多模态图条件视觉-语言重建网络用于遥感变化检测

Chengming Wang, Guodong Fan, Jinjiang Li, Min Gan, C. L. Philip Chen

机构 * School of Computer Science and Technology, Shandong Technology and Business University(山东科技职业大学计算机科学与技术学院) School of Computer Science and Technology, Qingdao University(青岛大学计算机科学与技术学院) School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 MGCR-Net通过多模态图条件视觉-语言重建机制提升遥感变化检测的语义交互能力。

Journal ref IEEE Transactions on Geoscience and Remote Sensing, vol. 64, pp. 1-15, 2026, Art no. 4701515

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09078 2026-03-11 cs.LG cs.CL 62%

Exclusive Self Attention

独占自注意力

Shuangfei Zhai

机构 * Apple(苹果公司)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.LG

AI总结 独占自注意力通过限制注意力机制捕捉与令牌自身价值正交的信息,提升了Transformer在序列建模任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09324 2026-03-11 cs.HC cs.AI 57%

Reading the Mood Behind Words: Integrating Prosody-Derived Emotional Context into Socially Responsive VR Agents

解读话语背后的情绪:将基于语调的情感上下文整合到社交响应的VR代理中

SangYeop Jeong, Yeongseo Na, Seung Gyu Jeong, Jin-Woo Jeong, Seong-Eun Kim

机构 * Department of Applied Artificial Intelligence(应用人工智能系) Seoul National University of Science and Technology(首尔科学技术大学)

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 本文提出一种整合语调情感上下文的VR交互流程,通过实时语音情感识别模型提升对话代理的自然性和用户亲和力。

Comments 12 pages, 4 figures, Accepted to CHI EA 2026 (Extended Abstracts of the 2026 CHI Conference on Human Factors in Computing Systems)

Journal ref Extended Abstracts of the 2026 CHI Conference on Human Factors in Computing Systems (CHI EA '26), 2026, 1-12

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09214 2026-03-11 cs.AI 57%

PrivPRISM: Automatically Detecting Discrepancies Between Google Play Data Safety Declarations and Developer Privacy Policies

PrivPRISM:自动检测Google Play数据安全声明与开发者隐私政策之间的差异

Bhanuka Silva, Dishanika Denipitiyage, Anirban Mahanti, Aruna Seneviratne, Suranga Seneviratne

机构 * University of Sydney(悉尼大学) University of New South Wales(新南威尔士大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 PrivPRISM通过对比隐私政策与数据安全声明,自动检测应用数据实践中的不一致,揭示系统性问题并强调自动化监管的必要性。

Comments 21 pages, 18 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09712 2026-03-11 cs.RO 50%

Robotic Scene Cloning:Advancing Zero-Shot Robotic Scene Adaptation in Manipulation via Visual Prompt Editing

机器人场景克隆:通过视觉提示编辑推进零样本机器人场景适应在操作中

Binyuan Huang, Yuqing Wen, Yucheng Zhao, Yaosi Hu, Tiancai Wang, Chang Wen Chen, Haoqiang Fan, Zhenzhong Chen

机构 * Wuhan University(武汉大学) University of Science and Technology of China(中国科学技术大学) Dexmal The Hong Kong Polytechnic University(香港理工大学)

专题命中 其他LLM :prompting(abstract)

AI总结 机器人场景克隆通过视觉提示编辑提升零样本机器人场景适应能力,实现跨场景的高效操作性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06931 2026-03-11 cs.LO 50%

LLM2SMT: Building an SMT Solver with Zero Human-Written Code

LLM2SMT:构建一个无需人工编写代码的SMT求解器

Mikoláš Janota, Mirek Olšák

专题命中 其他LLM :LLM(abstract)

AI总结 LLM2SMT通过无需人工编写代码的方式,构建了一个基于DPLL(T)风格的QF_UF SMT求解器,实现了同余闭包算法并生成证明,展示了其在SMT-LIB基准测试中的竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏