arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-27 至 2026-01-27 共收录 18 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 18 篇

2508.06030 2026-01-27 cs.CL cs.LG 90%

Efficient Knowledge Probing of Large Language Models by Adapting Pre-trained Embeddings

通过适应预训练嵌入高效探测大语言模型的知识

Kartik Sharma, Yiqiao Jin, Rakshit Trivedi, Srijan Kumar

机构 * Georgia Institute of Technology(佐治亚理工学院) Massachusetts Institute of Technology(麻省理工学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

AI总结 PEEK通过适应预训练嵌入模型,高效探测大语言模型的知识,准确率达90%,揭示了事实表示的底层结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04058 2026-01-27 cs.GR cs.CV 86%

SMooGPT: Stylized Motion Generation using Large Language Models

SMooGPT:利用大语言模型进行风格化动作生成

Lei Zhong, Yi Yang, Changjian Li

机构 * University of Edinburgh(爱丁堡大学)

专题命中 知识编辑与模型理解 :large language model(title);language model(title);LLM(abstract)

AI总结 SMooGPT通过利用大语言模型的推理、组合和生成能力,实现风格化动作生成,提升动作控制和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18483 2026-01-27 cs.CL cs.AI 79%

Funny or Persuasive, but Not Both: Evaluating Fine-Grained Multi-Concept Control in LLMs

幽默或有说服力,但不是两者:评估LLM中细粒度多概念控制

Arya Labroo, Ivaxi Sheth, Vyas Raina, Amaani Ahmed, Mario Fritz

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 研究评估了LLM中多概念控制的细粒度可控性,发现双概念设置下性能下降,揭示了模型在组合性上的局限性。

Comments Accepted for publication at EACL main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17284 2026-01-27 cs.CL cs.AI 79%

Mind the Ambiguity: Aleatoric Uncertainty Quantification in LLMs for Safe Medical Question Answering

注意模糊性:在LLMs中进行偶然不确定性量化以实现安全的医疗问答

Yaokun Liu, Yifan Liu, Phoebe Mbuvi, Zelin Li, Ruichen Yao, Gawon Lim, Dong Wang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出AU-Probe框架,通过检测输入模糊性提升医疗问答的安全性与准确性。

Comments Accepted at The Web Conference 2026 (WWW 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23077 2026-01-27 cs.RO 78%

Embodied Learning of Reward for Musculoskeletal Control with Vision Language Models

具身学习奖励以实现肌肉骨骼控制与视觉语言模型

Saraswati Soedarmadji, Yunyue Wei, Chen Zhang, Yisong Yue, Yanan Sui

机构 * Tsinghua University(清华大学) California Institute of Technology(加州理工学院)

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 本文提出MoVLR框架,利用视觉语言模型实现高维肌肉骨骼系统的具身学习,通过迭代交互发现和改进奖励函数。

Comments 18 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17343 2026-01-27 cs.AI 74%

Are We Evaluating the Edit Locality of LLM Model Editing Properly?

我们是否正确评估了LLM模型编辑的编辑局部性?

Wei Liu, Haomei Xu, Hongkai Liu, Zhiying Deng, Ruixuan Li, Heng Huang, Yee Whye Teh, Wee Sun Lee

机构 * National University of Singapore(新加坡国立大学) Huazhong University of Science(华中科技大学) Central China Normal University University of Maryland, College Park(马里兰大学学院市分校)

专题命中 知识编辑与模型理解 :LLM(title);分类 cs.AI

AI总结 本文提出了一种改进的LLM模型编辑特异性评估协议,以更准确地衡量知识保留能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17086 2026-01-27 cs.SD cs.AI eess.AS 74%

SonoEdit: Null-Space Constrained Knowledge Editing for Pronunciation Correction in LLM-Based TTS

SonoEdit:基于空域约束的知识编辑用于LLM基于TTS的发音纠正

Ayush Pratap Singh, Harshit Singh, Nityanand Mathur, Akshat Mandloi, Sudarshan Kamath

机构 * TU Darmstadt(图宾根大学) UMD(马里兰大学) Smallest AI(最小AI)

专题命中 知识编辑与模型理解 :LLM(title);分类 cs.AI

AI总结 SonoEdit通过空域约束编辑技术,无需重新训练即可修正预训练TTS模型中特定词汇的发音错误,同时保持其他行为不变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17764 2026-01-27 cs.CL cs.AI 73%

Cross-Lingual Probing and Community-Grounded Analysis of Gender Bias in Low-Resource Bengali

跨语言探测与社区导向分析低资源孟加拉语中的性别偏见

Md Asgor Hossain Reaj, Rajan Das Gupta, Jui Saha Pritha, Abdullah Al Noman, Abir Ahmed, Golam Md Mohiuddin, Tze Hui Liew

机构 * Department of Computer Science(计算机科学系) AIUB, Dhaka, Bangladesh Department of Information Technology(信息科技系) Wilmington University, Delaware, USA WUST, Virginia, USA Faculty of Information Science(信息科学系) Technology Multimedia University, Melaka, Malaysia(技术多媒体大学, Melaka, Malaysia) Centre for Intelligent Cloud Computing(智能云计算中心)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究通过跨语言探测和社区导向分析,揭示了孟加拉语中性别偏见的特征,强调需本地化方法和社区参与以减少偏见。

Comments Accepted in 2025 4th International Conference on Smart Cities, Automation & Intelligent Computing Systems (ICON-SONICS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17397 2026-01-27 cs.CL 70%

CLM-Bench: Benchmarking and Analyzing Cross-lingual Misalignment of LLMs in Knowledge Editing

CLM-Bench: 评估和分析LLMs在知识编辑中的跨语言不对齐

Yucheng Hu, Wei Zhou, Juesi Xiao

机构 * Tianjin University, School of Future Technology(天津大学,未来技术学院) Tianjin University, College of Intelligence and Computing(天津大学,智能计算学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 CLM-Bench通过构建文化意识的基准,揭示了LLMs在知识编辑中的跨语言不对齐问题,挑战了现有跨语言转移方法的有效性。

Comments EACL MME workshop paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17168 2026-01-27 cs.AI cs.MA 70%

Interpreting Agentic Systems: Beyond Model Explanations to System-Level Accountability

解释代理系统:超越模型解释到系统级问责

Judy Zhu, Dhari Gandhi, Himanshu Joshi, Ahmad Rezaie Mianroodi, Sedef Akinli Kocak, Dhanesh Ramachandran

机构 * Vector Institute for Artificial Intelligence(向量人工智能研究所) University of Texas, Austin(德克萨斯大学奥斯汀分校) Dalhousie University(达尔豪斯大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文探讨了代理系统中可解释性技术的必要性,提出需设计专门方法以确保系统在目标形成、环境交互和结果评估等阶段的可追溯性和问责性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05840 2026-01-27 cs.LG 70%

Multimodal Trajectory Representation Learning for Travel Time Estimation

多模态轨迹表示学习用于旅行时间估计

Zhi Liu, Xuyuan Hu, Xiao Han, Zhehao Dai, Zhaolin Deng, Guojiang Shen, Xiangjie Kong

机构 * Zhejiang University of Technology(浙江工业大学) Zhejiang University of Technology College of Computer Science(浙江工业大学计算机科学学院)

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract);分类 cs.LG

AI总结 本文提出多模态动态轨迹整合框架,通过整合GPS、网格轨迹和道路网络约束,提升旅行时间估计的性能和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18240 2026-01-27 cs.CV 67%

V-Loop: Visual Logical Loop Verification for Hallucination Detection in Medical Visual Question Answering

V-Loop:用于医学视觉问答中幻觉检测的视觉逻辑循环验证

Mengyuan Jin, Zehui Liao, Yong Xia

机构 * Northwestern Polytechnical University(西北工业大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

AI总结 V-Loop通过双向推理和视觉逻辑循环验证,提升医学视觉问答中幻觉检测的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17690 2026-01-27 cs.SD cs.AI cs.IR cs.LG eess.AS 62%

Segment Length Matters: A Study of Segment Lengths on Audio Fingerprinting Performance

片段长度至关重要:对音频指纹识别性能中片段长度的研究

Ziling Gong, Yunyan Ouyang, Iram Kamdar, Melody Ma, Hongjie Chen, Franck Dernoncourt, Ryan A. Rossi, Nesreen K. Ahmed

机构 * Data Science Institute Columbia University(数据科学研究所 哥伦比亚大学) Dolby Laboratories(杜比实验室) Adobe Research(Adobe研究) Cisco Research(思科研究)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了片段长度对音频指纹识别性能的影响,发现短片段长度(0.5秒)表现更优,并评估了大语言模型推荐最佳片段长度的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13379 2026-01-27 cs.AI cs.CV 57%

The Art of Saying "Maybe": A Conformal Lens for Uncertainty Benchmarking in VLMs

也许的艺术:一种用于VLMs不确定性基准测试的共形透镜

Asif Azad, Mohammad Sadat Hossain, MD Sadik Hossain Shanto, M Saifur Rahman, Md Rizwan Parvez

机构 * Bangladesh University of Engineering and Technology(孟加拉工程与技术大学) Qatar Computing Research Institute(卡塔尔计算研究所)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

AI总结 本文提出了一种用于VLMs不确定性基准测试的共形透镜,评估了18种最先进的VLMs在6个多元数据集上的表现,发现更大模型在不确定性量化方面表现更佳,而数学和推理任务则表现出较差的不确定性性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17986 2026-01-27 cs.LG 57%

Federated learning for unpaired multimodal data through a homogeneous transformer model

通过同质Transformer模型实现无配对多模态数据的联邦学习

Anders Eklund

机构 * Department of Biomedical Engineering, Linköping University, Sweden(_linköping大学生物医学工程系) Department of Computer and Information Science, Linköping University, Sweden(_linköping大学计算机与信息科学系) Center for Medical Image Science and Visualization (CMIV), Linköping University, Sweden(_linköping大学医学影像科学与可视化中心)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

AI总结 本文提出通过同质Transformer模型实现联邦学习,解决无配对多模态数据的训练问题,通过公共锚点对齐和子空间稳定化微调方法,在不传输私有数据的情况下实现全局模型统一表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17770 2026-01-27 eess.SP cs.AI 57%

Context-Aware Iterative Token Detection and Masked Transmission for Wireless Token Communication

具有上下文感知的迭代令牌检测与掩码传输用于无线令牌通信

Junyong Shin, Joohyuk Park, Jihong Park, Jinho Choi, Yo-Seb Jeon

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

AI总结 本文提出了一种基于预训练MLM的无线令牌通信框架,通过上下文感知的迭代检测和掩码策略提升通信质量与速率适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19113 2026-01-27 cs.CL 57%

Argument-Based Consistency in Toxicity Explanations of LLMs

基于论证的一致性:大语言模型毒性解释的评估

Ramaravind Kommiya Mothilal, Joanna Roy, Syed Ishtiaque Ahmed, Shion Guha

机构 * University of Toronto(多伦多大学) trail-ml

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.CL

AI总结 本研究提出基于论证的一致性标准,评估大语言模型对毒性的推理能力,发现其在复杂关系下的解释不一致。

Comments 29 pages, 7 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19442 2026-01-27 cs.AI 57%

Style2Code: A Style-Controllable Code Generation Framework with Dual-Modal Contrastive Representation Learning

Style2Code: 一种具有双模态对比学习的可控制代码生成框架

Dutao Zhang, Nicolas Rafael Arroyo Arias, YuLong He, Sergey Kovalchuk

机构 * ITMO University(ITMO大学) Saint Petersburg University(圣彼得堡大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

AI总结 Style2Code通过双模态对比学习和条件解码实现风格可控的代码生成,提升风格控制的同时保持代码正确性。

详情

展开后加载摘要…

URL PDF HTML 收藏