arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7596 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7596 篇

2512.22250 2025-12-30 cs.SE 85%

Hallucination Detection for LLM-based Text-to-SQL Generation via Two-Stage Metamorphic Testing

通过双阶段元测试检测基于大语言模型的文本到SQL生成中的幻觉

Bo Yang, Yinfen Xia, Weisong Sun, Yang Liu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 通过双阶段元测试方法检测基于大语言模型的文本到SQL生成中的幻觉,无需地面真实数据,提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23070 2025-12-23 cs.CV 85%

Vocabulary-free Fine-grained Visual Recognition via Enriched Contextually Grounded Vision-Language Model

无需词汇的细粒度视觉识别 via 增强的上下文感知视觉语言模型

Dmitry Demidov, Zaigham Zaheer, Omkar Thawakar, Salman Khan, Fahad Shahbaz Khan

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract)

AI总结 本文提出E-FineR方法,无需词汇实现细粒度视觉识别,提供高可解释性和在零样本和少样本分类中的高性能。

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05706 2025-11-20 eess.AS 85%

Bridging the Modality Gap: Softly Discretizing Audio Representation for LLM-based Automatic Speech Recognition

Mu Yang, Szu-Jui Chen, Jiamin Xie, John Hansen

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments ASRU 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09453 2025-11-13 eess.SP 85%

LLM Enabled Beam Training for Pinching Antenna Systems (PASS)

Deqiao Gan, Xiaoxia Xu, Xiaohu Ge, Yuanwei Liu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments submitted to IEEE journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24966 2025-10-30 cs.LG cs.AI cs.CL stat.ML 85%

Sequences of Logits Reveal the Low Rank Structure of Language Models

Noah Golowich, Allen Liu, Abhishek Shetty

机构 * Microsoft Research(微软研究院) UC Berkeley(加州大学伯克利分校) MIT(麻省理工学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24408 2025-10-29 cs.CR cs.NI 85%

Uncovering Gaps Between RFC Updates and TCP/IP Implementations: LLM-Facilitated Differential Checks on Intermediate Representations

Yifan Wu, Xuewei Feng, Yuxiang Yang, Ke Xu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22892 2025-10-28 cs.RO cs.SY eess.SY 85%

Never Too Rigid to Reach: Adaptive Virtual Model Control with LLM- and Lyapunov-Based Reinforcement Learning

Jingzehua Xu, Yangyang Li, Yangfei Chen, Guanwen Xie, Shuai Zhang

机构 * Department of Engineering, University of Cambridge(剑桥大学工程系) Department of Electrical Engineering and Computer Science, Massachusetts Institute of Technology(麻省理工学院电气工程与计算机科学系) Zhejiang University-University of Illinois Urbana-Champaign Institute, Zhejiang University(浙江大学-伊利诺伊大学厄巴纳-香槟分校联合研究所) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际 Graduate School) Department of Data Science, New Jersey Institute of Technology(新泽西理工学院数据科学系)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09423 2025-10-22 cs.CV cs.RO 85%

Distilling LLM Prior to Flow Model for Generalizable Agent's Imagination in Object Goal Navigation

Badi Li, Ren-jie Lu, Yu Zhou, Jingke Meng, Wei-shi Zheng

机构 * Sun Yat-sen University(中山大学) The University of Hong Kong(香港大学) Key Laboratory of Machine Intelligence and Advanced Computing, Ministry of Education(教育部机器智能与高级计算重点实验室)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15729 2025-10-20 cs.IR 85%

FACE: A General Framework for Mapping Collaborative Filtering Embeddings into LLM Tokens

Chao Wang, Yixin Song, Jinhui Ye, Chuan Qin, Dazhong Shen, Lingfeng Liu, Xiang Wang, Yanyong Zhang

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11414 2025-10-14 cs.CR 85%

Uncertainty-Aware, Risk-Adaptive Access Control for Agentic Systems using an LLM-Judged TBAC Model

Charles Fleming, Ashish Kundu, Ramana Kompella

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02233 2025-10-10 cs.CL cs.AI cs.LG 85%

Enhancing LLM Reliability via Explicit Knowledge Boundary Modeling

Hang Zheng, Hongshen Xu, Yuncong Liu, Lu Chen, Pascale Fung, Kai Yu

机构 * X-LANCE Lab, School of Computer Science MoE Key Lab of Artificial Intelligence, SJTU AI Institute Shanghai Jiao Tong University, Shanghai, China(X-LANCE实验室,计算机科学学院,人工智能关键实验室,上海交通大学人工智能研究院,上海,中国) Jiangsu Key Lab of Language Computing, Suzhou, China(语言计算重点实验室,苏州,中国) AISpeech Co., Ltd., Suzhou, China(AISpeech公司,苏州,中国) Center for Artificial Intelligence Research (CAiRE) Hong Kong University of Science and Technology, Hong Kong, China(人工智能研究中心(CAiRE)香港科技大学,香港,中国) Suzhou Laboratory, Suzhou, China(苏州实验室,苏州,中国)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16975 2025-09-29 cs.LG cs.AI cs.CL 85%

Latent Concept Disentanglement in Transformer-based Language Models

Guan Zhe Hong, Bhavya Vasudeva, Vatsal Sharan, Cyrus Rashtchian, Prabhakar Raghavan, Rina Panigrahy

机构 * Purdue University(普渡大学) University of Southern California(南加州大学) Google(谷歌)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17422 2025-09-08 cs.RO cs.CV 85%

Multimodal LLM Guided Exploration and Active Mapping using Fisher Information

Wen Jiang, Boshu Lei, Katrina Ashton, Kostas Daniilidis

机构 * University of Pennsylvania(宾夕法尼亚大学) Archimedes, Athena RC(阿基米德、阿提卡RC)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12341 2025-08-14 cs.MM 85%

Multimodal LLM-based Query Paraphrasing for Video Search

Jiaxin Wu, Chong-Wah Ngo, Wing-Kwong Chan, Sheng-Hua Zhong, Xiong-Yong Wei, Qing Li

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22905 2025-08-01 cs.HC 85%

Exploring LLM-generated Culture-specific Affective Human-Robot Tactile Interaction

Qiaoqiao Ren, Tony Belpaeme

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08493 2025-07-22 cs.RO 85%

Intelligent LiDAR Navigation: Leveraging External Information and Semantic Maps with LLM as Copilot

Fujing Xie, Jiajie Zhang, Sören Schwertfeger

机构 * ShanghaiTech University(上海科技大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted at IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02745 2025-07-04 cs.HC 85%

Who's Sorry Now: User Preferences Among Rote, Empathic, and Explanatory Apologies from LLM Chatbots

Zahra Ashktorab, Alessandra Buccella, Jason D'Cruz, Zoe Fowler, Andrew Gill, Kei Yan Leung, P. D. Magnus, John Richards, Kush R. Varshney

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24007 2025-06-30 cs.CV 85%

Preemptive Hallucination Reduction: An Input-Level Approach for Multimodal Language Model

Nokimul Hasan Arif, Shadman Rabby, Md Hefzul Hossain Papon, Sabbir Ahmed

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract)

Comments Submitted for review in NCAA Springer, 21 pages, 4 figures, 4 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17203 2025-06-23 stat.AP 85%

Confidence Scoring for LLM-Generated SQL in Supply Chain Data Extraction

Jiekai Ma, Yikai Zhao

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments accepted by KDD workshop AI for Supply Chain 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10922 2025-06-13 cs.LG cs.AI cs.CL 85%

Robustly Improving LLM Fairness in Realistic Settings via Interpretability

Adam Karvonen, Samuel Marks

机构 * Anthropic

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02557 2025-06-04 cs.CV 85%

Kernel-based Unsupervised Embedding Alignment for Enhanced Visual Representation in Vision-language Models

Shizhan Gong, Yankai Jiang, Qi Dou, Farzan Farnia

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);foundation model(abstract)

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02514 2025-06-04 cs.HC 85%

To Embody or Not: The Effect Of Embodiment On User Perception Of LLM-based Conversational Agents

Kyra Wang, Boon-Kiat Quek, Jessica Goh, Dorien Herremans

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22655 2025-05-29 cs.LG cs.AI cs.CL 85%

Position: Uncertainty Quantification Needs Reassessment for Large-language Model Agents

Michael Kirchhof, Gjergji Kasneci, Enkelejda Kasneci

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21399 2025-05-28 cs.CL cs.AI cs.LG 85%

Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling

Hovhannes Tamoyan, Subhabrata Dutta, Iryna Gurevych

机构 * Ubiquitous Knowledge Processing Lab (UKP Lab)(通用知识处理实验室) Department of Computer Science(计算机科学系) Hessian Center for AI (hessian.AI)(黑森人工智能中心) Technical University of Darmstadt(达姆施塔特技术大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12694 2025-05-20 cs.IR 85%

LLM-based Query Expansion Fails for Unfamiliar and Ambiguous Queries

Kenya Abe, Kunihiro Takeoka, Makoto P. Kato, Masafumi Oyamada

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted at SIGIR 2025 short paper track

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12237 2025-05-20 cs.CV 85%

From Shots to Stories: LLM-Assisted Video Editing with Unified Language Representations

Yuzhi Li, Haojun Xu, Feng Tian

机构 * Shanghai University(上海大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03075 2025-05-07 cs.IR 85%

Direct Retrieval-augmented Optimization: Synergizing Knowledge Selection and Language Models

Zhengliang Shi, Lingyong Yan, Weiwei Sun, Yue Feng, Pengjie Ren, Xinyu Ma, Shuaiqiang Wang, Dawei Yin, Maarten de Rijke, Zhaochun Ren

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18881 2025-05-06 cs.HC 85%

Letters from Future Self: Augmenting the Letter-Exchange Exercise with LLM-based Agents to Enhance Young Adults' Career Exploration

Hayeon Jeon, Suhwoo Yoon, Keyeun Lee, Seo Hyeong Kim, Esther Hehsun Kim, Seonghye Cho, Yena Ko, Soeun Yang, Laura Dabbish, John Zimmerman, Eun-mee Kim, Hajin Lim

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 21 pages, 9 figures, Proceedings of the 2025 CHI Conference on Human Factors in Computing Systems (Best Paper Award, Top 1%)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13052 2025-04-18 cs.CR 85%

GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms

Sinan He, An Wang

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03444 2025-04-08 cs.DC 85%

LLMSched: Uncertainty-Aware Workload Scheduling for Compound LLM Applications

Botao Zhu, Chen Chen, Xiaoyi Fan, Yifei Zhu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments This paper is accepted by 45th IEEE International Conference on Distributed Computing Systems (ICDCS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏