arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2505.13988 2025-05-21 cs.CL 70%

The Hallucination Tax of Reinforcement Finetuning

Linxin Song, Taiwei Shi, Jieyu Zhao

机构 * University of Southern California(南加州大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13175 2025-05-20 cs.AI 70%

Enhancing LLMs for Time Series Forecasting via Structure-Guided Cross-Modal Alignment

Siming Sun, Kai Zhang, Xuejun Jiang, Wenchao Meng, Qinmin Yang

机构 * Zhejiang University(浙江大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12060 2025-05-20 cs.CL 70%

Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement

Peng Ding, Jun Kuang, Zongyu Wang, Xuezhi Cao, Xunliang Cai, Jiajun Chen, Shujian Huang

机构 * National Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) Meituan Inc., China(美团公司)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Acccepted by ACL 2025 Findings, 21 pages, 9 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10354 2025-05-19 cs.CL 70%

LDIR: Low-Dimensional Dense and Interpretable Text Embeddings with Relative Representations

Yile Wang, Zhanyu Shen, Hui Huang

机构 * College of Computer Science and Software Engineering, Shenzhen University(计算机科学与软件工程学院,深圳大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13274 2025-05-19 cs.HC cs.AI 70%

Augmented Object Intelligence with XR-Objects

Mustafa Doga Dogan, Eric J. Gonzalez, Karan Ahuja, Ruofei Du, Andrea Colaço, Johnny Lee, Mar Gonzalez-Franco, David Kim

机构 * Google(谷歌)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 15 pages, 15 figures, 2024 ACM Symposium on User Interface Software and Technology (UIST)

Journal ref ACM UIST 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.05341 2025-05-16 physics.chem-ph cs.LG 70%

Bayesian Optimization of Catalysis With In-Context Learning

Mayk Caldas Ramos, Shane S. Michtavy, Marc D. Porosoff, Andrew D. White

机构 * FutureHouse Inc.(FutureHouse公司) University of Rochester(罗切斯特大学) Department of Chemical Engineering University of Rochester(罗切斯特大学化学工程系)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20799 2025-05-14 cs.SE cs.AI 70%

Hallucination by Code Generation LLMs: Taxonomy, Benchmarks, Mitigation, and Challenges

Yunseo Lee, John Youngeun Song, Dongsun Kim, Jindae Kim, Mijung Kim, Jaechang Nam

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00886 2025-05-05 cs.IR cs.AI 70%

Towards Explainable Temporal User Profiling with LLMs

Milad Sabouri, Masoud Mansoury, Kun Lin, Bamshad Mobasher

机构 * DePaul University(德保罗大学) Delft University of Technology(代尔夫特理工大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20972 2025-04-30 cs.CL 70%

SetKE: Knowledge Editing for Knowledge Elements Overlap

Yifan Wei, Xiaoyan Yu, Ran Song, Hao Peng, Angsheng Li

机构 * State Key Laboratory of CCSE,School of Computer Science and Engineering,Beihang University(信息与通信工程国家重点实验室,计算机科学与工程学院,北航) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Beijing Institute of Technology(北京理工大学) Kunming University of Science and Technology(昆明理工大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments The CR version will be updated subsequently

Journal ref IJCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11975 2025-04-29 cs.CL 70%

SemEval-2025 Task 3: Mu-SHROOM, the Multilingual Shared Task on Hallucinations and Related Observable Overgeneration Mistakes

Raúl Vázquez, Timothee Mickus, Elaine Zosa, Teemu Vahtola, Jörg Tiedemann, Aman Sinha, Vincent Segonne, Fernando Sánchez-Vega, Alessandro Raganato, Jindřich Libovický, Jussi Karlgren, Shaoxiong Ji, Jindřich Helcl, Liane Guillou, Ona de Gibert, Jaione Bengoetxea, Joseph Attieh, Marianna Apidianaki

机构 * University of Helsinki(赫尔辛基大学) SiLO Université de Lorraine & ICANS Strasbourg(洛林大学及斯特拉斯堡ICANS) Université Bretagne Sud(布列塔尼南方大学) CIMAT A. C. University of Milano-Bicocca(米兰-布雷拉大学) TU Darmstadt(德累斯顿技术大学) Aveni Charles University(查尔斯大学) HiTZ Basque Center for Language Technology - Ixa(巴斯克语言技术中心-ixa)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Mu-SHROOM is part of SemEval-2025 (Task 3). TBP: Proceedings of the 19th International Workshop on Semantic Evaluation (SemEval-2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18050 2025-04-28 cs.SE cs.AI 70%

Validating Network Protocol Parsers with Traceable RFC Document Interpretation

Mingwei Zheng, Danning Xie, Qingkai Shi, Chengpeng Wang, Xiangyu Zhang

机构 * Purdue University(普渡大学) Nanjing University(南京大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15719 2025-04-23 cs.AI 70%

Implementing Rational Choice Functions with LLMs and Measuring their Alignment with User Preferences

Anna Karnysheva, Christian Drescher, Dietrich Klakow

机构 * Spoken Language Systems (LSV)(语音语言系统(LSV)) Saarland University(萨尔兰大学) Mercedes-Benz AG(梅赛德斯-奔驰集团)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11831 2025-04-21 cs.CL 70%

Are You Doubtful? Oh, It Might Be Difficult Then! Exploring the Use of Model Uncertainty for Question Difficulty Estimation

Leonidas Zotos, Hedderik van Rijn, Malvina Nissim

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 14 pages,7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09861 2025-04-16 cs.CY cs.AI cs.HC econ.GN q-fin.EC stat.AP 70%

EthosGPT: Mapping Human Value Diversity to Advance Sustainable Development Goals (SDGs)

Luyao Zhang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08747 2025-04-15 cs.AI cs.IR 70%

GridMind: A Multi-Agent NLP Framework for Unified, Cross-Modal NFL Data Insights

Jordan Chipka, Chris Moyer, Clay Troyer, Tyler Fuelling, Jeremy Hochstedler

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 16 pages, 2 figures, submitted to 2025 Sloan Sports Analytics Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08743 2025-04-15 cs.IR cs.LG cs.SY eess.SY math.OC stat.AP 70%

Dynamic Topic Analysis in Academic Journals using Convex Non-negative Matrix Factorization Method

Yang Yang, Tong Zhang, Jian Wu, Lijie Su

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 11 pages, 7 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04170 2025-04-10 cs.AI cs.CV cs.RO 70%

Digital Gene: Learning about the Physical World through Analytic Concepts

Jianhua Sun, Cewu Lu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12601 2025-04-09 cs.CL 70%

COPU: Conformal Prediction for Uncertainty Quantification in Natural Language Generation

Sean Wang, Yicheng Jiang, Yuxin Tang, Lu Cheng, Hanjie Chen

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments There is an error in the methodology of the paper. We would like to withdraw this submission in case that the convenience it may brings

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03810 2025-04-08 cs.AI cs.RO 70%

Hierarchically Encapsulated Representation for Protocol Design in Self-Driving Labs

Yu-Zhe Shi, Mingchen Liu, Fanxu Meng, Qiao Xu, Zhangqian Bi, Kun He, Lecheng Ruan, Qining Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments In International Conference on Learning Representations (ICLR'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01278 2025-04-03 cs.AI 70%

Strategize Globally, Adapt Locally: A Multi-Turn Red Teaming Agent with Dual-Level Learning

Si Chen, Xiao Yu, Ninareh Mehrabi, Rahul Gupta, Zhou Yu, Ruoxi Jia

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16137 2025-04-02 cs.RO cs.AI 70%

A Graph-to-Text Approach to Knowledge-Grounded Response Generation in Human-Robot Interaction

Nicholas Thomas Walker, Stefan Ultes, Pierre Lison

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Submitted to Dialogue & Discourse 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03314 2025-03-28 cs.CV cs.CL cs.DB 70%

BACON: Improving Clarity of Image Captions via Bag-of-Concept Graphs

Zhantao Yang, Ruili Feng, Keyu Yan, Huangji Wang, Zhicai Wang, Shangwen Zhu, Han Zhang, Jie Xiao, Pingyu Wu, Kai Zhu, Jixuan Chen, Chen-Wei Xie, Yue Yang, Hongyang Zhang, Yu Liu, Fan Cheng

专题命中 知识编辑与模型理解 :language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10504 2025-03-25 cs.CL 70%

DILA: Dictionary Label Attention for Mechanistic Interpretability in High-dimensional Multi-label Medical Coding Prediction

John Wu, David Wu, Jimeng Sun

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments https://proceedings.mlr.press/v259/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15953 2025-03-21 cs.SE cs.AI 70%

GAN-enhanced Simulation-driven DNN Testing in Absence of Ground Truth

Mohammed Attaoui, Fabrizio Pastore

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 15 pages, 8 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15342 2025-03-20 cs.CV cs.AI 70%

TruthLens:A Training-Free Paradigm for DeepFake Detection

Ritabrata Chakraborty, Rajatsubhra Chakraborty, Ali Khaleghi Rahimian, Thomas MacDougall

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01250 2025-03-19 cs.AI 70%

Collaborative Instance Object Navigation: Leveraging Uncertainty-Awareness to Minimize Human-Agent Dialogues

Francesco Taioli, Edoardo Zorzi, Gianni Franchi, Alberto Castellini, Alessandro Farinelli, Marco Cristani, Yiming Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments https://intelligolabs.github.io/CoIN/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12579 2025-03-18 cs.RO cs.LG 70%

Focusing Robot Open-Ended Reinforcement Learning Through Users' Purposes

Emilio Cartoni, Gianluca Cioccolini, Gianluca Baldassarre

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 4 pages, 2 figures, accepted at RLDM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12536 2025-03-18 cs.LG cs.CV cs.CY 70%

Debiasing Diffusion Model: Enhancing Fairness through Latent Representation Learning in Stable Diffusion Model

Lin-Chun Huang, Ching Chieh Tsao, Fang-Yi Su, Jung-Hsien Chiang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01090 2025-03-18 cs.CL 70%

Precise Localization of Memories: A Fine-grained Neuron-level Knowledge Editing Technique for LLMs

Haowen Pan, Xiaozhi Wang, Yixin Cao, Zenglin Shi, Xun Yang, Juanzi Li, Meng Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06486 2025-03-11 cs.CV cs.AI 70%

PerturboLLaVA: Reducing Multimodal Hallucinations with Perturbative Visual Training

Cong Chen, Mingyu Liu, Chenchen Jing, Yizhou Zhou, Fengyun Rao, Hao Chen, Bo Zhang, Chunhua Shen

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏