arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7596 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7596 篇

2408.09172 2025-01-14 cs.AI cs.CL 86%

Unlocking the Power of LLM Uncertainty for Active In-Context Example Selection

Hsiu-Yuan Huang, Zichen Wu, Yutong Yang, Junzhao Zhang, Yunfang Wu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09236 2024-12-10 cs.LG cs.AI math.ST stat.ML stat.TH 86%

Learning Interpretable Concepts: Unifying Causal Representation Learning and Foundation Models

Goutham Rajendran, Simon Buchholz, Bryon Aragam, Bernhard Schölkopf, Pradeep Ravikumar

专题命中 知识编辑与模型理解 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments To appear in NeurIPS 2024 under the modified title 'From Causal to Concept-Based Representation Learning'

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00353 2024-12-09 cs.CL cs.AI 86%

Enhancing Zero-shot Chain of Thought Prompting via Uncertainty-Guided Strategy Selection

Shanu Kumar, Saish Mendke, Karody Lubna Abdul Rahman, Santosh Kurasa, Parag Agrawal, Sandipan Dandapat

专题命中 知识编辑与模型理解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted in COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01033 2024-12-03 cs.CL cs.LG 86%

SAUP: Situation Awareness Uncertainty Propagation on LLM Agent

Qiwei Zhao, Xujiang Zhao, Yanchi Liu, Wei Cheng, Yiyou Sun, Mika Oishi, Takao Osaki, Katsushi Matsuda, Huaxiu Yao, Haifeng Chen

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03486 2024-11-07 cs.AI cs.CL 86%

LLM Generated Distribution-Based Prediction of US Electoral Results, Part I

Caleb Bradshaw, Caelen Miller, Sean Warnick

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 17 pages, 10 Figures, Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10866 2024-10-16 cs.CL cs.AI 86%

CodeUnlearn: Amortized Zero-Shot Machine Unlearning in Language Models Using Discrete Concept

YuXuan Wu, Bonaventure F. P. Dossou, Dianbo Liu

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04277 2024-10-08 cs.CL cs.AI 86%

Mechanistic Behavior Editing of Language Models

Joykirat Singh, Subhabrata Dutta, Tanmoy Chakraborty

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17504 2024-09-27 cs.LG cs.CL 86%

HaloScope: Harnessing Unlabeled LLM Generations for Hallucination Detection

Xuefeng Du, Chaowei Xiao, Yixuan Li

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments NeurIPS 2024 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00781 2024-09-26 cs.IR cs.AI cs.LG cs.MM 86%

ChatDiet: Empowering Personalized Nutrition-Oriented Food Recommender Chatbots through an LLM-Augmented Framework

Zhongqi Yang, Elahe Khatibi, Nitish Nagesh, Mahyar Abbasian, Iman Azimi, Ramesh Jain, Amir M. Rahmani

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Published on Smart Health

Journal ref Smart Health 32 (2024): 100465

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09629 2024-09-24 cs.CL cs.AI 86%

Confidence Estimation for LLM-Based Dialogue State Tracking

Yi-Jyun Sun, Suvodip Dey, Dilek Hakkani-Tur, Gokhan Tur

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted for publication at IEEE SLT 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10811 2024-08-21 cs.CL cs.AI 86%

Beyond English-Centric LLMs: What Language Do Multilingual Language Models Think in?

Chengzhi Zhong, Fei Cheng, Qianying Liu, Junfeng Jiang, Zhen Wan, Chenhui Chu, Yugo Murawaki, Sadao Kurohashi

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.06865 2024-08-09 cs.CL cs.AI 86%

Effective Prompt Extraction from Language Models

Yiming Zhang, Nicholas Carlini, Daphne Ippolito

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04784 2024-06-10 cs.CL cs.AI 86%

SelfGoal: Your Language Agents Already Know How to Achieve High-level Goals

Ruihan Yang, Jiangjie Chen, Yikai Zhang, Siyu Yuan, Aili Chen, Kyle Richardson, Yanghua Xiao, Deqing Yang

专题命中 知识编辑与模型理解 :language agent(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03487 2024-06-06 cs.CL cs.AI 86%

Analyzing LLM Behavior in Dialogue Summarization: Unveiling Circumstantial Hallucination Trends

Sanjana Ramprasad, Elisa Ferracane, Zachary C. Lipton

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03441 2024-06-06 cs.CL cs.LG 86%

Cycles of Thought: Measuring LLM Confidence through Stable Explanations

Evan Becker, Stefano Soatto

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06921 2024-04-11 cs.CL cs.AI 86%

GoEX: Perspectives and Designs Towards a Runtime for Autonomous LLM Applications

Shishir G. Patil, Tianjun Zhang, Vivian Fang, Noppapon C., Roy Huang, Aaron Hao, Martin Casado, Joseph E. Gonzalez, Raluca Ada Popa, Ion Stoica

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03732 2024-04-08 cs.CL cs.AI 86%

SHROOM-INDElab at SemEval-2024 Task 6: Zero- and Few-Shot LLM-Based Classification for Hallucination Detection

Bradley P. Allen, Fina Polat, Paul Groth

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

Comments 6 pages, 6 figures, 4 tables, camera-ready copy, accepted to the 18th International Workshop on Semantic Evaluation (SemEval-2024), for associated code and data see https://github.com/bradleypallen/shroom

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01482 2024-04-02 cs.CV cs.AI cs.LG 86%

Incorporating Geo-Diverse Knowledge into Prompting for Increased Geographical Robustness in Object Recognition

Kyle Buettner, Sina Malakouti, Xiang Lorraine Li, Adriana Kovashka

专题命中 知识编辑与模型理解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments To appear in IEEE/CVF Computer Vision and Pattern Recognition Conference (CVPR), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08241 2024-02-23 cs.CL cs.AI 86%

TEST: Text Prototype Aligned Embedding to Activate LLM's Ability for Time Series

Chenxi Sun, Hongyan Li, Yaliang Li, Shenda Hong

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08517 2024-01-25 cs.AI cs.CL cs.HC 86%

Supporting Student Decisions on Learning Recommendations: An LLM-Based Chatbot with Knowledge Graph Contextualization for Conversational Explainability and Mentoring

Hasan Abu-Rasheed, Mohamad Hussam Abdulsalam, Christian Weber, Madjid Fathi

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01862 2024-01-04 cs.CV cs.CL cs.LG 86%

A Vision Check-up for Language Models

Pratyusha Sharma, Tamar Rott Shaham, Manel Baradad, Stephanie Fu, Adrian Rodriguez-Munoz, Shivam Duggal, Phillip Isola, Antonio Torralba

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15451 2023-11-28 cs.CL cs.LG 86%

Uncertainty-aware Language Modeling for Selective Question Answering

Qi Yang, Shreya Ravikumar, Fynn Schmitt-Ulms, Satvik Lolla, Ege Demir, Iaroslav Elistratov, Alex Lavaee, Sadhana Lolla, Elaheh Ahmadi, Daniela Rus, Alexander Amini, Alejandro Perez

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07424 2023-11-14 cs.CL cs.AI 86%

Hallucination Augmented Recitations for Language Models

Abdullatif Köksal, Renat Aksitov, Chung-Ching Chang

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12443 2023-10-20 cs.IR cs.AI cs.CL 86%

Know Where to Go: Make LLM a Relevant, Responsible, and Trustworthy Searcher

Xiang Shi, Jiawei Liu, Yinpeng Liu, Qikai Cheng, Wei Lu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 4 figures, under peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16175 2023-10-05 cs.CL cs.AI 86%

Quantifying Uncertainty in Answers from any Language Model and Enhancing their Trustworthiness

Jiuhai Chen, Jonas Mueller

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13705 2025-07-21 cs.CL cs.IR 86%

Consistent Explainers or Unreliable Narrators? Understanding LLM-generated Group Recommendations

Cedric Waterschoot, Nava Tintarev, Francesco Barile

机构 * Maastricht University(马斯特里赫特大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Short paper accepted at the Nineteenth ACM Conference on Recommender Systems (RecSys '25). Cedric Waterschoot, Nava Tintarev, and Francesco Barile. 2025. Consistent Explainers or Unreliable Narrators? Understanding LLM-generated Group Recommendations. Proceedings of the Nineteenth ACM Conference on Recommender Systems (RecSys '25), Prague, Czech Republic. doi: 10.1145/3705328.3748015

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16090 2025-02-11 cs.CL 86%

Analysing the Residual Stream of Language Models Under Knowledge Conflicts

Yu Zhao, Xiaotang Du, Giwon Hong, Aryo Pradipta Gema, Alessio Devoto, Hongru Wang, Xuanli He, Kam-Fai Wong, Pasquale Minervini

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments Foundation Model Interventions Workshop @ NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.00306 2023-11-02 cs.CL 86%

Probing Explicit and Implicit Gender Bias through LLM Conditional Text Generation

Xiangjue Dong, Yibo Wang, Philip S. Yu, James Caverlee

专题命中 知识编辑与模型理解 :LLM(title,abstract);language model(abstract,comments);large language model(abstract);分类 cs.CL

Comments Accepted in Socially Responsible Language Modelling Research (SoLaR) 2023 at NeurIPS 2023; the first two authors contribute equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22938 2026-08-25 cs.SE cs.AR 新提交 86%

Execution-Anchored Hallucination Calibration Reranking for Verilog Code Generation

面向Verilog代码生成的执行锚定幻觉校准重排序

Guang Yang, Xing Hu, Xiang Chen, Terry Yue Zhuo, Xin Xia

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 该研究针对LLM生成Verilog代码时的性能问题,提出EAHC重排序框架,通过双通道架构融合执行与推理信号,解决现有方法的域迁移差和推理幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07941 2026-08-20 cs.CR 版本更新 86%

Collective Hallucination in Multi-Agent LLMs:Modeling and Defense

多智能体大语言模型中的集体幻觉:建模与防御

Saeid Jamshidi

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 提出一种系统级模型描述多智能体LLM中幻觉的传播与放大,并设计交互感知控制方法,通过置信加权聚合、自适应影响调节、外部验证和隔离不可靠智能体来抑制错误传播,在TruthfulQA和TriviaQA上使幻觉降低39%,事实准确率提升至0.87。

详情

展开后加载摘要…

URL PDF HTML 收藏