arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7596 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7596 篇

2408.03095 2025-04-01 cs.SE 85%

TestART: Improving LLM-based Unit Testing via Co-evolution of Automated Generation and Repair Iteration

Siqi Gu, Quanjun Zhang, Kecheng Li, Chunrong Fang, Fangyuan Tian, Liuchuan Zhu, Jianyi Zhou, Zhenyu Chen

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20188 2025-03-27 cs.CV 85%

Rethinking Vision-Language Model in Face Forensics: Multi-Modal Interpretable Forged Face Detector

Xiao Guo, Xiufeng Song, Yue Zhang, Xiaohong Liu, Xiaoming Liu

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract)

Comments 8 figures; 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08588 2025-03-12 cs.CL cs.AI cs.CY cs.LG 85%

BiasEdit: Debiasing Stereotyped Language Models via Model Editing

Xin Xu, Wei Xu, Ningyu Zhang, Julian McAuley

专题命中 知识编辑与模型理解 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by TrustNLP @ NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16985 2025-02-25 cs.LG cs.AI cs.CL 85%

Unveiling LLM Mechanisms Through Neural ODEs and Control Theory

Yukun Zhang, Qi Dong

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13632 2025-02-20 cs.LG cs.AI cs.CL 85%

Concept Layers: Enhancing Interpretability and Intervenability via LLM Conceptualization

Or Raphael Bidusa, Shaul Markovitch

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14257 2025-02-11 cs.CL cs.AI cs.LG 85%

Do I Know This Entity? Knowledge Awareness and Hallucinations in Language Models

Javier Ferrando, Oscar Obeso, Senthooran Rajamanoharan, Neel Nanda

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07224 2025-01-14 cs.RO 85%

Touched by ChatGPT: Using an LLM to Drive Affective Tactile Interaction

Qiaoqiao Ren, Tony Belpaeme

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04908 2025-01-10 cs.PL cs.AR 85%

HaVen: Hallucination-Mitigated LLM for Verilog Code Generation Aligned with HDL Engineers

Yiyao Yang, Fu Teng, Pengju Liu, Mengnan Qi, Chenyang Lv, Ji Li, Xuhong Zhang, Zhezhi He

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14233 2025-01-07 cs.CV cs.AI cs.CL cs.LG 85%

Detecting and Mitigating Hallucination in Large Vision Language Models via Fine-Grained AI Feedback

Wenyi Xiao, Ziwei Huang, Leilei Gan, Wanggui He, Haoyuan Li, Zhelun Yu, Fangxun Shu, Hao Jiang, Linchao Zhu

专题命中 知识编辑与模型理解 :language model(title,abstract);preference optimization(abstract);分类 cs.CL、cs.AI、cs.LG

Comments repo: https://github.com/Mr-Loevan/HSA-DPO

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16254 2024-11-11 cs.LG cs.AI cs.CL 85%

Confidence Regulation Neurons in Language Models

Alessandro Stolfo, Ben Wu, Wes Gurnee, Yonatan Belinkov, Xingyi Song, Mrinmaya Sachan, Neel Nanda

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11815 2024-10-16 cs.CV 85%

SGEdit: Bridging LLM with Text2Image Generative Model for Scene Graph-based Image Editing

Zhiyuan Zhang, DongDong Chen, Jing Liao

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted by ACM Transactions on Graphics and SIGGRAPH Asia 2024. Project page: https://bestzzhang.github.io/SGEdit

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10039 2024-10-15 cs.MA 85%

A Multi-LLM Orchestration Engine for Personalized, Context-Rich Assistance

Sumedh Rasal

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00558 2024-09-30 cs.CV 85%

Compositional 3D-aware Video Generation with LLM Director

Hanxin Zhu, Tianyu He, Anni Tang, Junliang Guo, Zhibo Chen, Jiang Bian

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Journal ref NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15051 2024-09-17 cs.CV 85%

Prior Knowledge Integration via LLM Encoding and Pseudo Event Regulation for Video Moment Retrieval

Yiyang Jiang, Wengyu Zhang, Xulu Zhang, Xiaoyong Wei, Chang Wen Chen, Qing Li

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted to ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03163 2024-09-17 cs.CL cs.AI cs.LG stat.ML 85%

Uncertainty in Language Models: Assessment through Rank-Calibration

Xinmeng Huang, Shuo Li, Mengxin Yu, Matteo Sesia, Hamed Hassani, Insup Lee, Osbert Bastani, Edgar Dobriban

专题命中 知识编辑与模型理解 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10794 2024-08-21 cs.CV 85%

Tapping in a Remote Vehicle's onboard LLM to Complement the Ego Vehicle's Field-of-View

Malsha Ashani Mahawatta Dona, Beatriz Cabrero-Daniel, Yinan Yu, Christian Berger

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 50th Euromicro Conference Series on Software Engineering and Advanced Applications (SEAA) 2024 - WiP

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19631 2024-08-15 cs.CL cs.AI cs.LG 85%

Retrieval-enhanced Knowledge Editing in Language Models for Multi-Hop Question Answering

Yucheng Shi, Qiaoyu Tan, Xuansheng Wu, Shaochen Zhong, Kaixiong Zhou, Ninghao Liu

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by CIKM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01703 2024-08-06 cs.HC 85%

WaitGPT: Monitoring and Steering Conversational LLM Agent in Data Analysis with On-the-Fly Code Visualization

Liwenhan Xie, Chengbo Zheng, Haijun Xia, Huamin Qu, Chen Zhu-Tian

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted in the 37th Annual ACM Symposium on User Interface Software and Technology (UIST'24)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11622 2024-07-01 cs.CV cs.AI cs.CL cs.LG 85%

Logical Closed Loop: Uncovering Object Hallucinations in Large Vision-Language Models

Junfei Wu, Qiang Liu, Ding Wang, Jinghao Zhang, Shu Wu, Liang Wang, Tieniu Tan

专题命中 知识编辑与模型理解 :language model(title,abstract);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accept to ACL 2024; 19 Pages, 15 Figures, 6 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09627 2024-06-06 cs.AI cs.CL cs.LG 85%

Mitigating Biases for Instruction-following Language Models via Bias Neurons Elimination

Nakyeong Yang, Taegwan Kang, Jungkyu Choi, Honglak Lee, Kyomin Jung

专题命中 知识编辑与模型理解 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments accepted to ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15300 2024-04-24 cs.CV cs.AI cs.CL cs.LG cs.MM 85%

Seeing is Believing: Mitigating Hallucination in Large Vision-Language Models via CLIP-Guided Decoding

Ailin Deng, Zhirui Chen, Bryan Hooi

专题命中 知识编辑与模型理解 :language model(title,abstract);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Code URL: https://github.com/d-ailin/CLIP-Guided-Decoding

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11943 2024-04-19 cs.HC 85%

AgentCoord: Visually Exploring Coordination Strategy for LLM-based Multi-Agent Collaboration

Bo Pan, Jiaying Lu, Ke Wang, Li Zheng, Zhen Wen, Yingchaojie Feng, Minfeng Zhu, Wei Chen

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12532 2024-03-20 cs.CV 85%

UniBind: LLM-Augmented Unified and Balanced Representation Space to Bind Them All

Yuanhuiyi Lyu, Xu Zheng, Jiazhou Zhou, Lin Wang

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted to CVPR2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.04380 2024-02-08 cs.SE 85%

Assured LLM-Based Software Engineering

Nadia Alshahwan, Mark Harman, Inna Harper, Alexandru Marginean, Shubho Sengupta, Eddy Wang

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 6 pages, 1 figure, InteNSE 24: ACM International Workshop on Interpretability, Robustness, and Benchmarking in Neural Software Engineering, April, 2024, Lisbon, Portugal

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13222 2024-01-26 cs.IR 85%

It's About Time: Incorporating Temporality in Retrieval Augmented Language Models

Anoushka Gade, Jorjeta Jetcheva

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07457 2024-01-17 cs.CV 85%

Concept-Guided Prompt Learning for Generalization in Vision-Language Models

Yi Zhang, Ce Zhang, Ke Yu, Yushun Tang, Zhihai He

专题命中 知识编辑与模型理解 :language model(title,abstract);pretraining(abstract);prompting(abstract)

Comments Accepted by AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15131 2023-11-28 cs.LG cs.AI cs.CL 85%

Localizing Lying in Llama: Understanding Instructed Dishonesty on True-False Questions Through Prompting, Probing, and Patching

James Campbell, Richard Ren, Phillip Guo

专题命中 知识编辑与模型理解 :prompting(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 14 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.04213 2023-10-17 cs.LG cs.AI cs.CL 85%

Does Localization Inform Editing? Surprising Differences in Causality-Based Localization vs. Knowledge Editing in Language Models

Peter Hase, Mohit Bansal, Been Kim, Asma Ghandeharioun

专题命中 知识编辑与模型理解 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2023 (Spotlight). 26 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22614 2026-08-25 cs.LG astro-ph.IM 新提交 84%

What AstroPT knows about galaxies, and what that can teach us about LLMs

AstroPT对星系的认知,以及这能为我们提供关于大型语言模型(LLMs)的启示

UniverseTBD, :, Kshitij Duraphe, Aman Kumar, Michael J. Smith, Shashwat Sourav

机构 * IUCAA(印度大学间天文和天体物理中心) AstroAI Washington University in St. Louis(圣路易斯华盛顿大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);language model(abstract);分类 cs.LG

AI总结 该研究利用基于星系图像训练的类LLM模型AstroPT作为测试平台,探究星系属性的出现顺序,为校准应用于LLMs的机械可解释性方法提供了受控沙盒。

Comments 13 pages, 12 figures, code at https://github.com/Smith42/astroPT, accepted at Sci-FM@COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05238 2026-08-07 cs.LG 新提交 84%

Decoupling Perception from Description: Computation-Grounded Representation Alignment between Multivariate Time Series and Language

感知与描述解耦:多变量时间序列与语言间的计算基础表示对齐

Xinran Feng, Yi Xie, Chao Zhang, Ruikun Li, Wanyun Ling, Ziyue Li, Chenxi Liu

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);language model(abstract);分类 cs.LG

AI总结 该研究针对多模态时间序列语言对齐的三难困境,提出CGTime模型,通过计算处理感知、LLM处理描述,在多变量理解任务上优于更大的通用模型。

Comments 46 pages, 9 figures, including supplementary material. Submitted to AAAI 2027. Xinran Feng and Yi Xie contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏