arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7565 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7565 篇

2508.17856 2025-08-26 cs.CR cs.SE 67%

MalLoc: Toward Fine-grained Android Malicious Payload Localization via LLMs

Tiezhu Sun, Marco Alecci, Aleksandr Pilgun, Yewei Song, Xunzhu Tang, Jordan Samhi, Tegawendé F. Bissyandé, Jacques Klein

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments Accepted at ICSME 2025, NIER Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09028 2025-08-13 cs.HC 67%

Envisioning Generative Artificial Intelligence in Cartography and Mapmaking

Yuhao Kang, Chenglong Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21055 2025-08-13 cs.CV 67%

What Changed and What Could Have Changed? State-Change Counterfactuals for Procedure-Aware Video Representation Learning

Chi-Hsi Kung, Frangil Ramirez, Juhyung Ha, Yi-Ting Chen, David Crandall, Yi-Hsuan Tsai

机构 * Indiana University(印第安纳大学) National Yang-Ming Chiao-Tung University(国家阳明交通大学) Atmanity Inc.(Atmanity公司)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments 16 pages, 4 figures

Journal ref International Conference on Computer Vision, ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19383 2025-08-13 cs.LG cs.AI cs.CL stat.ML 67%

Decoding-based Regression

Xingyou Song, Dara Bahri

机构 * Google DeepMind(谷歌DeepMind)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published in Transactions on Machine Learning Research (TMLR) 2025. Code can be found at https://github.com/google-research/optformer/tree/main/optformer/decoding_regression

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07141 2025-08-12 cs.HC 67%

SketchConcept: Sketching-based Concept Recomposition for Product Design using Generative AI

Runlin Duan, Chenfei Zhu, Yuzhao Chen, Dizhi Ma, Jingyu Shi, Ziyi Liu, Karthik Ramani

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06990 2025-08-12 cs.RO 67%

Imaginative World Modeling with Scene Graphs for Embodied Agent Navigation

Yue Hu, Junzhe Wu, Ruihan Xu, Hang Liu, Avery Xi, Henry X. Liu, Ram Vasudevan, Maani Ghaffari

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21893 2025-08-06 cs.CV 67%

Aether Weaver: Multimodal Affective Narrative Co-Generation with Dynamic Scene Graphs

Saeed Ghorbani

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03207 2025-08-06 cs.CV 67%

Open-Vocabulary HOI Detection with Interaction-aware Prompt and Concept Calibration

Ting Lei, Shaofeng Yin, Qingchao Chen, Yuxin Peng, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王璇计算机技术研究所) National Institute of Health Data Science, Peking University(北京大学国家健康数据科学研究院)

专题命中 知识编辑与模型理解 :language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17349 2025-08-05 cs.CV cs.IR 67%

DRC: Enhancing Personalized Image Generation via Disentangled Representation Composition

Yiyan Xu, Wuqiang Zheng, Wenjie Wang, Fengbin Zhu, Xinting Hu, Yang Zhang, Fuli Feng, Tat-Seng Chua

机构 * University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments Accepted for publication in ACM MM'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06593 2025-08-05 cs.CV 67%

SAGI: Semantically Aligned and Uncertainty Guided AI Image Inpainting

Paschalis Giakoumoglou, Dimitrios Karageorgiou, Symeon Papadopoulos, Panagiotis C. Petrantonakis

机构 * Department of Electrical and Computer Engineering, Aristotle University of Thessaloniki(阿尔伯塔大学电气与计算机工程系) Information Technologies Institute, CERTH(信息科技研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments ICCV2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23120 2025-08-01 cs.SE 67%

Vibe Modeling: Challenges and Opportunities

Jordi Cabot

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01751 2025-07-30 cs.AI cs.CL cs.LG 67%

SAKE: Steering Activations for Knowledge Editing

Marco Scialanga, Thibault Laugel, Vincent Grari, Marcin Detyniecki

机构 * EPFL(苏黎世联邦理工学院) AXA(安盛集团) TRAIL, LIP6, Sorbonne Université(TRAIL、LIP6、索邦大学) Polish Academy of Science, IBS PAN(波兰科学院、IBS PAN)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20025 2025-07-29 cs.CV 67%

Region-based Cluster Discrimination for Visual Representation Learning

Yin Xie, Kaicheng Yang, Xiang An, Kun Wu, Yongle Zhao, Weimo Deng, Zimin Ran, Yumeng Wang, Ziyong Feng, Roy Miles, Ismail Elezi, Jiankang Deng

机构 * DeepGlint University of Technology Sydney(悉尼科技大学) Huawei London Research Center(华为伦敦研究中心) Imperial College London(伦敦帝国理工学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments Accepted as a highlight paper at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19262 2025-07-28 cs.CV 67%

OVFact: Measuring and Improving Open-Vocabulary Factuality for Long Caption Models

Monika Wysoczańska, Shyamal Buch, Anurag Arnab, Cordelia Schmid

机构 * Google DeepMind(谷歌DeepMind) Warsaw University of Technology(华沙技术大学)

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15569 2025-07-22 cs.CV 67%

DynImg: Key Frames with Visual Prompts are Good Representation for Multi-Modal Video Understanding

Xiaoyi Bao, Chenwei Xie, Hao Tang, Tingyu Weng, Xiaofeng Wang, Yun Zheng, Xingang Wang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Alibaba Group(阿里巴巴集团) Peking University(北京大学) Luoyang Institute for Robot and Intelligent Equipment(洛阳机器人与智能装备研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14034 2025-07-21 cs.HC 67%

Architecting Human-AI Cocreation for Technical Services -- Interaction Modes and Contingency Factors

Jochen Wulf, Jurg Meierhofer, Frank Hannich

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12855 2025-07-18 cs.RO cs.SY eess.SY 67%

DEMONSTRATE: Zero-shot Language to Robotic Control via Multi-task Demonstration Learning

Rahel Rickenbach, Bruce Lee, René Zurbrügg, Carmen Amo Alonso, Melanie N. Zeilinger

机构 * ETH Zurich(苏黎世联邦理工学院) University of Pennsylvania(宾夕法尼亚大学) Stanford University(斯坦福大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14931 2025-07-10 cs.RO 67%

Hier-SLAM++: Neuro-Symbolic Semantic SLAM with a Hierarchically Categorical Gaussian Splatting

Boying Li, Vuong Chi Hao, Peter J. Stuckey, Ian Reid, Hamid Rezatofighi

机构 * Faculty of Information Technology, Monash University(信息技术学院,墨尔本大学) VinUniversity(文大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments 18 pages. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03534 2025-07-08 cs.CE 67%

A Concept for Autonomous Problem-Solving in Intralogistics Scenarios

Johannes Sigel, Daniel Dittler, Nasser Jazdi, Michael Weyrich

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02439 2025-07-08 econ.GN q-fin.EC 67%

Introducing a New Brexit-Related Uncertainty Index: Its Evolution and Economic Consequences

Ismet Gocer, Julia Darby, Serdar Ongan

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments We introduce a new "Brexit Related Uncertainty Index", which was developed by authors using Text Mining, NLP and LLMs. We tested our index's performance by using diagrams and applying a VAR analysis on the US economy. We can share our index with other researchers via email

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00505 2025-07-08 cs.CV 67%

LLaVA-SP: Enhancing Visual Representation with Visual Spatial Tokens for MLLMs

Haoran Lou, Chunxiao Fan, Ziyan Liu, Yuexin Wu, Xinliang Wang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Beihang University(北航)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments Accepted to ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08723 2025-07-04 cs.HC 67%

Human-Computer Interaction and Visualization in Natural Language Generation Models: Applications, Challenges, and Opportunities

Yunchao Wang, Guodao Sun, Zihang Fu, Ronghua Liang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments The article has been accepted by Frontiers of Computer Science (FCS), with the DOI: {10.1007/s11704-025-50356-6}

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21476 2025-06-27 cs.CV 67%

Global and Local Entailment Learning for Natural World Imagery

Srikumar Sastry, Aayush Dhakal, Eric Xing, Subash Khanal, Nathan Jacobs

机构 * Washington University in St. Louis(圣路易斯华盛顿大学)

专题命中 知识编辑与模型理解 :language model(abstract);foundation model(abstract)

Comments Accepted at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09930 2025-06-12 cs.RO cs.CV 67%

From Intention to Execution: Probing the Generalization Boundaries of Vision-Language-Action Models

Irving Fang, Juexiao Zhang, Shengbang Tong, Chen Feng

机构 * New York University(纽约大学)

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract)

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13106 2025-06-12 cs.LG cs.AI cs.CL cs.CV 67%

Using Shapley interactions to understand how models use structure

Divyansh Singhvi, Diganta Misra, Andrej Erkelens, Raghav Jain, Isabel Papadimitriou, Naomi Saphra

机构 * ELLIS & MPI-IS Tübingen(ELLIS与MPI-IS图宾根研究所) UC San Diego(圣地亚哥大学) Kempner Institute, Harvard University(哈佛法学院凯普纳研究所)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published in ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13151 2025-06-10 cs.LG cs.AI cs.CL 67%

MIB: A Mechanistic Interpretability Benchmark

Aaron Mueller, Atticus Geiger, Sarah Wiegreffe, Dana Arad, Iván Arcuschin, Adam Belfki, Yik Siu Chan, Jaden Fiotto-Kaufman, Tal Haklay, Michael Hanna, Jing Huang, Rohan Gupta, Yaniv Nikankin, Hadas Orgad, Nikhil Prakash, Anja Reusch, Aruna Sankaranarayanan, Shun Shao, Alessandro Stolfo, Martin Tutek, Amir Zur, David Bau, Yonatan Belinkov

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to ICML 2025. Project website at https://mib-bench.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00915 2025-06-03 cs.CV 67%

3D Skeleton-Based Action Recognition: A Review

Mengyuan Liu, Hong Liu, Qianshuo Hu, Bin Ren, Junsong Yuan, Jiaying Lin, Jiajun Wen

机构 * State Key Laboratory of General Artificial Intelligence, Peking University, Shenzhen Graduate School(国家一般人工智能实验室,北京大学深圳研究生院) Department of Information Engineering and Computer Science (DISI), University of Trento(信息工程与计算机科学系(DISI),特伦托大学) University at Buffalo, The State University of New York(布法罗大学,纽约州立大学) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20254 2025-05-27 cs.LG cs.AI cs.CL stat.ML 67%

Position: Mechanistic Interpretability Should Prioritize Feature Consistency in SAEs

Xiangchen Song, Aashiq Muhamed, Yujia Zheng, Lingjing Kong, Zeyu Tang, Mona T. Diab, Virginia Smith, Kun Zhang

机构 * Carnegie Mellon University(卡内基梅隆大学) MBZUAI(穆斯林人工智能研究院)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19774 2025-05-27 eess.AS 67%

DuRep: Dual-Mode Speech Representation Learning via ASR-Aware Distillation

Prabash Reddy Male, Swayambhu Nath Ray, Harish Arsikere, Akshat Jaiswal, Prakhar Swarup, Prantik Sen, Debmalya Chakrabarty, K V Vijay Girish, Nikhil Bhave, Frederick Weber, Sambuddha Bhattacharya, Sri Garimella

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05057 2025-05-21 cs.SE 67%

Towards Mitigating API Hallucination in Code Generated by LLMs with Hierarchical Dependency Aware

Yujia Chen, Mingyu Chen, Cuiyun Gao, Zhihan Jiang, Zhongqi Li, Yuchi Ma

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments Accepted by FSE 2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏