arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7583 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7583 篇

2504.17314 2025-12-02 cs.LG cs.CV 57%

Class-Conditional Distribution Balancing for Group Robust Classification

基于类别条件分布平衡的组鲁棒分类

Miaoyun Zhao, Chenrong Li, Qiang Zhang

机构 * Dalian University of Technology(大连理工大学)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

AI总结 本文提出了一种基于类别条件分布平衡的鲁棒分类方法,通过样本重新加权策略消除对偏见注释的依赖,有效消除虚假相关性,提升模型在现实世界中的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22697 2025-12-01 cs.RO cs.CL cs.CV 57%

Mechanistic Finetuning of Vision-Language-Action Models via Few-Shot Demonstrations

通过少样本示范机制性微调视觉-语言-动作模型

Chancharik Mitra, Yusen Luo, Raj Saravanan, Dantong Niu, Anirudh Pai, Jesse Thomason, Trevor Darrell, Abrar Anwar, Deva Ramanan, Roei Herzig

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

AI总结 本研究提出Robotic Steering方法,通过少样本示范机制性微调视觉-语言-动作模型,提升其在机器人任务中的适应性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21974 2025-12-01 cs.CL 57%

Start Making Sense(s): A Developmental Probe of Attention Specialization Using Lexical Ambiguity

开始理解(s):利用词汇歧义开发注意力专业化探测

Pamela D. Rivière, Sean Trott

机构 * University of California, San Diego(加州大学圣地亚哥分校) Rutgers University - Newark(新泽西州立大学罗格斯-纽ark分校)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

AI总结 通过词汇歧义研究,发现不同大小的Transformer模型在消歧任务中存在不同的注意力机制发展特性。

Comments 13 pages (main text), 5 figures (main text) 6 pages (appendix), 6 figures (appendix), journal submission to TACL ("a" decision: pre-MIT Press publication version)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19506 2025-11-26 cs.LG cs.LO 57%

Profile Generators: A Link between the Narrative and the Binary Matrix Representation

生成器:叙事与二进制矩阵表示之间的桥梁

Raoul H. Kutil, Georg Zimmermann, Barbara Strasser-Kirchweger, Christian Borgelt

机构 * Department of AIHI, University of Salzburg(AIHI系,萨尔茨堡大学) Research Programme Biomedical Data Science, Paracelsus Medical University(生物医学数据科学研究计划,帕拉塞尔斯医学大学) Department of Psychology, University of Salzburg(心理学系,萨尔茨堡大学)

专题命中 知识编辑与模型理解 :prompting(abstract);分类 cs.LG

AI总结 本研究提出了一种将DSM-5叙述形式与二进制矩阵表示联系起来的生成器方法,用于高效生成复杂障碍的症状组合。

Comments 31 pages, 8 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04645 2025-11-25 cs.IR cs.AI 57%

Pathway to Relevance: How Cross-Encoders Implement a Semantic Variant of BM25

相关性路径:交叉编码器如何实现语义变体的BM25

Meng Lu, Catherine Chen, Carsten Eickhoff

机构 * Brown University(布朗大学) University of Tübingen(图宾根大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

AI总结 本文通过分析交叉编码器的机制,揭示其如何通过结合传统相关性信号实现语义变体的BM25排序功能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18136 2025-11-25 cs.CV cs.AI 57%

SCALER: SAM-Enhanced Collaborative Learning for Label-Deficient Concealed Object Segmentation

SCALER:基于SAM的增强协同学习用于标签匮乏的隐蔽物体分割

Chunming He, Rihan Zhang, Longxiang Tang, Ziyun Yang, Kai Li, Deng-Ping Fan, Sina Farsiu

机构 * Duke University(杜克大学) Harvard University(哈佛大学) Apple(苹果公司) Meta Nankai University(南开大学)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.AI

AI总结 SCALER通过联合优化分割器和SAM,提升隐蔽物体分割在标签稀缺条件下的性能。

Comments 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11706 2025-11-21 cs.LG cs.CV 57%

Context-Aware Multimodal Representation Learning for Spatio-Temporally Explicit Environmental Modelling

面向情境的多模态表示学习用于时空明确的环境建模

Julia Peters, Karin Mora, Miguel D. Mahecha, Chaonan Ji, David Montero, Clemens Mosig, Guido Kraemer

机构 * Environmental Data Science and Remote Sensing Group(环境数据科学与遥感小组) Institute for Earth System Science and Remote Sensing(地球系统科学与遥感研究所) Leipzig University(莱比锡大学) German Centre for Integrative Biodiversity Research (iDiv)(整合生物多样性研究德国中心(iDiv))

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

AI总结 本文提出一种面向情境的多模态表示学习框架,整合不同地球观测模态以高时空分辨率建模环境,提升生态分析的精度与效率。

Comments 10 pages (incliding 2 pages of references), 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15633 2025-11-20 cs.CV cs.LG 57%

Hierarchical Semantic Tree Anchoring for CLIP-Based Class-Incremental Learning

基于CLIP的层次语义树锚定的类增量学习

Tao Hu, Lan Li, Zhen-Hao Xie, Da-Wei Zhou

机构 * School of Artificial Intelligence, Nanjing University(人工智能学院,南京大学) State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

AI总结 HASTEN通过层次语义树锚定方法,有效解决CLIP类增量学习中的灾难性遗忘问题,提升模型对层次化类别结构的保持能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14778 2025-11-20 cs.AI 57%

Learning Interestingness in Automated Mathematical Theory Formation

George Tsoukalas, Rahul Saha, Amitayush Thakur, Sabrina Reguyal, Swarat Chaudhuri

机构 * UT Austin(得克萨斯大学) Princeton University(普林斯顿大学) Stanford University(斯坦福大学)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.AI

Comments NeurIPS 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12220 2025-11-18 cs.CV cs.LG 57%

Suppressing VLM Hallucinations with Spectral Representation Filtering

Ameen Ali, Tamim Zoabi, Lior Wolf

机构 * Tel Aviv University(特拉维夫大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11552 2025-11-17 cs.CV cs.CL 57%

DocLens : A Tool-Augmented Multi-Agent Framework for Long Visual Document Understanding

Dawei Zhu, Rui Meng, Jiefeng Chen, Sujian Li, Tomas Pfister, Jinsung Yoon

机构 * Google Cloud AI Research(谷歌云人工智能研究) School of Computer Science, Peking University(北京大学计算机学院)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11262 2025-11-17 cs.CV cs.CL 57%

Discovering Meaningful Units with Visually Grounded Semantics from Image Captions

Melika Behjati, James Henderson

机构 * Idiap Research Institute(日内瓦研究所)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11234 2025-11-17 cs.CL 57%

LANE: Lexical Adversarial Negative Examples for Word Sense Disambiguation

Jader Martins Camboim de Sá, Jooyoung Lee, Cédric Pruski, Marcos Da Silveira

机构 * FSTM - University of Luxembourg(卢森堡大学FSTM分校) Luxembourg Institute of Science and Technology(卢森堡科学与技术研究所) Brown University(布朗大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10997 2025-11-17 cs.CV cs.LG 57%

PROMISE: Prompt-Attentive Hierarchical Contrastive Learning for Robust Cross-Modal Representation with Missing Modalities

Jiajun Chen, Sai Cheng, Yutao Yuan, Yirui Zhang, Haitao Yuan, Peng Peng, Yi Zhong

专题命中 知识编辑与模型理解 :prompting(abstract);分类 cs.LG

Comments Accepted by AAAI'2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09018 2025-11-13 cs.CV cs.AI 57%

Causally-Grounded Dual-Path Attention Intervention for Object Hallucination Mitigation in LVLMs

Liu Yu, Zhonghao Chen, Ping Kuang, Zhikun Feng, Fan Zhou, Lan Wang, Gillian Dobbie

机构 * University of Auckland(奥克兰大学) China Scholarship Council(中国留学基金委)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

Comments 9 pages, published to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08802 2025-11-13 cs.LG 57%

The Non-Linear Representation Dilemma: Is Causal Abstraction Enough for Mechanistic Interpretability?

Denis Sutter, Julian Minder, Thomas Hofmann, Tiago Pimentel

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

Comments NeurIPS 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10180 2025-11-13 cs.CV cs.LG 57%

CART: Compositional Auto-Regressive Transformer for Image Generation

Siddharth Roheda, Rohit Chowdhury, Aniruddha Bala, Rohan Jaiswal

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

Comments figures compressed to meet arxiv size limit

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08075 2025-11-12 cs.CV cs.AI 57%

CLIP is All You Need for Human-like Semantic Representations in Stable Diffusion

Cameron Braunstein, Mariya Toneva, Eddy Ilg

机构 * Saarland University, Saarbrücken Germany(萨尔兰州大学) MPI for Software Systems, Saarbrücken Germany(软件系统研究所) University of Technology Nuremberg, Nuremberg Germany(纽伦堡技术大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

Comments 28 pages, 8 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07682 2025-11-12 cs.HC cs.AI 57%

Designing and Evaluating Malinowski's Lens: An AI-Native Educational Game for Ethnographic Learning

Michael Hoffmann, Jophin John, Jan Fillies, Adrian Paschke

机构 * Leibniz Supercomputing Centre(莱比锡超算中心) Stanford University(斯坦福大学)

专题命中 知识编辑与模型理解 :prompting(abstract);分类 cs.AI

Comments 21 pages, 8 figures. Full preprint version; shorter version in preparation

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07068 2025-11-11 cs.CV cs.LG 57%

ClusterMine: Robust Label-Free Visual Out-Of-Distribution Detection via Concept Mining from Text Corpora

Nikolas Adaloglou, Diana Petrusheva, Mohamed Asker, Felix Michels, Markus Kollmann

机构 * Heinrich Heine University of Düsseldorf(海因里希-海涅大学杜塞尔多夫分校)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

Comments Accepted in WACV 2026. Code in https://github.com/HHU-MMBS/clustermine_wacv_official 9 Tables, 11 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06653 2025-11-11 cs.CV cs.CL 57%

HiMo-CLIP: Modeling Semantic Hierarchy and Monotonicity in Vision-Language Alignment

Ruijia Wu, Ping Chen, Fei Shen, Shaoan Zhao, Qiang Hui, Huanlin Gao, Ting Lu, Zhaoxiang Liu, Fang Zhao, Kai Wang, Shiguo Lian

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments Accepted by AAAI 2026 as an Oral Presentation (13 pages, 7 figures, 7 tables)

Journal ref AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04173 2025-11-10 cs.AI 57%

Open Agent Specification (Agent Spec): A Unified Representation for AI Agents

Soufiane Amini, Yassine Benajiba, Cesare Bernardis, Paul Cayet, Hassan Chafi, Abderrahim Fathan, Louis Faucon, Damien Hilloulin, Sungpack Hong, Ingo Kossyk, Tran Minh Son Le, Rhicheek Patra, Sujith Ravi, Jonas Schweizer, Jyotika Singh, Shailender Singh, Weiyi Sun, Kartik Talamadupula, Jerry Xu

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03093 2025-11-05 cs.LG 57%

From Flat to Hierarchical: Extracting Sparse Representations with Matching Pursuit

Valérie Costa, Thomas Fel, Ekdeep Singh Lubana, Bahareh Tolooshams, Demba Ba

机构 * EPFL(瑞士联邦理工学院) Kempner Institute, Harvard University(哈佛大学凯普纳研究所) CBS-NTT Program in Physics of Intelligence, Harvard University(哈佛大学物理智能CBSTNTT项目) Physics of Artificial Intelligence Group, NTT Research, Inc., Sunnyvale, CA, USA(NTT研究公司人工智能物理研究组) University of Alberta(阿尔伯塔大学) Alberta Machine Intelligence Institute (Amii)(阿尔伯塔人工智能研究所) SEAS, Harvard University(哈佛大学工程与应用科学学院)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01610 2025-11-04 cs.CV cs.AI 57%

DINO-MX: A Modular & Flexible Framework for Self-Supervised Learning

Mahmut Selman Gokmen, Cody Bumgardner

机构 * Computer Science Department University of Kentucky(卡内基梅隆大学计算机科学系)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26466 2025-11-04 cs.CV cs.LG 57%

Representation-Level Counterfactual Calibration for Debiased Zero-Shot Recognition

Pei Peng, MingKun Xie, Hang Hao, Tong Jin, ShengJun Huang

机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03690 2025-11-04 cs.LG 57%

Graph Neural Networks for Electricity Load Forecasting

Eloi Campagne, Yvenn Amara-Ouali, Yannig Goude, Itai Zehavi, Argyris Kalogeratos

机构 * Centre Borelli, Ecole Normale Supérieure Paris-Saclay, Gif-sur-Yvette, France(巴黎萨克雷大学Borelli中心) EDF Lab, Palaiseau, France(法国电力公司实验室)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00785 2025-11-04 cs.CV cs.AI 57%

Class-agnostic 3D Segmentation by Granularity-Consistent Automatic 2D Mask Tracking

Juan Wang, Yasutomo Kawanishi, Tomo Miyazaki, Zhijie Wang, Shinichiro Omachi

机构 * Graduate School of Engineering(工程研究生院) Multimodal Data Recognition Research Team(多模态数据识别研究团队) RIKEN GRP(日本理化学研究所)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.AI

Comments Under review in Pattern Recognition

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24813 2025-10-30 cs.CV cs.AI 57%

DualCap: Enhancing Lightweight Image Captioning via Dual Retrieval with Similar Scenes Visual Prompts

Binbin Li, Guimiao Yang, Zisen Qi, Haiping Wang, Yu Ding

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)

专题命中 知识编辑与模型理解 :prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24459 2025-10-29 cs.AI cs.MA cs.SE 57%

Affordance Representation and Recognition for Autonomous Agents

Habtom Kahsay Gidey, Niklas Huber, Alexander Lenz, Alois Knoll

机构 * Technische Universität München(慕尼黑技术大学) Jessy Works(杰西工作)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.AI

Journal ref The Second International Workshop on Hypermedia Multi-Agent Systems (HyperAgents 2025), in conjunction with the 28th European Conference on Artificial Intelligence (ECAI 2025); October 26, 2025, Bologna, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21323 2025-10-27 cs.CV cs.LG 57%

VL-SAE: Interpreting and Enhancing Vision-Language Alignment with a Unified Concept Set

Shufan Shen, Junshu Sun, Qingming Huang, Shuhui Wang

机构 * Key Lab of Intell. Info. Process., Inst. of Comput. Tech., CAS(智能信息处理重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏