arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7596 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7596 篇

2509.02033 2025-09-03 cs.CL 57%

StructCoh: Structured Contrastive Learning for Context-Aware Text Semantic Matching

Chao Xue, Ziyuan Gao

机构 * Beihang University, Beijing, China(北京航空航天大学) University College London, London, UK(伦敦大学学院)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments Accepted by PRICAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00503 2025-09-03 cs.CL eess.AS 57%

Entropy-based Coarse and Compressed Semantic Speech Representation Learning

Jialong Zuo, Guangyan Zhang, Minghui Fang, Shengpeng Ji, Xiaoqi Jiao, Jingyu Li, Yiwen Guo, Zhou Zhao

机构 * Zhejiang University(浙江大学) LIGHTSPEED Independent Researcher(独立研究者)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08243 2025-08-26 cs.CL 57%

Jinx: Unlimited LLMs for Probing Alignment Failures

Jiahao Zhao, Liwei Dong

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments https://huggingface.co/Jinx-org

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12051 2025-08-26 cs.LG cs.CE 57%

GUST: Quantifying Free-Form Geometric Uncertainty of Metamaterials Using Small Data

Jiahui Zheng, Cole Jahnke, Wei "Wayne" Chen

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16837 2025-08-26 cs.CL 57%

LLMs Learn Constructions That Humans Do Not Know

Jonathan Dunn, Mai Mohamed Eida

机构 * Department of Linguistics University of Illinois Urbana-Champaign(语言学系伊利诺伊大学厄巴纳-香槟分校)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13057 2025-08-22 cs.LG cs.CV 57%

MaskSDM with Shapley values to improve flexibility, robustness, and explainability in species distribution modeling

Robin Zbinden, Nina van Tiel, Gencer Sumbul, Chiara Vanalli, Benjamin Kellenberger, Devis Tuia

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04567 2025-08-07 cs.CV cs.CL 57%

Analyzing and Mitigating Object Hallucination: A Training Bias Perspective

Yifan Li, Kun Zhou, Wayne Xin Zhao, Lei Fang, Ji-Rong Wen

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03998 2025-08-07 cs.CL 57%

Transferring Expert Cognitive Models to Social Robots via Agentic Concept Bottleneck Models

Xinyu Zhao, Zhen Tan, Maya Enisman, Minjae Seo, Marta R. Durantini, Dolores Albarracin, Tianlong Chen

机构 * The University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Arizona State University(亚利桑那州立大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.CL

Comments 27 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01474 2025-08-05 cs.LG 57%

HT-Transformer: Event Sequences Classification by Accumulating Prefix Information with History Tokens

Ivan Karpukhin, Andrey Savchenko

机构 * Sber AI Lab(Sber AI实验室)

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21369 2025-07-30 cs.CL 57%

Turbocharging Web Automation: The Impact of Compressed History States

Xiyue Zhu, Peng Tang, Haofu Liao, Srikar Appalaraju

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) AWS AI Labs(亚马逊AWS人工智能实验室)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15278 2025-07-29 cs.CV cs.AI 57%

CopyJudge: Automated Copyright Infringement Identification and Mitigation in Text-to-Image Diffusion Models

Shunchang Liu, Zhuan Shi, Lingjuan Lyu, Yaochu Jin, Boi Faltings

机构 * EPFL(苏黎世联邦理工学院) Mila - Quebec AI Institute Mcgill University(蒙特利尔麦吉尔大学人工智能研究所) Westlake University(西湖大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

Comments Accepted by ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16438 2025-07-23 cs.NI cs.LG 57%

The Sweet Danger of Sugar: Debunking Representation Learning for Encrypted Traffic Classification

Yuqi Zhao, Giovanni Dettori, Matteo Boffa, Luca Vassio, Marco Mellia

机构 * Politecnico di Torino(托里尼理工学院)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

Comments This paper has been accepted at ACM SIGCOMM 2025. It will appear in the proceedings with DOI 10.1145/3718958.3750498

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18527 2025-07-23 cs.IR cs.LG 57%

Probing Ranking LLMs: A Mechanistic Analysis for Information Retrieval

Tanya Chowdhury, Atharva Nijasure, James Allan

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.LG

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14639 2025-07-22 q-bio.QM cs.LG 57%

KinForm: Kinetics Informed Feature Optimised Representation Models for Enzyme $k_{cat}$ and $K_{M}$ Prediction

Saleh Alwer, Ronan Fleming

机构 * University of Galway(Galway大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13482 2025-07-21 cs.LG cs.CV 57%

Improving Out-of-distribution Human Activity Recognition via IMU-Video Cross-modal Representation Learning

Seyyed Saeid Cheshmi, Buyao Lyu, Thomas Lisko, Rajesh Rajamani, Robert A. McGovern, Yogatheesan Varatharajah

机构 * Department of Computer Science & Engineering University of Minnesota(计算机科学与工程系明尼苏达大学) Department of Mechanical Engineering University of Minnesota(机械工程系明尼苏达大学) Department of Neurosurgery University of Minnesota(神经外科系明尼苏达大学)

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12464 2025-07-17 cs.CV cs.LG q-bio.QM 57%

CytoSAE: Interpretable Cell Embeddings for Hematology

Muhammed Furkan Dasdelen, Hyesu Lim, Michele Buck, Katharina S. Götze, Carsten Marr, Steffen Schneider

机构 * Institute of AI for Health, Helmholtz Munich Institute of Computational Biology, Helmholtz Munich Korea Advanced Institute of Science \& Technology Medical Department for Hematology Oncology, Technical University Munich Munich Center for Machine Learning (MCML)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09664 2025-07-15 cs.HC cs.AI 57%

SimStep: Chain-of-Abstractions for Incremental Specification and Debugging of AI-Generated Interactive Simulations

Zoe Kaputa, Anika Rajaram, Vryan Almanon Feliciano, Zhuoyue Lyu, Maneesh Agrawala, Hari Subramonyam

机构 * Stanford University(斯坦福大学) The Harker School(哈克尔学校) University of Cambridge(剑桥大学)

专题命中 知识编辑与模型理解 :prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08473 2025-07-14 cs.LG 57%

Evaluating SAE interpretability without explanations

Gonçalo Paulo, Nora Belrose

机构 * EleutherAI

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08443 2025-07-14 cs.LG 57%

KGRAG-Ex: Explainable Retrieval-Augmented Generation with Knowledge Graph-based Perturbations

Georgios Balanos, Evangelos Chasanis, Konstantinos Skianis, Evaggelia Pitoura

机构 * University of Ioannina, Greece(希腊伊奥安妮亚大学) Archimedes, Athena Research Center, Greece(阿提卡研究中心)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08371 2025-07-14 cs.CL 57%

The Curious Case of Factuality Finetuning: Models' Internal Beliefs Can Improve Factuality

Benjamin Newman, Abhilasha Ravichander, Jaehun Jung, Rui Xin, Hamish Ivison, Yegor Kuznetsov, Pang Wei Koh, Yejin Choi

机构 * University of Washington(华盛顿大学) Stanford University(斯坦福大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments 29 pages, 4 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24360 2025-07-14 cs.LG 57%

Interpreting Large Text-to-Image Diffusion Models with Dictionary Learning

Stepan Shabalin, Ayush Panda, Dmitrii Kharlapenko, Abdur Raheem Ali, Yixiong Hao, Arthur Conmy

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

Comments 10 pages, 10 figures, Mechanistic Interpretability for Vision at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07982 2025-07-11 cs.CV cs.AI 57%

Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling

Haoyu Wu, Diankun Wu, Tianyu He, Junliang Guo, Yang Ye, Yueqi Duan, Jiang Bian

机构 * Microsoft Research(微软研究院) Tsinghua University(清华大学)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.AI

Comments 18 pages, project page: https://GeometryForcing.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07862 2025-07-11 cs.LG q-bio.QM 57%

Predicting and generating antibiotics against future pathogens with ApexOracle

Tianang Leng, Fangping Wan, Marcelo Der Torossian Torres, Cesar de la Fuente-Nunez

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

Comments 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05020 2025-07-11 cs.CV cs.AI 57%

Adaptation of Multi-modal Representation Models for Multi-task Surgical Computer Vision

Soham Walimbe, Britty Baby, Vinkle Srivastav, Nicolas Padoy

机构 * University of Strasbourg, CNRS, INSERM, ICube, UMR7357, Strasbourg, France(斯特拉斯堡大学,法国国家科学研究中心(CNRS),法国国家卫生研究院(INSERM),ICube,UMR7357,斯特拉斯堡) Institute of Image-Guided Surgery, IHU Strasbourg, Strasbourg, France(影像引导手术研究所,斯特拉斯堡IHU,斯特拉斯堡)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05017 2025-07-08 cs.CL cs.SC 57%

Verified Language Processing with Hybrid Explainability: A Technical Report

Oliver Robert Fox, Giacomo Bergami, Graham Morgan

机构 * School of Computing, Faculty of Science, Agriculture and Engineering, Newcastle University(计算学院、科学与工程学院、农业与工程学院、新castle大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.18101 2025-07-08 cs.CV cs.AI cs.RO 57%

INoD: Injected Noise Discriminator for Self-Supervised Representation Learning in Agricultural Fields

Julia Hindel, Nikhil Gosala, Kevin Bregler, Abhinav Valada

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.AI

Comments 11 pages, 10 figures

Journal ref IEEE Robotics and Automation Letters (Volume: 8, Issue: 9, September 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07772 2025-07-08 cs.CV cs.LG 57%

Hallucinatory Image Tokens: A Training-free EAZY Approach on Detecting and Mitigating Object Hallucinations in LVLMs

Liwei Che, Tony Qingze Liu, Jing Jia, Weiyi Qin, Ruixiang Tang, Vladimir Pavlovic

机构 * Rutgers University(罗杰斯大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

Comments Accepted to ICCV2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02956 2025-07-08 cs.CR cs.AI 57%

A Representation Engineering Perspective on the Effectiveness of Multi-Turn Jailbreaks

Blake Bullwinkel, Mark Russinovich, Ahmed Salem, Santiago Zanella-Beguelin, Daniel Jones, Giorgio Severi, Eugenia Kim, Keegan Hines, Amanda Minnich, Yonatan Zunger, Ram Shankar Siva Kumar

机构 * msft(微软)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22768 2025-07-04 cs.LG 57%

Multivariate de Bruijn Graphs: A Symbolic Graph Framework for Time Series Forecasting

Mert Onur Cakiroglu, Idil Bilge Altun, Mehmet Dalkilic, Elham Buxton, Hasan Kurban

机构 * Department of Computer Science, Indiana University Bloomington, IN, USA(印第安纳大学布卢明顿分校计算机科学系) College of Science and Engineering, Hamad Bin Khalifa University, Doha, Qatar(哈马德·本·卡西姆大学科学与工程学院) Department of Computer Science, University of Illinois Springfield, IL, USA(伊利诺伊大学斯普林菲尔德分校计算机科学系)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22763 2025-07-01 q-fin.PM cs.LG q-fin.CP 57%

Can We Reliably Predict the Fed's Next Move? A Multi-Modal Approach to U.S. Monetary Policy Forecasting

Fiona Xiao Jingyi, Lili Liu

机构 * National University of Singapore(新加坡国立大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

Comments 9 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏