arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7565 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7565 篇

2407.11243 2025-05-12 cs.CV 67%

Representation Learning and Identity Adversarial Training for Facial Behavior Understanding

Mang Ning, Albert Ali Salah, Itir Onal Ertugrul

机构 * Utrecht University(乌得勒支大学)

专题命中 知识编辑与模型理解 :foundation model(abstract);pretraining(abstract)

Comments FG 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04410 2025-05-08 cs.CV 67%

DeCLIP: Decoupled Learning for Open-Vocabulary Dense Perception

Junjie Wang, Bin Chen, Yulin Li, Bin Kang, Yichi Chen, Zhuotao Tian

机构 * School of Computer Science and Technology, HIT, Shenzhen(哈尔滨工业大学深圳校区计算机科学与技术学院) International Research Institute for Artificial Intelligence, HIT, Shenzhen(哈尔滨工业大学深圳国际人工智能研究院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 知识编辑与模型理解 :language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01238 2025-05-05 cs.CL cs.AI cs.LG 67%

EvalxNLP: A Framework for Benchmarking Post-Hoc Explainability Methods on NLP Models

Mahdi Dhaini, Kafaite Zahra Hussain, Efstratios Zaradoukas, Gjergji Kasneci

机构 * Technical University of Munich, School of Computation, Information and Technology, Department of Computer Science(慕尼黑技术大学,计算信息学院,计算机科学系)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to the xAI World Conference (2025) - System Demonstration

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01198 2025-05-05 cs.CL cs.AI cs.LG 67%

Gender Bias in Explainability: Investigating Performance Disparity in Post-hoc Methods

Mahdi Dhaini, Ege Erdogan, Nils Feldhus, Gjergji Kasneci

机构 * Technical University of Munich(慕尼黑技术大学) School of Computation, Information and Technology(计算、信息与技术学院) Department of Computer Science(计算机科学系) Technische Universität Berlin(柏林技术大学) BIFOLD – Berlin Institute for the Foundations of Learning and Data(柏林学习与数据基础研究所) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to ACM Conference on Fairness, Accountability, and Transparency (FAccT) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21282 2025-05-01 cs.DB 67%

Birdie: Natural Language-Driven Table Discovery Using Differentiable Search Index

Yuxiang Guo, Zhonghao Hu, Yuren Mao, Baihua Zheng, Yunjun Gao, Mingwei Zhou

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments Accepted by VLDB 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03118 2025-05-01 cs.HC cs.CV 67%

ObjectFinder: An Open-Vocabulary Assistive System for Interactive Object Search by Blind People

Ruiping Liu, Jiaming Zhang, Angela Schön, Karin Müller, Junwei Zheng, Kailun Yang, Anhong Guo, Kathrin Gerling, Rainer Stiefelhagen

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18866 2025-04-29 cs.CV 67%

PiercingEye: Dual-Space Video Violence Detection with Hyperbolic Vision-Language Guidance

Jiaxu Leng, Zhanjie Wu, Mingpi Tan, Mengjingcheng Mo, Jiankang Zheng, Qingqing Li, Ji Gan, Xinbo Gao

机构 * Key Laboratory of Image Cognition, Chongqing University of Posts and Telecommunications(重庆邮电大学图像认知重点实验室) Guangyang Bay Laboratory, Chongqing Institute for Brain and Intelligence(重庆脑科学与智能技术研究院广阳湾实验室)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments Submitted to IEEE Transactions on Pattern Analysis and Machine Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18151 2025-04-28 cs.IR 67%

Leveraging Decoder Architectures for Learned Sparse Retrieval

Jingfen Qiao, Thong Nguyen, Evangelos Kanoulas, Andrew Yates

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14554 2025-04-22 cs.CR cs.CV 67%

REDEditing: Relationship-Driven Precise Backdoor Poisoning on Text-to-Image Diffusion Models

Chongye Guo, Jinhu Fu, Junfeng Fang, Kun Wang, Guorui Feng

机构 * Shanghai University(上海大学) Beijing University of Posts and Telecommunications(北京邮电大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11723 2025-04-17 cs.HC cs.CY 67%

Probing the Unknown: Exploring Student Interactions with Probeable Problems at Scale in Introductory Programming

Paul Denny, Viraj Kumar, Stephen MacNeil, James Prather, Juho Leinonen

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments Accepted at ITiCSE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09207 2025-04-15 cs.DB cs.IR 67%

Pneuma: Leveraging LLMs for Tabular Data Representation and Retrieval in an End-to-End System

Muhammad Imam Luthfi Balaka, David Alexander, Qiming Wang, Yue Gong, Adila Krisnadhi, Raul Castro Fernandez

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments SIGMOD 2025 Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15166 2025-04-15 cs.CV cs.AI cs.CL cs.LG cs.MM 67%

Machine Unlearning in Hyperbolic vs. Euclidean Multimodal Contrastive Learning: Adapting Alignment Calibration to MERU

Àlex Pujol Vidal, Sergio Escalera, Kamal Nasrollahi, Thomas B. Moeslund

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06153 2025-04-09 cs.CV 67%

A Large-Scale Analysis on Contextual Self-Supervised Video Representation Learning

Akash Kumar, Ashlesha Kumar, Vibhav Vineet, Yogesh S Rawat

专题命中 知识编辑与模型理解 :foundation model(abstract);pretraining(abstract)

Comments CVPR'25 Workshop: 6th Data-Efficient Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23105 2025-04-01 cs.CV 67%

Open-Vocabulary Semantic Segmentation with Uncertainty Alignment for Robotic Scene Understanding in Indoor Building Environments

Yifan Xu, Vineet Kamat, Carol Menassa

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments 32 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16707 2025-03-31 cs.CV 67%

Cross-Modal and Uncertainty-Aware Agglomeration for Open-Vocabulary 3D Scene Understanding

Jinlong Li, Cristiano Saltori, Fabio Poiesi, Nicu Sebe

专题命中 知识编辑与模型理解 :language model(abstract);foundation model(abstract)

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20823 2025-03-28 cs.CR 67%

Playing the Fool: Jailbreaking LLMs and Multimodal LLMs with Out-of-Distribution Strategy

Joonhyun Jeong, Seyun Bae, Yeonsung Jung, Jaeryong Hwang, Eunho Yang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments Accepted at CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06215 2025-03-14 cs.CL cs.AI cs.LG 67%

DataEnvGym: Data Generation Agents in Teacher Environments with Student Feedback

Zaid Khan, Elias Stengel-Eskin, Jaemin Cho, Mohit Bansal

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2025 Spotlight; Project Page: https://DataEnvGym.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08342 2025-03-13 cs.CV 67%

Attention Reallocation: Towards Zero-cost and Controllable Hallucination Mitigation of MLLMs

Chongjun Tu, Peng Ye, Dongzhan Zhou, Lei Bai, Gang Yu, Tao Chen, Wanli Ouyang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06149 2025-03-11 cs.IT eess.SP math.IT 67%

Wireless Hallucination in Generative AI-enabled Communications: Concepts, Issues, and Solutions

Xudong Wang, Jiacheng Wang, Lei Feng, Dusit Niyato, Ruichen Zhang, Jiawen Kang, Zehui Xiong, Hongyang Du, Shiwen Mao

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05318 2025-03-10 cs.CL cs.AI cs.LG 67%

Uncertainty-Aware Decoding with Minimum Bayes Risk

Nico Daheim, Clara Meister, Thomas Möllenhoff, Iryna Gurevych

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2025 (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02601 2025-03-07 cs.CY 67%

ChatGPT vs Social Surveys: Probing Objective and Subjective Silicon Population

Muzhi Zhou, Lu Yu, Xiaomin Geng, Lan Luo

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00986 2025-03-04 cs.CV 67%

Modeling Fine-Grained Hand-Object Dynamics for Egocentric Video Representation Learning

Baoqi Pei, Yifei Huang, Jilan Xu, Guo Chen, Yuping He, Lijin Yang, Yali Wang, Weidi Xie, Yu Qiao, Fei Wu, Limin Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments Accepted as ICLR 2025 conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18654 2025-03-03 cs.CV 67%

Mitigating Object Hallucination in MLLMs via Data-augmented Phrase-level Alignment

Pritam Sarkar, Sayna Ebrahimi, Ali Etemad, Ahmad Beirami, Sercan Ö. Arık, Tomas Pfister

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments Published in ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19164 2025-02-24 cs.CV 67%

Poison as Cure: Visual Noise for Mitigating Object Hallucinations in LVMs

Kejia Zhang, Keda Tao, Jiasheng Tang, Huan Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10008 2025-02-17 econ.GN q-fin.EC 67%

ChatGPT and Deepseek: Can They Predict the Stock Market and Macroeconomy?

Jian Chen, Guohao Tang, Guofu Zhou, Wu Zhu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00862 2025-02-14 cs.HC 67%

User-Driven Value Alignment: Understanding Users' Perceptions and Strategies for Addressing Biased and Discriminatory Statements in AI Companions

Xianzhe Fan, Qing Xiao, Xuhui Zhou, Jiaxin Pei, Maarten Sap, Zhicong Lu, Hong Shen

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments 19 pages, 1 figure, Accepted by CHI '25

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06251 2025-02-11 cs.HC 67%

Amplifying Minority Voices: AI-Mediated Devil's Advocate System for Inclusive Group Decision-Making

Soohwan Lee, Mingyu Kim, Seoyeong Hwang, Dajung Kim, Kyungho Lee

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments 10 pages, 3 figures. This is a preprint version of the poster accepted to ACM Conference on Intelligent User Interfaces(IUI'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14924 2025-02-10 cs.CV 67%

DiPEx: Dispersing Prompt Expansion for Class-Agnostic Object Detection

Jia Syuen Lim, Zhuoxiao Chen, Mahsa Baktashmotlagh, Zhi Chen, Xin Yu, Zi Huang, Yadan Luo

专题命中 知识编辑与模型理解 :language model(abstract);prompting(abstract)

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12643 2025-02-05 cs.LG cs.AI cs.CL 67%

DLBacktrace: A Model Agnostic Explainability for any Deep Learning Models

Vinay Kumar Sankarapu, Chintan Chitroda, Yashwardhan Rathore, Neeraj Kumar Singh, Pratinav Seth

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12702 2025-01-23 cs.PL 67%

Paradigm-Based Automatic HDL Code Generation Using LLMs

Wenhao Sun, Bing Li, Grace Li Zhang, Xunzhao Yin, Cheng Zhuo, Ulf Schlichtmann

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

Comments accepted by ISQED2025. arXiv admin note: text overlap with arXiv:2407.18326

详情

展开后加载摘要…

URL PDF HTML 收藏