arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-05 至 2025-11-05 共收录 155 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 28 篇

2509.20410 2025-11-05 eess.AS cs.SD 50%

Phoenix-VAD: Streaming Semantic Endpoint Detection for Full-Duplex Speech Interaction

Weijie Wu, Wenhao Guan, Kaidi Wang, Peijie Chen, Zhuanling Zha, Junbo Li, Jun Fang, Lin Li, Qingyang Hong

机构 * School of Informatics, Xiamen University, China(厦门大学信息学院) School of Electronic Science and Engineering, Xiamen University, China(厦门大学电子科学与技术学院) DiDi Global Inc., Beijing, China(滴滴全球有限公司)

专题命中 效率与部署 :LLM(abstract)

Comments It requires internal PR approval

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02055 2025-11-05 cs.CR 50%

Private Map-Secure Reduce: Infrastructure for Efficient AI Data Markets

Sameer Wagh, Kenneth Stibler, Shubham Gupta, Lacey Strahm, Irina Bejan, Jiahao Chen, Dave Buckley, Ruchi Bhatia, Jack Bandy, Aayush Agarwal, Andrew Trask

专题命中 效率与部署 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 12 篇

2401.05914 2025-11-05 cs.CL cs.AI 88%

How Teachers Can Use Large Language Models and Bloom's Taxonomy to Create Educational Quizzes

Sabina Elkins, Ekaterina Kochmar, Jackie C. K. Cheung, Iulian Serban

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 8 pages, 8 figures. Accepted to the main track of the EAAI-24: The 14th Symposium on Educational Advances in Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01670 2025-11-05 cs.AI physics.chem-ph 88%

QCBench: Evaluating Large Language Models on Domain-Specific Quantitative Chemistry

Jiaqing Xie, Weida Wang, Ben Gao, Zhuo Yang, Haiyuan Wan, Shufei Zhang, Tianfan Fu, Yuqiang Li

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) Wuhan University(武汉大学) Xidian University(西安电子科技大学) Tsinghua University(清华大学) Nanjing University(南京大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments Revision at Journal of Chemical Information and Modeling

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02238 2025-11-05 cs.AI 85%

Deep Ideation: Designing LLM Agents to Generate Novel Research Ideas on Scientific Concept Network

Keyu Zhao, Weiquan Lin, Qirui Zheng, Fengli Xu, Yong Li

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Artificial Intelligence Academy, Xidian University(西安电子科技大学人工智能学院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 23 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02374 2025-11-05 cs.CL cs.AI 84%

AyurParam: A State-of-the-Art Bilingual Language Model for Ayurveda

Mohd Nauman, Sravan Gvm, Vijay Devane, Shyam Pawar, Viraj Thakur, Kundeshwar Pundalik, Piyush Sawarkar, Rohit Saluja, Maunendra Desarkar, Ganesh Ramakrishnan

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02451 2025-11-05 cs.CL 79%

Merging Continual Pretraining Models for Domain-Specialized LLMs: A Case Study in Finance

Kentaro Ueda, François Portet, Hirohiko Suwa, Keiichi Yasumoto

机构 * NARA Institute of Science and Technology(日本科学技术研究院)

专题命中 领域大模型 :pretraining(title);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01956 2025-11-05 cs.CY cs.AI 77%

Vibe Learning: Education in the age of AI

Marcos Florencio, Francielle Prieto

机构 * INTELI – Instituto de Tecnologia e Liderança(INTELI技术与领导力研究所) FGV - Fundação Getúlio Vargas(弗洛里奥·瓦格斯基金会)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26994 2025-11-05 cs.LG 77%

HADSF: Aspect Aware Semantic Control for Explainable Recommendation

Zheng Nie, Peijie Sun

机构 * National University of Singapore(新加坡国立大学) Nanjing University of Posts and Telecommunications(南京邮电大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted by WSDM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00985 2025-11-05 cs.DB cs.AI cs.CL 73%

ORANGE: An Online Reflection ANd GEneration framework with Domain Knowledge for Text-to-SQL

Yiwen Jiao, Tonghui Ren, Yuche Gao, Zhenying He, Yinan Jing, Kai Zhang, X. Sean Wang

机构 * Fudan University(复旦大学) Tencent Cloud(腾讯云) University of Cambridge(剑桥大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 16 pages, 4 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23104 2025-11-05 cs.CL cs.AI cs.IR 73%

Leveraging Hierarchical Organization for Medical Multi-document Summarization

Yi-Li Hsu, Katelyn X. Mei, Lucy Lu Wang

机构 * National Tsing Hua University(清华大学) University of Washington(华盛顿大学) Allen Institute for AI(人工智能研究院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09586 2025-11-05 cs.HC cs.AI cs.CL 73%

ValueCompass: A Framework for Measuring Contextual Value Alignment Between Human and LLMs

Hua Shen, Tiffany Knearem, Reshmi Ghosh, Yu-Ju Yang, Nicholas Clark, Tanushree Mitra, Yun Huang

机构 * NYU Shanghai(纽约大学上海校区) New York University(纽约大学) University of Washington(华盛顿大学) MBZUAI Microsoft(微软) UIUC(伊利诺伊大学香槟分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02428 2025-11-05 cs.HC 67%

Can Conversational AI Counsel for Change? A Theory-Driven Approach to Supporting Dietary Intentions in Ambivalent Individuals

Michelle Bak, Kexin Quan, Tre Tomaszewski, Jessie Chin

专题命中 领域大模型 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02181 2025-11-05 cs.IR 50%

KGBridge: Knowledge-Guided Prompt Learning for Non-overlapping Cross-Domain Recommendation

Yuhan Wang, Qing Xie, Zhifeng Bao, Mengzi Tang, Lin Li, Yongjian Liu

专题命中 领域大模型 :pretraining(abstract)

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 知识编辑与模型理解 12 篇

2510.27328 2025-11-05 cs.CL 88%

A Unified Representation Underlying the Judgment of Large Language Models

Yi-Long Lu, Jiajun Song, Wei Wang

机构 * State Key Laboratory of General Artificial Intelligence(人工智能通用技术国家重点实验室) BIGAI

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02089 2025-11-05 cs.LG cs.CL 84%

LLM Probing with Contrastive Eigenproblems: Improving Understanding and Applicability of CCS

Stefan F. Schouten, Peter Bloem

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted to the Mechanistic Interpretability Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02759 2025-11-05 cs.AI cs.SY eess.SY 83%

LLM-Supported Formal Knowledge Representation for Enhancing Control Engineering Content with an Interactive Semantic Layer

Julius Fiedler, Carsten Knoll, Klaus Röbenack

机构 * Institute of Control Theory, TU Dresden(控制理论研究所,德累斯顿技术大学) Chair of Fundamentals of Electrical Engineering, TU Dresden(电气工程基础教授,德累斯顿技术大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);language model(abstract);分类 cs.AI

Comments 4 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02795 2025-11-05 cs.LG cs.CL 79%

Can LLMs subtract numbers?

Mayank Jobanputra, Nils Philipp Walter, Maitrey Mehta, Blerta Veseli, Evan Parker Kelly Chapple, Yifan Wang, Sneha Chetani, Ellie Pavlick, Antonio Vergari, Vera Demberg

机构 * Saarland University(萨尔兰大学) CISPA Helmholtz Center for Information Security(CISPA海德堡中心 for 信息安全) University of Utah(犹他大学) Brown University(布朗大学) University of Edinburgh(爱丁堡大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

Comments Work-in-progress; MathNLP non-archival presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04306 2025-11-05 cs.LG cs.AI 79%

Improving Uncertainty Estimation through Semantically Diverse Language Generation

Lukas Aichberger, Kajetan Schweighofer, Mykyta Ielanskyi, Sepp Hochreiter

机构 * ELLIS Unit Linz and LIT AI Lab, Institute for Machine Learning, Johannes Kepler University Linz(林茨ELLIS单元和LIT AI实验室,机器学习研究所,林茨约瑟夫·胡纳克大学) NXAI GmbH(NXAI公司)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01892 2025-11-05 cs.LG cs.CL 79%

Retrieval-Augmented Multimodal Depression Detection

Ruibo Hou, Shiyu Teng, Jiaqing Liu, Shurong Chai, Yinhao Li, Lanfen Lin, Yen-Wei Chen

机构 * College of Information Science and Engineering, Ritsumeikan University(信息科学与工程学院,立命馆大学) College of Computer Science and Technology, Zhejiang University(计算机科学与技术学院,浙江大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted in IEEE EMBC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15090 2025-11-05 cs.CL cs.AI 79%

ExpertLens: Activation steering features are highly interpretable

Masha Fedzechkina, Eleonora Gualdoni, Sinead Williamson, Katherine Metcalf, Skyler Seto, Barry-John Theobald

机构 * Apple(苹果公司)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02022 2025-11-05 cs.LG cs.AI 73%

Shared Parameter Subspaces and Cross-Task Linearity in Emergently Misaligned Behavior

Daniel Aarao Reis Arturi, Eric Zhang, Andrew Ansah, Kevin Zhu, Ashwinee Panda, Aishwarya Balwani

机构 * McGill University(麦吉尔大学) McMaster University(麦马斯特大学) University of Alberta(阿尔伯塔大学) Algoverse AI Research(Algoverse AI研究) St. Jude Children’s Research Hospital(圣犹大儿童研究医院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02720 2025-11-05 cs.CV cs.AI 70%

LLEXICORP: End-user Explainability of Convolutional Neural Networks

Vojtěch Kůr, Adam Bajger, Adam Kukučka, Marek Hradil, Vít Musil, Tomáš Brázdil

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02243 2025-11-05 cs.AI 70%

When Modalities Conflict: How Unimodal Reasoning Uncertainty Governs Preference Dynamics in MLLMs

Zhuoran Zhang, Tengyue Wang, Xilin Gong, Yang Shi, Haotian Wang, Di Wang, Lijie Hu

机构 * Peking University(北京大学) Provable Responsible AI and Data Analytics (PRADA) Lab(可证明负责任的人工智能和数据分析实验室) King Abdullah University of Science and Technology(卡布斯大学) South China University of Technology(华南理工大学) Tsinghua University(清华大学) University of Georgia(佐治亚大学) MBZUAI(马克斯·普朗克人工智能研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21971 2025-11-05 cs.LG 68%

GRAM-DTI: adaptive multimodal representation learning for drug target interaction prediction

Feng Jiang, Amina Mollaysa, Hehuan Ma, Tommaso Mansi, Junzhou Huang, Mangal Prakash, Rui Liao

机构 * University of Texas at Arlington(德克萨斯理工大学) Johnson & Johnson Innovative Medicine(强生创新医学)

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG;large language model(journal_ref);language model(journal_ref)

Journal ref NeurIPS 2025 2nd Workshop on Multi-modal Foundation Models and Large Language Models for Life Sciences

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03093 2025-11-05 cs.LG 57%

From Flat to Hierarchical: Extracting Sparse Representations with Matching Pursuit

Valérie Costa, Thomas Fel, Ekdeep Singh Lubana, Bahareh Tolooshams, Demba Ba

机构 * EPFL(瑞士联邦理工学院) Kempner Institute, Harvard University(哈佛大学凯普纳研究所) CBS-NTT Program in Physics of Intelligence, Harvard University(哈佛大学物理智能CBSTNTT项目) Physics of Artificial Intelligence Group, NTT Research, Inc., Sunnyvale, CA, USA(NTT研究公司人工智能物理研究组) University of Alberta(阿尔伯塔大学) Alberta Machine Intelligence Institute (Amii)(阿尔伯塔人工智能研究所) SEAS, Harvard University(哈佛大学工程与应用科学学院)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 其他LLM 9 篇

2508.00032 2025-11-05 cs.MA 85%

Strategic Communication and Language Bias in Multi-Agent LLM Coordination

Alessio Buscemi, Daniele Proverbio, Alessandro Di Stefano, The Anh Han, German Castignani, Pietro Liò

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01100 2025-11-05 cs.CL cs.LG 84%

Repetitions are not all alike: distinct mechanisms sustain repetition in language models

Matéo Mahaut, Francesca Franzon

机构 * Universitat Pompeu Fabra(庞培法布拉大学)

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24655 2025-11-05 cs.LG q-bio.GN 79%

HyperHELM: Hyperbolic Hierarchy Encoding for mRNA Language Modeling

Max van Spengler, Artem Moskalev, Tommaso Mansi, Mangal Prakash, Rui Liao

机构 * Johnson & Johnson Innovative Medicine(强生创新医学) University of Amsterdam(阿姆斯特丹大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09013 2025-11-05 cs.CV 78%

Prompt to Restore, Restore to Prompt: Cyclic Prompting for Universal Adverse Weather Removal

Rongxin Liao, Feng Li, Yanyan Wei, Zenglin Shi, Le Zhang, Huihui Bai, Meng Wang

机构 * School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院) School of Information and Communication Engineering, University of Electronic Science and Technology of China(电子科技大学信息与通信工程学院) School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院)

专题命中 其他LLM :prompting(title);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏