arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-22 至 2025-09-22 共收录 202 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 37 篇

2501.18592 2025-09-22 cs.CV cs.AI cs.LG cs.RO 81%

Advances in Multimodal Adaptation and Generalization: From Traditional Approaches to Foundation Models

Hao Dong, Moru Liu, Kaiyang Zhou, Eleni Chatzi, Juho Kannala, Cyrill Stachniss, Olga Fink

专题命中 评测与基准 :foundation model(title,abstract);分类 cs.AI、cs.LG

Comments Project page: https://github.com/donghao51/Awesome-Multimodal-Adaptation

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15258 2025-09-22 cs.LG cs.AI eess.SP 81%

Generative AI Meets Wireless Sensing: Towards Wireless Foundation Model

Zheng Yang, Guoxuan Chi, Chenshu Wu, Hanyu Liu, Yuchong Gao, Yunhao Liu, Jie Xu, Tony Xiao Han

机构 * Tsinghua University(清华大学) University of Hong Kong(香港大学) Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳)) Huawei Technology Co. Ltd.(华为技术有限公司)

专题命中 评测与基准 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18008 2025-09-22 cs.CL cs.NE 79%

Personalized Language Models via Privacy-Preserving Evolutionary Model Merging

Kyuyoung Kim, Jinwoo Shin, Jaehyung Kim

机构 * KAIST AI(韩国科学技术院人工智能研究所) Yonsei University(延世大学)

专题命中 评测与基准 :language model(title,abstract);分类 cs.CL

Comments EMNLP 2025 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09871 2025-09-22 cs.CL cs.AI 79%

Emulating Public Opinion: A Proof-of-Concept of AI-Generated Synthetic Survey Responses for the Chilean Case

Bastián González-Bustamante, Nando Verelst, Carla Cisternas

机构 * Universidad Diego Portales(迪亚戈·波特莱斯大学) Leiden University(莱顿大学)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Working paper: 18 pages, 4 tables, 2 figures

Journal ref Empiria Lab Method Series (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07188 2025-09-22 cs.CL cs.AI 79%

DischargeSim: A Simulation Benchmark for Educational Doctor-Patient Communication at Discharge

Zonghai Yao, Michael Sun, Won Seok Jang, Sunjae Kwon, Soie Kwon, Hong Yu

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Equal contribution for the first two authors. To appear in the proceedings of the Main Conference on Empirical Methods in Natural Language Processing (EMNLP) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15432 2025-09-22 cs.IR 78%

SERVAL: Surprisingly Effective Zero-Shot Visual Document Retrieval Powered by Large Vision and Language Models

Thong Nguyen, Yibin Lei, Jia-Huei Ju, Andrew Yates

专题命中 评测与基准 :language model(title,abstract)

Comments Accepted

Journal ref EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16232 2025-09-22 cs.CL 77%

MuseScorer: Idea Originality Scoring At Scale

Ali Sarosh Bangash, Krish Veera, Ishfat Abrar Islam, Raiyan Abdul Baten

机构 * Bellini College of Artificial Intelligence, Cybersecurity, and Computing, University of South Florida, USA(贝尔尼人工智能、网络安全与计算学院,佛罗里达州立大学)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11096 2025-09-22 cs.CR cs.AI 77%

SeCodePLT: A Unified Platform for Evaluating the Security of Code GenAI

Yuzhou Nie, Zhun Wang, Yu Yang, Ruizhe Jiang, Yuheng Tang, Xander Davies, Yarin Gal, Bo Li, Wenbo Guo, Dawn Song

机构 * UC Santa Barbara(加州大学圣巴巴拉分校) UC Berkeley(加州大学伯克利分校) VirtueAI UIUC(伊利诺伊大学香槟分校) UChicago(芝加哥大学) University of Oxford(牛津大学) UK AI Safety Institute(英国人工智能安全研究所)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted to NeurIPS D&B track 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15932 2025-09-22 cs.LG cs.AI cs.IT math.IT stat.ML 73%

The Alignment Bottleneck

Wenjun Cao

机构 * Independent Researcher(独立研究者)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06947 2025-09-22 cs.AR cs.AI cs.LG cs.PL 73%

PyraNet: A Multi-Layered Hierarchical Dataset for Verilog

Bardia Nadimi, Ghali Omar Boutaib, Hao Zheng

机构 * Dept. of Computer Science \& Eng. University of South Florida Tampa, Florida, United States

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04675 2025-09-22 cs.CL cs.AI cs.IR 73%

ConfReady: A RAG based Assistant and Dataset for Conference Checklist Responses

Michael Galarnyk, Rutwik Routu, Vidhyakshaya Kannan, Kosha Bheda, Prasun Banerjee, Agam Shah, Sudheer Chava

机构 * Georgia Institute of Technology(佐治亚理工学院) Duke University(杜克大学) Sai University(赛大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP 2025 Demo

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17093 2025-09-22 eess.AS cs.CL 70%

P2VA: Converting Persona Descriptions into Voice Attributes for Fair and Controllable Text-to-Speech

Yejin Lee, Jaehoon Kang, Kyuhong Shim

机构 * Department of Artificial Intelligence, Sungkyunkwan University, Korea(人工智能系,成均馆大学,韩国) Department of Computer Science and Engineering, Sungkyunkwan University, Korea(计算机科学与工程系,成均馆大学,韩国)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16781 2025-09-22 cs.CL 70%

Evaluating Robustness of LLMs in Question Answering on Multilingual Noisy OCR Data

Bhawna Piryani, Jamshid Mozafari, Abdelrahman Abdallah, Antoine Doucet, Adam Jatowt

机构 * University of Innsbruck(因斯布鲁克大学) University of La Rochelle(拉罗谢尔大学) University of Ljubljana(卢布尔雅那大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at CIKM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15366 2025-09-22 cs.AI 70%

Diagnostics of cognitive failures in multi-agent expert systems using dynamic evaluation protocols and subsequent mutation of the processing context

Andrejs Sorstkins, Josh Bailey, Dr Alistair Baron

机构 * School of Computing and Communications(计算与通讯学院) Lancaster University(兰卡斯特大学)

专题命中 评测与基准 :LLM(abstract);language model(abstract);分类 cs.AI

Comments Dissertation and research project created in collaboration with JobFair LTD

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16141 2025-09-22 cs.CV 67%

AcT2I: Evaluating and Improving Action Depiction in Text-to-Image Models

Vatsal Malaviya, Agneet Chatterjee, Maitreya Patel, Yezhou Yang, Chitta Baral

机构 * Arizona State University(亚利桑那州立大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments Project Page : https://vatsal-malaviya.github.io/AcT2I/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15221 2025-09-22 cs.CV 67%

ScaleCUA: Scaling Open-Source Computer Use Agents with Cross-Platform Data

Zhaoyang Liu, Jingjing Xie, Zichen Ding, Zehao Li, Bowen Yang, Zhenyu Wu, Xuehui Wang, Qiushi Sun, Shi Liu, Weiyun Wang, Shenglong Ye, Qingyun Li, Xuan Dong, Yue Yu, Chenyu Lu, YunXiang Mo, Yao Yan, Zeyue Tian, Xiao Zhang, Yuan Huang, Yiqian Liu, Weijie Su, Gen Luo, Xiangyu Yue, Biqing Qi, Kai Chen, Bowen Zhou, Yu Qiao, Qifeng Chen, Wenhai Wang

专题命中 评测与基准 :language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15690 2025-09-22 cs.AI 57%

CCrepairBench: A High-Fidelity Benchmark and Reinforcement Learning Framework for C++ Compilation Repair

Weixuan Sun, Jucai Zhai, Dengfeng Liu, Xin Zhang, Xiaojun Wu, Qiaobo Hao, AIMgroup, Yang Fang, Jiuyang Tang

机构 * Weixuan Sun 1,2(某机构) Jucai Zhai 1(某机构) Xin Zhang 1, 3(某机构) Dengfeng Liu 1(某机构) Xiaojun Wu 1(某机构) Qiaobo Hao 1(某机构) AIMgroup 1(AIM集团) Yang Fang 2(某机构) Jiuyang Tang 2(某机构)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05115 2025-09-22 cs.HC cs.AI 57%

"It Felt Like I Was Left in the Dark": Exploring Information Needs and Design Opportunities for Family Caregivers of Older Adult Patients in Critical Care Settings

Shihan Fu, Bingsheng Yao, Smit Desai, Yuqi Hu, Yuling Sun, Samantha Stonbraker, Yanjun Gao, Elizabeth M. Goldberg, Dakuo Wang

机构 * Northeastern University(东北大学) University of Michigan(密歇根大学) University of Colorado College of Nursing(科罗拉多大学护理学院) University of Colorado Anschutz Medical Campus(科罗拉多大学安舒茨医疗校区)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15233 2025-09-22 cs.MM cs.CL cs.CV 57%

Video2Roleplay: A Multimodal Dataset and Framework for Video-Guided Role-playing Agents

Xueqiao Zhang, Chao Zhang, Jingtao Xu, Yifan Zhu, Xin Shi, Yi Yang, Yawei Luo

机构 * Zhejiang University(浙江大学)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

Comments Accepted at EMNLP2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15971 2025-09-22 cs.SE 50%

LeakageDetector 2.0: Analyzing Data Leakage in Jupyter-Driven Machine Learning Pipelines

Owen Truong, Terrence Zhang, Arnav Marchareddy, Ryan Lee, Jeffery Busold, Michael Socas, Eman Abdullah AlOmar

专题命中 评测与基准 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15567 2025-09-22 cs.SE 50%

Brevity is the Soul of Wit: Condensing Code Changes to Improve Commit Message Generation

Hongyu Kuang, Ning Zhang, Hui Gao, Xin Zhou, Wesley K. G. Assunção, Xiaoxing Ma, Dong Shao, Guoping Rong, He Zhang

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15496 2025-09-22 cs.CV 50%

Lynx: Towards High-Fidelity Personalized Video Generation

Shen Sang, Tiancheng Zhi, Tianpei Gu, Jing Liu, Linjie Luo

机构 * ByteDance(字节跳动)

专题命中 评测与基准 :foundation model(abstract)

Comments Lynx Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00743 2025-09-22 cs.CV 50%

Quality-Driven Curation of Remote Sensing Vision-Language Data via Learned Scoring Models

Dilxat Muhtar, Enzhuo Zhang, Zhenshi Li, Feng Gu, Yanglangxing He, Pengfeng Xiao, Xueliang Zhang

机构 * Nanjing University(南京大学)

专题命中 评测与基准 :language model(abstract)

Comments 39 pages, 13 figures. Accept for NeruIPS2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01437 2025-09-22 cs.CV cs.GR 50%

Img2CAD: Reverse Engineering 3D CAD Models from Images through VLM-Assisted Conditional Factorization

Yang You, Mikaela Angelina Uy, Jiaqi Han, Rahul Thomas, Haotong Zhang, Yi Du, Hansheng Chen, Francis Engelmann, Suya You, Leonidas Guibas

机构 * Stanford University(斯坦福大学) NVIDIA(英伟达) Peking University(北京大学) DEVCOM Army Research Laboratory(陆军研究实验室)

专题命中 评测与基准 :foundation model(abstract)

Comments Accepted to SIGGRAPH Asia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 35 篇

2509.07485 2025-09-22 cs.IR 89%

Multi-view-guided Passage Reranking with Large Language Models

Jeongwoo Na, Jun Kwon, Eunseong Choi, Jongwuk Lee

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13452 2025-09-22 cs.PL 89%

Large Language Model Powered Symbolic Execution

Yihe Li, Ruijie Meng, Gregory J. Duck

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 29 pages, 6 figures, 7 tables, published in "Object-Oriented Programming, Systems, Languages & Applications" (OOPSLA), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15361 2025-09-22 cs.CL cs.AI cs.MM 88%

Beyond Spurious Signals: Debiasing Multimodal Large Language Models via Counterfactual Inference and Adaptive Expert Routing

Zichen Wu, Hsiu-Yuan Huang, Yunfang Wu

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) MOE Key Laboratory of Computational Linguistics, Peking University(北京大学教育部计算语言学重点实验室) National Key Laboratory for Multimedia Information Processing, Peking University(北京大学国家多媒体信息处理重点实验室)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07820 2025-09-22 cs.CL cs.IR 88%

Query Optimization for Parametric Knowledge Refinement in Retrieval-Augmented Large Language Models

Youan Cong, Pritom Saha Akash, Cheng Wang, Kevin Chen-Chuan Chang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15518 2025-09-22 cs.CL cs.AI cs.LG 87%

How do Language Models Generate Slang: A Systematic Comparison between Human and Machine-Generated Slang Usages

Siyang Wu, Zhewei Sun

机构 * Data Science Institute University of Chicago(芝加哥大学数据科学研究所) Toyota Technological Institute at Chicago(芝加哥丰田技术研究所)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07824 2025-09-22 cs.CL cs.AI cs.LG 87%

Efficient Real-time Refinement of Language Model Text Generation

Joonho Ko, Jinheon Baek, Sung Ju Hwang

机构 * KAIST(韩国科学技术院)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏