arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-03 至 2025-10-03 共收录 222 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 53 篇

2510.01283 2025-10-03 cs.CL 70%

Evaluation Sheet for Deep Research: A Use Case for Academic Survey Writing

Israel Abebe Azime, Tadesse Destaw Belay, Atnafu Lambebo Tonja

机构 * Saarland University(萨尔兰大学) Instituto Politécnico Nacional(国家理工学院) MBZUAI

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21315 2025-10-03 cs.CL 70%

Charting the Landscape of African NLP: Mapping Progress and Shaping the Road Ahead

Jesujoba O. Alabi, Michael A. Hedderich, David Ifeoluwa Adelani, Dietrich Klakow

机构 * Saarland University, Saarland Informatics Campus(萨尔兰大学,萨尔兰信息学校区) LMU Munich and Munich Center for Machine Learning(慕尼黑大学及慕尼黑机器学习中心) Mila - Quebec AI Institute, McGill University & Canada CIFAR AI Chair(魁北克人工智能研究所,麦吉尔大学及加拿大 CIFAR 人工智能 chair)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12051 2025-10-03 cs.CL 70%

TLUE: A Tibetan Language Understanding Evaluation Benchmark

Fan Gao, Cheng Huang, Nyima Tashi, Xiangxiang Wang, Thupten Tsering, Ban Ma-bao, Renzeg Duojie, Gadeng Luosang, Rinchen Dongrub, Dorje Tashi, Hao Wang Xiao Feng, Yongbin Yu

机构 * University of Electronic Science and Technology of China(电子科技大学) Tibet University(西藏大学) University of Texas Southwestern Medical Center(德克萨斯西南医学中心) Southern Methodist University(南方 Methodist 大学) The State Key Laboratory of Tibetan Intelligence(藏语智能国家重点实验室) University of Connecticut(康涅狄格大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by EMNLP Main Conference (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02185 2025-10-03 cs.SE cs.CR cs.MA 67%

FalseCrashReducer: Mitigating False Positive Crashes in OSS-Fuzz-Gen Using Agentic AI

Paschal C. Amusuo, Dongge Liu, Ricardo Andres Calvo Mendez, Jonathan Metzman, Oliver Chang, James C. Davis

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01197 2025-10-03 cs.IR 67%

Are LLMs ready to help non-expert users to make charts of official statistics data?

Gadir Suleymanli, Alexander Rogiers, Lucas Lageweg, Jefrey Lijffijt

专题命中 评测与基准 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04584 2025-10-03 cs.HC 67%

SlideItRight: Using AI to Find Relevant Slides and Provide Feedback for Open-Ended Questions

Chloe Qianhui Zhao, Jie Cao, Eason Chen, Kenneth R. Koedinger, Jionghao Lin

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments 14 pages, to be published at the 26th International Conference on Artificial Intelligence in Education (AIED '25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14379 2025-10-03 eess.SY cs.SY 67%

On the Standard Performance Criteria for Applied Control Design: PID, MPC or Machine Learning Controller?

Pouria Sarhadi

专题命中 评测与基准 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01792 2025-10-03 cs.CL cs.AI cs.IR 62%

Comparison of Unsupervised Metrics for Evaluating Judicial Decision Extraction

Ivan Leonidovich Litvak, Anton Kostin, Fedor Lashkin, Tatiana Maksiyan, Sergey Lagutin

机构 * Moscow Center for Advanced Studies(莫斯科高级研究学院)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL、cs.AI

Comments 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01266 2025-10-03 cs.CL cs.AI 62%

OpenAI's GPT-OSS-20B Model and Safety Alignment Issues in a Low-Resource Language

Isa Inuwa-Dutse

机构 * University of Huddersfield(赫德菲尔德大学)

专题命中 评测与基准 :prompting(abstract);分类 cs.CL、cs.AI

Comments 6 pages, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24683 2025-10-03 cs.CL cs.AI 62%

Should I Share this Translation? Evaluating Quality Feedback for User Reliance on Machine Translation

Dayeon Ki, Kevin Duh, Marine Carpuat

机构 * University of Maryland(马里兰大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02187 2025-10-03 cs.SD cs.LG eess.AS 57%

High-Fidelity Speech Enhancement via Discrete Audio Tokens

Luca A. Lanzendörfer, Frédéric Berdoz, Antonis Asonitis, Roger Wattenhofer

机构 * ETH Zurich(苏黎世联邦理工学院)

专题命中 评测与基准 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01887 2025-10-03 q-fin.CP cs.AI 57%

FINCH: Financial Intelligence using Natural language for Contextualized SQL Handling

Avinash Kumar Singh, Bhaskarjit Sarmah, Stefano Pasquali

机构 * Domyn

专题命中 评测与基准 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01470 2025-10-03 cs.CY cs.CL 57%

Extracting O*NET Features from the NLx Corpus to Build Public Use Aggregate Labor Market Data

Stephen Meisenbacher, Svetlozar Nestorov, Peter Norlander

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

Comments 85 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01245 2025-10-03 cs.CL 57%

SeMob: Semantic Synthesis for Dynamic Urban Mobility Prediction

Runfei Chen, Shuyang Jiang, Wei Huang

机构 * Urban Mobility Institute, Tongji University, China(同济大学城市 mobility 院) College of Surveying and Geo-informatics, Tongji University, China(同济大学测绘地理信息学院) College of Computer Science and Artificial Intelligence, Fudan University, China(复旦大学计算机科学与人工智能学院) Department of Civil Engineering, Toronto Metropolitan University, Canada(多伦多 Metropolitan 大学土木工程系)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

Comments EMNLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05288 2025-10-03 cs.CV cs.AI cs.RO 57%

PlaceIt3D: Language-Guided Object Placement in Real 3D Scenes

Ahmed Abdelreheem, Filippo Aleotti, Jamie Watson, Zawar Qureshi, Abdelrahman Eldesokey, Peter Wonka, Gabriel Brostow, Sara Vicente, Guillermo Garcia-Hernando

机构 * Niantic Spatial KAUST(科威特科学与技术研究中心) UCL(伦敦大学学院)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

Comments ICCV 2025. Project page: https://nianticlabs.github.io/placeit3d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11835 2025-10-03 cs.LG cs.CV 57%

How Can Time Series Analysis Benefit From Multiple Modalities? A Survey and Outlook

Haoxin Liu, Harshavardhan Kamarthi, Zhiyuan Zhao, Shangqing Xu, Shiyu Wang, Qingsong Wen, Tom Hartvigsen, Fei Wang, B. Aditya Prakash

机构 * Georgia Institute of Technology(佐治亚理工学院) Bytedance Inc.(字节跳动公司) Squirrel AI, USA(squirrel AI 美国分公司) The University of Virginia(弗吉尼亚大学) Cornell University(康奈尔大学)

专题命中 评测与基准 :foundation model(abstract);分类 cs.LG

Comments Github Repo: https://github.com/AdityaLab/MM4TSA Updated to include papers accepted by IJCAI25, KDD25, ICML25, NeurIPS25 4 figures or tables, 19 pages, 251 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09780 2025-10-03 cs.AI 57%

AgentDAM: Privacy Leakage Evaluation for Autonomous Web Agents

Arman Zharmagambetov, Chuan Guo, Ivan Evtimov, Maya Pavlova, Ruslan Salakhutdinov, Kamalika Chaudhuri

机构 * FAIR at Meta(Meta 的公平性研究部门)

专题命中 评测与基准 :prompting(abstract);分类 cs.AI

Comments Accepted to NeurIPS 2025 (D&B track), project page: https://github.com/facebookresearch/ai-agent-privacy

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02178 2025-10-03 cs.RO cs.CV 50%

DisCo-Layout: Disentangling and Coordinating Semantic and Physical Refinement in a Multi-Agent Framework for 3D Indoor Layout Synthesis

Jialin Gao, Donghao Zhou, Mingjian Liang, Lihao Liu, Chi-Wing Fu, Xiaowei Hu, Pheng-Ann Heng

机构 * The Chinese University of Hong Kong(香港中文大学) Monash University(墨尔本大学) Amazon(亚马逊) South China University of Technology(华南理工大学)

专题命中 评测与基准 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02114 2025-10-03 cs.CV 50%

FRIEREN: Federated Learning with Vision-Language Regularization for Segmentation

Ding-Ruei Shen

机构 * Eindhoven University of Technology(埃因霍温理工大学) NXP Semiconductors(NXP半导体公司)

专题命中 评测与基准 :foundation model(abstract)

Comments Master Thesis

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 38 篇

2510.01863 2025-10-03 cs.NE cs.LG 89%

Microscaling Floating Point Formats for Large Language Models

Marco Cococcioni, Dario Pagani, Federico Rossi

机构 * University of Pisa, Department of Information Engineering(比萨大学信息工程学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01240 2025-10-03 cs.LG cs.CL 88%

RSAVQ: Riemannian Sensitivity-Aware Vector Quantization for Large Language Models

Zukang Xu, Xing Hu, Qiang Wu, Dawei Yang

机构 * Houmo AI

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17599 2025-10-03 cs.LG 88%

Dynamic Bundling with Large Language Models for Zero-Shot Inference on Text-Attributed Graphs

Yusheng Zhao, Qixin Zhang, Xiao Luo, Weizhi Zhang, Zhiping Xiao, Wei Ju, Philip S. Yu, Ming Zhang

机构 * Peking University(北京大学) Nanyang Technological University(南洋理工大学) University of Washington(华盛顿大学) University of California, Los Angeles(加州大学洛杉矶分校) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18379 2025-10-03 cs.IR 87%

REALM: Recursive Relevance Modeling for LLM-based Document Re-Ranking

Pinhuan Wang, Zhiqiu Xia, Chunhua Liao, Feiyi Wang, Hang Liu

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments EMNLP 2025 (Main Conference, Oral). 15 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01251 2025-10-03 cs.CL stat.ML 85%

Efficient Uncertainty Estimation for LLM-based Entity Linking in Tabular Data

Carlo Bono, Federico Belotti, Matteo Palmonari

机构 * Politecnico di Milano, DEIB(米兰理工学院信息工程学院) Università degli Studi di Milano Bicocca, DISCo(米兰大学比可卡分校信息科学学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01239 2025-10-03 cs.CL 85%

CIFLEX: Contextual Instruction Flow for Sub-task Execution in Multi-Turn Interactions with a Single On-Device LLM

Juntae Lee, Jihwan Bang, Seunghan Yang, Simyung Chang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments accepted at EMNLP 2025 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01234 2025-10-03 cs.CL 85%

LLMRank: Understanding LLM Strengths for Model Routing

Shubham Agrawal, Prasang Gupta

机构 * Zeno AI

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 13 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01370 2025-10-03 cs.CV cs.AI cs.LG physics.comp-ph 84%

SPUS: A Lightweight and Parameter-Efficient Foundation Model for PDEs

Abu Bucker Siddik, Diane Oyen, Alexander Most, Michal Kucer, Ayan Biswas

机构 * Computing and Artificial Intelligence Division (CAI)(计算与人工智能部门) Space Remote Sensing and Data Science(空间遥感与数据科学) Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室)

专题命中 效率与部署 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01394 2025-10-03 cs.LG cs.CL 82%

Optimal Stopping vs Best-of-$N$ for Inference Time Optimization

Yusuf Kalayci, Vinod Raman, Shaddin Dughmi

机构 * University of Southern California(南加州大学) University of Michigan(密歇根大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);RLHF(abstract)

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01645 2025-10-03 cs.CR cs.AI cs.CL cs.LG 80%

Position: Privacy Is Not Just Memorization!

Niloofar Mireshghallah, Tianshi Li

机构 * Carnegie Mellon University(卡内基梅隆大学) Northeastern University(东北大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 27 pages, 6 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02224 2025-10-03 cs.LG stat.ML 79%

Efficiently Generating Correlated Sample Paths from Multi-step Time Series Foundation Models

Ethan Baron, Boris Oreshkin, Ruijun Ma, Hanyu Zhang, Kari Torkkola, Michael W. Mahoney, Andrew Gordon Wilson, Tatiana Konstantinova

机构 * New York University(纽约大学) Amazon(亚马逊)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏