arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-29 至 2025-08-29 共收录 117 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 27 篇

2506.07249 2025-08-29 cs.CL 79%

Bias Attribution in Filipino Language Models: Extending a Bias Interpretability Metric for Application on Agglutinative Languages

Lance Calvin Lim Gamboa, Yue Feng, Mark Lee

机构 * School of Computer Science, University of Birmingham(英国伯明翰大学计算机科学学院) Department of Information Systems and Computer Science, Ateneo de Manila University(马尼拉大学信息系统与计算机科学系)

专题命中 评测与基准 :language model(title,abstract);分类 cs.CL

Comments Accepted into the Gender Bias in NLP Workshop at ACL 2025 (GeBNLP@ACL2025)

Journal ref https://aclanthology.org/2025.gebnlp-1.19/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20813 2025-08-29 cs.CV 78%

Adapting Foundation Model for Dental Caries Detection with Dual-View Co-Training

Tao Luo, Han Wu, Tong Yang, Dinggang Shen, Zhiming Cui

机构 * School of Biomedical Engineering \& State Key Laboratory of Advanced Medical Materials Devices, ShanghaiTech University, Shanghai, China Lingang Laboratory, Shanghai, China Shanghai United Imaging Intelligence Co. Ltd., Shanghai, China Shanghai Clinical Research Trial Center, Shanghai, China Shanghai Linkedcare Information Technology Co., Ltd., Shanghai, China

专题命中 评测与基准 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20707 2025-08-29 cs.CE 78%

Can News Predict the Direction of Oil Price Volatility? A Language Model Approach with SHAP Explanations

Romina Hashami, Felipe Maldonado

专题命中 评测与基准 :language model(title,abstract)

Comments 9 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20973 2025-08-29 cs.CL cs.AI cs.HC 73%

ProactiveEval: A Unified Evaluation Framework for Proactive Dialogue Agents

Tianjian Liu, Fanqi Wan, Jiajian Guo, Xiaojun Quan

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 21 pages, 6 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17232 2025-08-29 cs.MM cs.AI cs.CL 73%

A Highly Clean Recipe Dataset with Ingredient States Annotation for State Probing Task

Mashiro Toyooka, Kiyoharu Aizawa, Yoko Yamakata

机构 * The University of Tokyo(东京大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACM Multimedia 2025. The dataset are publicly available at: https://huggingface.co/datasets/mashi6n/nhkrecipe-100-anno-1

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08952 2025-08-29 cs.CL cs.AI 73%

Detect, Investigate, Judge and Determine: A Knowledge-guided Framework for Few-shot Fake News Detection

Ye Liu, Jiajun Zhu, Xukai Liu, Haoyu Tang, Yanghai Zhang, Kai Zhang, Xiaofang Zhou, Enhong Chen

机构 * University of Science and Technology of China(中国科学技术大学) State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20816 2025-08-29 cs.CR cs.AI 70%

Multi-Agent Penetration Testing AI for the Web

Isaac David, Arthur Gervais

机构 * University College London(伦敦大学学院)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07999 2025-08-29 cs.CL 70%

WideSearch: Benchmarking Agentic Broad Info-Seeking

Ryan Wong, Jiawei Wang, Junjie Zhao, Li Chen, Yan Gao, Long Zhang, Xuan Zhou, Zuo Wang, Kai Xiang, Ge Zhang, Wenhao Huang, Yang Wang, Ke Wang

机构 * ByteDance Seed(字节跳动种子)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18076 2025-08-29 cs.CL 70%

Neither Valid nor Reliable? Investigating the Use of LLMs as Judges

Khaoula Chehbouni, Mohammed Haddou, Jackie Chi Kit Cheung, Golnoosh Farnadi

机构 * McGill University(麦吉尔大学) Mila - Quebec AI Institute(魁北克AI研究所) Statistics Canada(加拿大统计局)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Prepared for conference submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20660 2025-08-29 eess.AS cs.SD 67%

CodecBench: A Comprehensive Benchmark for Acoustic and Semantic Evaluation

Ruifan Deng, Yitian Gong, Qinghui Gao, Luozhijie Jin, Qinyuan Cheng, Zhaoye Fei, Shimin Li, Xipeng Qiu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20736 2025-08-29 cs.CL 57%

Leveraging Semantic Triples for Private Document Generation with Local Differential Privacy Guarantees

Stephen Meisenbacher, Maulik Chevli, Florian Matthes

机构 * Technical University of Munich School of Computation, Information and Technology Department of Computer Science(慕尼黑技术大学计算、信息与技术学院计算机科学系)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

Comments 17 pages, 2 figures, 11 tables. Accepted to EMNLP 2025 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10175 2025-08-29 cs.CL 57%

Estimating Machine Translation Difficulty

Lorenzo Proietti, Stefano Perrella, Vilém Zouhar, Roberto Navigli, Tom Kocmi

机构 * Sapienza NLP Group, Sapienza University of Rome(Sapienza 大学自然语言处理小组,Sapienza 罗马大学) ETH Zurich(苏黎世联邦理工学院) Cohere

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20530 2025-08-29 cs.CV 50%

Enhancing Pseudo-Boxes via Data-Level LiDAR-Camera Fusion for Unsupervised 3D Object Detection

Mingqian Ji, Jian Yang, Shanshan Zhang

机构 * PCA Lab, School of Computer Science and Engineering, Nanjing University of Science and Technology(PCA实验室,计算机科学与工程学院,南京理工大学)

专题命中 评测与基准 :foundation model(abstract)

Comments Accepted by ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14511 2025-08-29 cs.SE 50%

What You See Is What It Does: A Structural Pattern for Legible Software

Eagon Meng, Daniel Jackson

专题命中 评测与基准 :LLM(abstract)

Comments 16 pages. Appearing in Onward! at SPLASH 2025; added DOI, updated references/formatting

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00626 2025-08-29 cs.CV 50%

ZIM: Zero-Shot Image Matting for Anything

Beomyoung Kim, Chanyong Shin, Joonhyun Jeong, Hyungsik Jung, Se-Yun Lee, Sewhan Chun, Dong-Hyun Hwang, Joonsang Yu

机构 * NAVER Cloud, ImageVision(NAVER云,ImageVision)

专题命中 评测与基准 :foundation model(abstract)

Comments ICCV 2025 (Highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 17 篇

2508.20828 2025-08-29 cs.CL cs.IR 89%

GDLLM: A Global Distance-aware Modeling Approach Based on Large Language Models for Event Temporal Relation Extraction

Jie Zhao, Wanting Ning, Yuxiao Fei, Yubo Feng, Lishuang Li

机构 * School of Computer Science and Technology, Dalian University of Technology, China(大连理工大学计算机科学与技术学院) Luddy School of Informatics, Computing, and Engineering, Indiana University Indianapolis, the United States(印第安纳大学印第安纳波利斯分校信息学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);small language model(abstract);分类 cs.CL

Comments Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing (EMNLP Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20718 2025-08-29 cs.CL 88%

Addressing Tokenization Inconsistency in Steganography and Watermarking Based on Large Language Models

Ruiyi Yan, Yugo Murawaki

机构 * Graduate School of Informatics, Kyoto University(京都大学信息学研究科)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20122 2025-08-29 cs.NE cs.ET cs.LG 88%

Spatio-Temporal Pruning for Compressed Spiking Large Language Models

Yi Jiang, Malyaban Bal, Brian Matejek, Susmit Jha, Adam Cobb, Abhronil Sengupta

机构 * School of Electrical Engineering and Computer Science(电气工程与计算机科学学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17513 2025-08-29 cs.LG cs.AI cs.AR 88%

Improving Quantization with Post-Training Model Expansion

Giuseppe Franco, Pablo Monteagudo-Lago, Ian Colbert, Nicholas Fraser, Michaela Blott

机构 * AMD

专题命中 效率与部署 :post-training(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20737 2025-08-29 cs.SE cs.AI 85%

Rethinking Testing for LLM Applications: Characteristics, Challenges, and a Lightweight Interaction Protocol

Wei Ma, Yixiao Yang, Qiang Hu, Shi Ying, Zhi Jin, Bo Du, Zhenchang Xing, Tianlin Li, Junjie Shi, Yang Liu, Linxiao Jiang

机构 * Singapore Management University Singapore Capital Normal University Beijing China Tianjin University Tianjin China Wuhan University China CSIRO's Data61 \& Australian National University Australia Nanyang Technological University Singapore Singapore Management University Capital Normal University Tianjin University Wuhan University CSIRO's Data61 \& Australian National University Nanyang Technological University

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21016 2025-08-29 cs.LG cs.AI 79%

Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance

Luozhijie Jin, Zijie Qiu, Jie Liu, Zijie Diao, Lifeng Qiao, Ning Ding, Alex Lamb, Xipeng Qiu

专题命中 效率与部署 :large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20274 2025-08-29 cs.DC 78%

Predictable LLM Serving on GPU Clusters

Erfan Darzi, Shreeanant Bharadwaj, Sree Bhargavi Balija

专题命中 效率与部署 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19320 2025-08-29 cs.CV cs.AI 77%

MIDAS: Multimodal Interactive Digital-humAn Synthesis via Real-time Autoregressive Video Generation

Ming Chen, Liyuan Cui, Wenyuan Zhang, Haoxian Zhang, Yan Zhou, Xiaohan Li, Songlin Tang, Jiwen Liu, Borui Liao, Hejia Chen, Xiaoqiang Liu, Pengfei Wan

机构 * Kling Team, Kuaishou Technology(快手科技 Kling 团队) Zhejiang University(浙江大学) Tsinghua University(清华大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Technical Report. Project Page: https://chenmingthu.github.io/milm/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16201 2025-08-29 cs.CV cs.AI cs.CL 73%

SpecVLM: Enhancing Speculative Decoding of Video LLMs via Verifier-Guided Token Pruning

Yicheng Ji, Jun Zhang, Heming Xia, Jinpeng Chen, Lidan Shou, Gang Chen, Huan Li

机构 * The State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院) Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系) School of Computer Science, Beijing University of Posts and Telecommunications(北京邮电大学计算机学院)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11752 2025-08-29 cs.CL 70%

DART: Distilling Autoregressive Reasoning to Silent Thought

Nan Jiang, Ziming Wu, De-Chuan Zhan, Fuming Lai, Shaobing Lian

机构 * Nanjing University(南京大学) Tencent Inc.(腾讯公司)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20124 2025-08-29 cs.SE cs.AI 70%

Towards Better Correctness and Efficiency in Code Generation

Yunlong Feng, Yang Xu, Xiao Xu, Binyuan Hui, Junyang Lin

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21044 2025-08-29 cs.CV 67%

MMG-Vid: Maximizing Marginal Gains at Segment-level and Token-level for Efficient Video LLMs

Junpeng Ma, Qizhe Zhang, Ming Lu, Zhibin Wang, Qiang Zhou, Jun Song, Shanghang Zhang

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20965 2025-08-29 cs.CV 67%

DrivingGaussian++: Towards Realistic Reconstruction and Editable Simulation for Surrounding Dynamic Driving Scenes

Yajiao Xiong, Xiaoyu Zhou, Yongtao Wan, Deqing Sun, Ming-Hsuan Yang

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王炫计算机技术研究所) Google DeepMind(谷歌DeepMind) University of California, Merced(加州大学默塞德分校)

专题命中 效率与部署 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20899 2025-08-29 cs.RO 67%

Language-Enhanced Mobile Manipulation for Efficient Object Search in Indoor Environments

Liding Zhang, Zeqi Li, Kuanqi Cai, Qian Huang, Zhenshan Bing, Alois Knoll

机构 * School of Computation, Information and Technology (CIT), Technical University of Munich(计算、信息与技术学院(CIT),慕尼黑技术大学) State Key Laboratory for Novel Software Technology and the School of Science and Technology, Nanjing University (Suzhou Campus)(新型软件技术国家重点实验室和南京大学科学技术学院(苏州校区))

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Journal ref 2025 IEEE International Conference on Cyborg and Bionic Systems (CBS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20557 2025-08-29 cs.CL cs.AI 62%

Adaptive Federated Distillation for Multi-Domain Non-IID Textual Data

Jiahao Xiao, Jiangming Liu

机构 * School of Information Science and Engineering, Yunnan University, China(信息科学与工程学院,云南大学,中国) Yunnan Key Laboratory of Intelligent Systems(云南智能系统重点实验室)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏