arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-01 至 2025-08-01 共收录 132 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 27 篇

2507.22927 2025-08-01 cs.CL 77%

PRGB Benchmark: A Robust Placeholder-Assisted Algorithm for Benchmarking Retrieval-Augmented Generation

Zhehao Tan, Yihan Jiao, Dan Yang, Lei Liu, Jie Feng, Duolin Sun, Yue Shen, Jian Wang, Peng Wei, Jinjie Gu

机构 * Zhehao Tan(未知) Yihan Jiao(未知) Dan Yang(未知) Lei Liu(未知) Jie Feng(未知) Duolin Sun(未知) Yue Shen(未知) Jian Wang(未知) Peng Wei(未知) Jinjie Gu(未知)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22938 2025-08-01 cs.CL cs.AI 76%

A Graph-based Approach for Multi-Modal Question Answering from Flowcharts in Telecom Documents

Sumit Soman, H. G. Ranjani, Sujoy Roychowdhury, Venkata Dharma Surya Narayana Sastry, Akshat Jain, Pranav Gangrade, Ayaaz Khan

机构 * Ericsson R&D Bangalore Karnataka India(爱立信研发部班加罗尔卡纳塔克邦印度)

专题命中 评测与基准 :large language model(abstract,comments);language model(abstract,comments);分类 cs.CL、cs.AI

Comments Accepted for publication at the KDD 2025 Workshop on Structured Knowledge for Large Language Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19219 2025-08-01 cs.AI cs.LG cs.MA math.CO 73%

Where Paths Collide: A Comprehensive Survey of Classic and Learning-Based Multi-Agent Pathfinding

Shiyue Wang, Haozheng Xu, Yuhan Zhang, Jingran Lin, Changhong Lu, Xiangfeng Wang, Wenhao Li

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 112 pages, 21 figures, 20 tables. The project website is: https://wangsh1yue.github.io/Where-Paths-Collide

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22917 2025-08-01 cs.CL cs.AI cs.IR 73%

Reading Between the Timelines: RAG for Answering Diachronic Questions

Kwun Hang Lau, Ruiyuan Zhang, Weijie Shi, Xiaofang Zhou, Xiaojun Cheng

机构 * Hong Kong University of Science and Technology(香港科技大学) China Unicom (Hong Kong) Operation Ltd(中国移动(香港)运营有限公司)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23400 2025-08-01 cs.CL cs.IR 70%

MRGSEM-Sum: An Unsupervised Multi-document Summarization Framework based on Multi-Relational Graphs and Structural Entropy Minimization

Yongbing Zhang, Fang Nan, Shengxiang Gao, Yuxin Huang, Kaiwen Tan, Zhengtao Yu

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23319 2025-08-01 cs.CL 70%

What's Taboo for You? - An Empirical Evaluation of LLMs Behavior Toward Sensitive Content

Alfio Ferrara, Sergio Picascia, Laura Pinnavaia, Vojimir Ranitovic, Elisabetta Rocchetti, Alice Tuveri

机构 * Università degli Studi di Milano, Department of Computer Science(米兰大学计算机科学系) Università degli Studi di Milano, Department of Languages, Literatures, Cultures and Mediations(米兰大学语言、文学、文化与媒介系) Università degli Studi di Milano, Department of Historical Studies(米兰大学历史学系)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22932 2025-08-01 cs.CL q-fin.GN 70%

FinMarBa: A Market-Informed Dataset for Financial Sentiment Classification

Baptiste Lefort, Eric Benhamou, Beatrice Guez, Jean-Jacques Ohana, Ethan Setrouk, Alban Etienne

机构 * Ai For Alpha Centrale Supélec Paris Dauphine PSL(巴黎-法兰西大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19480 2025-08-01 cs.CV 67%

GenHancer: Imperfect Generative Models are Secretly Strong Vision-Centric Enhancers

Shijie Ma, Yuying Ge, Teng Wang, Yuxin Guo, Yixiao Ge, Ying Shan

机构 * ARC Lab, Tencent PCG(腾讯PCG ARC实验室) Institute of Automation, CAS(中国科学院自动化研究所)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments ICCV 2025. Project released at: https://mashijie1028.github.io/GenHancer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23194 2025-08-01 cs.CL cs.AI cs.LG 67%

Geak: Introducing Triton Kernel AI Agent & Evaluation Benchmarks

Jianghui Wang, Vinay Joshi, Saptarshi Majumder, Xu Chao, Bin Ding, Ziqiong Liu, Pratik Prabhanjan Brahma, Dong Li, Zicheng Liu, Emad Barsoum

机构 * Advanced Micro Devices, Inc.(先进微器件公司)

专题命中 评测与基准 :prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11952 2025-08-01 cs.CL cs.AI cs.LG 67%

Robust and Fine-Grained Detection of AI Generated Texts

Ram Mohan Rao Kadiyala, Siddartha Pullakhandam, Kanwal Mehreen, Drishti Sharma, Siddhant Gupta, Jebish Purbey, Ashay Srivastava, Subhasya TippaReddy, Arvind Reddy Bobbili, Suraj Telugara Chandrashekhar, Modabbir Adeeb, Srinadh Vura, Suman Debnath, Hamza Farooq

机构 * Vantager Cohere for AI Community University of Maryland(马里兰大学) IIT Roorkee(印度理工学院罗尔基) Perplexity University of South Florida(佛罗里达州立大学) University of Houston(休斯顿大学) IISc Bangalore(班加罗尔印度理工学院) Stanford University(斯坦福大学) Amazon(亚马逊)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 18 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23404 2025-08-01 cs.CL 57%

Enhanced Arabic Text Retrieval with Attentive Relevance Scoring

Salah Eddine Bekhouche, Azeddine Benlamoudi, Yazid Bounab, Fadi Dornaika, Abdenour Hadid

机构 * University of the Basque Country UPV/EHU(巴斯克国家大学UPV/EHU) Lab. de Genie Electrique (LAGE), University of Ouargla(电气工程实验室(LAGE),奥尔加拉大学) Faculty of Pharmacy, Helsinki University(药学院,赫尔辛基大学) IKERBASQUE, Basque Foundation for Science(ikerbasque,巴斯克科学基金会) Sorbonne University Abu Dhabi(索邦大学阿布扎比)

专题命中 评测与基准 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23356 2025-08-01 cs.SE cs.AI 57%

Quality Evaluation of COBOL to Java Code Transformation

Shmulik Froimovich, Raviv Gal, Wesam Ibraheem, Avi Ziv

机构 * Quality Technologies Department(质量技术部门) IBM Research - Israel Haifa(IBM以色列海法研究所)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

Comments Submitted to ASE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23272 2025-08-01 cs.CV cs.AI 57%

Towards Affordable Tumor Segmentation and Visualization for 3D Breast MRI Using SAM2

Solha Kang, Eugene Kim, Joris Vankerschaver, Utku Ozbulak

机构 * Center for Biosystems and Biotech Data Science, Ghent University Global Campus, Incheon, Republic of Korea(生物系统与生物技术数据科学中心,格罗宁根大学全球校园,韩国Incheon) Department of Mathematics, Computer Science and Statistics, Ghent University, Ghent, Belgium(数学、计算机科学与统计学系,格罗宁根大学,比利时Ghent) IDLab, Department of Electronics and Information Systems, Ghent University, Ghent, Belgium(IDLab,电子与信息系统系,格罗宁根大学,比利时Ghent)

专题命中 评测与基准 :foundation model(abstract);分类 cs.AI

Comments Accepted for publication in the 28th International Conference on Medical Image Computing and Computer Assisted Intervention (MICCAI), 2nd Deep Breast Workshop on AI and Imaging for Diagnostic and Treatment Challenges in Breast Care (DeepBreath), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23091 2025-08-01 cs.AI cs.SD eess.AS 57%

Moravec's Paradox: Towards an Auditory Turing Test

David Noever, Forrest McKee

专题命中 评测与基准 :language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22252 2025-08-01 cs.HC 50%

Multidimensional Assessment of Takeover Performance in Conditionally Automated Driving

Kexin Liang, Jan Luca Kästle, Bani Anvari, Simeon C. Calvert, J. W. C. van Lint

专题命中 评测与基准 :prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17761 2025-08-01 cs.CV 50%

Step1X-Edit: A Practical Framework for General Image Editing

Shiyu Liu, Yucheng Han, Peng Xing, Fukun Yin, Rui Wang, Wei Cheng, Jiaqi Liao, Yingming Wang, Honghao Fu, Chunrui Han, Guopeng Li, Yuang Peng, Quan Sun, Jingwei Wu, Yan Cai, Zheng Ge, Ranchen Ming, Lei Xia, Xianfang Zeng, Yibo Zhu, Binxing Jiao, Xiangyu Zhang, Gang Yu, Daxin Jiang

机构 * Step1X-Image Team(Step1X-图像团队)

专题命中 评测与基准 :LLM(abstract)

Comments code: https://github.com/stepfun-ai/Step1X-Edit

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 18 篇

2409.17092 2025-08-01 cs.LG cs.AI cs.DM 90%

Accumulator-Aware Post-Training Quantization for Large Language Models

Ian Colbert, Giuseppe Franco, Fabian Grob, Jinjie Zhang, Rayan Saab

机构 * AMD(AMD公司) TUM(慕尼黑工业大学) GSK(葛兰素史克) University of California San Diego(加州大学圣地亚哥分校)

专题命中 效率与部署 :post-training(title,abstract);large language model(title);language model(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22923 2025-08-01 cs.CL cs.AI 90%

How and Where to Translate? The Impact of Translation Strategies in Cross-lingual LLM Prompting

Aman Gupta, Yingying Zhuang, Zhou Yu, Ziji Zhang, Anurag Beniwal

机构 * Amazon(亚马逊)

专题命中 效率与部署 :prompting(title,abstract);LLM(title);large language model(abstract);language model(abstract)

Comments Accepted at Prompt Optimization KDD '25

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15441 2025-08-01 cs.SE cs.AI cs.LG 88%

Insights into resource utilization of code small language models serving with runtime engines and execution providers

Francisco Durán, Matias Martinez, Patricia Lago, Silverio Martínez-Fernández

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);分类 cs.AI、cs.LG

Comments Accepted in Journal of Systems and Software (JSS). For its published version refer to the Journal of JSS

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23554 2025-08-01 cs.AI 85%

DICE: Dynamic In-Context Example Selection in LLM Agents via Efficient Knowledge Transfer

Ruoyu Wang, Junda Wu, Yu Xia, Tong Yu, Ryan A. Rossi, Julian McAuley, Lina Yao

机构 * UNSW Sydney(新南威尔士大学悉尼分校) UC San Diego(南加州大学圣地亚哥分校) Adobe Research(Adobe研究) CSIRO’s Data 61(澳大利亚联邦科学与工业研究组织的数据61)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23399 2025-08-01 cs.CL cs.CY 83%

Beyond the Cloud: Assessing the Benefits and Drawbacks of Local LLM Deployment for Translators

Peter Sandrini

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18659 2025-08-01 cs.CV cs.AI 79%

DHCP: Detecting Hallucinations by Cross-modal Attention Pattern in Large Vision-Language Models

Yudong Zhang, Ruobing Xie, Xingwu Sun, Yiqing Huang, Jiansheng Chen, Zhanhui Kang, Di Wang, Yu Wang

机构 * Tsinghua University, Tencent(清华大学、腾讯) Tencent(腾讯) Tencent, University of Macau(腾讯、澳门大学) University of Science and Technology Beijing(北京科技大学) Tsinghua University(清华大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

Comments Accepted by ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23217 2025-08-01 cs.LG cs.AI 79%

Zero-Shot Document Understanding using Pseudo Table of Contents-Guided Retrieval-Augmented Generation

Hyeon Seong Jeong, Sangwoo Jo, Byeong Hyun Yoon, Yoonseok Heo, Haedong Jeong, Taehoon Kim

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22920 2025-08-01 cs.CL cs.AI 79%

Discrete Tokenization for Multimodal LLMs: A Comprehensive Survey

Jindong Li, Yali Fu, Jiahong Liu, Linxiao Cao, Wei Ji, Menglin Yang, Irwin King, Ming-Hsuan Yang

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23362 2025-08-01 cs.CV 78%

Short-LVLM: Compressing and Accelerating Large Vision-Language Models by Pruning Redundant Layers

Ji Ma, Wei Suo, Peng Wang, Yanning Zhang

机构 * Northwestern Polytechnical University(西北工业大学) National Engineering Laboratory for Integrated Aero-Space-Ground-Ocean Big Data Application Technology(集成空天地海大数据应用技术国家工程实验室)

专题命中 效率与部署 :language model(title,abstract)

Comments Accepted By ACM MM 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06458 2025-08-01 cs.CV 78%

Pruning All-Rounder: Rethinking and Improving Inference Efficiency for Large Vision Language Models

Wei Suo, Ji Ma, Mengyang Sun, Lin Yuanbo Wu, Peng Wang, Yanning Zhang

机构 * Northwestern Polytechnical University(西北工业大学) Swansea University(斯旺西大学)

专题命中 效率与部署 :language model(title,abstract)

Comments Accepted by ICCV 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11237 2025-08-01 cs.AI cs.CL cs.SE 76%

Collaboration is all you need: LLM Assisted Safe Code Translation

Rabimba Karanjai, Sam Blackshear, Lei Xu, Weidong Shi

机构 * University Of Houston(休斯顿大学) Mysten Labs(Mysten实验室) Kent State University(肯特州立大学)

专题命中 效率与部署 :LLM(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23536 2025-08-01 cs.LG cs.AI 73%

From LLMs to Edge: Parameter-Efficient Fine-Tuning on Edge Devices

Georg Slamanig, Francesco Corti, Olga Saukh

机构 * Graz University of Technology(格拉茨技术大学) CSH Vienna(维也纳CSH)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23093 2025-08-01 cs.LG cs.AI cs.PF 73%

On the Sustainability of AI Inferences in the Edge

Ghazal Sobhani, Md. Monzurul Amin Ifath, Tushar Sharma, Israat Haque

机构 * Dalhousie University(达尔豪西大学) Faculty of Computer Science Dalhousie University Halifax, Canada(计算机科学学院达尔豪西大学加拿大 Halifax) Faculty of Computer Science. Associate Professor Dalhousie University Halifax, Canada(计算机科学学院副教授达尔豪西大学加拿大 Halifax) Faculty of Computer Science. Assistant Professor Dalhousie University Halifax, Canada(计算机科学学院助理教授达尔豪西大学加拿大 Halifax)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 14 pages, 8 figures, 6 tables, in preparation for journal submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23211 2025-08-01 cs.CL 70%

Failures Are the Stepping Stones to Success: Enhancing Few-Shot In-Context Learning by Leveraging Negative Samples

Yunhao Liang, Ruixuan Ying, Takuya Taniguchi, Zhe Cui

机构 * Chengdu Institute of Computer Applications, Chinese Academy of Sciences(中国科学院成都计算机应用研究所) University of Chinese Academy of Sciences(中国科学院大学) Institute of Multidisciplinary Research for Advanced Materials (IMRAM), Tohoku University(东北大学多学科先进材料研究所)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏