arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-06 至 2025-08-06 共收录 181 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 55 篇

2506.19773 2025-08-06 cs.AI 72%

Automatic Prompt Optimization for Knowledge Graph Construction: Insights from an Empirical Study

Nandana Mihindukulasooriya, Niharika S. D'Souza, Faisal Chowdhury, Horst Samulowitz

机构 * IBM Research(IBM研究院)

专题命中 评测与基准 :LLM(abstract,comments);prompting(abstract);分类 cs.AI

Comments Accepted at LLM+Graph WS at VLDB 2025. 21 pages, 7 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03396 2025-08-06 cs.AI 70%

Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis

Rui Zou, Mengqi Wei, Yutao Zhu, Jirong Wen, Xin Zhao, Jing Chen

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03009 2025-08-06 cs.CV cs.AI 70%

Enhancing Long Video Question Answering with Scene-Localized Frame Grouping

Xuyi Yang, Wenhao Zhang, Hongbo Jin, Lin Liu, Hongbo Xu, Yongwei Nie, Fei Yu, Fei Ma

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02994 2025-08-06 cs.AI 70%

When AIs Judge AIs: The Rise of Agent-as-a-Judge Evaluation for LLMs

Fangyi Yu

机构 * Fangyi Yu

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03535 2025-08-06 cs.CV 67%

CoEmoGen: Towards Semantically-Coherent and Scalable Emotional Image Content Generation

Kaishen Yuan, Yuting Zhang, Shang Gao, Yijie Zhu, Wenshuo Chen, Yutao Yue

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments 10 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02998 2025-08-06 cs.SE 67%

MRG-Bench: Evaluating and Exploring the Requirements of Context for Repository-Level Code Generation

Haiyang Li

专题命中 评测与基准 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00265 2025-08-06 cs.CV 67%

Multimodal Referring Segmentation: A Survey

Henghui Ding, Song Tang, Shuting He, Chang Liu, Zuxuan Wu, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Shanghai University of Finance and Economics(上海财经大学) ByteDance Inc(字节跳动公司)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments Project Page: https://github.com/henghuiding/Awesome-Multimodal-Referring-Segmentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05787 2025-08-06 cs.CV 67%

EASG-Bench: Video Q&A Benchmark with Egocentric Action Scene Graphs

Ivan Rodin, Tz-Ying Wu, Kyle Min, Sharath Nittur Sridhar, Antonino Furnari, Subarna Tripathi, Giovanni Maria Farinella

机构 * University of Catania(卡塔尼亚大学) Intel Labs(英特尔实验室)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments Accepted to SAUAFG Workshop at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00991 2025-08-06 cs.CV 67%

GOBench: Benchmarking Geometric Optics Generation and Understanding of MLLMs

Xiaorong Zhu, Ziheng Jia, Jiarui Wang, Xiangyu Zhao, Haodong Duan, Xiongkuo Min, Jia Wang, Zicheng Zhang, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04954 2025-08-06 cs.CV 67%

CAD-MLLM: Unifying Multimodality-Conditioned CAD Generation With MLLM

Jingwei Xu, Chenyu Wang, Zibo Zhao, Wen Liu, Yi Ma, Shenghua Gao

机构 * School of Information Science and Technology, ShanghaiTech University(信息科学与技术学院,上海科技大学) Transcengram DeepSeek AI University of Hong Kong(香港大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments Project page: https://cad-mllm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11548 2025-08-06 cs.CV 67%

Learning Interpretable Queries for Explainable Image Classification with Information Pursuit

Stefan Kolek, Aditya Chattopadhyay, Kwan Ho Ryan Chan, Hector Andrade-Loarca, Gitta Kutyniok, Réne Vidal

机构 * LMU Munich(慕尼黑大学) AWS AI Labs(AWS人工智能实验室) University of Pennsylvania(宾夕法尼亚大学) Technical University of Munich(慕尼黑技术大学) Munich Center of Machine Learning(慕尼黑机器学习中心)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments Published at ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03489 2025-08-06 cs.CL cs.AI 62%

CF-RAG: A Dataset and Method for Carbon Footprint QA Using Retrieval-Augmented Generation

Kaiwen Zhao, Bharathan Balaji, Stephen Lee

机构 * University of Pittsburgh(匹兹堡大学) Amazon(亚马逊)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03523 2025-08-06 cs.CL 57%

FilBench: Can LLMs Understand and Generate Filipino?

Lester James V. Miranda, Elyanah Aco, Conner Manuel, Jan Christian Blaise Cruz, Joseph Marvin Imperial

机构 * Allen Institute for AI(艾伦人工智能研究所) Nara Institute of Science and Technology(奈拉科学与技术研究所) Together AI SEACrowd MBZUAI(穆萨大学人工智能研究所) University of Bath(巴斯大学) National University, Philippines(菲律宾国家大学)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03522 2025-08-06 physics.geo-ph cs.LG 57%

Machine Learning Algorithms for Transplanting Accelerometer Observations in Future Satellite Gravimetry Missions

Mohsen Romeshkani, Jürgen Müller, Sahar Ebadi, Alexey Kupriyanov, Annike Knabe, Nina Fletling, Manuel Schilling

专题命中 评测与基准 :prompting(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.05671 2025-08-06 cs.CL 57%

Pre-trained Transformer-Based Approach for Arabic Question Answering : A Comparative Study

Kholoud Alsubhi, Amani Jamal, Areej Alhothali

专题命中 评测与基准 :language model(abstract);分类 cs.CL

Comments Rewrite the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03216 2025-08-06 cs.HC cs.AI 57%

Navigation Pixie: Implementation and Empirical Study Toward On-demand Navigation Agents in Commercial Metaverse

Hikari Yanagawa, Yuichi Hiroi, Satomi Tokida, Yuji Hatada, Takefumi Hiraki

机构 * Cluster Metaverse Lab University of Tsukuba(茨川大学集群元宇宙实验室) Cluster Metaverse Lab(集群元宇宙实验室) The University of Tokyo(东京大学) University of Tsukuba(茨川大学)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

Comments 11 pages + supplement 3 pages. To appear in IEEE ISMAR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03490 2025-08-06 cs.CV 50%

ParticleSAM: Small Particle Segmentation for Material Quality Monitoring in Recycling Processes

Yu Zhou, Pelle Thielmann, Ayush Chamoli, Bruno Mirbach, Didier Stricker, Jason Rambach

机构 * department of Augmented Vision, DFKI Kaiserslautern, Germany(增强视觉系,德意志联邦研究院(DFKI)凯撒斯劳滕分校)

专题命中 评测与基准 :foundation model(abstract)

Comments 12 pages, 4 figures. Accepted for presentation at EUSIPCO 2025, September 8-12, 2025. List of accepted papers available at http://cmsworkshops.com/EUSIPCO2025/papers/accepted_papers.php

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03118 2025-08-06 cs.CV 50%

H3R: Hybrid Multi-view Correspondence for Generalizable 3D Reconstruction

Heng Jia, Linchao Zhu, Na Zhao

机构 * ReLER Lab, CCAI, Zhejiang University(浙江大学ReLER实验室,中国计算机协会,浙江大学) The State Key Lab of Brain-Machine Intelligence, Zhejiang University(浙江大学脑机智能国家重点实验室) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 评测与基准 :foundation model(abstract)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02958 2025-08-06 cs.HC 50%

VRSight: An AI-Driven Scene Description System to Improve Virtual Reality Accessibility for Blind People

Daniel Killough, Justin Feng, Zheng Xue "ZX" Ching, Daniel Wang, Rithvik Dyava, Yapeng Tian, Yuhang Zhao

专题命中 评测与基准 :LLM(abstract)

Comments 17 pages, 10 figures, 2 tables, LaTeX; To be published in ACM's 2025 Symposium on User Interface Software and Technology (UIST 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 23 篇

2508.03533 2025-08-06 cs.CL 86%

EmbedGrad: Gradient-Based Prompt Optimization in Embedding Space for Large Language Models

Xiaoming Hou, Jiquan Zhang, Zibin Lin, DaCheng Tao, Shengli Zhang

专题命中 效率与部署 :large language model(title);language model(title);foundation model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03484 2025-08-06 cs.AI 86%

Semantic-aware Graph-guided Behavior Sequences Generation with Large Language Models for Smart Homes

Zhiyao Xu, Dan Zhao, Qingsong Zou, Qing Li, Yong Jiang, Yuhang Wang, Jingyu Xiao

机构 * Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) Peng Cheng Laboratory(鹏城实验室) Southwest University(西南大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与部署 :large language model(title);language model(title);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03487 2025-08-06 cs.SE cs.AI cs.LG 86%

BitsAI-Fix: LLM-Driven Approach for Automated Lint Error Resolution in Practice

Yuanpeng Li, Qi Long, Zhiyuan Yao, Jian Xu, Lintao Xie, Xu He, Lu Geng, Xin Han, Yueyan Chen, Wenbo Duan

机构 * ByteDance(字节跳动) Carnegie Mellon University(卡内基梅隆大学) Zhejiang University(浙江大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03148 2025-08-06 cs.LG cs.AI cs.DC 86%

Frontier: Simulating the Next Generation of LLM Inference Systems

Yicheng Feng, Xin Tan, Kin Hang Sew, Yimin Jiang, Yibo Zhu, Hong Xu

机构 * The Chinese University of Hong Kong(香港中文大学) StepFun

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03255 2025-08-06 cs.CY cs.CL cs.MA 85%

Inherent and emergent liability issues in LLM-based agentic systems: a principal-agent perspective

Garry A. Gabison, R. Patrick Xian

机构 * Queen Mary University of London(伦敦女王大学) UC Berkeley(伯克利大学) Certivize AI UC San Francisco(旧金山大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 22 pages (incl. appendix), accepted at REALM workshop, ACL2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03464 2025-08-06 cs.CE 85%

Learning to Incentivize: LLM-Empowered Contract for AIGC Offloading in Teleoperation

Zijun Zhan, Yaxian Dong, Daniel Mawunyo Doe, Yuqing Hu, Shuai Li, Shaohua Cao, Zhu Han

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10352 2025-08-06 eess.AS cs.CL 79%

Pseudo-Autoregressive Neural Codec Language Models for Efficient Zero-Shot Text-to-Speech Synthesis

Yifan Yang, Shujie Liu, Jinyu Li, Yuxuan Hu, Haibin Wu, Hui Wang, Jianwei Yu, Lingwei Meng, Haiyang Sun, Yanqing Liu, Yan Lu, Kai Yu, Xie Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Microsoft Corporation(微软公司) Shanghai Jiao Tong University, Shanghai Innovation Institute(上海交通大学上海创新研究院)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL

Comments Accepted in ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02694 2025-08-06 cs.AI cs.CL cs.MA 79%

Efficient Agents: Building Effective Agents While Reducing Cost

Ningning Wang, Xavier Hu, Pai Liu, He Zhu, Yue Hou, Heyuan Huang, Shengyu Zhang, Jian Yang, Jiaheng Liu, Ge Zhang, Changwang Zhang, Jun Wang, Yuchen Eleanor Jiang, Wangchunshu Zhou

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Work in progress. For GitHub repository, see https://github.com/OPPO-PersonalAI/OAgents

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03469 2025-08-06 cs.CV 78%

IKOD: Mitigating Visual Attention Degradation in Large Vision-Language Models

Jiabing Yang, Chenhang Cui, Yiyang Zhou, Yixiang Chen, Peng Xia, Ying Wei, Tao Yu, Yan Huang, Liang Wang

专题命中 效率与部署 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02936 2025-08-06 cs.AI 77%

AQUAH: Automatic Quantification and Unified Agent in Hydrology

Songkun Yan, Zhi Li, Siyu Zhu, Yixin Wen, Mofan Zhang, Mengye Chen, Jie Cao, Yang Hong

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 8 pages, 5 figures, 2025 ICCV SEA workshop paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02836 2025-08-06 cs.CR cs.LG 77%

Agentic Privacy-Preserving Machine Learning

Mengyu Zhang, Zhuotao Liu, Jingwen Huang, Xuanqi Liu

机构 * Tsinghua University(清华大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏