arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-07 至 2025-08-07 共收录 173 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 51 篇

2508.03966 2025-08-07 cs.NE 75%

GP and LLMs for Program Synthesis: No Clear Winners

Jose Guadalupe Hernandez, Anil Kumar Saini, Gabriel Ketron, Jason H. Moore

专题命中 评测与基准 :large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03732 2025-08-07 cs.CV 75%

What is Beneath Misogyny: Misogynous Memes Classification and Explanation

Kushal Kanwar, Dushyant Singh Chauhan, Gopendra Vikram Singh, Asif Ekbal

机构 * Jaypee University of Information Technology(杰伊佩大学信息科技学院) CortexTor Labs(CortexTor实验室) Amity Center for Artificial Intelligence(阿米蒂人工智能中心) Indian Institute of Technology Jodhpur(印度理工学院朱道尔)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08617 2025-08-07 cs.PL cs.AR 75%

RTLCoder: Outperforming GPT-3.5 in Design RTL Generation with Our Open-Source Dataset and Lightweight Solution

Shang Liu, Wenji Fang, Yao Lu, Qijun Zhang, Hongce Zhang, Zhiyao Xie

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract)

Comments This is the LAD Conference version of RTLCoder, for the TCAD extension version, please refer to: arXiv:2312.08617v4

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04576 2025-08-07 cs.AI 70%

ConfProBench: A Confidence Evaluation Benchmark for MLLM-Based Process Judges

Yue Zhou, Yi Chang, Yuan Wu

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21167 2025-08-07 cs.CV cs.AI 70%

ChartM$^3$: Benchmarking Chart Editing with Multimodal Instructions

Donglu Yang, Liang Zhang, Zihao Yue, Liangyu Chen, Yichen Xu, Wenxuan Wang, Qin Jin

机构 * independent researcher(独立研究者)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05727 2025-08-07 eess.AS cs.CL cs.SD 70%

ContextASR-Bench: A Massive Contextual Speech Recognition Benchmark

He Wang, Linhan Ma, Dake Guo, Xiong Wang, Lei Xie, Jin Xu, Junyang Lin

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14448 2025-08-07 cs.CL 70%

How Far Can LLMs Improve from Experience? Measuring Test-Time Learning Ability in LLMs with Human Comparison

Jiayin Wang, Zhiquang Guo, Weizhi Ma, Min Zhang

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12342 2025-08-07 cs.CL 70%

CRAB: A Benchmark for Evaluating Curation of Retrieval-Augmented LLMs in Biomedicine

Hanmeng Zhong, Linqing Chen, Wentao Wu, Weilei Wang

机构 * PatSnap Co., LTD.(PatSnap公司)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10945 2025-08-07 cs.LG stat.ML 70%

Gradient-Based Multi-Objective Deep Learning: Algorithms, Theories, Applications, and Beyond

Weiyu Chen, Baijiong Lin, Xiaoyuan Zhang, Xi Lin, Han Zhao, Qingfu Zhang, James T. Kwok

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) City University of Hong Kong(香港城市大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17125 2025-08-07 cs.CV cs.AI 70%

DOGR: Towards Versatile Visual Document Grounding and Referring

Yinan Zhou, Yuxin Chen, Haokun Lin, Yichen Wu, Shuyu Yang, Zhongang Qi, Chen Ma, Li Zhu, Ying Shan

机构 * Xi’an Jiaotong University(西安交通大学) ARC Lab, Tencent PCG(腾讯PCG ARC实验室) City University of Hongkong(香港城市大学) Institute of Automation, CAS(中国科学院自动化研究所) Harvard University(哈佛大学) vivo Mobile Communication Co.(vivo移动通信公司)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 22 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15576 2025-08-07 cs.CL cs.IR 70%

A Survey of Conversational Search

Fengran Mo, Kelong Mao, Ziliang Zhao, Hongjin Qian, Haonan Chen, Yiruo Cheng, Xiaoxi Li, Yutao Zhu, Zhicheng Dou, Jian-Yun Nie

机构 * University of Montreal, Canada(蒙特利尔大学) Renmin University of China(中国人民大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 38 pages, 8 figures, corresponding Github repository: https://github.com/fengranMark/ConvSearch-Survey

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06083 2025-08-07 cs.LG cs.IR 70%

A Survey of Controllable Learning: Methods and Applications in Information Retrieval

Chenglei Shen, Xiao Zhang, Teng Shi, Changshuo Zhang, Guofu Xie, Jun Xu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China, Beijing 100872, China(中国人民大学人工智能学院) AI Lab at Lenovo Research, Beijing 100085, China(联想研究院人工智能实验室)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04017 2025-08-07 cs.CV 67%

Can Large Multimodal Models Actively Recognize Faulty Inputs? A Systematic Evaluation Framework of Their Input Scrutiny Ability

Haiqi Yang, Jinzhe Li, Gengxu Li, Yi Chang, Yuan Wu

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments 9pages, 2figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03967 2025-08-07 cs.CV cs.CR cs.IR 67%

RAVID: Retrieval-Augmented Visual Detection: A Knowledge-Driven Approach for AI-Generated Image Identification

Mamadou Keita, Wassim Hamidouche, Hessen Bougueffa Eutamene, Abdelmalik Taleb-Ahmed, Abdenour Hadid

机构 * Laboratory of IEMN, Univ. Polytechnique Hauts-de-France(IEMN实验室,法国高等技术法国大学) KU 6G Research Center, Khalifa University(KU 6G研究中心,哈利法大学) Sorbonne Center for Artificial Intelligence, Sorbonne University(人工智能研究中心,索邦大学)

专题命中 评测与基准 :language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03859 2025-08-07 cs.CV 67%

CreatiLayout: Siamese Multimodal Diffusion Transformer for Creative Layout-to-Image Generation

Hui Zhang, Dexiang Hong, Yitong Wang, Jie Shao, Xinglong Wu, Zuxuan Wu, Yu-Gang Jiang

机构 * Institute of Trustworthy Embodied AI(可信具身人工智能研究院) Fudan University(复旦大学) Shanghai Collaborative Innovation Center of Intelligent Visual Computing(上海智能视觉计算协同创新中心) Bytedance Intelligent Creation(字节跳动智能创作)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04531 2025-08-07 cs.CL cs.AI 62%

Unveiling the Landscape of Clinical Depression Assessment: From Behavioral Signatures to Psychiatric Reasoning

Zhuang Chen, Guanqun Bi, Wen Zhang, Jiawei Hu, Aoyun Wang, Xiyao Xiao, Kun Feng, Minlie Huang

机构 * School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) CoAI Group, DCST, IAI, BNRIST, Tsinghua University(清华大学) University of International Relations(国际关系大学) Central China Normal University(华中师范大学) Lingxin AI(灵心AI) Yuquan Hospital, Tsinghua University(清华大学友谊医院)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04442 2025-08-07 cs.CL cs.AI 62%

Automated Generation of Curriculum-Aligned Multiple-Choice Questions for Malaysian Secondary Mathematics Using Generative AI

Rohaizah Abdul Wahid, Muhamad Said Nizamuddin Nadim, Suliana Sulaiman, Syahmi Akmal Shaharudin, Muhammad Danial Jupikil, Iqqwan Jasman Su Azlan Su

机构 * Fakulti Komputeran dan Meta-Teknologi (META), Universiti Pendidikan Sultan Idris(计算机与元技术学院(META),苏丹依德里斯教育大学)

专题命中 评测与基准 :prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16520 2025-08-07 cs.CL cs.AI 62%

AUTALIC: A Dataset for Anti-AUTistic Ableist Language In Context

Naba Rizvi, Harper Strickland, Daniel Gitelman, Tristan Cooper, Alexis Morales-Flores, Michael Golden, Aekta Kallepalli, Akshat Alurkar, Haaset Owens, Saleha Ahmedi, Isha Khirwadkar, Imani Munyaka, Nedjma Ousidhoum

机构 * University of California, San Diego(加州大学圣迭戈分校) Cardiff University(卡迪夫大学)

专题命中 评测与基准 :language model(abstract);分类 cs.CL、cs.AI

Comments accepted to ACL main 2025, 9 pages, 5 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15715 2025-08-07 cs.CL astro-ph.IM 61%

From Queries to Criteria: Understanding How Astronomers Evaluate LLMs

Alina Hyk, Kiera McCormick, Mian Zhong, Ioana Ciucă, Sanjib Sharma, John F Wu, J. E. G. Peek, Kartheik G. Iyer, Ziang Xiao, Anjalie Field

机构 * Oregon State University(俄勒冈州立大学) Loyola University Maryland(马里兰洛约纳大学) Johns Hopkins University(约翰霍普金斯大学) Stanford University(斯坦福大学) Space Telescope Science Institute(空间望远镜科学研究所) Columbia University(哥伦比亚大学)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL;language model(comments)

Comments Accepted to the Conference on Language Modeling 2025 (COLM), 22 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04698 2025-08-07 cs.CL 57%

FaST: Feature-aware Sampling and Tuning for Personalized Preference Alignment with Limited Data

Thibaut Thonet, Germán Kruszewski, Jos Rozen, Pierre Erbacher, Marc Dymetman

机构 * NAVER Labs Europe(NAVER欧洲实验室) Independent Researcher(独立研究者)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04470 2025-08-07 cs.LG 57%

FedHiP: Heterogeneity-Invariant Personalized Federated Learning Through Closed-Form Solutions

Jianheng Tang, Zhirui Yang, Jingchao Wang, Kejia Fan, Jinfeng Xu, Huiping Zhuang, Anfeng Liu, Houbing Herbert Song, Leye Wang, Yunhuai Liu

机构 * PKU, China(北京大学) CSU, China(中国科技大学) HKU, China(香港大学) SCUT, China(华南理工大学) UMBC, USA(伯克利大学)

专题命中 评测与基准 :foundation model(abstract);分类 cs.LG

Comments 11 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
1605.04515 2025-08-07 cs.CL 57%

Meta-Evaluation of Translation Evaluation Methods: a systematic up-to-date overview

Lifeng Han, Serge Gladkoff

机构 * The University of Manchester, UK(曼彻斯特大学) Leiden University(莱顿大学) Logrus Global LLC(Logrus全球公司)

专题命中 评测与基准 :language model(abstract);分类 cs.CL

Comments Presented Tutorial at LREC-2022: International Conference on Language Resources and Evaluation

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04128 2025-08-07 eess.SP 50%

Neuro-MoBRE: Exploring Multi-subject Multi-task Intracranial Decoding via Explicit Heterogeneity Resolving

Di Wu, Yifei Jia, Siyuan Li, Shiqi Zhao, Jie Yang, Mohamad Sawan

专题命中 评测与基准 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04120 2025-08-07 cs.CV 50%

CLIPVehicle: A Unified Framework for Vision-based Vehicle Search

Likai Wang, Ruize Han, Xiangqun Zhang, Wei Feng

机构 * College of Intelligence and Computing, Tianjin University(智能与计算学院,天津大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院) Shenzhen University of Advanced Technology(深圳大学先进技术学院)

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03724 2025-08-07 cs.CV 50%

From Waveforms to Pixels: A Survey on Audio-Visual Segmentation

Jia Li, Yapeng Tian

机构 * Department of Computer Science, The University of Texas at Dallas(计算机科学系,德克萨斯大学达拉斯分校)

专题命中 评测与基准 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10416 2025-08-07 cs.MM cs.SD eess.AS 50%

Can Sound Replace Vision in LLaVA With Token Substitution?

Ali Vosoughi, Jing Bi, Pinxin Liu, Yunlong Tang, Chenliang Xu

专题命中 评测与基准 :language model(abstract)

Comments Project page: https://ali-vosoughi.github.io/SoundCLIP/

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15098 2025-08-07 cs.CV 50%

CLIP-AGIQA: Boosting the Performance of AI-Generated Image Quality Assessment with CLIP

Zhenchen Tang, Zichuan Wang, Bo Peng, Jing Dong

机构 * New Laboratory of Pattern Recognition, Institute of Automation, Chinese Academy of Sciences(模式识别新实验室,自动化研究所,中国科学院)

专题命中 评测与基准 :language model(abstract)

Comments accepted by ICPR2024

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 22 篇

2502.13179 2025-08-07 cs.LG cs.AI 92%

PTQ1.61: Push the Real Limit of Extremely Low-Bit Post-Training Quantization Methods for Large Language Models

Jiaqi Zhao, Miao Zhang, Ming Wang, Yuzhang Shang, Kaihao Zhang, Weili Guan, Yaowei Wang, Min Zhang

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Illinois Institute of Technology(伊利诺伊大学香槟分校)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);post-training(title,abstract);分类 cs.AI、cs.LG

Comments 20 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04073 2025-08-07 cs.CL cs.LG 91%

Efficient Strategy for Improving Large Language Model (LLM) Capabilities

Julián Camilo Velandia Gutiérrez

机构 * Universidad Nacional de Colombia(哥伦比亚国立大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(title);分类 cs.CL、cs.LG

Comments Based on master's thesis in Systems and Computer Engineering, Universidad Nacional de Colombia (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10691 2025-08-07 cs.AI 89%

Fine-Tuning and Deploying Large Language Models Over Edges: Issues and Approaches

Yanjie Dong, Haijun Zhang, Chengming Li, Song Guo, Victor C. M. Leung, Xiping Hu

机构 * Shenzhen MSU-BIT University(深圳MSU-BIT大学) University of Science and Technology Beijing(北京科技大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏