arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-18 至 2025-09-18 共收录 154 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 41 篇

2503.21670 2025-09-18 cs.CL cs.AI 62%

COMI-LINGUA: Expert Annotated Large-Scale Dataset for Multitask NLP in Hindi-English Code-Mixing

Rajvee Sheth, Himanshu Beniwal, Mayank Singh

机构 * LINGO Research Group, Indian Institute of Technology Gandhinagar(LINGO研究组、印度理工学院冈丁纳格尔)

专题命中 评测与基准 :prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13539 2025-09-18 cs.CL 57%

Op-Fed: Opinion, Stance, and Monetary Policy Annotations on FOMC Transcripts Using Active Learning

Alisa Kanganis, Katherine A. Keith

机构 * Williams College(威廉姆斯学院)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17671 2025-09-18 cs.MA cs.AI 57%

ComfyGPT: A Self-Optimizing Multi-Agent System for Comprehensive ComfyUI Workflow Generation

Oucheng Huang, Yuhang Ma, Zeng Zhao, Mingrui Wu, Jiayi Ji, Rongsheng Zhang, Zhipeng Hu, Xiaoshuai Sun, Rongrong Ji

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14227 2025-09-18 cs.CV 50%

Cinéaste: A Fine-grained Contextual Movie Question Answering Benchmark

Nisarg A. Shah, Amir Ziai, Chaitanya Ekanadham, Vishal M. Patel

机构 * Netflix, Inc.(Netflix公司) Johns Hopkins University(约翰霍普金斯大学)

专题命中 评测与基准 :language model(abstract)

Comments 11 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13939 2025-09-18 cs.CV 50%

Can Current AI Models Count What We Mean, Not What They See? A Benchmark and Systematic Evaluation

Gia Khanh Nguyen, Yifeng Huang, Minh Hoai

机构 * Australian Institute for Machine Learning, University of Adelaide(澳大利亚机器学习研究所,阿德莱德大学) Stony Brook University(石溪大学)

专题命中 评测与基准 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13798 2025-09-18 cond-mat.mtrl-sci cond-mat.mes-hall physics.chem-ph physics.comp-ph 50%

Thermal Conductivity Limits of MoS$_2$ and MoSe$_2$: Revisiting High-Order Anharmonic Lattice Dynamics with Machine Learning Potentials

Tugbey Kocabas, Murat Keceli, Tanju Gurel, Milorad Milosevic, Cem Sevik

专题命中 评测与基准 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10256 2025-09-18 cs.CV 50%

Deep Learning for Crack Detection: A Review of Learning Paradigms, Generalizability, and Datasets

Xinan Zhang, Haolin Wang, Yung-An Hsieh, Zhongyu Yang, Anthony Yezzi, Yi-Chang Tsai

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 评测与基准 :foundation model(abstract)

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 25 篇

2509.13695 2025-09-18 cs.CL 88%

Can Large Language Models Robustly Perform Natural Language Inference for Japanese Comparatives?

Yosuke Mikami, Daiki Matsuoka, Hitomi Yanaka

机构 * The University of Tokyo(东京大学) Riken(理化学研究所)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments To appear in Proceedings of the 16th International Conference on Computational Semantics (IWCS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13541 2025-09-18 cs.CL cs.AI cs.LG 87%

Annotation-Efficient Language Model Alignment via Diverse and Representative Response Texts

Yuu Jinnai, Ukyo Honda

机构 * CyberAgent / Tokyo, Japan(CyberAgent)

专题命中 效率与部署 :language model(title,abstract);large language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP Findings, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14169 2025-09-18 cs.LG 85%

TopoSizing: An LLM-aided Framework of Topology-based Understanding and Sizing for AMS Circuits

Ziming Wei, Zichen Kong, Yuan Wang, David Z. Pan, Xiyuan Tang

机构 * School of EECS, Peking University(电子工程系,北京大学) School of Integrated Circuits, Peking University(集成电路学院,北京大学) Department of Electrical and Computer Engineering, The University of Texas at Austin(电气与计算机工程系,德克萨斯大学奥斯汀分校) Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13942 2025-09-18 cs.SE 85%

Evaluating Classical Software Process Models as Coordination Mechanisms for LLM-Based Software Generation

Duc Minh Ha, Phu Trac Kien, Tho Quan, Anh Nguyen-Duc

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13765 2025-09-18 cs.AR 85%

TENET: An Efficient Sparsity-Aware LUT-Centric Architecture for Ternary LLM Inference On Edge

Zhirui Huang, Rui Ma, Shijie Cao, Ran Shu, Ian Wang, Ting Cao, Chixiao Chen, Yongqiang Xiong

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13710 2025-09-18 cs.AR 85%

CompAir: Synergizing Complementary PIMs and In-Transit NoC Computation for Efficient LLM Acceleration

Hongyi Li, Songchen Ma, Huanyu Qu, Weihao Zhang, Jia Chen, Junfeng Lin, Fengbin Tu, Rong Zhao

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13514 2025-09-18 cs.CR 85%

AQUA-LLM: Evaluating Accuracy, Quantization, and Adversarial Robustness Trade-offs in LLMs for Cybersecurity Question Answering

Onat Gungor, Roshan Sood, Harold Wang, Tajana Rosing

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted by the 24th IEEE International Conference on Machine Learning and Applications (ICMLA'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14216 2025-09-18 cs.LG cs.AI 84%

A Universal Banach--Bregman Framework for Stochastic Iterations: Unifying Stochastic Mirror Descent, Learning and LLM Training

Johnny R. Zhang, Xiaomei Mi, Gaoyuan Du, Qianyi Sun, Shiqi Wang, Jiaxuan Li, Wenhua Zhou

机构 * University of Manchester(曼彻斯特大学) Amazon(亚马逊) Microsoft(微软) Meta

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 69 pages, 10 figures. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13487 2025-09-18 cs.SE cs.AI 83%

Prompt2DAG: A Modular Methodology for LLM-Based Data Enrichment Pipeline Generation

Abubakari Alidu, Michele Ciavotta, Flavio DePaoli

机构 * Dept. Informatics, Systems and Communication, University of Milan-Bicocca(信息学、系统与通信系,米兰-比科卡大学)

专题命中 效率与部署 :LLM(title,abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13780 2025-09-18 cs.RO 78%

Behavior Foundation Model for Humanoid Robots

Weishuai Zeng, Shunlin Lu, Kangning Yin, Xiaojie Niu, Minyue Dai, Jingbo Wang, Jiangmiao Pang

机构 * Peking University(北京大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shanghai Jiaotong University(上海交通大学) Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 效率与部署 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13704 2025-09-18 cs.AI cs.SE 77%

InfraMind: A Novel Exploration-based GUI Agentic Framework for Mission-critical Industrial Management

Liangtao Lin, Zhaomeng Zhu, Tianwei Zhang, Yonggang Wen

机构 * Nanyang Technological University(南洋理工大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09061 2025-09-18 cs.DC cs.AI cs.PF 77%

EdgeProfiler: A Fast Profiling Framework for Lightweight LLMs on Edge Using Analytical Model

Alyssa Pinnock, Shakya Jayakody, Kawsher A Roxy, Md Rubel Ahmed

机构 * University of Central Florida(中央佛罗里达大学) Intel Corporation(英特尔公司) Louisiana Tech University(路易斯安那理工大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 4 figures, 7 pages, IEEE conference template

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11824 2025-09-18 cs.HC cs.AI 77%

AppAgent v2: Advanced Agent for Flexible Mobile Interactions

Yanda Li, Chi Zhang, Wenjia Jiang, Wanqi Yang, Bin Fu, Pei Cheng, Xin Chen, Ling Chen, Yunchao Wei

机构 * University of Technology Sydney(悉尼技术大学) Tencent(腾讯) Beijing Jiaotong University(北京交通大学) Westlake University(西湖大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13734 2025-09-18 cs.CL 70%

Implementing a Logical Inference System for Japanese Comparatives

Yosuke Mikami, Daiki Matsuoka, Hitomi Yanaka

机构 * The University of Tokyo(东京大学) Riken(理化学研究所)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL

Comments In Proceedings of the 5th Workshop on Natural Logic Meets Machine Learning (NALOMA)

Journal ref Proceedings of the 5th Workshop on Natural Logic Meets Machine Learning (NALOMA), pages 18-32, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13676 2025-09-18 cs.CV cs.AI 70%

Re-purposing SAM into Efficient Visual Projectors for MLLM-Based Referring Image Segmentation

Xiaobo Yang, Xiaojin Gong

机构 * Zhejiang University(浙江大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13990 2025-09-18 cs.CL cs.AI cs.LG 67%

Slim-SC: Thought Pruning for Efficient Scaling with Self-Consistency

Colin Hong, Xu Guo, Anand Chaanan Singh, Esha Choukse, Dmitrii Ustiugov

机构 * NTU Singapore(新加坡国立大学) KTH Royal Institute of Technology(皇家理工学院) Microsoft(微软公司)

专题命中 效率与部署 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by EMNLP 2025 (Oral), 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18787 2025-09-18 cs.CY 67%

Automatic Detection of Moral Values in Music Lyrics

Vjosa Preniqi, Iacopo Ghinassi, Julia Ive, Kyriaki Kalimeri, Charalampos Saitis

专题命中 效率与部署 :large language model(abstract);language model(abstract)

Comments Accepted to the 25th International Society for Music Information Retrieval Conference (ISMIR 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12577 2025-09-18 cs.CY cs.CL 57%

An AI-Powered Framework for Analyzing Collective Idea Evolution in Deliberative Assemblies

Elinor Poole-Dayan, Deb Roy, Jad Kabbara

专题命中 效率与部署 :LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18454 2025-09-18 cs.LG 57%

Pseudo-Asynchronous Local SGD: Robust and Efficient Data-Parallel Training

Hiroki Naganuma, Xinzhi Zhang, Man-Chung Yue, Ioannis Mitliagkas, Philipp A. Witte, Russell J. Hewett, Yin Tat Lee

机构 * Mila Université de Montréal(蒙特利尔大学) University of Washington(华盛顿大学) The University of Hong Kong(香港大学) Microsoft(微软) NVIDIA(英伟达)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

Comments Accepted to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13997 2025-09-18 cs.AR 50%

An RDMA-First Object Storage System with SmartNIC Offload

Yu Zhu, Aditya Dhakal, Pedro Bruel, Gourav Rattihalli, Yunming Xiao, Johann Lombardi, Dejan Milojicic

专题命中 效率与部署 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13839 2025-09-18 cs.RO 50%

Pre-Manipulation Alignment Prediction with Parallel Deep State-Space and Transformer Models

Motonari Kambara, Komei Sugiura

机构 * Keio University(keio大学)

专题命中 效率与部署 :foundation model(abstract)

Comments Published in Advanced Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13629 2025-09-18 cs.CV 50%

SAMIR, an efficient registration framework via robust feature learning from SAM

Yue He, Min Liu, Qinghao Liu, Jiazheng Wang, Yaonan Wang, Hang Zhang, Xiang Chen

专题命中 效率与部署 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13479 2025-09-18 cond-mat.mtrl-sci physics.comp-ph 50%

From Data to Alloys Predicting and Screening High Entropy Alloys for High Hardness Using Machine Learning

Rahul Bouri, Manikantan R. Nair, Tribeni Roy

专题命中 效率与部署 :language model(abstract)

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏