arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-12 至 2025-09-12 共收录 116 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 20 篇

2503.21544 2025-09-12 cs.CL cs.AI cs.LG 89%

SWI: Speaking with Intent in Large Language Models

Yuwei Yin, EunJeong Hwang, Giuseppe Carenini

机构 * University of British Columbia(不列颠哥伦比亚大学) Vector Institute for AI(人工智能矢量研究所)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Code: https://github.com/YuweiYin/SWI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09602 2025-09-12 cs.CL stat.AP 85%

LAVA: Language Model Assisted Verbal Autopsy for Cause-of-Death Determination

Yiqun T. Chen, Tyler H. McCormick, Li Liu, Abhirup Datta

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08910 2025-09-12 cs.CV cs.AI 85%

PromptGuard: An Orchestrated Prompting Framework for Principled Synthetic Text Generation for Vulnerable Populations using LLMs with Enhanced Safety, Fairness, and Controllability

Tung Vu, Lam Nguyen, Quynh Dao

机构 * Posts and Telecommunications Institute of Technology(邮电技术研究所) Hanoi Architectural University(河内建筑大学)

专题命中 推理与问题求解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09013 2025-09-12 cs.CL cs.AI cs.CV 81%

Can Vision-Language Models Solve Visual Math Equations?

Monjoy Narayan Choudhury, Junling Wang, Yifan Hou, Mrinmaya Sachan

机构 * IIIT Bangalore(班加罗尔印度理工学院) ETH Zürich(苏黎世联邦理工学院)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Monjoy Narayan Choudhury and Junling Wang contributed equally to this work. Accepted at EMNLP2025 main. Code and datasets are open-sourced with links in the paper

Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09272 2025-09-12 cs.AI 77%

Fusing Knowledge and Language: A Comparative Study of Knowledge Graph-Based Question Answering with LLMs

Vaibhav Chaudhary, Neha Soni, Narotam Singh, Amita Kapoor

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 46 pages, 4 figures, 17 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09082 2025-09-12 cs.CL 77%

MR-UIE: Multi-Perspective Reasoning with Reinforcement Learning for Universal Information Extraction

Zhongqiu Li, Shiquan Wang, Ruiyu Fang, Mengjiao Bao, Zhenhe Wu, Shuangyong Song, Yongxiang Li, Zhongjiang He

机构 * Institute of Artificial Intelligence (TeleAI)(人工智能研究院) China Telecom Corp Ltd(中国电信有限公司) BeiHang University(北航大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12932 2025-09-12 cs.CL 77%

Culturally-Nuanced Story Generation for Reasoning in Low-Resource Languages: The Case of Javanese and Sundanese

Salsabila Zahirah Pranida, Rifo Ahmad Genadi, Fajri Koto

机构 * Department of Natural Language Processing, MBZUAI(自然语言处理系,MBZUAI)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15917 2025-09-12 cs.SE 75%

Towards Test Generation from Task Description for Mobile Testing with Multi-modal Reasoning

Hieu Huynh, Hai Phung, Hao Pham, Tien N. Nguyen, Vu Nguyen

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Change the method and experimentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04227 2025-09-12 cs.CR 75%

Can LLMs Hack Enterprise Networks? Autonomous Assumed Breach Penetration-Testing Active Directory Networks

Andreas Happe, Jürgen Cito

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09193 2025-09-12 cs.NI 75%

AI Reasoning for Wireless Communications and Networking: A Survey and Perspectives

Haoxiang Luo, Yu Yan, Yanhui Bian, Wenjiao Feng, Ruichen Zhang, Yinqiu Liu, Jiacheng Wang, Gang Sun, Dusit Niyato, Hongfang Yu, Abbas Jamalipour, Shiwen Mao

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09650 2025-09-12 cs.CL 70%

All for One: LLMs Solve Mental Math at the Last Token With Information Transferred From Other Tokens

Siddarth Mamidanna, Daking Rai, Ziyu Yao, Yilun Zhou

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校) George Mason University(乔治·马歇尔大学) Datadog AI Research(Datadog人工智能研究)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14336 2025-09-12 cs.SE 67%

Toward Generation of Test Cases from Task Descriptions via History-aware Planning

Duy Cao, Phu Nguyen, Vy Le, Tien N. Nguyen, Vu Nguyen

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

Comments Change the method and experimentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09263 2025-09-12 cs.CV 67%

DATE: Dynamic Absolute Time Enhancement for Long Video Understanding

Chao Yuan, Yang Yang, Yehui Yang, Zach Cheng

机构 * Beihang University(北京航空航天大学) Dcar, ByteDance(字节跳动Dcar部门) Qfin Holdings,Inc(Qfin控股公司) MAIS, Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01106 2025-09-12 cs.AI cs.CV cs.RO 57%

Robix: A Unified Model for Robot Interaction, Reasoning and Planning

Huang Fang, Mengxi Zhang, Heng Dong, Wei Li, Zixuan Wang, Qifeng Zhang, Xueyun Tian, Yucheng Hu, Hang Li

专题命中 推理与问题求解 :pretraining(abstract);分类 cs.AI

Comments Tech report. Project page: https://robix-seed.github.io/robix/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09356 2025-09-12 cs.AI cs.RO 57%

Curriculum-Based Multi-Tier Semantic Exploration via Deep Reinforcement Learning

Abdel Hakim Drid, Vincenzo Suriani, Daniele Nardi, Abderrezzak Debilou

机构 * Department of Electrical Engineering - Mohamed Khider, University of Biskra, Biskra (Algeria)(巴尔克拉大学电子工程系) Department of Engineering - University of Basilicata, Potenza (Italy)(巴塞里卡大学工程系) Department of Computer, Control, and Management Engineering ``Antonio Ruberti'', Sapienza University of Rome, Rome (Italy)(罗马萨皮恩扎大学计算机、控制与管理工程系)

专题命中 推理与问题求解 :language model(abstract);分类 cs.AI

Comments The 19th International Conference on Intelligent Autonomous Systems (IAS 19), 2025, Genoa

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06465 2025-09-12 cs.LG cs.CE q-bio.BM 57%

CAME-AB: Cross-Modality Attention with Mixture-of-Experts for Antibody Binding Site Prediction

Hongzong Li, Jiahao Ma, Zhanpeng Shi, Rui Xiao, Fanming Jin, Ye-Fan Hu, Hangjun Che, Jian-Dong Huang

机构 * Generative AI Research and Development Center The Hong Kong University of Science and Technology(生成式人工智能研究与发展中心 香港科学大学) MILES The University of Hong Kong(MILES 香港大学) College of Veterinary Medicine Jilin University(吉林大学兽医学院) School of Chemistry and Chemical Engineering South China University of Technology(华南理工大学化学与化工学院) School of Biomedical Sciences The University of Hong Kong(香港大学生物医学科学学院) Computational Immunology Centre BayVax Biotech Limited(计算免疫学中心 BayVax 生物技术有限公司) College of Electronic and Information Engineering Southwest University(西南大学电子与信息工程学院)

专题命中 推理与问题求解 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.02671 2025-09-12 cs.LG cs.CC 57%

A Logic for Expressing Log-Precision Transformers

William Merrill, Ashish Sabharwal

机构 * New York University(纽约大学) Allen Institute for AI(人工智能研究院)

专题命中 推理与问题求解 :language model(abstract);分类 cs.LG

Comments May 24, 2023: Restructured version of old preprint. Oct 12, 2023: To appear at NeurIPS. Sept 10, 2025: minor technical corrections

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09286 2025-09-12 cs.CV 50%

Visual Programmability: A Guide for Code-as-Thought in Chart Understanding

Bohao Tang, Yan Ma, Fei Zhang, Jiadi Su, Ethan Chern, Zhulin Hu, Zhixin Wang, Pengfei Liu, Ya Zhang

专题命中 推理与问题求解 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 评测与基准 36 篇

2509.08829 2025-09-12 cs.CY cs.AI cs.IR 90%

PerFairX: Is There a Balance Between Fairness and Personality in Large Language Model Recommendations?

Chandan Kumar Sah

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 10 pages, 5 figures. Accepted to the Workshop on Multimodal Continual Learning (MCL) at ICCV 2025. @2025 IEEE/CVF International Conference on Computer Vision Workshops (ICCVW), ICCV's 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02787 2025-09-12 cs.CL cs.CR cs.CY cs.LG 90%

SimMark: A Robust Sentence-Level Similarity-Based Watermarking Algorithm for Large Language Models

Amirhossein Dabiriaghdam, Lele Wang

机构 * Department of ECE, University of British Columbia(电子工程系,不列颠哥伦比亚大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments Accepted to EMNLP 25 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08997 2025-09-12 cs.HC 89%

YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models

Yaman Yu, Yiren Liu, Jacky Zhang, Yun Huang, Yang Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09229 2025-09-12 cs.CL 88%

Reading Between the Lines: Classifying Resume Seniority with Large Language Models

Matan Cohen, Shira Shani, Eden Menahem, Yehudit Aperstein, Alexander Apartsin

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19662 2025-09-12 physics.ed-ph 88%

Multimodal large language models and physics visual tasks: comparative analysis of performance and costs

Giulia Polverini, Bor Gregorcic

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11538 2025-09-12 cs.CL cs.AI eess.AS 86%

MERaLiON-SpeechEncoder: Towards a Speech Foundation Model for Singapore and Beyond

Muhammad Huzaifah, Geyu Lin, Tianchi Liu, Hardik B. Sailor, Kye Min Tan, Tarun K. Vangani, Qiongqiong Wang, Jeremy H. M. Wong, Jinyang Wu, Nancy F. Chen, Ai Ti Aw

机构 * MERaLiON Team(MERaLiON团队) Institute for Infocomm Research (I 2 R), A*STAR, Singapore(信息通信研究所(I2R),A*STAR,新加坡)

专题命中 评测与基准 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17274 2025-09-12 cs.SE cs.CR 85%

CleanVul: Automatic Function-Level Vulnerability Detection in Code Commits Using LLM Heuristics

Yikun Li, Ting Zhang, Ratnadira Widyasari, Yan Naing Tun, Huu Hung Nguyen, Tan Bui, Ivana Clairine Irsan, Yiran Cheng, Xiang Lan, Han Wei Ang, Frank Liauw, Martin Weyssow, Hong Jin Kang, Eng Lieh Ouh, Lwin Khin Shar, David Lo

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09593 2025-09-12 cs.CL cs.AI 84%

Fluent but Unfeeling: The Emotional Blind Spots of Language Models

Bangzhao Shu, Isha Joshi, Melissa Karnaze, Anh C. Pham, Ishita Kakkar, Sindhu Kothe, Arpine Hovasapian, Mai ElSherief

机构 * Northeastern University(东北大学) UC San Diego(加州大学圣地亚哥分校) University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校)

专题命中 评测与基准 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Camera-ready version for ICWSM 2026. First two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08535 2025-09-12 cs.NI cs.AI 83%

LLM-Driven Adaptive 6G-Ready Wireless Body Area Networks: Survey and Framework

Mohammad Jalili Torkamani, Negin Mahmoudi, Kiana Kiashemshaki

机构 * School of Computing, University of Nebraska--Lincoln(计算机学院,内布拉斯加大学林肯分校) Department of Computer Science, Bowling Green State University(计算机科学系,博灵格林州立大学)

专题命中 评测与基准 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08865 2025-09-12 cs.SE 82%

TraceRAG: A LLM-Based Framework for Explainable Android Malware Detection and Behavior Analysis

Guangyu Zhang, Xixuan Wang, Shiyu Sun, Peiyan Xiao, Kun Sun, Yanhai Xiong

专题命中 评测与基准 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06602 2025-09-12 cs.LG cs.AI 79%

Demo: Healthcare Agent Orchestrator (HAO) for Patient Summarization in Molecular Tumor Boards

Matthias Blondeel, Noel Codella, Sam Preston, Hao Qiu, Leonardo Schettini, Frank Tuan, Wen-wai Yim, Smitha Saligrama, Mert Öz, Shrey Jain, Matthew P. Lungren, Thomas Osborne

机构 * Microsoft Health and Life Sciences(微软健康与生命科学)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 9 pages, 1 figure; Added missing co-authors and contributors

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09307 2025-09-12 cs.CV cs.AI cs.CL cs.MM 79%

Can Multimodal LLMs See Materials Clearly? A Multimodal Benchmark on Materials Characterization

Zhengzhao Lai, Youbin Zheng, Zhenyang Cai, Haonan Lyu, Jinpu Yang, Hongqing Liang, Yan Hu, Benyou Wang

专题命中 评测与基准 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏