arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18998 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18998 篇

2507.13758 2025-09-30 cs.CY 82%

Towards Evaluting Fake Reasoning Bias in Language Models

Qian Wang, Zhenheng Tang, Zhanzhi Lou, Nuo Chen, Wenxuan Wang, Bingsheng He

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15182 2025-09-30 cs.CL cs.AI cs.LG 82%

ReflAct: World-Grounded Decision Making in LLM Agents via Goal-State Reflection

Jeonghye Kim, Sojeong Rhee, Minbeom Kim, Dohyung Kim, Sangmook Lee, Youngchul Sung, Kyomin Jung

机构 * KAIST(韩国科学技术院) Seoul National University(首尔国立大学)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to EMNLP 2025 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21922 2025-09-29 cs.CV 82%

Spatial Reasoning in Foundation Models: Benchmarking Object-Centric Spatial Understanding

Vahid Mirjalili, Ramin Giahi, Sriram Kollipara, Akshay Kekuda, Kehui Yao, Kai Zhao, Jianpeng Xu, Kaushiki Nag, Sinduja Subramaniam, Topojoy Biswas, Evren Korpeoglu, Kannan Achan

机构 * Walmart Global Tech(沃尔玛全球科技)

专题命中 推理与问题求解 :foundation model(title,abstract);language model(abstract)

Comments 4 pages, NeurIPS Workshop SpaVLE

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12587 2025-09-25 cs.CV 82%

Multimodal Chain of Continuous Thought for Latent-Space Reasoning in Vision-Language Models

Tan-Hanh Pham, Chris Ngo

机构 * Harvard Medical School, Harvard University(哈佛医学院、哈佛大学) Athinoula A. Martinos Center for Biomedical Imaging, Massachusetts General Hospital(阿提尼乌拉A.马丁努斯生物医学成像中心、麻省总医院) Knovel Engineering Lab, Singapore(Knovel工程实验室、新加坡)

专题命中 推理与问题求解 :language model(title,abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19003 2025-09-24 cs.CV 82%

Unveiling Chain of Step Reasoning for Vision-Language Models with Fine-grained Rewards

Honghao Chen, Xingzhou Lou, Xiaokun Feng, Kaiqi Huang, Xinlong Wang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract)

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18700 2025-09-24 cs.SD eess.AS 82%

Enhancing Automatic Chord Recognition through LLM Chain-of-Thought Reasoning

Chih-Cheng Chang, Bo-Yu Chen, Lu-Rong Chen, Li Su

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16736 2025-09-23 cs.MA cs.CR 82%

Towards Transparent and Incentive-Compatible Collaboration in Decentralized LLM Multi-Agent Systems: A Blockchain-Driven Approach

Minfeng Qi, Tianqing Zhu, Lefeng Zhang, Ningran Li, Wanlei Zhou

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

Comments 17 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02318 2025-09-23 cs.SD cs.AI cs.CL cs.LG cs.MM eess.AS 82%

Audio-Reasoner: Improving Reasoning Capability in Large Audio Language Models

Zhifei Xie, Mingbao Lin, Zihang Liu, Pengcheng Wu, Shuicheng Yan, Chunyan Miao

机构 * Nanyang Technological University(南洋理工大学) National University of Singapore(国立新加坡大学) Rakuten

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Technical report, in process

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15132 2025-09-19 cs.CY cs.CV 82%

From Pixels to Urban Policy-Intelligence: Recovering Legacy Effects of Redlining with a Multimodal LLM

Anthony Howell, Nancy Wu, Sharmistha Bagchi, Yushim Kim, Chayn Sun

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23759 2025-09-18 cs.CL cs.AI cs.CV cs.LG 82%

Puzzled by Puzzles: When Vision-Language Models Can't Take a Hint

Heekyung Lee, Jiaxin Ge, Tsung-Han Wu, Minwoo Kang, Trevor Darrell, David M. Chan

机构 * POSTECH University of California, Berkeley(加州大学伯克利分校)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13317 2025-09-17 cs.CV 82%

3D Aware Region Prompted Vision Language Model

An-Chieh Cheng, Yang Fu, Yukang Chen, Zhijian Liu, Xiaolong Li, Subhashree Radhakrishnan, Song Han, Yao Lu, Jan Kautz, Pavlo Molchanov, Hongxu Yin, Xiaolong Wang, Sifei Liu

机构 * MIT(麻省理工学院) NVIDIA(英伟达)

专题命中 推理与问题求解 :language model(title,abstract);prompting(abstract)

Comments Project Website: https://www.anjiecheng.me/sr3d

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01016 2025-09-03 cs.AI cs.CL cs.LG cs.NE 82%

Analysis of Error Sources in LLM-based Hypothesis Search for Few-Shot Rule Induction

Aishni Parab, Hongjing Lu, Ying Nian Wu, Sumit Gulwani

机构 * Department of Statistics, University of California, Los Angeles(统计学系,加州大学洛杉矶分校) Microsoft, Redmond, WA(微软公司,西雅图,华盛顿州) Department of Psychology, University of California, Los Angeles(心理学系,加州大学洛杉矶分校)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments This is the preprint version corresponding to our NeurIPS 2025 Workshop on Multimodal Algorithmic Reasoning submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21565 2025-09-01 cs.CV 82%

How Well Do Vision--Language Models Understand Cities? A Comparative Study on Spatial Reasoning from Street-View Images

Juneyoung Ro, Namwoo Kim, Yoonjin Yoon

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract)

Comments Accepted to ICCV Workshop 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18174 2025-08-26 cs.HC 82%

InReAcTable: LLM-Powered Interactive Visual Data Story Construction from Tabular Data

Gerile Aodeng, Guozheng Li, Yunshan Feng, Qiyang Chen, Yu Zhang, Chi Harold Liu

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

Comments 16 pages, 10 figures, accepted at ACM UIST 2025 (to appear)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16514 2025-08-25 cs.LG cs.AI cs.CL 82%

FLAMES: Improving LLM Math Reasoning via a Fine-Grained Analysis of the Data Synthesis Pipeline

Parker Seegmiller, Kartik Mehta, Soumya Saha, Chenyang Tao, Shereen Oraby, Arpit Gupta, Tagyoung Chung, Mohit Bansal, Nanyun Peng

机构 * Amazon AGI Foundations(亚马逊人工智能基础研究机构) Dartmouth College(达特茅斯学院) UNC Chapel Hill(北卡罗来纳大学教堂山分校) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments To appear at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12455 2025-08-19 cs.CV 82%

X-Ray-CoT: Interpretable Chest X-ray Diagnosis with Vision-Language Models via Chain-of-Thought Reasoning

Chee Ng, Liliang Sun, Shaoqing Tang

机构 * Universiti Teknologi Malaysia(马来西亚技术大学)

专题命中 推理与问题求解 :language model(title);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01136 2025-08-05 cs.DB cs.AI cs.CL cs.IR cs.LG 82%

DBAIOps: A Reasoning LLM-Enhanced Database Operation and Maintenance System using Knowledge Graphs

Wei Zhou, Peng Sun, Xuanhe Zhou, Qianglei Zang, Ji Xu, Tieying Zhang, Guoliang Li, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Baisheng (Shenzhen) Technology Co., Ltd.(柏盛(深圳)科技有限公司) Tsinghua University(清华大学)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments DBAIOps supports 25 database systems and has been deployed in 20 real-world scenarios, covering domains like finance, energy, and healthcare. See website at: https://www.dbaiops.com; See code at: https://github.com/weAIDB/DBAIOps/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20622 2025-07-29 cs.RO 82%

FMimic: Foundation Models are Fine-grained Action Learners from Human Videos

Guangyan Chen, Meiling Wang, Te Cui, Yao Mu, Haoyang Lu, Zicai Peng, Mengxiao Hu, Tianxing Zhou, Mengyin Fu, Yi Yang, Yufeng Yue

机构 * Beijing Institute of Technology, Beijing, P. R. China(北京理工大学) The University of Hong Kong, Hong Kong, P. R. China(香港大学)

专题命中 推理与问题求解 :foundation model(title,abstract);language model(abstract)

Comments accepted to International Journal of Robotics Research(IJRR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04834 2025-07-21 cs.SE 82%

LLM-Based Multi-Agent Systems for Software Engineering: Literature Review, Vision and the Road Ahead

Junda He, Christoph Treude, David Lo

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

Comments TOSEM 2030 Special Issue

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04109 2025-07-08 cs.CL cs.AI cs.LG 82%

Self-Consistency Preference Optimization

Archiki Prasad, Weizhe Yuan, Richard Yuanzhe Pang, Jing Xu, Maryam Fazel-Zarandi, Mohit Bansal, Sainbayar Sukhbaatar, Jason Weston, Jane Yu

机构 * Meta FAIR New York University(纽约大学)

专题命中 推理与问题求解 :preference optimization(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML 2025 (camera-ready)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11564 2025-07-08 cs.RO cs.CV 82%

PAVLM: Advancing Point Cloud based Affordance Understanding Via Vision-Language Model

Shang-Ching Liu, Van Nhiem Tran, Wenkai Chen, Wei-Lun Cheng, Yen-Lin Huang, I-Bin Liao, Yung-Hui Li, Jianwei Zhang

机构 * Technical Aspects of Multimodal Systems (TAMS), Department of Informatics, University of Hamburg(汉堡大学信息学院多模态系统技术部门) Hon Hai Research Institute (HHRI)(鸿海研究机构) Department of Electrical Engineering, National Taiwan University(台湾大学电子工程系) Department of Computer Science and Technology, National Tsinghua University(清华大学计算机科学与技术系)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14557 2025-07-04 quant-ph cs.MA 82%

Enhancing LLM-based Quantum Code Generation with Multi-Agent Optimization and Quantum Error Correction

Charlie Campbell, Hao Mark Chen, Wayne Luk, Hongxiang Fan

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

Comments Paper accepted by DAC'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14505 2025-06-24 cs.LG cs.AI cs.CL 82%

RePST: Language Model Empowered Spatio-Temporal Forecasting via Semantic-Oriented Reprogramming

Hao Wang, Jindong Han, Wei Fan, Leilei Sun, Hao Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Hong Kong University of Science and Technology(香港科学与技术大学) Shandong University(山东大学) Oxford University(牛津大学) Beihang University(北航大学)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08590 2025-06-24 cs.CL cs.AI cs.LG 82%

Reasoning Circuits in Language Models: A Mechanistic Interpretation of Syllogistic Inference

Geonhee Kim, Marco Valentino, André Freitas

机构 * Department of Computer Science, University of Manchester, UK(英国曼彻斯特大学计算机科学系) Idiap Research Institute, Switzerland(瑞士Idiap研究所) School of Computer Science, University of Sheffield, UK(英国谢菲尔德大学计算机科学学院) National Biomarker Centre, CRUK-MI, University of Manchester, UK(英国曼彻斯特大学国家生物标志物中心)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to Findings of ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16639 2025-06-23 cs.SE 82%

LLM-based Satisfiability Checking of String Requirements by Consistent Data and Checker Generation

Boqi Chen, Aren A. Babikian, Shuzhao Feng, Dániel Varró, Gunter Mussbacher

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

Comments Accepted at the 33rd IEEE International Requirements Engineering 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14103 2025-06-23 cs.HC 82%

DangerMaps: Personalized Safety Advice for Travel in Urban Environments using a Retrieval-Augmented Language Model

Jonas Oppenlaender

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract)

Comments 14 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14100 2025-06-18 cs.RO cs.SY eess.SY 82%

A Hierarchical Test Platform for Vision Language Model (VLM)-Integrated Real-World Autonomous Driving

Yupeng Zhou, Can Cui, Juntong Peng, Zichong Yang, Juanwu Lu, Jitesh H Panchal, Bin Yao, Ziran Wang

机构 * Purdue University(普渡大学)

专题命中 推理与问题求解 :language model(title,abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16557 2025-06-16 cs.MA 82%

Is Your LLM-Based Multi-Agent a Reliable Real-World Planner? Exploring Fraud Detection in Travel Planning

Junchi Yao, Jianhua Xu, Tianyu Xin, Ziyi Wang, Shenzhe Zhu, Shu Yang, Di Wang

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

Comments Accepted by ICML 2025 Workshop MAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10966 2025-06-13 cs.RO 82%

GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation

Ning Gao, Yilun Chen, Shuai Yang, Xinyi Chen, Yang Tian, Hao Li, Haifeng Huang, Hanqing Wang, Tai Wang, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Xi’an Jiaotong University(西安交通大学) Zhejiang University(浙江大学) Nanjing University(南京大学)

专题命中 推理与问题求解 :LLM(title,abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17441 2025-06-12 cs.CL cs.AI cs.LG 82%

Discovering Forbidden Topics in Language Models

Can Rager, Chris Wendler, Rohit Gandikota, David Bau

机构 * Independent(独立研究者) Northeastern University(东北大学)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏