arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18998 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18998 篇

2503.07832 2025-03-12 cs.AI cs.CL cs.LG cs.SE 82%

RefactorBench: Evaluating Stateful Reasoning in Language Agents Through Code

Dhruv Gautam, Spandan Garg, Jinu Jang, Neel Sundaresan, Roshanak Zilouchian Moghaddam

专题命中 推理与问题求解 :language agent(title);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2025 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06772 2025-03-12 cs.CL cs.AI cs.LG 82%

ReasonFlux: Hierarchical LLM Reasoning via Scaling Thought Templates

Ling Yang, Zhaochen Yu, Bin Cui, Mengdi Wang

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Code: https://github.com/Gen-Verse/ReasonFlux

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04919 2025-03-10 cs.CV 82%

FirePlace: Geometric Refinements of LLM Common Sense Reasoning for 3D Object Placement

Ian Huang, Yanan Bao, Karen Truong, Howard Zhou, Cordelia Schmid, Leonidas Guibas, Alireza Fathi

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01743 2025-03-10 cs.CL cs.AI cs.LG 82%

Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs

Microsoft, :, Abdelrahman Abouelenin, Atabak Ashfaq, Adam Atkinson, Hany Awadalla, Nguyen Bach, Jianmin Bao, Alon Benhaim, Martin Cai, Vishrav Chaudhary, Congcong Chen, Dong Chen, Dongdong Chen, Junkun Chen, Weizhu Chen, Yen-Chun Chen, Yi-ling Chen, Qi Dai, Xiyang Dai, Ruchao Fan, Mei Gao, Min Gao, Amit Garg, Abhishek Goswami, Junheng Hao, Amr Hendy, Yuxuan Hu, Xin Jin, Mahmoud Khademi, Dongwoo Kim, Young Jin Kim, Gina Lee, Jinyu Li, Yunsheng Li, Chen Liang, Xihui Lin, Zeqi Lin, Mengchen Liu, Yang Liu, Gilsinia Lopez, Chong Luo, Piyush Madan, Vadim Mazalov, Arindam Mitra, Ali Mousavi, Anh Nguyen, Jing Pan, Daniel Perez-Becker, Jacob Platin, Thomas Portet, Kai Qiu, Bo Ren, Liliang Ren, Sambuddha Roy, Ning Shang, Yelong Shen, Saksham Singhal, Subhojit Som, Xia Song, Tetyana Sych, Praneetha Vaddamanu, Shuohang Wang, Yiming Wang, Zhenghao Wang, Haibin Wu, Haoran Xu, Weijian Xu, Yifan Yang, Ziyi Yang, Donghan Yu, Ishmam Zabir, Jianwen Zhang, Li Lyna Zhang, Yunan Zhang, Xiren Zhou

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07180 2025-03-07 cs.CL cs.AI cs.LG 82%

Gumbel Counterfactual Generation From Language Models

Shauli Ravfogel, Anej Svete, Vésteinn Snæbjarnarson, Ryan Cotterell

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted in ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13942 2025-02-20 cs.CV 82%

A Chain-of-Thought Subspace Meta-Learning for Few-shot Image Captioning with Large Vision and Language Models

Hao Huang, Shuaihang Yuan, Yu Hao, Congcong Wen, Yi Fang

专题命中 推理与问题求解 :language model(title,abstract);prompting(abstract)

Comments 11 pages, 3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19959 2025-02-18 cs.CY 82%

Gender Biases in LLMs: Higher intelligence in LLM does not necessarily solve gender bias and stereotyping

Rajesh Ranjan, Shailja Gupta, Surya Naranyan Singh

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

Comments 1 Figures, 5 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12433 2025-02-04 cs.IR 82%

LLM4Rerank: LLM-based Auto-Reranking Framework for Recommendations

Jingtong Gao, Bo Chen, Weiwen Liu, Xiangyang Li, Yichao Wang, Wanyu Wang, Huifeng Guo, Ruiming Tang, Xiangyu Zhao

专题命中 推理与问题求解 :LLM(title,abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.08992 2025-02-03 cs.CV 82%

Contextual Emotion Recognition using Large Vision Language Models

Yasaman Etesam, Özge Nilay Yalçın, Chuxuan Zhang, Angelica Lim

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract)

Comments 8 pages, website: https://yasaman-etesam.github.io/Contextual-Emotion-Recognition/. arXiv admin note: text overlap with arXiv:2310.19995

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16411 2025-01-30 cs.CV cs.AI cs.CL cs.LG cs.RO 82%

PhysBench: Benchmarking and Enhancing Vision-Language Models for Physical World Understanding

Wei Chow, Jiageng Mao, Boyi Li, Daniel Seita, Vitor Guizilini, Yue Wang

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2025. Project page: https://physbench.github.io/ Dataset: https://huggingface.co/datasets/USC-GVL/PhysBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14983 2025-01-28 cs.SE 82%

Code Change Intention, Development Artifact and History Vulnerability: Putting Them Together for Vulnerability Fix Detection by LLM

Xu Yang, Wenhan Zhu, Michael Pacheco, Jiayuan Zhou, Shaowei Wang, Xing Hu, Kui Liu

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

Comments Accepted in FSE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12904 2025-01-23 cs.SE 82%

A Functional Software Reference Architecture for LLM-Integrated Systems

Alessio Bucaioni, Martin Weyssow, Junda He, Yunbo Lyu, David Lo

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

Comments Accepted for publication at the 22nd IEEE International Conference on Software Architecture (ICSA 2025) - New and Emerging Ideas

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15084 2025-01-20 cs.CL cs.AI cs.LG 82%

AceMath: Advancing Frontier Math Reasoning with Post-Training and Reward Modeling

Zihan Liu, Yang Chen, Mohammad Shoeybi, Bryan Catanzaro, Wei Ping

专题命中 推理与问题求解 :post-training(title);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16339 2025-01-10 cs.CL cs.AI cs.CY cs.LG 82%

Deliberative Alignment: Reasoning Enables Safer Language Models

Melody Y. Guan, Manas Joglekar, Eric Wallace, Saachi Jain, Boaz Barak, Alec Helyar, Rachel Dias, Andrea Vallone, Hongyu Ren, Jason Wei, Hyung Won Chung, Sam Toyer, Johannes Heidecke, Alex Beutel, Amelia Glaese

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10064 2024-12-31 cs.MA 82%

Revolutionizing Bridge Operation and Maintenance with LLM-based Agents: An Overview of Applications and Insights

Xinyu Chen, Lianzhen Zhang

专题命中 推理与问题求解 :LLM(title,abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11124 2024-12-24 cs.CV 82%

Combating Multimodal LLM Hallucination via Bottom-Up Holistic Reasoning

Shengqiong Wu, Hao Fei, Liangming Pan, William Yang Wang, Shuicheng Yan, Tat-Seng Chua

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

Comments 16 pages, 10 figures, accepted by AAAI 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15736 2024-12-09 cs.LG cs.AI cs.CL cs.CV 82%

Evaluating Large Vision-and-Language Models on Children's Mathematical Olympiads

Anoop Cherian, Kuan-Chuan Peng, Suhas Lohit, Joanna Matthiesen, Kevin Smith, Joshua B. Tenenbaum

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at NeurIPS 2024 (Datasets and Benchmarks Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07754 2024-12-06 cs.CL cs.AI cs.LG 82%

Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models

Jiacheng Ye, Shansan Gong, Liheng Chen, Lin Zheng, Jiahui Gao, Han Shi, Chuan Wu, Xin Jiang, Zhenguo Li, Wei Bi, Lingpeng Kong

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02655 2024-12-04 cs.RO cs.SY eess.SY 82%

LLM-Enhanced Path Planning: Safe and Efficient Autonomous Navigation with Instructional Inputs

Pranav Doma, Aliasghar Arab, Xuesu Xiao

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15115 2024-11-28 cs.LG cs.AI cs.CL 82%

On Designing Effective RL Reward at Training Time for LLM Reasoning

Jiaxuan Gao, Shusheng Xu, Wenjie Ye, Weilin Liu, Chuyi He, Wei Fu, Zhiyu Mei, Guangju Wang, Yi Wu

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05037 2024-11-11 cs.CL cs.AI cs.LG 82%

Towards Interpreting Language Models: A Case Study in Multi-Hop Reasoning

Mansi Sakarvadia

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments University of Chicago, Computer Science, Master of Science Dissertation

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16999 2024-11-05 cs.CV 82%

Visual CoT: Advancing Multi-Modal Language Models with a Comprehensive Dataset and Benchmark for Chain-of-Thought Reasoning

Hao Shao, Shengju Qian, Han Xiao, Guanglu Song, Zhuofan Zong, Letian Wang, Yu Liu, Hongsheng Li

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract)

Comments Project Page: https://hao-shao.com/projects/viscot.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14808 2024-11-01 cs.CL cs.AI cs.CY cs.HC cs.LG 82%

Implicit Personalization in Language Models: A Systematic Study

Zhijing Jin, Nils Heil, Jiarui Liu, Shehzaad Dhuliawala, Yahang Qi, Bernhard Schölkopf, Rada Mihalcea, Mrinmaya Sachan

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22225 2024-10-30 cs.RO 82%

CaStL: Constraints as Specifications through LLM Translation for Long-Horizon Task and Motion Planning

Weihang Guo, Zachary Kingston, Lydia E. Kavraki

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13651 2024-10-18 cs.CV 82%

Help Me Identify: Is an LLM+VQA System All We Need to Identify Visual Concepts?

Shailaja Keyur Sampat, Maitreya Patel, Yezhou Yang, Chitta Baral

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01586 2024-10-07 cs.CL cs.AI cs.LG cs.MA 82%

TrustAgent: Towards Safe and Trustworthy LLM-based Agents

Wenyue Hua, Xianjun Yang, Mingyu Jin, Zelong Li, Wei Cheng, Ruixiang Tang, Yongfeng Zhang

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments In EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07053 2024-10-04 cs.CV 82%

Multimodal Self-Instruct: Synthetic Abstract Image and Visual Reasoning Instruction Using Language Model

Wenqi Zhang, Zhenglin Cheng, Yuanyu He, Mengna Wang, Yongliang Shen, Zeqi Tan, Guiyang Hou, Mingqian He, Yanna Ma, Weiming Lu, Yueting Zhuang

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract)

Comments The paper is accepted by EMNLP-24. Code: https://github.com/zwq2018/Multi-modal-Self-instruct dataset: https://huggingface.co/datasets/zwq2018/Multi-modal-Self-instruct Leaderboard: https://multi-modal-self-instruct.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02528 2024-08-22 cs.HC 82%

GigSense: An LLM-Infused Tool for Workers Collective Intelligence

Kashif Imteyaz, Claudia Flores-Saviaga, Saiph Savage

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13315 2024-08-20 cs.CV 82%

PuzzleVQA: Diagnosing Multimodal Reasoning Challenges of Language Models with Abstract Visual Patterns

Yew Ken Chia, Vernon Toh Yan Han, Deepanway Ghosal, Lidong Bing, Soujanya Poria

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract)

Comments ACL 2024 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07311 2024-08-15 cs.HC 82%

MultiSurf-GPT: Facilitating Context-Aware Reasoning with Large-Scale Language Models for Multimodal Surface Sensing

Yongquan Hu, Black Sun, Pengcheng An, Zhuying Li, Wen Hu, Aaron J. Quigley

专题命中 推理与问题求解 :language model(title,abstract);prompting(abstract)

Comments 6 pages. MOBILEHCI Adjunct '24, 26th International Conference on Mobile Human-Computer Interaction, September 30-October 3, 2024, Melbourne, VIC, Australia

详情

展开后加载摘要…

URL PDF HTML 收藏