arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-11 至 2025-08-11 共收录 171 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 7 篇

2501.14119 2025-08-11 cs.CL cs.AI 85%

Autonomous Structural Memory Manipulation for Large Language Models Using Hierarchical Embedding Augmentation

Derek Yotheringhay, Alistair Kirkland, Humphrey Kirkbride, Josiah Whitesteeple

专题命中 长上下文与记忆 :large language model(title);language model(title);分类 cs.CL、cs.AI

Comments arXiv admin note: This paper has been withdrawn by arXiv due to disputed and unverifiable authorship

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19349 2025-08-11 cs.AR 85%

DECA: A Near-Core LLM Decompression Accelerator Grounded on a 3D Roofline Model

Gerasimos Gerogiannis, Stijn Eyerman, Evangelos Georganas, Wim Heirman, Josep Torrellas

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02679 2025-08-11 cs.HC 82%

LLM Agent-Based Simulation of Student Activities and Mental Health Using Smartphone Sensing Data

Wayupuk Sommuang, Kun Kerdthaisong, Pasin Buakhaw, Aslan B. Wong, Nutchanon Yongsatianchot

专题命中 长上下文与记忆 :LLM(title,abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00977 2025-08-11 cs.CL 77%

Context-Aware Hierarchical Merging for Long Document Summarization

Litu Ou, Mirella Lapata

机构 * University of Edinburgh(爱丁堡大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03101 2025-08-11 cs.CL 72%

Single-Pass Document Scanning for Question Answering

Weili Cao, Jianyou Wang, Youze Zheng, Longtian Bao, Qirui Zheng, Taylor Berg-Kirkpatrick, Ramamohan Paturi, Leon Bergen

机构 * Laboratory for Emerging Intelligence(新兴智能实验室) University of California, San Diego(加州大学圣地亚哥分校)

专题命中 长上下文与记忆 :language model(abstract,comments);large language model(abstract);分类 cs.CL

Comments Published at Conference on Language Modeling (COLM), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 推理与问题求解 21 篇

2508.06009 2025-08-11 cs.CV 88%

MathReal: We Keep It Real! A Real Scene Benchmark for Evaluating Math Reasoning in Multimodal Large Language Models

Jun Feng, Zixin Wang, Zhentao Zhang, Yue Guo, Zhihan Zhou, Xiuyi Chen, Zhenyang Li, Dawei Yin

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract)

Comments 29 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19015 2025-08-11 cs.CV cs.MM 88%

Can Multimodal Large Language Models Understand Spatial Relations?

Jingping Liu, Ziyan Liu, Zhedong Cen, Yan Zhou, Yinan Zou, Weiyan Zhang, Haiyun Jiang, Tong Ruan

机构 * School of Information Science and Engineering, East China University of Science and Technology, Shanghai, China(信息科学与工程学院,东华大学,上海,中国) School of Computer Science, Fudan University, Shanghai, China(计算机科学学院,复旦大学,上海,中国)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract)

Comments 13 pages, 7 figures, published to ACL 2025

Journal ref In Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 620-632, 2025, Vienna, Austria

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11881 2025-08-11 cs.AI cs.CL 87%

Hypothesis-Driven Theory-of-Mind Reasoning for Large Language Models

Hyunwoo Kim, Melanie Sclar, Tan Zhi-Xuan, Lance Ying, Sydney Levine, Yang Liu, Joshua B. Tenenbaum, Yejin Choi

机构 * NVIDIA(NVIDIA公司) University of Washington(华盛顿大学) MIT(麻省理工学院) Harvard University(哈佛大学) Amazon(亚马逊公司) Stanford University(斯坦福大学)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments COLM 2025. For code and data, see https://hyunw.kim/thought-tracing

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23145 2025-08-11 cs.PL cs.AI cs.CL cs.LG 87%

CodeARC: Benchmarking Reasoning Capabilities of LLM Agents for Inductive Program Synthesis

Anjiang Wei, Tarun Suresh, Jiannan Cao, Naveen Kannan, Yuheng Wu, Kai Yan, Thiago S. F. X. Teixeira, Ke Wang, Alex Aiken

机构 * Stanford University(斯坦福大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) MIT(麻省理工学院) Intel(英特尔) Nanjing University(南京大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11246 2025-08-11 cs.CL cs.AI 86%

No Universal Prompt: Unifying Reasoning through Adaptive Prompting for Temporal Table Reasoning

Abhishek Rajgaria, Kushagra Dixit, Mayank Vyas, Harshavardhan Kalalbandi, Dan Roth, Vivek Gupta

机构 * University of Utah(犹他大学) Arizona State University(亚利桑那州立大学) University of California Riverside(加州大学河滨分校) University of Pennsylvania(宾夕法尼亚大学)

专题命中 推理与问题求解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 23 pages, 21 Tables, 10 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01700 2025-08-11 cs.RO cs.AI cs.CL 86%

Code-as-Symbolic-Planner: Foundation Model-Based Robot Planning via Symbolic Code Generation

Yongchao Chen, Yilun Hao, Yang Zhang, Chuchu Fan

机构 * Massachusetts Institute of Technology(麻省理工学院) Harvard University(哈佛大学) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)

专题命中 推理与问题求解 :foundation model(title);LLM(abstract);large language model(abstract);language model(abstract)

Comments 7 pages, 7 figures, 3 tables

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS'2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06471 2025-08-11 cs.CL 85%

GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models

5 Team, Aohan Zeng, Xin Lv, Qinkai Zheng, Zhenyu Hou, Bin Chen, Chengxing Xie, Cunxiang Wang, Da Yin, Hao Zeng, Jiajie Zhang, Kedong Wang, Lucen Zhong, Mingdao Liu, Rui Lu, Shulin Cao, Xiaohan Zhang, Xuancheng Huang, Yao Wei, Yean Cheng, Yifan An, Yilin Niu, Yuanhao Wen, Yushi Bai, Zhengxiao Du, Zihan Wang, Zilin Zhu, Bohan Zhang, Bosi Wen, Bowen Wu, Bowen Xu, Can Huang, Casey Zhao, Changpeng Cai, Chao Yu, Chen Li, Chendi Ge, Chenghua Huang, Chenhui Zhang, Chenxi Xu, Chenzheng Zhu, Chuang Li, Congfeng Yin, Daoyan Lin, Dayong Yang, Dazhi Jiang, Ding Ai, Erle Zhu, Fei Wang, Gengzheng Pan, Guo Wang, Hailong Sun, Haitao Li, Haiyang Li, Haiyi Hu, Hanyu Zhang, Hao Peng, Hao Tai, Haoke Zhang, Haoran Wang, Haoyu Yang, He Liu, He Zhao, Hongwei Liu, Hongxi Yan, Huan Liu, Huilong Chen, Ji Li, Jiajing Zhao, Jiamin Ren, Jian Jiao, Jiani Zhao, Jianyang Yan, Jiaqi Wang, Jiayi Gui, Jiayue Zhao, Jie Liu, Jijie Li, Jing Li, Jing Lu, Jingsen Wang, Jingwei Yuan, Jingxuan Li, Jingzhao Du, Jinhua Du, Jinxin Liu, Junkai Zhi, Junli Gao, Ke Wang, Lekang Yang, Liang Xu, Lin Fan, Lindong Wu, Lintao Ding, Lu Wang, Man Zhang, Minghao Li, Minghuan Xu, Mingming Zhao, Mingshu Zhai, Pengfan Du, Qian Dong, Shangde Lei, Shangqing Tu, Shangtong Yang, Shaoyou Lu, Shijie Li, Shuang Li, Shuang-Li, Shuxun Yang, Sibo Yi, Tianshu Yu, Wei Tian, Weihan Wang, Wenbo Yu, Weng Lam Tam, Wenjie Liang, Wentao Liu, Xiao Wang, Xiaohan Jia, Xiaotao Gu, Xiaoying Ling, Xin Wang, Xing Fan, Xingru Pan, Xinyuan Zhang, Xinze Zhang, Xiuqing Fu, Xunkai Zhang, Yabo Xu, Yandong Wu, Yida Lu, Yidong Wang, Yilin Zhou, Yiming Pan, Ying Zhang, Yingli Wang, Yingru Li, Yinpei Su, Yipeng Geng, Yitong Zhu, Yongkun Yang, Yuhang Li, Yuhao Wu, Yujiang Li, Yunan Liu, Yunqing Wang, Yuntao Li, Yuxuan Zhang, Zezhen Liu, Zhen Yang, Zhengda Zhou, Zhongpei Qiao, Zhuoer Feng, Zhuorui Liu, Zichen Zhang, Zihan Wang, Zijun Yao, Zikang Wang, Ziqiang Liu, Ziwei Chai, Zixuan Li, Zuodong Zhao, Wenguang Chen, Jidong Zhai, Bin Xu, Minlie Huang, Hongning Wang, Juanzi Li, Yuxiao Dong, Jie Tang

专题命中 推理与问题求解 :foundation model(title);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01096 2025-08-11 cs.AI 85%

SuperRL: Reinforcement Learning with Supervision to Boost Language Model Reasoning

Yihao Liu, Shuocheng Li, Lang Cao, Yuhang Xie, Mengyu Zhou, Haoyu Dong, Xiaojun Ma, Shi Han, Dongmei Zhang

机构 * Peking University(北京大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Microsoft(微软公司)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);SFT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05995 2025-08-11 cs.LG 83%

Optimizing Prompt Sequences using Monte Carlo Tree Search for LLM-Based Optimization

Fei Xu Yu, Gina Adam, Nathaniel D. Bastian, Tian Lan

机构 * The George Washington University(乔治·华盛顿大学) United States Military Academy(美国军事学院)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04576 2025-08-11 cs.CL cs.AI cs.CY 82%

Show, Don't Tell: Uncovering Implicit Character Portrayal using LLMs

Brandon Jaipersaud, Zining Zhu, Frank Rudzicz, Elliot Creager

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Journal ref NeurIPS 2024 Creativity and Generative AI Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06060 2025-08-11 cs.AI 81%

LLMs for Resource Allocation: A Participatory Budgeting Approach to Inferring Preferences

Sankarshan Damle, Boi Faltings

机构 * Artificial Intelligence Laboratory (LIA), EPFL(人工智能实验室(LIA),瑞士联邦理工学院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Published in the Proceedings of the 28th European Conference on Artificial Intelligence (ECAI 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07081 2025-08-11 cs.CL cs.AI 81%

Self-Steering Language Models

Gabriel Grand, Joshua B. Tenenbaum, Vikash K. Mansinghka, Alexander K. Lew, Jacob Andreas

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13147 2025-08-11 cs.AI cs.CL 79%

Are Your LLMs Capable of Stable Reasoning?

Junnan Liu, Hongwei Liu, Linchen Xiao, Ziyi Wang, Kuikun Liu, Songyang Gao, Wenwei Zhang, Songyang Zhang, Kai Chen

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments ACL 2025 Camera, Benchmark: https://huggingface.co/datasets/opencompass/LiveMathBench, Code: https://github.com/open-compass/GPassK

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00048 2025-08-11 cs.LG cs.AI cs.CL 78%

Contextually Entangled Gradient Mapping for Optimized LLM Comprehension

Colin Sisate, Alistair Goldfinch, Vincent Waterstone, Sebastian Kingsley, Mariana Blackthorn

专题命中 推理与问题求解 :LLM(title);分类 cs.CL、cs.AI、cs.LG

Comments arXiv admin note: This paper has been withdrawn by arXiv due to disputed and unverifiable authorship

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06042 2025-08-11 cs.AI 77%

Society of Mind Meets Real-Time Strategy: A Hierarchical Multi-Agent Framework for Strategic Reasoning

Daechul Ahn, San Kim, Jonghyun Choi

机构 * Seoul National University(首尔国立大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06168 2025-08-11 cs.IR 75%

Improving Table Retrieval with Question Generation from Partial Tables

Hsing-Ping Liang, Che-Wei Chang, Yao-Chung Fan

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments TRL@ACL2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05928 2025-08-11 cs.LG 74%

Mitigating Think-Answer Mismatch in LLM Reasoning Through Noise-Aware Advantage Reweighting

Si Shen, Peijun Shen, Wenhua Zhao, Danhao Zhu

专题命中 推理与问题求解 :LLM(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06342 2025-08-11 cs.CV cs.SI 67%

Street View Sociability: Interpretable Analysis of Urban Social Behavior Across 15 Cities

Kieran Elrod, Katherine Flanigan, Mario Bergés

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18525 2025-08-11 cs.RO 67%

RoboTron-Nav: A Unified Framework for Embodied Navigation Integrating Perception, Planning, and Prediction

Yufeng Zhong, Chengjian Feng, Feng Yan, Fanfan Liu, Liming Zheng, Lin Ma

机构 * Meituan(美团)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18418 2025-08-11 cs.IR cs.CL cs.LG 62%

Rank1: Test-Time Compute for Reranking in Information Retrieval

Orion Weller, Kathryn Ricci, Eugene Yang, Andrew Yates, Dawn Lawrie, Benjamin Van Durme

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 推理与问题求解 :language model(abstract);分类 cs.CL、cs.LG

Comments Published at CoLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05976 2025-08-11 cs.CV cs.RO 50%

PASG: A Closed-Loop Framework for Automated Geometric Primitive Extraction and Semantic Anchoring in Robotic Manipulation

Zhihao Zhu, Yifan Zheng, Siyu Pan, Yaohui Jin, Yao Mu

机构 * MoE key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(人工智能教育部重点实验室、人工智能研究院、上海交通大学)

专题命中 推理与问题求解 :language model(abstract)

Comments Accepted to ICCV 2025. 8 pages main paper, 8 figures, plus supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 评测与基准 47 篇

2508.06277 2025-08-11 cs.CL cs.LG cs.SD 90%

Large Language Model Data Generation for Enhanced Intent Recognition in German Speech

Theresa Pekarek Rosin, Burak Can Kaplan, Stefan Wermter

机构 * University of Hamburg - Knowledge Technology(汉堡大学-知识技术)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments 11 pages, 3 figures, accepted at KONVENS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20910 2025-08-11 cs.CL 89%

Automated Privacy Information Annotation in Large Language Model Interactions

Hang Zeng, Xiangyu Liu, Yong Hu, Chaoyue Niu, Fan Wu, Shaojie Tang, Guihai Chen

机构 * Shanghai Jiao Tong University(上海交通大学) WeChat Tencent(微信腾讯) University at Buffalo(布法罗大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 8 content pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06155 2025-08-11 cs.CL 88%

Semantic and Structural Analysis of Implicit Biases in Large Language Models: An Interpretable Approach

Renhan Zhang, Lian Lian, Zhen Qi, Guiran Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06145 2025-08-11 cs.AI 88%

Retrieval Augmented Large Language Model System for Comprehensive Drug Contraindications

Byeonghun Bang, Jongsuk Yoon, Dong-Jin Chang, Seho Park, Yong Oh Lee

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏