arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5891 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5891 篇

2410.19744 2024-10-29 cs.IR cs.AI 57%

Towards Next-Generation LLM-based Recommender Systems: A Survey and Beyond

Qi Wang, Jindong Li, Shiqi Wang, Qianli Xing, Runliang Niu, He Kong, Rui Li, Guodong Long, Yi Chang, Chengqi Zhang

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19973 2024-10-28 cs.CV cs.LG 57%

STLLaVA-Med: Self-Training Large Language and Vision Assistant for Medical Question-Answering

Guohao Sun, Can Qin, Huazhu Fu, Linwei Wang, Zhiqiang Tao

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

Comments EMNLP 2024 Main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15926 2024-10-22 cs.CV cs.CL 57%

Mitigating Object Hallucination via Concentric Causal Attention

Yun Xing, Yiheng Li, Ivan Laptev, Shijian Lu

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments To appear at NeurIPS 2024. Code is available at https://github.com/xing0047/cca-llava

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14917 2024-10-21 cs.CL 57%

With Ears to See and Eyes to Hear: Sound Symbolism Experiments with Multimodal Large Language Models

Tyler Loakman, Yucheng Li, Chenghua Lin

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments Accepted to EMNLP 2024 (Camera Ready)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12832 2024-10-18 cs.LG 57%

Generative Reward Models

Dakota Mahan, Duy Van Phung, Rafael Rafailov, Chase Blagden, Nathan Lile, Louis Castricato, Jan-Philipp Fränken, Chelsea Finn, Alon Albalak

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12773 2024-10-17 cs.RO cs.AI 57%

Harmon: Whole-Body Motion Generation of Humanoid Robots from Language Descriptions

Zhenyu Jiang, Yuqi Xie, Jinhan Li, Ye Yuan, Yifeng Zhu, Yuke Zhu

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments Accepted for oral presentation at 8th Annual Conference on Robot Learning. Project website: https://ut-austin-rpl.github.io/Harmon/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12004 2024-10-17 cs.CL 57%

Toolken+: Improving LLM Tool Usage with Reranking and a Reject Option

Konstantin Yakovlev, Sergey Nikolenko, Andrey Bout

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments EMNLP 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15198 2024-10-17 cs.AI cs.SI econ.GN q-fin.EC 57%

Do LLM Agents Exhibit Social Behavior?

Yan Leng, Yuan Yuan

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11578 2024-10-16 eess.IV cs.AI cs.CV 57%

STA-Unet: Rethink the semantic redundant for Medical Imaging Segmentation

Vamsi Krishna Vasa, Wenhui Zhu, Xiwen Chen, Peijie Qiu, Xuanzhao Dong, Yalin Wang

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11312 2024-10-16 cs.CV cs.AI 57%

Swarm Intelligence in Geo-Localization: A Multi-Agent Large Vision-Language Model Collaborative Framework

Xiao Han, Chen Zhu, Xiangyu Zhao, Hengshu Zhu

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments resubmit to www2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09457 2024-10-15 cs.LG cs.CR 57%

Power-Softmax: Towards Secure LLM Inference over Encrypted Data

Itamar Zimerman, Allon Adir, Ehud Aharoni, Matan Avitan, Moran Baruch, Nir Drucker, Jenny Lerner, Ramy Masalha, Reut Meiri, Omri Soceanu

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02442 2024-10-15 cs.CL 57%

Let Me Speak Freely? A Study on the Impact of Format Restrictions on Performance of Large Language Models

Zhi Rui Tam, Cheng-Kuang Wu, Yi-Lin Tsai, Chieh-Yen Lin, Hung-yi Lee, Yun-Nung Chen

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09380 2024-10-15 cs.CV cs.AI 57%

Prompting Video-Language Foundation Models with Domain-specific Fine-grained Heuristics for Video Question Answering

Ting Yu, Kunhao Fu, Shuhui Wang, Qingming Huang, Jun Yu

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments IEEE Transactions on Circuits and Systems for Video Technology

Journal ref IEEE Transactions on Circuits and Systems for Video Technology, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09268 2024-10-15 cs.SE cs.AI cs.CY cs.HC 57%

One Step at a Time: Combining LLMs and Static Analysis to Generate Next-Step Hints for Programming Tasks

Anastasiia Birillo, Elizaveta Artser, Anna Potriasaeva, Ilya Vlasov, Katsiaryna Dzialets, Yaroslav Golubev, Igor Gerasimov, Hieke Keuning, Timofey Bryksin

专题命中 其他推理 :chain-of-thought(abstract);分类 cs.AI

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07484 2024-10-15 cs.AI 57%

WALL-E: World Alignment by Rule Learning Improves World Model-based LLM Agents

Siyu Zhou, Tianyi Zhou, Yijun Yang, Guodong Long, Deheng Ye, Jing Jiang, Chengqi Zhang

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments 35 pages, including references and appendix. Code is available at https://github.com/elated-sawyer/WALL-E

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13505 2024-10-14 cs.RO cs.AI 57%

Robots Can Multitask Too: Integrating a Memory Architecture and LLMs for Enhanced Cross-Task Robot Action Generation

Hassan Ali, Philipp Allgeuer, Carlo Mazzola, Giulia Belgiovine, Burak Can Kaplan, Lukáš Gajdošech, Stefan Wermter

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08601 2024-10-14 cs.CL 57%

StraGo: Harnessing Strategic Guidance for Prompt Optimization

Yurong Wu, Yan Gao, Bin Benjamin Zhu, Zineng Zhou, Xiaodi Sun, Sheng Yang, Jian-Guang Lou, Zhiming Ding, Linjun Yang

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments 19 pages, 3 figures, 20 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07391 2024-10-11 cs.AI 57%

The Cognitive Capabilities of Generative AI: A Comparative Analysis with Human Benchmarks

Isaac R. Galatzer-Levy, David Munday, Jed McGiffin, Xin Liu, Danny Karmon, Ilia Labzovsky, Rivka Moroshko, Amir Zait, Daniel McDuff

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06765 2024-10-10 cs.CL cs.CV 57%

To Preserve or To Compress: An In-Depth Study of Connector Selection in Multimodal Large Language Models

Junyan Lin, Haoran Chen, Dawei Zhu, Xiaoyu Shen

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments Accepted to EMNLP 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14252 2024-10-10 cs.LG 57%

Time-FFM: Towards LM-Empowered Federated Foundation Model for Time Series Forecasting

Qingxiang Liu, Xu Liu, Chenghao Liu, Qingsong Wen, Yuxuan Liang

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05304 2024-10-10 cs.CR cs.AI cs.SE 57%

Developing Assurance Cases for Adversarial Robustness and Regulatory Compliance in LLMs

Tomas Bueno Momcilovic, Dian Balta, Beat Buesser, Giulio Zizzo, Mark Purcell

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments Accepted to the ASSURE 2024 workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13248 2024-10-08 cs.CL 57%

Are Large Language Models Capable of Generating Human-Level Narratives?

Yufei Tian, Tenghao Huang, Miri Liu, Derek Jiang, Alexander Spangher, Muhao Chen, Jonathan May, Nanyun Peng

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03993 2024-10-08 cs.CL 57%

A Survey on Natural Language Counterfactual Generation

Yongjie Wang, Xiaoqi Qiu, Yu Yue, Xu Guo, Zhiwei Zeng, Yuhong Feng, Zhiqi Shen

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments Accepted by EMNLP 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14673 2024-10-08 cs.CL 57%

Insights into LLM Long-Context Failures: When Transformers Know but Don't Tell

Taiming Lu, Muhan Gao, Kuai Yu, Adam Byerly, Daniel Khashabi

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15156 2024-10-08 cs.CL 57%

Student Data Paradox and Curious Case of Single Student-Tutor Model: Regressive Side Effects of Training LLMs for Personalized Learning

Shashank Sonkar, Naiming Liu, Richard G. Baraniuk

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments Accepted at EMNLP 2024 Findings Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03227 2024-10-07 cs.CL 57%

ALR$^2$: A Retrieve-then-Reason Framework for Long-context Question Answering

Huayang Li, Pat Verga, Priyanka Sen, Bowen Yang, Vijay Viswanathan, Patrick Lewis, Taro Watanabe, Yixuan Su

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01627 2024-10-03 cs.CL 57%

Intent Detection in the Age of LLMs

Gaurav Arora, Shreya Jain, Srujana Merugu

专题命中 其他推理 :chain-of-thought(abstract);分类 cs.CL

Comments Accepted at EMNLP 2024 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01401 2024-10-03 cs.CL 57%

Question-guided Knowledge Graph Re-scoring and Injection for Knowledge Graph Question Answering

Yu Zhang, Kehai Chen, Xuefeng Bai, zhao kang, Quanjiang Guo, Min Zhang

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments findings of EMNLP2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00033 2024-10-02 cs.AI 57%

The Phenomenology of Machine: A Comprehensive Analysis of the Sentience of the OpenAI-o1 Model Integrating Functionalism, Consciousness Theories, Active Inference, and AI Architectures

Victoria Violet Hoyle

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09330 2024-10-01 cs.CL 57%

Learning from Natural Language Explanations for Generalizable Entity Matching

Somin Wadhwa, Adit Krishnan, Runhui Wang, Byron C. Wallace, Chris Kong

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments Accepted to EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏