arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5027 信号源:cs.CL, cs.AI, cs.LG

1. 复杂问题求解 5027 篇

2411.13244 2024-11-21 cs.CL 57%

Leveraging Prior Experience: An Expandable Auxiliary Knowledge Base for Text-to-SQL

Zhibo Chu, Zichong Wang, Qitao Qin

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15792 2024-11-19 cs.IR cs.AI 57%

IQLS: Framework for leveraging Metadata to enable Large Language Model based queries to complex, versatile Data

Sami Azirar, Hossam A. Gabbar, Chaouki Regoui

专题命中 复杂问题求解 :planning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08516 2024-11-14 cs.CL 57%

Tree-of-Table: Unleashing the Power of LLMs for Enhanced Large-Scale Table Understanding

Deyi Ji, Lanyun Zhu, Siqi Gao, Peng Xu, Hongtao Lu, Jieping Ye, Feng Zhao

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18346 2024-11-14 cs.CL cs.CV 57%

Quantifying and Mitigating Unimodal Biases in Multimodal Large Language Models: A Causal Perspective

Meiqi Chen, Yixin Cao, Yan Zhang, Chaochao Lu

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12036 2024-11-13 cs.CL cs.CV 57%

Exploring Advanced Large Language Models with LLMsuite

Giorgio Roffo

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

Comments Keywords: Language Model Benchmarking, Pre-Trained LLM Comparison, LLM Performance Analysis, NLP Model Evaluation Tools, Public Dataset Inference for LLMs, BLEU and ROUGE Metrics for LLM, Open Source LLM Testing Tools, Large Language Model Evaluation Software, NLP Benchmarking Suite, Comprehensive LLM Evaluation Toolkit

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16620 2024-11-13 cs.CV cs.CL 57%

OmAgent: A Multi-modal Agent Framework for Complex Video Understanding with Task Divide-and-Conquer

Lu Zhang, Tiancheng Zhao, Heting Ying, Yibo Ma, Kyusong Lee

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05641 2024-11-11 cs.CL 57%

Evaluating Large Language Model Capability in Vietnamese Fact-Checking Data Generation

Long Truong To, Hung Tuan Le, Dat Van-Thanh Nguyen, Manh Trong Nguyen, Tri Thien Nguyen, Tin Van Huynh, Kiet Van Nguyen

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04476 2024-11-08 cs.LG 57%

LLM-R: A Framework for Domain-Adaptive Maintenance Scheme Generation Combining Hierarchical Agents and RAG

Laifa Tao, Qixuan Huang, Xianjun Wu, Weiwei Zhang, Yunlong Wu, Bin Li, Chen Lu, Xingshuo Hai

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.LG

Comments 30 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04468 2024-11-08 cs.AI cs.MA 57%

Magentic-One: A Generalist Multi-Agent System for Solving Complex Tasks

Adam Fourney, Gagan Bansal, Hussein Mozannar, Cheng Tan, Eduardo Salinas, Erkang, Zhu, Friederike Niedtner, Grace Proebsting, Griffin Bassman, Jack Gerrits, Jacob Alber, Peter Chang, Ricky Loynd, Robert West, Victor Dibia, Ahmed Awadallah, Ece Kamar, Rafah Hosn, Saleema Amershi

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03409 2024-11-07 cs.RO cs.AI 57%

STEER: Flexible Robotic Manipulation via Dense Language Grounding

Laura Smith, Alex Irpan, Montserrat Gonzalez Arenas, Sean Kirmani, Dmitry Kalashnikov, Dhruv Shah, Ted Xiao

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

Comments Project website: https://lauramsmith.github.io/steer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20092 2024-11-05 cs.CL cs.SE 57%

Divide-and-Conquer Meets Consensus: Unleashing the Power of Functions in Code Generation

Jingchang Chen, Hongxuan Tang, Zheng Chu, Qianglong Chen, Zekun Wang, Ming Liu, Bing Qin

专题命中 复杂问题求解 :planning(abstract);分类 cs.CL

Comments NeurIPS 2024 oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.24105 2024-11-01 cs.LG 57%

Matchmaker: Self-Improving Large Language Model Programs for Schema Matching

Nabeel Seedat, Mihaela van der Schaar

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.LG

Comments Accepted to NeurIPS 2024, GenAI for Health Workshop and Table Representation Learning Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15852 2024-11-01 cs.SE cs.AI 57%

SOEN-101: Code Generation by Emulating Software Process Models Using Large Language Model Agents

Feng Lin, Dong Jae Kim, Tse-Husn, Chen

专题命中 复杂问题求解 :chain-of-thought(abstract);分类 cs.AI

Comments ICSE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17515 2024-10-31 cs.AI 57%

From News to Forecast: Integrating Event Analysis in LLM-Based Time Series Forecasting with Reflection

Xinlei Wang, Maike Feng, Jing Qiu, Jinjin Gu, Junhua Zhao

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

Comments This paper has been accepted for NeurIPS 2024. Code and data are available at https://github.com/ameliawong1996/From_News_to_Forecast

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22315 2024-10-30 cs.CL cs.CV 57%

Natural Language Inference Improves Compositionality in Vision-Language Models

Paola Cascante-Bonilla, Yu Hou, Yang Trista Cao, Hal Daumé, Rachel Rudinger

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

Comments Project page: https://cece-vlm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22029 2024-10-30 cs.CL cs.CV 57%

Are VLMs Really Blind

Ayush Singh, Mansi Gupta, Shivank Garg

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

Comments 2 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02352 2024-10-30 cs.CL 57%

Pelican: Correcting Hallucination in Vision-LLMs via Claim Decomposition and Program of Thought Verification

Pritish Sahu, Karan Sikka, Ajay Divakaran

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02793 2024-10-30 cs.CV cs.CL 57%

ImageInWords: Unlocking Hyper-Detailed Image Descriptions

Roopal Garg, Andrea Burns, Burcu Karagol Ayan, Yonatan Bitton, Ceslee Montgomery, Yasumasa Onoe, Andrew Bunner, Ranjay Krishna, Jason Baldridge, Radu Soricut

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

Comments Webpage (https://google.github.io/imageinwords), GitHub (https://github.com/google/imageinwords), HuggingFace (https://huggingface.co/datasets/google/imageinwords)

详情

展开后加载摘要…

URL PDF HTML 收藏
2006.08880 2024-10-29 cs.AI math.LO 57%

On SCC-recursiveness in Quantitative Argumentation

Zongshun Wang, Yuping Shen

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20321 2024-10-29 cs.AI 57%

Effective Instruction Parsing Plugin for Complex Logical Query Answering on Knowledge Graphs

Xingrui Zhuo, Jiapu Wang, Gongqing Wu, Shirui Pan, Xindong Wu

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17246 2024-10-29 cs.RO cs.AI 57%

Learning Precise, Contact-Rich Manipulation through Uncalibrated Tactile Skins

Venkatesh Pattabiraman, Yifeng Cao, Siddhant Haldar, Lerrel Pinto, Raunaq Bhirangi

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17531 2024-10-29 cs.CV cs.AI 57%

SimVG: A Simple Framework for Visual Grounding with Decoupled Multi-modal Fusion

Ming Dai, Lingfeng Yang, Yihao Xu, Zhenhua Feng, Wankou Yang

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

Comments 24pages, 18figures, NeurIPS2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19084 2024-10-28 cs.CL 57%

GCoder: Improving Large Language Model for Generalized Graph Problem Solving

Qifan Zhang, Xiaobin Hong, Jianheng Tang, Nuo Chen, Yuhan Li, Wenzhong Li, Jing Tang, Jia Li

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.05448 2024-10-28 cs.CL 57%

Representational Analysis of Binding in Language Models

Qin Dai, Benjamin Heinzerling, Kentaro Inui

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15163 2024-10-25 cs.AI 57%

Optimizing Large Language Models for Dynamic Constraints through Human-in-the-Loop Discriminators

Timothy Wei, Annabelle Miin, Anastasia Miin

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10695 2024-10-23 cs.CV cs.AI cs.GR 57%

Playground v3: Improving Text-to-Image Alignment with Deep-Fusion Large Language Models

Bingchen Liu, Ehsan Akhgari, Alexander Visheratin, Aleks Kamko, Linmiao Xu, Shivam Shrirao, Chase Lambert, Joao Souza, Suhail Doshi, Daiqing Li

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

Comments Project page: https://playground.com/pg-v3

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12405 2024-10-17 cs.CL 57%

ProSA: Assessing and Understanding the Prompt Sensitivity of LLMs

Jingming Zhuo, Songyang Zhang, Xinyu Fang, Haodong Duan, Dahua Lin, Kai Chen

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

Comments EMNLP 2024, Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11963 2024-10-17 cs.CV cs.AI 57%

CtrlSynth: Controllable Image Text Synthesis for Data-Efficient Multimodal Learning

Qingqing Cao, Mahyar Najibi, Sachin Mehta

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11531 2024-10-16 cs.AI 57%

AGENTiGraph: An Interactive Knowledge Graph Platform for LLM-based Chatbots Utilizing Private Data

Xinjie Zhao, Moritz Blum, Rui Yang, Boming Yang, Luis Márquez Carpintero, Mónica Pina-Navarro, Tony Wang, Xin Li, Huitao Li, Yanran Fu, Rongrong Wang, Juntao Zhang, Irene Li

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

Comments 30 pages, 7 figures; Submitted to COLING 2025 System Demonstrations Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11459 2024-10-16 cs.CL 57%

Jigsaw Puzzles: Splitting Harmful Questions to Jailbreak Large Language Models

Hao Yang, Lizhen Qu, Ehsan Shareghi, Gholamreza Haffari

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏