arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 10577 信号源:cs.CL, cs.AI, cs.LG

1. 推理评测 10577 篇

2404.10399 2024-10-10 cs.RO 50%

FoundationGrasp: Generalizable Task-Oriented Grasping with Foundation Models

Chao Tang, Dehao Huang, Wenlong Dong, Ruinian Xu, Hong Zhang

专题命中 推理评测 :reasoning(abstract)

Comments 18 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14156 2024-10-08 cs.CV 50%

Unveiling the Tapestry of Consistency in Large Vision-Language Models

Yuan Zhang, Fei Xiao, Tao Huang, Chun-Kai Fan, Hongyuan Dong, Jiawen Li, Jiacong Wang, Kuan Cheng, Shanghang Zhang, Haoyuan Guo

专题命中 推理评测 :reasoning(abstract)

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00469 2024-10-02 cs.CV 50%

Deep Multimodal Fusion for Semantic Segmentation of Remote Sensing Earth Observation Data

Ivica Dimitrovski, Vlatko Spasev, Ivan Kitanovski

专题命中 推理评测 :planning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19684 2024-10-01 cs.CV 50%

MedViLaM: A multimodal large language model with advanced generalizability and explainability for medical data understanding and generation

Lijian Xu, Hao Sun, Ziyu Ni, Hongsheng Li, Shaoting Zhang

专题命中 推理评测 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00722 2024-10-01 cs.CV 50%

BRAU-Net++: U-Shaped Hybrid CNN-Transformer Network for Medical Image Segmentation

Libin Lan, Pengzhou Cai, Lu Jiang, Xiaojuan Liu, Yongmei Li, Yudong Zhang

专题命中 推理评测 :planning(abstract)

Comments 13 pages, 7 figures, 9 tables. This work has been submitted to the IEEE TETCI for possible publication. Code: https://github.com/Caipengzhou/BRAU-Netplusplus

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10484 2024-09-30 cs.CV 50%

Beyond Raw Videos: Understanding Edited Videos with Large Multimodal Model

Lu Xu, Sijie Zhu, Chunyuan Li, Chia-Wen Kuo, Fan Chen, Xinyao Wang, Guang Chen, Dawei Du, Ye Yuan, Longyin Wen

专题命中 推理评测 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11802 2024-09-24 cs.CV 50%

PhyBench: A Physical Commonsense Benchmark for Evaluating Text-to-Image Models

Fanqing Meng, Wenqi Shao, Lixin Luo, Yahong Wang, Yiran Chen, Quanfeng Lu, Yue Yang, Tianshuo Yang, Kaipeng Zhang, Yu Qiao, Ping Luo

专题命中 推理评测 :reasoning(abstract)

Comments Some low-quality data and comments may mislead readers to understand the paper. We are working hard to correct these problems and resubmit the paper after making the necessary revisions

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13589 2024-09-23 eess.IV cs.CV 50%

Analyzing the Effect of $k$-Space Features in MRI Classification Models

Pascal Passigan, Vayd Ramkumar

专题命中 推理评测 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13407 2024-09-23 cs.CV 50%

Instruction-guided Multi-Granularity Segmentation and Captioning with Large Multimodal Model

Li Zhou, Xu Yuan, Zenghui Sun, Zikun Zhou, Jingsong Lan

专题命中 推理评测 :reasoning(abstract)

Comments Code and dataset will be released at https://github.com/lizhou-cs/mglmm. 7 pages, 4 figures with Supplementary Material

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08108 2024-09-09 cs.CV 50%

TaskCLIP: Extend Large Vision-Language Model for Task Oriented Object Detection

Hanning Chen, Wenjun Huang, Yang Ni, Sanggeon Yun, Yezi Liu, Fei Wen, Alvaro Velasquez, Hugo Latapie, Mohsen Imani

专题命中 推理评测 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16176 2024-08-30 cs.CV 50%

VLM4Bio: A Benchmark Dataset to Evaluate Pretrained Vision-Language Models for Trait Discovery from Biological Images

M. Maruf, Arka Daw, Kazi Sajeed Mehrab, Harish Babu Manogaran, Abhilash Neog, Medha Sawhney, Mridul Khurana, James P. Balhoff, Yasin Bakis, Bahadir Altintas, Matthew J. Thompson, Elizabeth G. Campolongo, Josef C. Uyeda, Hilmar Lapp, Henry L. Bart, Paula M. Mabee, Yu Su, Wei-Lun Chao, Charles Stewart, Tanya Berger-Wolf, Wasila Dahdul, Anuj Karpatne

专题命中 推理评测 :reasoning(abstract)

Comments 36 pages, 37 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05165 2024-08-29 cs.SE 50%

Feedback-Driven Automated Whole Bug Report Reproduction for Android Apps

Dingbang Wang, Yu Zhao, Sidong Feng, Zhaoxu Zhang, William G. J. Halfond, Chunyang Chen, Xiaoxia Sun, Jiangfan Shi, Tingting Yu

专题命中 推理评测 :reasoning(abstract)

Comments Accepted by ISSTA 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14469 2024-08-27 cs.CV 50%

Grounded Multi-Hop VideoQA in Long-Form Egocentric Videos

Qirui Chen, Shangzhe Di, Weidi Xie

专题命中 推理评测 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18093 2024-08-26 cs.CR 50%

ChatSpamDetector: Leveraging Large Language Models for Effective Phishing Email Detection

Takashi Koide, Naoki Fukushi, Hiroki Nakano, Daiki Chiba

专题命中 推理评测 :reasoning(abstract)

Comments Accepted at SecureComm 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11289 2024-08-23 cs.RO 50%

ManipVQA: Injecting Robotic Affordance and Physically Grounded Information into Multi-Modal Large Language Models

Siyuan Huang, Iaroslav Ponomarenko, Zhengkai Jiang, Xiaoqi Li, Xiaobin Hu, Peng Gao, Hongsheng Li, Hao Dong

专题命中 推理评测 :reasoning(abstract)

Comments Code and dataset are publicly available at https://github.com/SiyuanHuang95/ManipVQA. Accepted by IROS2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09005 2024-08-20 cs.CV 50%

Comparative Performance Analysis of Transformer-Based Pre-Trained Models for Detecting Keratoconus Disease

Nayeem Ahmed, Md Maruf Rahman, Md Fatin Ishrak, Md Imran Kabir Joy, Md Sanowar Hossain Sabuj, Md. Sadekur Rahman

专题命中 推理评测 :planning(abstract)

Comments 14 pages, 3 tables, 27 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00880 2024-08-05 cs.CY 50%

Annotator in the Loop: A Case Study of In-Depth Rater Engagement to Create a Bridging Benchmark Dataset

Sonja Schmer-Galunder, Ruta Wheelock, Scott Friedman, Alyssa Chvasta, Zaria Jalan, Emily Saltz

专题命中 推理评测 :reasoning(abstract)

Comments Accepted Paper at AAAI/ACM Artificial Intelligence, Ethics, and Society (AIES)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21429 2024-08-01 cs.SE 50%

Chat-like Asserts Prediction with the Support of Large Language Model

Han Wang, Han Hu, Chunyang Chen, Burak Turhan

专题命中 推理评测 :chain-of-thought(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16500 2024-07-30 cs.CV 50%

LLMGA: Multimodal Large Language Model based Generation Assistant

Bin Xia, Shiyin Wang, Yingfan Tao, Yitong Wang, Jiaya Jia

专题命中 推理评测 :reasoning(abstract)

Comments The paper is accepted by ECCV2024. The code is available at https://github.com/dvlab-research/LLMGA

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17688 2024-07-25 cs.IR 50%

Large Language Models Enhanced Collaborative Filtering

Zhongxiang Sun, Zihua Si, Xiaoxue Zang, Kai Zheng, Yang Song, Xiao Zhang, Jun Xu

专题命中 推理评测 :reasoning(abstract)

Comments Accepted by CIKM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12575 2024-07-25 cs.CR 50%

LLMs Cannot Reliably Identify and Reason About Security Vulnerabilities (Yet?): A Comprehensive Evaluation, Framework, and Benchmarks

Saad Ullah, Mingji Han, Saurabh Pujar, Hammond Pearce, Ayse Coskun, Gianluca Stringhini

专题命中 推理评测 :reasoning(abstract)

Comments Accepted for publication in IEEE Symposium on Security and Privacy 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13902 2024-07-22 cs.SE 50%

EvaluateXAI: A Framework to Evaluate the Reliability and Consistency of Rule-based XAI Techniques for Software Analytics Tasks

Md Abdul Awal, Chanchal K. Roy

专题命中 推理评测 :reasoning(abstract)

Comments This manuscript was accepted in the Journal of Systems and Software (JSS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13761 2024-07-19 cs.CV 50%

SegPoint: Segment Any Point Cloud via Large Language Model

Shuting He, Henghui Ding, Xudong Jiang, Bihan Wen

专题命中 推理评测 :reasoning(abstract)

Comments ECCV 2024, Project Page: https://heshuting555.github.io/SegPoint

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13094 2024-07-19 cs.CV 50%

Rethinking Video-Text Understanding: Retrieval from Counterfactually Augmented Data

Wufei Ma, Kai Li, Zhongshi Jiang, Moustafa Meshry, Qihao Liu, Huiyu Wang, Christian Häne, Alan Yuille

专题命中 推理评测 :reasoning(abstract)

Comments ECCV 2024. Project page: https://feint6k.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16449 2024-07-19 cs.CV 50%

Evaluating and Analyzing Relationship Hallucinations in Large Vision-Language Models

Mingrui Wu, Jiayi Ji, Oucheng Huang, Jiale Li, Yuhang Wu, Xiaoshuai Sun, Rongrong Ji

专题命中 推理评测 :reasoning(abstract)

Comments ICML2024; Project Page:https://github.com/mrwu-mac/R-Bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18746 2024-07-16 cs.RO 50%

Lifelong Robot Library Learning: Bootstrapping Composable and Generalizable Skills for Embodied Control with Language Models

Georgios Tziafas, Hamidreza Kasaei

专题命中 推理评测 :reasoning(abstract)

Comments ICRA 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08962 2024-07-16 cs.CV 50%

Depicting Beyond Scores: Advancing Image Quality Assessment through Multi-modal Language Models

Zhiyuan You, Zheyuan Li, Jinjin Gu, Zhenfei Yin, Tianfan Xue, Chao Dong

专题命中 推理评测 :reasoning(abstract)

Comments Accepted to ECCV2024, Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.05052 2024-07-15 cs.CV 50%

Facial Affective Behavior Analysis with Instruction Tuning

Yifan Li, Anh Dao, Wentao Bao, Zhen Tan, Tianlong Chen, Huan Liu, Yu Kong

专题命中 推理评测 :reasoning(abstract)

Comments V2.0, project page: https://johnx69.github.io/FABA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05566 2024-07-09 cs.CV 50%

GMC: A General Framework of Multi-stage Context Learning and Utilization for Visual Detection Tasks

Xuan Wang, Hao Tang, Zhigang Zhu

专题命中 推理评测 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18039 2024-06-27 physics.med-ph 50%

Diagnosis Assistant for Liver Cancer Utilizing a Large Language Model with Three Types of Knowledge

Xuzhou Wu, Guangxin Li, Xing Wang, Zeyu Xu, Yingni Wang, Jianming Xian, Xueyu Wang, Gong Li, Kehong Yuan

专题命中 推理评测 :CoT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏