arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 2037 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 2037 篇

2502.01126 2025-02-04 cs.CL 57%

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

Vaishnavi Shrivastava, Ananya Kumar, Percy Liang

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12853 2025-01-23 cs.LG 57%

Data-and-Semantic Dual-Driven Spectrum Map Construction for 6G Spectrum Management

Jiayu Liu, Fuhui Zhou, Xiaodong Liu, Rui Ding, Lu Yuan, Qihui Wu

专题命中 测试时计算 :reasoning(abstract);分类 cs.LG

Comments This paper has been accepted for presentation at the IEEE Global Communications Conference (GLOBECOM), Cape Town, South Africa, December 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14335 2024-12-17 cs.CL 57%

MQM-APE: Toward High-Quality Error Annotation Predictors with Automatic Post-Editing in LLM Translation Evaluators

Qingyu Lu, Liang Ding, Kanjian Zhang, Jinxia Zhang, Dacheng Tao

专题命中 测试时计算 :verifier(abstract);分类 cs.CL

Comments COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09240 2024-12-13 cs.CV cs.AI 57%

VLMs meet UDA: Boosting Transferability of Open Vocabulary Segmentation with Unsupervised Domain Adaptation

Roberto Alcover-Couso, Marcos Escudero-Viñolo, Juan C. SanMiguel, Jesus Bescos

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08393 2024-12-12 cs.CL 57%

Learning to Reason via Self-Iterative Process Feedback for Small Language Models

Kaiyuan Chen, Jin Wang, Xuejie Zhang

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments Accepted by COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10691 2024-11-19 cs.CL 57%

Python is Not Always the Best Choice: Embracing Multilingual Program of Thoughts

Xianzhen Luo, Qingfu Zhu, Zhiming Zhang, Libo Qin, Xuanyu Zhang, Qing Yang, Dongliang Xu, Wanxiang Che

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments Accepted by EMNLP 2024. Code and data are released at https://github.com/Luowaterbi/MultiPoT

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07641 2024-11-13 cs.LG 57%

Top-$nσ$: Not All Logits Are You Need

Chenxia Tang, Jianchun Liu, Hongli Xu, Liusheng Huang

专题命中 测试时计算 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09215 2024-11-08 cs.IR cs.AI 57%

On Softmax Direct Preference Optimization for Recommendation

Yuxin Chen, Junfei Tan, An Zhang, Zhengyi Yang, Leheng Sheng, Enzhi Zhang, Xiang Wang, Tat-Seng Chua

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03590 2024-11-07 cs.CL 57%

From Medprompt to o1: Exploration of Run-Time Strategies for Medical Challenge Problems and Beyond

Harsha Nori, Naoto Usuyama, Nicholas King, Scott Mayer McKinney, Xavier Fernandes, Sheng Zhang, Eric Horvitz

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01563 2024-11-01 cs.CL 57%

LoFiT: Localized Fine-tuning on LLM Representations

Fangcong Yin, Xi Ye, Greg Durrett

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments NeurIPS 2024 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17518 2024-10-02 cs.CR cs.AI 57%

Multi-Designated Detector Watermarking for Language Models

Zhengan Huang, Gongxian Zeng, Xin Mu, Yu Wang, Yue Yu

专题命中 测试时计算 :verifier(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14507 2024-09-19 cs.CL 57%

Internal Consistency and Self-Feedback in Large Language Models: A Survey

Xun Liang, Shichao Song, Zifan Zheng, Hanyu Wang, Qingchen Yu, Xunkai Li, Rong-Hua Li, Yi Wang, Zhonghao Wang, Feiyu Xiong, Zhiyu Li

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments 20 pages, 10 figures, 6 tables, 13 equations

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08463 2024-08-19 cs.AI 57%

A theory of understanding for artificial intelligence: composability, catalysts, and learning

Zijian Zhang, Sara Aronowitz, Alán Aspuru-Guzik

专题命中 测试时计算 :verifier(abstract);分类 cs.AI

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15363 2024-08-15 cs.CL 57%

Exploring LLM Multi-Agents for ICD Coding

Rumeng Li, Xun Wang, Hong Yu

专题命中 测试时计算 :CoT(abstract);分类 cs.CL

Comments 12pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17361 2024-07-25 cs.CV cs.AI 57%

MuST: Multi-Scale Transformers for Surgical Phase Recognition

Alejandra Pérez, Santiago Rodríguez, Nicolás Ayobi, Nicolás Aparicio, Eugénie Dessevres, Pablo Arbeláez

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12423 2024-06-21 cs.CV cs.AI 57%

Jack of All Tasks, Master of Many: Designing General-purpose Coarse-to-Fine Vision-Language Model

Shraman Pramanick, Guangxing Han, Rui Hou, Sayan Nag, Ser-Nam Lim, Nicolas Ballas, Qifan Wang, Rama Chellappa, Amjad Almahairi

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI

Comments CVPR 2024 Highlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12392 2024-05-31 cs.CL 57%

PiVe: Prompting with Iterative Verification Improving Graph-based Generative Capability of LLMs

Jiuzhou Han, Nigel Collier, Wray Buntine, Ehsan Shareghi

专题命中 测试时计算 :verifier(abstract);分类 cs.CL

Comments Our code and data are at https://github.com/Jiuzhouh/PiVe (accepted to ACL 2024 Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15264 2024-04-29 cs.CL 57%

DEEM: Dynamic Experienced Expert Modeling for Stance Detection

Xiaolong Wang, Yile Wang, Sijie Cheng, Peng Li, Yang Liu

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments Accepted by LREC-COLING 2024, Oral presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14564 2024-03-22 cs.CL 57%

Language Models Hallucinate, but May Excel at Fact Verification

Jian Guan, Jesse Dodge, David Wadden, Minlie Huang, Hao Peng

专题命中 测试时计算 :verifier(abstract);分类 cs.CL

Comments Accepted in NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06173 2024-03-12 cs.RO cs.LG 57%

Speeding up 6-DoF Grasp Sampling with Quality-Diversity

Johann Huber, François Hélénon, Mathilde Kappel, Elie Chelly, Mahdi Khoramshahi, Faïz Ben Amar, Stéphane Doncieux

专题命中 测试时计算 :planning(abstract);分类 cs.LG

Comments 7 pages, 8 figures. Preprint version

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10151 2024-02-16 cs.CL 57%

ControlLM: Crafting Diverse Personalities for Language Models

Yixuan Weng, Shizhu He, Kang Liu, Shengping Liu, Jun Zhao

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14262 2023-12-25 cs.SE cs.AI 57%

Exploring the intersection of Generative AI and Software Development

Filipe Calegario, Vanilson Burégio, Francisco Erivaldo, Daniel Moraes Costa Andrade, Kailane Felix, Nathalia Barbosa, Pedro Lucas da Silva Lucena, César França

专题命中 测试时计算 :chain-of-thought(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.02541 2023-11-29 cs.CR cs.AI 57%

PCPT and ACPT: Copyright Protection and Traceability Scheme for DNN Models

Xuefeng Fan, Dahao Fu, Hangyu Gui, Xinpeng Zhang, Xiaoyi Zhou

专题命中 测试时计算 :verifier(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.04495 2023-11-09 cs.CL 57%

Multi-label and Multi-target Sampling of Machine Annotation for Computational Stance Detection

Zhengyuan Liu, Hai Leong Chieu, Nancy F. Chen

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments Findings of EMNLP 2023. arXiv admin note: text overlap with arXiv:2305.19845

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08303 2023-09-18 cs.CL 57%

Self-Consistent Narrative Prompts on Abductive Natural Language Inference

Chunkit Chan, Xin Liu, Tsz Ho Chan, Jiayang Cheng, Yangqiu Song, Ginny Wong, Simon See

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments Accepted at IJCNLP-AACL 2023 main track

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07645 2023-08-21 cs.CL 57%

Steering Language Generation: Harnessing Contrastive Expert Guidance and Negative Prompting for Coherent and Diverse Synthetic Data Generation

Charles O'Neill, Yuan-Sen Ting, Ioana Ciuca, Jack Miller, Thang Bui

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00108 2023-08-21 cs.SE cs.LG 57%

Better patching using LLM prompting, via Self-Consistency

Toufique Ahmed, Premkumar Devanbu

专题命中 测试时计算 :CoT(abstract);分类 cs.LG

Comments Accepted at ASE-NIER (2023) track

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08204 2023-08-17 cs.CL 57%

MoCoSA: Momentum Contrast for Knowledge Graph Completion with Structure-Augmented Pre-trained Language Models

Jiabang He, Liu Jia, Lei Wang, Xiyao Li, Xing Xu

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.02072 2022-11-02 cs.LG cs.IT math.IT stat.ML 57%

Deciding What to Model: Value-Equivalent Sampling for Reinforcement Learning

Dilip Arumugam, Benjamin Van Roy

专题命中 测试时计算 :planning(abstract);分类 cs.LG

Comments Accepted to Neural Information Processing Systems (NeurIPS) 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.01975 2022-09-07 cs.CL 57%

Selective Annotation Makes Language Models Better Few-Shot Learners

Hongjin Su, Jungo Kasai, Chen Henry Wu, Weijia Shi, Tianlu Wang, Jiayi Xin, Rui Zhang, Mari Ostendorf, Luke Zettlemoyer, Noah A. Smith, Tao Yu

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏