arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-16 至 2025-12-16 共收录 269 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 36 篇

2505.20164 2025-12-16 cs.CL 77%

Thinking with Visual Abstract: Enhancing Multimodal Reasoning via Visual Abstraction

通过视觉抽象思考:通过视觉抽象增强多模态推理

Dairu Liu, Ziyue Wang, Minyuan Ruan, Fuwen Luo, Chi Chen, Peng Li, Yang Liu

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

AI总结 通过引入视觉抽象思考范式,提升多模态大语言模型在视觉感知和推理任务中的性能,实现更高效的视觉推理机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12154 2025-12-16 cs.CR cs.LG 77%

Keep the Lights On, Keep the Lengths in Check: Plug-In Adversarial Detection for Time-Series LLMs in Energy Forecasting

保持灯光亮起,保持长度在控制中:用于能源预测时间序列LLM的插件对抗检测

Hua Ma, Ruoxi Sun, Minhui Xue, Xingliang Yuan, Carsten Rudolph, Surya Nepal, Ling Liu

机构 * The University of Melbourne, Australia(墨尔本大学) Monash University, Australia(莫纳什大学) Georgia Institute of Technology, United States(佐治亚理工学院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出一种用于时间序列LLM的插件对抗检测方法,通过采样诱导的分歧检测对抗性示例,提升能源预测的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11943 2025-12-16 cs.MA cs.AI econ.GN q-fin.EC 77%

How AI Agents Follow the Herd of AI? Network Effects, History, and Machine Optimism

AI代理如何跟随AI的群体?网络效应、历史与机器乐观

Yu Liu, Wenwen Li, Yifan Dou, Guangnan Ye

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究探讨AI代理在网络效应游戏中的决策行为,发现历史数据对LLM推理有显著影响,揭示了AI系统中均衡结果受历史塑造而非单纯激励驱动的特性。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13106 2025-12-16 cs.LG cs.AI 76%

TraPO: A Semi-Supervised Reinforcement Learning Framework for Boosting LLM Reasoning

TraPO:一种用于提升大语言模型推理能力的半监督强化学习框架

Shenzhi Yang, Guangcheng Zhu, Xing Zheng, Yingfan MA, Zhongqi Chen, Bowen Song, Weiqiang Wang, Junbo Zhao, Gang Chen, Haobo Wang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团)

专题命中 推理与问题求解 :LLM(title);分类 cs.AI、cs.LG

AI总结 TraPO通过结合少量标注样本与大量未标注样本,提升大语言模型在数学推理任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14642 2025-12-16 cs.CV 75%

Relation-R1: Progressively Cognitive Chain-of-Thought Guided Reinforcement Learning for Unified Relation Comprehension

Relation-R1: 逐步认知链式思维引导的强化学习用于统一关系理解

Lin Li, Wei Chen, Jiahui Li, Kwang-Ting Cheng, Long Chen

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);SFT(abstract)

AI总结 Relation-R1通过整合认知链式思维引导的强化学习,实现了对二元和N元关系的统一理解,提升了视觉-语义定位能力。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11909 2025-12-16 cs.AI 74%

Causal Strengths and Leaky Beliefs: Interpreting LLM Reasoning via Noisy-OR Causal Bayes Nets

因果强度与渗漏信念:通过噪声-或因果贝叶斯网络解读LLM推理

Hanna Dettki

机构 * New York University(纽约大学)

专题命中 推理与问题求解 :LLM(title);分类 cs.AI

AI总结 本文通过噪声-或因果贝叶斯网络评估LLM和人类在因果推理任务中的表现,探讨其因果强度和信念差异。

Journal ref WiML Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12777 2025-12-16 cs.CL cs.AI 73%

State over Tokens: Characterizing the Role of Reasoning Tokens

令牌上的状态:阐明推理令牌的作用

Mosh Levy, Zohar Elyoseph, Shauli Ravfogel, Yoav Goldberg

机构 * Bar-Ilan University(巴伊兰大学) University of Haifa(海法大学) New York University(纽约大学) Allen Institute for AI(人工智能研究院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出SoT框架,将LLM的推理令牌视为外部化计算状态,而非文本叙述,以揭示其实际推理机制及未被关注的研究问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02454 2025-12-16 cs.CL cs.AI 73%

Multimodal DeepResearcher: Generating Text-Chart Interleaved Reports From Scratch with Agentic Framework

多模态深度研究员:从零开始生成文本-图表交织报告的代理框架

Zhaorui Yang, Bo Pan, Han Wang, Yiyao Wang, Xingyu Liu, Luoxuan Weng, Yingchaojie Feng, Haozhe Feng, Minfeng Zhu, Bo Zhang, Wei Chen

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 多模态深度研究员通过代理框架实现从零开始生成文本-图表交织报告,利用FDV结构化文本表示提升可视化生成质量。

Comments AAAI 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09810 2025-12-16 cs.AI 70%

Towards a Common Framework for Autoformalization

迈向自动形式化的一个共同框架

Agnieszka Mensfelt, David Tena Cucala, Santiago Franco, Angeliki Koutsoukou-Argyraki, Vince Trencsenyi, Kostas Stathis

机构 * Department of Computer Science, Royal Holloway, University of London(伦敦大学皇家霍洛威学院计算机科学系) Department of Computer Science and Technology, University of Cambridge(剑桥大学计算机科学与技术系)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文旨在提出一个统一框架,以促进不同领域之间的交叉融合,推动下一代人工智能系统的发展。

Comments Presented at NeLaMKRR@KR, 2025 (arXiv:2511.09575). A shorter version of this work will appear in the Proceedings of the AAAI Conference on Artificial Intelligence (AAAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08768 2025-12-16 cs.CL 70%

AraReasoner: Evaluating Reasoning-Based LLMs for Arabic NLP

AraReasoner: 评估基于推理的LLM在阿拉伯语NLP中的表现

Ahmed Hasanaath, Aisha Alansari, Ahmed Ashraf, Chafik Salmane, Hamzah Luqman, Saad Ezzini

机构 * King Fahd University of Petroleum and Minerals(国王法赫德石油和矿物大学) SDAIA–KFUPM Joint Research Center for Artificial Intelligence(SDAIA-KFUPM人工智能联合研究中心) Mohammed VI Polytechnic University(穆莱·易卜拉欣(polytechnic)大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 AraReasoner评估基于推理的LLM在阿拉伯语NLP中的表现,发现通过精心选择示例可显著提升分类任务性能,DeepSeek在复杂推理任务中表现优于GPT基线,LoRA微调进一步提升F1和BLEU分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21320 2025-12-16 cs.CL 70%

SciReasoner: Laying the Scientific Reasoning Ground Across Disciplines

SciReasoner: 跨学科的科学推理基础

Yizhou Wang, Chen Tang, Han Deng, Jiabei Xiao, Jiaqi Liu, Jianyu Wu, Jun Yao, Pengze Li, Encheng Su, Lintao Wang, Guohang Zhuang, Yuchen Ren, Ben Fei, Ming Hu, Xin Chen, Dongzhan Zhou, Junjun He, Xiangyu Yue, Zhenfei Yin, Jiamin Wu, Qihao Zheng, Yuhao Zhou, Huihui Xu, Chenglong Ma, Yan Lu, Wenlong Zhang, Chunfeng Song, Philip Torr, Shixiang Tang, Xinzhu Ma, Wanli Ouyang, Lei Bai

专题命中 推理与问题求解 :foundation model(abstract);SFT(abstract);分类 cs.CL

AI总结 SciReasoner通过跨学科学习提升科学推理能力,支持多种任务,增强跨领域泛化和准确性。

Comments technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14829 2025-12-16 cs.CL 70%

Measuring Chain of Thought Faithfulness by Unlearning Reasoning Steps

通过反向学习推理步骤来衡量推理链的忠实性

Martin Tutek, Fateme Hashemi Chaleshtori, Ana Marasović, Yonatan Belinkov

机构 * Technion - Israel Institute of Technology(技术学院-以色列理工学院) University of Utah(犹他大学)

专题命中 推理与问题求解 :language model(abstract);prompting(abstract);分类 cs.CL

AI总结 通过反向学习推理步骤来评估推理链的参数忠实性,揭示模型推理与预测之间的关系。

Comments Outstanding paper at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01700 2025-12-16 cs.AI 70%

DeepVIS: Bridging Natural Language and Data Visualization Through Step-wise Reasoning

DeepVIS: 通过分步推理连接自然语言与数据可视化

Zhihao Shuai, Boyan Li, Siyu Yan, Yuyu Luo, Weikai Yang

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Hong Kong University of Science and Technology(香港科技大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 DeepVIS通过整合分步推理提升自然语言到可视化的质量,提供透明的推理过程以增强用户理解与调整能力。

Comments IEEE VIS 2025 full paper

Journal ref IEEE Transactions on Visualization and Computer Graphics, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10576 2025-12-16 cs.CV 67%

HumanSense: From Multimodal Perception to Empathetic Context-Aware Responses through Reasoning MLLMs

HumanSense: 从多模态感知到通过推理的 empathetic 上下文感知响应

Zheng Qin, Ruobing Zheng, Yabing Wang, Tianqi Li, Yi Yuan, Jingdong Chen, Le Wang

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

AI总结 HumanSense通过多阶段模态渐进强化学习提升MLLMs在多模态感知和交互任务中的性能,强调推理能力对共情反馈的重要性。

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12957 2025-12-16 cs.DB cs.LO 67%

Database Research needs an Abstract Relational Query Language

数据库研究需要一种抽象关系查询语言

Wolfgang Gatterbauer, Diandre Miguel Sabale

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

AI总结 本文提出了一种抽象关系查询语言(ARQL),旨在通过分离查询意图与语法,提供统一的语义框架,以支持机器生成查询与人类验证调试的交互需求。

Comments CIDR 2026. 16th Annual Conference on Innovative Data Systems Research (CIDR '26). January 18-21, 2026, Chaminade, USA. 16 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12692 2025-12-16 cs.AI cs.CL cs.LG 67%

WebOperator: Action-Aware Tree Search for Autonomous Agents in Web Environment

WebOperator: 基于动作意识的树搜索用于网络环境中的自主代理

Mahir Labib Dihan, Tanzima Hashem, Mohammed Eunus Ali, Md Rizwan Parvez

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Bangladesh University of Engineering and Technology (BUET)(孟加拉工程与技术大学) Faculty of Information Technology(信息技术学院) Monash University(莫纳什大学) Qatar Computing Research Institute (QCRI)(卡塔尔计算研究所)

专题命中 推理与问题求解 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 WebOperator通过引入树搜索框架,实现可靠的回溯和战略探索,提升自主代理在网页环境中的任务成功率。

Comments Under review at ICLR 2026. Project page: https://kagnlp.github.io/WebOperator/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01948 2025-12-16 cs.CL 57%

How Far Are We from Genuinely Useful Deep Research Agents?

我们距离真正有用的深度研究代理还有多远?

Dingling Zhang, He Zhu, Jincheng Ren, Kangqi Song, Xinran Zhou, Boyu Feng, Shudong Liu, Jiabin Luo, Weihao Xie, Zhaohui Wang, Tianrui Qin, King Zhu, Yuqing Wang, Qianben Chen, Yuchen Eleanor Jiang, Wei Wang, Jiaheng Liu, Wangchunshu Zhou

机构 * OPPO AI Agent Team(OPPO 人工智能代理团队)

专题命中 推理与问题求解 :LLM(abstract);分类 cs.CL

AI总结 本文提出FINDER基准和DEFT分类,揭示当前深度研究代理在证据整合与推理鲁棒性规划方面的不足。

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19476 2025-12-16 cs.CL 57%

A Pipeline to Assess Merging Methods via Behavior and Internals

一种通过行为和内部机制评估合并方法的流程

Yutaro Sigrist, Andreas Waldis

机构 * Information Systems Research Lab, Lucerne University of Applied Sciences and Arts(卢塞恩应用科学与艺术大学信息系统研究实验室) Technical University of Darmstadt(达姆施塔特技术大学)

专题命中 推理与问题求解 :language model(abstract);分类 cs.CL

AI总结 本文提出了一种评估合并方法的流程,通过行为和内部机制的综合分析,揭示合并对模型性能和语言能力的影响。

Comments BlackboxNLP

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13380 2025-12-16 cs.RO 50%

Universal Dexterous Functional Grasping via Demonstration-Editing Reinforcement Learning

通过演示编辑强化学习实现通用灵巧功能抓取

Chuan Mao, Haoqi Yuan, Ziye Huang, Chaoyi Xu, Kai Ma, Zongqing Lu

机构 * Peking University(北京大学) BeingBeyond

专题命中 推理与问题求解 :language model(abstract)

AI总结 本研究提出DemoFunGrasp,通过演示编辑强化学习实现通用灵巧功能抓取,提升抓取性能和现实泛化能力。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 评测与基准 55 篇

2506.07927 2025-12-16 cs.AI cs.CL cs.LG 90%

Solving Inequality Proofs with Large Language Models

用大语言模型解决不等式证明

Pan Lu, Jiayi Sheng, Luna Lyu, Jikai Jin, Tony Xia, Alex Gu, James Zou

机构 * Stanford University(斯坦福大学) UC Berkeley(伯克利大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种非正式但可验证的任务公式化方法,通过IneqMath数据集和LLM-as-judge评估框架,揭示了大语言模型在解决不等式证明任务中的局限性及改进方向。

Comments 50 pages, 24 figures, accepted as a Spotlight at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11009 2025-12-16 cs.CL cs.AI 90%

SproutBench: A Benchmark for Safe and Ethical Large Language Models for Youth

SproutBench: 为青少年设计的安全和伦理大型语言模型基准

Wenpeng Xing, Lanyi Wei, Haixiao Hu, Jingyi Yu, Rongchang Li, Mohan Li, Changting Lin, Meng Han

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 SproutBench通过1283个发展性对抗提示评估47种LLMs,揭示儿童安全漏洞,为青少年AI设计提供指导。

Comments Accepted in AAAI 2026 Workshop on AI for Education

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12488 2025-12-16 cs.CL 89%

The American Ghost in the Machine: How language models align culturally and the effects of cultural prompting

机器中的美国幽灵:语言模型如何实现文化对齐以及文化提示的影响

James Luther, Donald Brown

机构 * School of Data Science University of Virginia(数据科学学院 多伦多大学)

专题命中 评测与基准 :language model(title,abstract);prompting(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本研究通过文化提示测试了多种LLM对不同文化适应性,发现多数模型默认倾向美国,但对日本和中国文化对齐存在困难。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03761 2025-12-16 cs.CL 89%

Pet-Bench: Benchmarking the Abilities of Large Language Models as E-Pets in Social Network Services

Pet-Bench: 评估大型语言模型作为社交网络服务中电子宠物的能力基准

Hongcheng Guo, Zheyong Xie, Shaosheng Cao, Boyang Wang, Weiting Liu, Zheyu Ye, Zhoujun Li, Zuozhu Liu, Wei Lu

机构 * Fudan University(复旦大学) Xiaohongshu Inc.(小红书公司) Beihang University(北航) Zhejiang University(浙江大学) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 Pet-Bench是一个评估大型语言模型作为电子宠物在社交网络服务中能力的基准测试,通过多样化的任务和7500多个互动实例,评估模型在自我进化和人际互动方面的表现,揭示模型大小和能力对性能的影响,推动情感沉浸式人-宠物互动的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13004 2025-12-16 eess.SY cs.SY 89%

Large Language Models for Power System Applications: A Comprehensive Literature Survey

大语言模型在电力系统应用中的综述:全面的文献调查

Muhammad Sarwar, Muhammad Rizwan, Mubushra Aziz, Abdul Rehman Sudais

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文综述了大语言模型在电力系统中的应用,探讨了其在故障诊断、负荷预测等领域的潜力及面临的挑战,提出未来研究方向。

Comments 17 pages, 1 table, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13330 2025-12-16 cs.CL cs.AI 88%

FIN-bench-v2: A Unified and Robust Benchmark Suite for Evaluating Finnish Large Language Models

FIN-bench-v2:一个用于评估芬兰大型语言模型的统一且稳健的基准测试集

Joona Kytöniemi, Jousia Piha, Akseli Reunamo, Fedor Vitiugin, Farrokh Mehryary, Sampo Pyysalo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 FIN-bench-v2通过整合芬兰语言任务和评估方法,提供统一且稳健的基准测试集,用于评估芬兰大型语言模型的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20578 2025-12-16 cs.SE 88%

LLPut: Investigating Large Language Models for Bug Report-Based Input Generation

LLPut: 探究大型语言模型在基于bug报告的输入生成中的应用

Alif Al Hasan, Subarna Saha, Mia Mohammad Imran, Tarannum Shaila Zaman

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出LLPut技术,评估三种开源生成式LLMs在从bug报告中提取相关输入方面的性能,探讨生成式LLMs在自动bug诊断中的能力和限制。

Journal ref The First International Workshop on Large Language Model-Oriented Empirical Research (LLanMER 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12010 2025-12-16 cs.CY cs.CL 88%

Leveraging Large Language Models for Career Mobility Analysis: A Study of Gender, Race, and Job Change Using U.S. Online Resume Profiles

利用大语言模型进行职业流动性分析:一项基于美国在线简历资料研究性别、种族和工作转换的调查

Palakorn Achananuparp, Ye Xu, Yao Lu, Xavier Jayaraj Siddarth Ashok, Ee-Peng Lim

机构 * Singapore Management University(新加坡国立管理学院) Columbia University(哥伦比亚大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本研究利用大语言模型分析美国在线简历数据,探讨性别、种族和工作转换对职业流动性的影响,发现女性和黑人毕业生的工作转换回报较低。

Comments Accepted by EPJ Data Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23065 2025-12-16 cs.CL 88%

SNS-Bench-VL: Benchmarking Multimodal Large Language Models in Social Networking Services

SNS-Bench-VL:在社交网络服务中评估多模态大语言模型的基准测试

Hongcheng Guo, Zheyong Xie, Shaosheng Cao, Boyang Wang, Weiting Liu, Anjie Le, Lei Li, Zhoujun Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 SNS-Bench-VL是一个用于评估多模态大语言模型在社交网络服务中性能的基准测试,涵盖8个多模态任务,包含4001个问题-答案对,评估25种先进模型,揭示多模态社交理解的挑战。

Comments We found problems in the code while rechecking our implementation. These issues led to noticeable numerical discrepancies, making some of the reported results and conclusions potentially unreliable. Therefore, we request to withdraw this submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12059 2025-12-16 cs.AI 88%

The Forecast Critic: Leveraging Large Language Models for Poor Forecast Identification

预测批评者:利用大语言模型进行差预测识别

Luke Bhan, Hanyu Zhang, Andrew Gordon Wilson, Michael W. Mahoney, Chuck Arvin

机构 * Amazon(亚马逊)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 利用大语言模型进行预测监控,通过识别不合理预测提升预测质量。

Comments Presented at AAAI 2026 AI4TS workshop and AABA4ET workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15101 2025-12-16 cs.LG cs.CL cs.IT math.IT 86%

Cost-aware LLM-based Online Dataset Annotation

面向成本的基于大语言模型的在线数据集标注

Eray Can Elumar, Cem Tekin, Osman Yagan

机构 * Dept. of Electrical and Computer Engineering(电气与计算机工程系) Carnegie Mellon University(卡内基梅隆大学) Dept. of Electrical Engineering(电气工程系) Bilkent University(比尔肯特大学)

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出CaMVo框架,通过自适应选择LLM子集降低标注成本,实现高效准确的数据集标注。

Journal ref In The Thirty-ninth Annual Conference on Neural Information Processing Systems, 2025. URL https://openreview.net/forum?id=3AdTRYA2uJ

详情

展开后加载摘要…

URL PDF HTML 收藏