arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 5118 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5118 篇

2603.03543 2026-03-05 cs.CL cs.AI 62%

Tucano 2 Cool: Better Open Source LLMs for Portuguese

Tucano 2 Cool: 更好的开源葡萄牙语大语言模型

Nicholas Kluge Corrêa, Aniket Sen, Shiza Fatimah, Sophia Falk, Lennard Landgraf, Julia Kastner, Lucie Flek

机构 * Bonn-Aachen International Center for Information Technology (b-it) / CAISA Lab(波恩-亚琛国际信息科技中心(b-it)/ CAISA实验室) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔机器学习与人工智能研究所) Center for Science and Thought(科学与思想研究中心) Helmholtz-Institut für Strahlen- und Kernphysik(亥姆霍兹辐射与核物理研究所) Bonn Sustainable AI Lab(波恩可持续AI实验室)

专题命中 工具调用 :tool use(abstract);分类 cs.AI、cs.CL

AI总结 Tucano 2推出了一系列开源葡萄牙语大语言模型,通过扩展数据集和改进训练方法,实现了在多种语言任务上的最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11601 2026-03-02 cs.LG cs.AI 62%

Continuous Optimization for Feature Selection with Permutation-Invariant Embedding and Policy-Guided Search

基于排列不变嵌入和策略引导搜索的连续优化特征选择

Rui Liu, Rui Xie, Zijun Yao, Yanjie Fu, Dongjie Wang

机构 * University of Kansas(堪萨斯大学) University of Central Florida(中央佛罗里达大学) Arizona State University(亚利桑那州立大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种基于排列不变嵌入和策略引导搜索的连续优化特征选择框架,通过编码器-解码器范式和强化学习方法解决特征子集嵌入中的排列敏感性和凸性假设问题。

Comments KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16800 2026-02-27 cs.CR cs.AI cs.LG 62%

Large-scale online deanonymization with LLMs

大规模在线去匿名化与LLMs

Simon Lermen, Daniel Paleka, Joshua Swanson, Michael Aerni, Nicholas Carlini, Florian Tramèr

机构 * MATS ETH Zurich(苏黎世联邦理工学院) Anthropic

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 利用LLMs实现大规模在线去匿名化,通过提取身份特征、语义嵌入搜索和推理验证,显著提升召回率和精度,挑战现有隐私保护机制。

Comments 24 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20809 2026-02-25 cs.LG cs.AI 62%

Regret-Guided Search Control for Efficient Learning in AlphaZero

基于遗憾的搜索控制用于AlphaZero中的高效学习

Yun-Jui Tsai, Wei-Yu Chen, Yan-Ru Ju, Yu-Hung Chang, Ti-Rong Wu

机构 * Department of Computer Science, National Yang Ming Chiao Tung University, Taiwan(National Yang Ming Chiao Tung University) Institute of Information Science, Academia Sinica, Taiwan(Academia Sinica) College of Computing, Georgia Institute of Technology(Georgia Institute of Technology)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 RGSC通过学习识别高遗憾状态,提升AlphaZero的搜索效率和鲁棒性,显著提高围棋等游戏的性能。

Comments Accepted by the Fourteenth International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15796 2026-02-25 cs.LG cs.AI q-bio.BM 62%

Monte Carlo Tree Diffusion with Multiple Experts for Protein Design

结合多专家的蒙特卡洛树扩散用于蛋白质设计

Xuefeng Liu, Mingxuan Cao, Songhao Jiang, Xiao Luo, Xiaotian Duan, Mengdi Wang, Tobin R. Sosnick, Jinbo Xu, Rick Stevens

机构 * University of Chicago(芝加哥大学) Data Science Institute(数据科学研究所) Department of Biochemistry and Molecular Biology(生物化学与分子生物学系) Toyota Technological Institute at Chicago(芝加哥丰田技术研究所) Argonne National Laboratory(阿贡国家实验室) Princeton University(普林斯顿大学)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 MCTD-ME通过结合多专家的蒙特卡洛树扩散方法,提升蛋白质设计任务的性能,特别是在反向折叠、折叠和条件设计挑战中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15923 2026-02-19 cond-mat.mtrl-sci cs.AI cs.LG 62%

A fully differentiable framework for training proxy Exchange Correlation Functionals for periodic systems

一种完全可微的框架用于训练周期系统中的代理交换关联函数

Rakshit Kumar Singh, Aryan Amit Barsainyan, Bharath Ramsundar

机构 * Deep Forest Sciences(深林科学)

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种可微框架,用于训练周期系统中的代理交换关联函数,通过整合机器学习模型提升DFT计算效率,实验结果显示相对误差在5-10%范围内。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13543 2026-02-17 cs.IR cs.CL cs.LG 62%

LiveNewsBench: Evaluating LLM Web Search Capabilities with Freshly Curated News

LiveNewsBench: 用最新整理的新闻评估大语言模型网络搜索能力

Yunfan Zhang, Kathleen McKeown, Smaranda Muresan

机构 * Columbia University(哥伦比亚大学) Barnard College(巴纳德学院)

专题命中 工具调用 :agentic(abstract);分类 cs.CL、cs.LG

AI总结 LiveNewsBench通过最新新闻数据评估大语言模型的网络搜索能力,提供多跳搜索和推理任务,支持大规模训练数据集构建,公开排行榜和代码。

Comments An earlier version of this work was publicly available on OpenReview as an ICLR 2026 submission in September 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11581 2026-02-13 cs.IR cs.AI cs.CL 62%

Analytical Search

分析搜索

Yiteng Tu, Shuo Miao, Weihang Su, Yiqun Liu, Qingyao Ai

机构 * DCST, Tsinghua University(清华大学智能驾驶与车路协同研究院) Quan Cheng Laboratory(量子工程实验室)

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 本文提出分析搜索范式,旨在通过证据导向和多步骤推理解决复杂分析需求,提升信息检索的端到端能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06717 2026-02-12 cs.LG cs.AI 62%

Proficient Graph Neural Network Design by Accumulating Knowledge on Large Language Models

通过在大型语言模型上积累知识来精通图神经网络设计

Jialiang Wang, Hanmo Liu, Shimin Di, Zhili Wang, Jiachuan Wang, Lei Chen, Xiaofang Zhou

机构 * Hong Kong University of Science and Technology(香港科学与技术大学) Southeast University(东南大学) HoHuawei Hong Kong Research Center (HKRC)(华为香港研究中心) University of Tsukuba(筑波大学)

专题命中 工具调用 :AI agent(abstract);分类 cs.AI、cs.LG

AI总结 DesiGNN通过在大型语言模型上积累知识,提升图神经网络设计的自动化水平,实现高效精准的模型生成。

Comments Accepted at WSDM 2026. Title changed from "Computation-friendly graph neural network design by accumulating knowledge on large language models" to "Proficient Graph Neural Network Design by Accumulating Knowledge on Large Language Models"

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21475 2026-02-10 cs.NE cs.AI cs.LG 62%

Task-free Adaptive Meta Black-box Optimization

无需任务的自适应元黑盒优化

Chao Wang, Licheng Jiao, Lingling Li, Jiaxuan Zhao, Guanchun Wang, Fang Liu, Shuyuan Yang

机构 * Xidian University(西安电子科技大学) Tianjin Research Institute for Water Transport Engineering, M.O.T.(天津水运工程研究院)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 ABOM通过闭环自适应参数学习机制,在无需预定义任务分布的情况下实现零样本黑盒优化。

Comments This article was published as a conference paper (oral) at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01475 2026-02-03 cs.AI cs.LG 62%

Learning to Guide Local Search for MPE Inference in Probabilistic Graphical Models

在概率图模型中学习引导局部搜索用于MPE推断

Brij Malhotra, Shivvrat Arya, Tahrima Rahman, Vibhav Giridhar Gogate

机构 * Department of Computer Science(计算机科学系) The University of Texas at Dallas(德克萨斯大学达拉斯分校) New Jersey Institute of Technology(新泽西理工学院)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出神经元消融框架,通过学习引导局部搜索以提升概率图模型中MPE推断的效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20131 2026-01-29 cs.IR cs.AI cs.SE 62%

Taxonomy of the Retrieval System Framework: Pitfalls and Paradigms

检索系统框架的分类:陷阱与范式

Deep Shah, Sanket Badhe, Nehal Kathrotia

机构 * National Institute of Standards(国家标准技术研究所) Department of Physics, Colorado State University, Fort Collins, CO 80523 USA(科罗拉多州立大学物理系) Electrical Engineering Department, University of Colorado, Boulder, CO 80309 USA(科罗拉多大学电气工程系) Google LLC, CA 94043 USA(谷歌公司)

专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文提出检索系统框架的分类方法,探讨了效率与有效性之间的权衡,分析了表示、粒度、协调和鲁棒性层的设计挑战,并提供优化现代神经搜索系统的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11234 2026-01-28 cs.LG cs.AI 62%

Bayes Adaptive Monte Carlo Tree Search for Offline Model-based Reinforcement Learning

贝叶斯自适应蒙特卡洛树搜索用于离线模型驱动强化学习

Jiayu Chen, Le Xu, Wentse Chen, Jeff Schneider

机构 * The University of Hong Kong(香港大学) Tsinghua University(清华大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出贝叶斯自适应蒙特卡洛树搜索算法,用于提升离线模型驱动强化学习的性能,显著优于现有方法。

Comments This paper is accepted in ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17829 2026-01-27 cs.CL cs.AI 62%

Linguistic and Argument Diversity in Synthetic Data for Function-Calling Agents

合成数据中语言和论证多样性用于功能调用代理

Dan Greenstein, Zohar Karnin, Chen Amiraz, Oren Somekh

机构 * Technion(技术学院) TII(技术研究所)

专题命中 工具调用 :function calling(abstract);分类 cs.AI、cs.CL

AI总结 本文提出了一种生成合成数据集的方法,通过优化通用多样性度量标准,提高功能调用代理训练数据的语言和论证多样性,从而提升模型在分布外任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15058 2026-01-27 cs.CR cs.LG cs.SE 62%

LibLMFuzz: LLM-Augmented Fuzz Target Generation for Black-box Libraries

LibLMFuzz: 用于黑盒库的LLM增强模糊目标生成

Ian Hardgrove, John D. Hastings

机构 * The Beacom College of Computer and Cyber Sciences(计算机与网络科学学院) Dakota State University(达科他州立大学)

专题命中 工具调用 :agentic(abstract);分类 cs.LG、cs.SE

AI总结 LibLMFuzz通过结合LLM和轻量级工具链,实现对闭源库的自动模糊测试,生成正确驱动程序并提高覆盖率。

Comments 6 pages, 2 figures, 1 table, 2 listings

Journal ref 2025 IEEE Cyber Awareness and Research Symposium (CARS'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13564 2026-01-21 cs.LG cs.AI physics.chem-ph q-bio.BM 62%

Multi-objective fluorescent molecule design with a data-physics dual-driven generative framework

具有数据-物理双驱生成框架的多目标荧光分子设计

Yanheng Li, Zhichen Pu, Lijiang Yang, Zehao Zhou, Yi Qin Gao

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 LUMOS通过结合数据与物理驱动的生成框架,实现了多目标荧光分子的高效反向设计与优化。

Comments Total 43 pages: 32 pages Main Text + 11 pages SI

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13384 2026-01-21 cs.SE cs.CL 62%

From Completion to Editing: Unlocking Context-Aware Code Infilling via Search-and-Replace Instruction Tuning

从补全到编辑:通过搜索和替换指令微调解锁上下文感知的代码填充

Jiajun Zhang, Zeyu Cui, Jiaxi Yang, Lei Zhang, Yuheng Jing, Zeyao Ma, Tianyi Bai, Zilei Wang, Qiang Liu, Liang Wang, Binyuan Hui, Junyang Lin

机构 * USTC(University of Science and Technology of China) Alibaba Group(阿里巴巴集团) CASIA(Chinese Academy of Sciences Institute of Automation) SIAT(Institute of Automation, Chinese Academy of Sciences)

专题命中 工具调用 :agentic(abstract);分类 cs.CL、cs.SE

AI总结 通过搜索和替换指令微调,SRI框架实现了上下文感知的代码填充,提升了补全性能并保持低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20156 2026-01-21 cs.CL cs.AI cs.SD eess.AS 62%

Fun-Audio-Chat Technical Report

Fun-Audio-Chat 技术报告

Tongyi Fun Team, Qian Chen, Luyao Cheng, Chong Deng, Xiangang Li, Jiaqing Liu, Chao-Hong Tan, Wen Wang, Junhao Xu, Jieping Ye, Qinglin Zhang, Qiquan Zhang, Jingren Zhou

机构 * Alibaba Group(阿里巴巴集团)

专题命中 工具调用 :function calling(abstract);分类 cs.AI、cs.CL

AI总结 Fun-Audio-Chat通过双分辨率语音表示和核心鸡尾酒训练,解决语音-文本模型的时间分辨率不匹配和灾难性遗忘问题,实现高效且高质量的音频理解与生成。

Comments Authors are listed in alphabetical order, 21 pages, open-source at https://github.com/FunAudioLLM/Fun-Audio-Chat

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13075 2026-01-21 cs.LG cs.AI 62%

METIS: Mentoring Engine for Thoughtful Inquiry & Solutions

METIS:面向深入探究与解决方案的导师引擎

Abhinav Rajeev Kumar, Dhruv Trehan, Paras Chopra

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 METIS通过工具增强和阶段意识功能,帮助本科生从想法发展到论文,优于GPT-5和Claude Sonnet 4.5,在文档基础阶段表现更佳。

Comments 12 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11560 2026-01-21 cs.IR cs.AI cs.LG 62%

DeepEvidence: Empowering Biomedical Discovery with Deep Knowledge Graph Research

DeepEvidence: 通过深度知识图谱研究赋能生物医学发现

Zifeng Wang, Zheng Chen, Ziwei Yang, Xuan Wang, Qiao Jin, Yifan Peng, Zhiyong Lu, Jimeng Sun

机构 * Keiji AI Institute of Scientific and Industrial Research, Osaka University(大阪大学科学工业研究所) Bioinformatics Center, Institute for Chemical Research, Kyoto University(京都大学化学研究所生物信息中心) Division of Intramural Research, National Library of Medicine, National Institutes of Health(国家卫生研究院生物医学图书馆内部研究部) Department of Population Health Sciences, Weill Cornell Medicine(韦尔·科恩医学中心流行病学与健康科学系) School of Computing and Data Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机与数据科学学院)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 DeepEvidence通过深度知识图谱研究框架,系统化地连接异构生物医学资源,提升科学发现的效率和证据综合能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26854 2026-01-21 cs.AI cs.LG 62%

Inverse Knowledge Search over Verifiable Reasoning: Synthesizing a Scientific Encyclopedia from a Long Chains-of-Thought Knowledge Base

反向知识搜索与可验证推理:从长推理链知识库合成科学百科全书

Yu Li, Yuan Huang, Tao Wang, Caiyu Fan, Xiansheng Cai, Sihan Hu, Xinzijian Liu, Cheng Shi, Mingjun Xu, Zhen Wang, Yan Wang, Xiangqi Jin, Tianhan Zhang, Linfeng Zhang, Lei Wang, Youjin Deng, Pan Zhang, Weijie Sun, Xinyu Li, Weinan E, Linfeng Zhang, Zhiyuan Yao, Kun Chen

机构 * Lanzhou Center for Theoretical Physics, Key Laboratory of Theoretical Physics of Gansu Province, Key Laboratory of Quantum Theory and Applications of MoE, Gansu Provincial Research Center for Basic Disciplines of Quantum Physics(兰州理论物理中心、甘肃省理论物理重点实验室、教育部量子理论与应用重点实验室、甘肃省量子物理基础学科研究省重点中心) Institute of Theoretical Physics, Chinese Academy of Sciences(中国科学院理论物理研究所) DP Technology(DP技术) Institute of Physics, Chinese Academy of Sciences(中国科学院物理研究所) Département d’Informatique, École normale supérieure(巴黎高等师范大学计算机系)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于长推理链知识库的反向知识搜索方法,通过生成可验证的科学百科全书,实现了跨领域科学合成。

Comments 43 pages, 4 figures. This work is part of the SciencePedia project (sciencepedia.bohrium.com). Corrected author name spelling

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07580 2026-01-13 physics.ins-det cs.AI cs.LG hep-ex 62%

Large Language Models for Physics Instrument Design

大型语言模型在物理仪器设计中的应用

Sara Zoccheddu, Shah Rukh Qasim, Patrick Owen, Nicola Serra

专题命中 工具调用 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了大型语言模型在物理仪器设计中的应用,发现其能生成有效且物理合理的配置,尽管未进行特定任务训练,并提出将LLMs与强化学习结合以优化设计工作流。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06604 2026-01-13 cs.AI cs.LG cs.RO 62%

Object-Centric World Models Meet Monte Carlo Tree Search

以对象为中心的世界模型与蒙特卡洛树搜索

Rodion Vakhitov, Leonid Ugadiarov, Aleksandr Panov

机构 * MIPT Moscow(莫斯科米斯托夫物理技术学院) AIRI(人工智能研究所) FRC CSC RAS(俄罗斯科学院计算机科学与应用数学研究所)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出ObjectZero算法,通过对象中心表示和图神经网络,结合蒙特卡洛树搜索实现更有效的环境建模与强化学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06301 2026-01-13 cs.CR cs.AI cs.SE 62%

Beyond BeautifulSoup: Benchmarking LLM-Powered Web Scraping for Everyday Users

超越BeautifulSoup:为日常用户评估基于LLM的网络爬虫基准测试

Arth Bhardwaj, Nirav Diwan, Gang Wang

专题命中 工具调用 :tool use(abstract);分类 cs.AI、cs.SE

AI总结 本文评估了基于LLM的网络爬虫在日常用户中的应用,展示了端到端LLM代理如何使复杂爬虫变得简单,同时比较了LLM辅助脚本和端到端代理在不同场景下的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03476 2026-01-08 eess.SY cs.AI cs.LG cs.MA cs.SY 62%

Online Decision-Making Under Uncertainty for Vehicle-to-Building Systems

在不确定环境下为车辆到建筑系统进行在线决策

Rishav Sen, Yunuo Zhang, Fangqi Liu, Jose Paolo Talusan, Ava Pettet, Yoshinori Suzue, Ayan Mukhopadhyay, Abhishek Dubey

机构 * Vanderbilt University(范德比大学) Nissan Advanced Technology Center - Silicon Valley(日产先进技术中心-硅谷)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出了一种基于马尔可夫决策过程的在线决策方法,用于解决车辆到建筑系统在不确定环境下的优化问题,通过在线搜索和启发式剪枝提升效率,实验表明其优于现有方法。

Comments 17 pages, 2 figures, 10 tables. Published in the Proceedings of the 16th ACM/IEEE International Conference on Cyber-Physical Systems (ICCPS '25), May 06--09, 2025, Irvine, CA, USA

Journal ref Proceedings of 16th ACM/IEEE International Conference on Cyber-Physical Systems (ICCPS), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08726 2026-01-08 cs.CL cs.AI 62%

Improved LLM Agents for Financial Document Question Answering

改进的金融文档问答大型语言模型代理

Nelvin Tan, Zian Seng, Liang Zhang, Yu-Ching Shih, Dong Yang, Amol Salunkhe

机构 * American Express(美国美国运通)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出改进的金融文档问答代理,通过实验展示其在无 oracle 标签情况下的有效性,并引入更安全的计算代理。

Comments 13 pages, 6 figures. More analysis is added to Appendix C

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02714 2026-01-07 cs.AI cs.CL 62%

Time-Scaling Is What Agents Need Now

现在智能体需要时间扩展

Zhi Liu, Guangzhi Wang

机构 * CareerInternational Research Team(CareerInternational研究团队)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出时间扩展概念,旨在通过扩展时间路径提升智能体的深度推理和问题解决能力,无需增加静态参数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14244 2026-01-06 cs.CL cs.AI 62%

From Context to EDUs: Faithful and Structured Context Compression via Elementary Discourse Unit Decomposition

从上下文到EDUs:通过基本话语单元分解实现忠实且结构化的上下文压缩

Yiqing Zhou, Yu Lei, Shuzheng Si, Qingyan Sun, Wei Wang, Yifei Wu, Hao Wen, Gang Chen, Fanchao Qi, Maosong Sun

机构 * DeepLang AI Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学) Beijing University of Posts and Telecommunications(北京邮电大学) Beijing Jiaotong University(北京交通大学)

专题命中 工具调用 :autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出EDU-based Context Compressor,通过基本话语单元分解实现结构化上下文压缩,提升模型在长文档问答和复杂搜索任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19717 2025-12-24 cs.LG cs.AI 62%

Thermodynamic Focusing for Inference-Time Search: Practical Methods for Target-Conditioned Sampling and Prompted Inference

推理时间搜索的热力学聚焦:目标条件采样和提示推理的实用方法

Zhan Zhang

机构 * Zhan Zhang(张湛)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出ICFA算法,通过目标条件重新加权提升推理时间搜索效率,结合结构化提示与混合架构实现更高效的样本利用。

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03343 2025-12-15 cs.CL cs.AI 62%

Idea-Gated Transformers: Enforcing Semantic Coherence via Differentiable Vocabulary Pruning

Idea-Gated Transformers: 通过可微分词汇修剪强制语义一致性

Darshan Fofadiya

机构 * Darshan Fofadiya(独立研究者)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.CL

AI总结 Idea-Gated Transformers通过可微分词汇修剪机制,实现语义一致性,提升语言模型的领域保留能力与生成可控性。

Comments Code available at https://github.com/DarshanFofadiya/idea-gated-transformers/tree/main

详情

展开后加载摘要…

URL PDF HTML 收藏