arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-28 至 2026-08-28 共收录 223 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 65 篇

2510.12979 2026-08-28 cs.AI cs.CL 版本更新 81%

DeepPlanner: Scaling Planning Capability for Deep Research Agents via Advantage Shaping

DeepPlanner:通过优势塑造提升深度研究智能体的规划能力

Wei Fan, Wenlin Yao, Zheng Li, Feng Yao, Xin Liu, Liang Qiu, Qingyu Yin, Yangqiu Song, Bing Yin

机构 * The Hong Kong University of Science and Technology(香港科技大学) Amazon(亚马逊) University of California, San Diego(加州大学圣地亚哥分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 针对现有深度研究智能体规划阶段优化不足的问题,提出端到端 RL 框架 DeepPlanner,通过塑造 token 级优势与选择性提升样本级优势,在7个基准上以更低训练预算实现最优规划效果。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27225 2026-08-28 cs.RO cs.AI 新提交 79%

STEP: State-Aware Task Estimation and Planning with Multi-Modal LLMs for Human-Robot Collaboration

STEP:基于多模态大语言模型的状态感知任务估计与规划,用于人机协作

Maitrey Gramopadhye, Prakash Baskaran, Xiao Liu, Songpo Li, Soshi Iba

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Honda Research Institute(本田研究所)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 该研究针对多模态大语言模型用于人机协作任务规划时的状态理解缺失问题,提出STEP方法,在机器人装配模拟任务中使动作可执行性提升32.8%、最终状态误差降低14.8%。

Comments Published in IEEE International Conference on Robot and Human Interactive Communication (RO-MAN), 2026, 8 pages, 4 figuers, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27219 2026-08-28 cs.CL 新提交 79%

BALMS: Benchmarking Agentic LLMs for Longitudinal Mental Health Sensing

BALMS:面向纵向心理健康感知的智能体大语言模型基准测试

Yu Yvonne Wu, Arvind Pillai, Yuliang Chen, Yuwei Zhang, Sudarshan Regmi, Tess Z. Griffin, Michael V. Heinz, Lisa A. Marsch, Nicholas C. Jacobson, Andrew Campbell

机构 * Dartmouth College(达特茅斯学院) University of Cambridge(剑桥大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.CL

AI总结 该研究提出首个面向纵向心理健康感知的智能体大语言模型基准BALMS,经多数据集、任务与主干评估发现零样本智能体表现有限,思维链提示有提升但存不足,凸显了对特定智能体的需求。

Comments Accepted to EMNLP 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25531 2026-08-28 cs.CL 版本更新 79%

ClueWeaver: Reward-Guided Dual-Agent Evidence Reasoning for Compact LLMs on Literary Long Narratives

ClueWeaver:面向紧凑型大语言模型的、针对文学长篇叙事的奖励引导双智能体证据推理框架

Jihao Zhu, Zhiwei Yang, Wenxiao Zhang, Junqian Zhao, Qi You, Fangqi Wang, Zheyuan Deng, Hanzhe Yang, Yu Liu, Jin B. Hong

机构 * Institute of Information Engineering, CAS(中国科学院信息工程研究所) University of Aberdeen(阿伯丁大学) The University of Western Australia(西澳大学) Brown University(布朗大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.CL

AI总结 ClueWeaver是用于紧凑型本地模型的双智能体证据推理框架,可提升本地语言模型在长篇叙事问答与声明验证任务中的性能,提供可检查的证据推理轨迹。

Comments Accepted by ICONIP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15763 2026-08-28 cs.CL 版本更新 79%

Training Agents to Evolve with Their Harness: TaoLive Digital Avatar Agent Technical Report

TaoLive数字虚拟人智能体技术报告:训练智能体随其Harness进化

TaoLive AIGC LLM Team: Yuhan Sun, Wenhao Lin, Yongdong Luo, Yibo Hu, Meiguang Jin, Junfeng Ma, Weihang Pan, Jiaxin Zhao, Zulong Chen

机构 * TaoLive(陶境科技)

专题命中 规划决策 :agent(title);tool use(abstract);分类 cs.CL

AI总结 本研究针对直播电商数字虚拟人主播的实时需求,提出HAT方法,结合HSA的三阶段训练,使35B紧凑模型在低延迟下适配Harness变化,性能优于基础模型及通用大语言模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16514 2026-08-28 cs.RO cs.AI 版本更新 79%

No Plan, Yet Human: A Reactive Robotics Model Predicts Human Planning Failures on a Clinical Task

无计划,却有人类:一种反应式机器人模型预测临床任务中人类计划失败

Michael Migacev, Vito Mengers, Antonia Köngeter, Oliver Brock

机构 * Robotics and Biology Laboratory, Technische Universität Berlin, Germany(技术大学柏林机器人与生物学实验室,德国) Science of Intelligence, Research Cluster of Excellence, Berlin, Germany(智能科学,卓越研究集群,柏林,德国) Robotics Institute Germany(德国机器人研究所)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 该研究利用反应式梯度下降框架AICON,通过塔罗伦敦测试揭示人类计划能力下降时的反应模式,发现其能更准确预测24个问题的难度排序,并在留出验证中表现优异,揭示了生物系统组织方式的普遍规律。

Comments Accepted at SAB26

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27151 2026-08-28 cs.RO 新提交 78%

Planning a Shared Modular Fixture Layout Across Robotic Disassembly Stages

面向机器人拆卸阶段的共享模块化夹具布局规划

Haohui Pan, Takuya Kiyokawa, Kensuke Harada

机构 * The University of Osaka(大阪大学) The National Institute of Advanced Industrial Science and Technology (AIST)(日本国立先进工业科学技术研究所(AIST))

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究针对机器人拆卸中支撑布局需适配阶段变化的问题,提出基于去噪扩散概率模型与贝叶斯优化的模块化真空夹具系统,实现螺丝刀、剃须刀拆卸的共享布局,稳定裕度达66.9%和81.6%,验证了方案的可行性与稳定性。

Comments 15 pages, 9 figures. Submitted to IEEE Transactions on Automation Science and Engineering (T-ASE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22294 2026-08-28 cs.RO 版本更新 78%

Beyond Instance Slots: Semantically Rich World Models for Physical Interaction Planning

超越实例槽:面向物理交互规划的语义丰富世界模型

Juntao Cheng, Jingkai Wang, Yijun Shen, Xiansheng Chen, Zhiwei Yu

机构 * Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院)

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究针对物理交互规划中实例槽无法明确实体任务角色的问题,提出SR-WM模型,通过功能角色绑定实现语义接口,在LIBERO模拟套件等评估中验证了其视觉动力学与规划决策的连接能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19971 2026-08-28 cs.RO cs.CV 版本更新 78%

Unified Prediction and Planning via Conflict-Aware Disjoint Parameter Training

通过冲突感知不相交参数训练实现统一预测与规划

Taewon Seo, Seonae Jeon, Giwon Lee, Kuk-Jin Yoon, Daehee Park

机构 * DGIST(韩国科学技术院大邱庆北校区) KAIST(韩国科学技术院)

专题命中 规划决策 :planning(title,abstract)

AI总结 研究社交机器人在拥挤环境中统一预测与规划问题,提出基于模型合并的不相交参数训练框架DPT,通过分布式参数学习减轻技能冲突,稀疏合并提升性能,在标准基准测试中验证其在机器人导航上通用且有效。

Comments Accepted at ECCV 2026. 38 pages, 14 figures. Project page: this https URL (https://dpt2026.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02115 2026-08-28 cs.IR 版本更新 78%

Planning over Matrix-Factorization MDPs for Candidate Generation

基于矩阵分解MDP的候选生成规划

Mikhail Trapeznikov, Maksim Utushkin

专题命中 规划决策 :planning(title,abstract)

AI总结 将推荐系统的用户旅程建模为MDP,通过折叠更新用户状态进行规划,实验表明单步前瞻即可显著提升固定嵌入下的检索效果。

Comments Accepted to the 5th Workshop on End-to-End Customer Journey Optimization at KDD 2026. 6 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25548 2026-08-28 cs.RO 版本更新 78%

Using VLM Reasoning to Constrain Task and Motion Planning

利用视觉语言模型推理来约束任务和运动规划

Muyang Yan, Miras Mengdibayev, Ardon Floros, Weihang Guo, Lydia E. Kavraki, Zachary Kingston

机构 * Department of Computer Science, Purdue University(普渡大学计算机科学系) Department of Computer Science, Rice University(莱斯大学计算机科学系) Ken Kennedy Institute, Rice University(莱斯大学肯尼迪研究所)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出VIZ-COAST方法,利用大预训练视觉语言模型的空间推理能力,提前识别向下细化中的问题,减少规划时间并消除失败。

Comments 9 pages, 7 figures, 1 table. Submitted to AAAI 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26304 2026-08-28 math.OC 新提交 71%

Multi-Objective Planning for Healthcare Facility Resilience: Mitigate Now or Respond Later?

医疗设施韧性的多目标规划:当前缓解还是事后响应?

Gizem Toplu-Tutay, John J. Hasenbein, Matt Kammer-Kerwick, Erhan Kutanoglu

专题命中 规划决策 :planning(title)

AI总结 本研究针对医疗设施洪水风险,提出双目标两阶段随机优化模型,开发Benders分解与拉格朗日对偶方法,通过得州3752家机构案例验证,可在有限额外成本下平衡经济损失与社会脆弱地区服务中断影响。

Comments Submitted manuscript with supplementary material. Data and code: this https URL (https://doi.org/10.5281/zenodo.21510695)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26867 2026-08-28 cs.AI 新提交 70%

BekchiAI: Measuring, Observing, and Controlling LLM Agents in One Click

BekchiAI:一键式测量、观测与控制大语言模型智能体

Mesut Toruk

专题命中 规划决策 :planning(abstract);agentic(abstract);分类 cs.AI

AI总结 BekchiAI是一款兼具智能体技能测量基准与实时观测控制平台的工具,含2057个测试任务的基准及配套平台,已公开发布并完成多模型对比。

Comments 8 pages, 1 Figure, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26116 2026-08-28 cs.AI 新提交 70%

The Artificial Experimentalist: Discovery and Control of Self-Organizing Phenomena with Autotelic Reinforcement Learning

人工实验者:利用自目的强化学习发现与控制自组织现象

Marko Cvjetko, Benedikt Hartl, Michael Levin, Clément Moulin-Frier, Pierre-Yves Oudeyer

机构 * Inria Centre at the University of Bordeaux(波尔多大学Inria中心) Allen Discovery Center at Tufts University(塔夫茨大学艾伦发现中心) Wyss Institute for Biologically Inspired Engineering at Harvard University(哈佛大学Wyss生物启发工程研究所) Inria(法国国家信息与自动化研究所) INSA Lyon(里昂国立应用科学学院) CITI(CITI研究所) UR3720(UR3720实验室)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 该研究提出基于自目的强化学习的闭环框架CARL,以Lenia为对象,实现了高效发现、控制自组织孤子及实时引导其穿越迷宫的能力,策略可零样本泛化至分布外条件。

Comments 8 pages, 8 figures. Accepted at ALIFE 2026. Companion website: this https URL (https://developmentalsystems.org/carl/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27176 2026-08-28 cs.CL cs.AI cs.LG eess.AS 新提交 67%

When Text Misleads: Inconsistent-Aware Reasoning for Audio-Grounded Dialogue

当文本误导时:面向音频接地对话的不一致感知推理

Yen-Ju Lu, Yuzhe Wang, Yaohan Guan, Xiluo He, Jiarui Hai, Mingrui Liang, Kaavya Chaparala, Thomas Thebaud, Laureano Moro-Velazquez, Najim Dehak, Jesus Villalba

机构 * Center for Language and Speech Processing, Johns Hopkins University(约翰霍普金斯大学语言与语音处理中心)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本研究针对口语对话理解中基于转录本的捷径问题,构建了含501个问题的受控基准ContraTalk,提出Audio Twin智能体式推理框架,可提升冲突问答案例的准确率并减少文本偏向陷阱选择。

Comments 24 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13463 2026-08-28 cs.CV cs.AI cs.CL cs.LG 版本更新 67%

MLLM-Routed Heterogeneous Ensembles for Robust Cross-Dataset Image Classification

用于鲁棒跨数据集图像分类的MLLM路由异质集成模型

Daniel Perkins, John Squires, Janou Milligan, Chandra Raskoti, Linda Ungerboeck

机构 * The Bredesen Center for Interdisciplinary Research and Graduate Education(布雷德森跨学科研究与研究生教育中心) University of Tennessee Knoxville(田纳西大学诺克斯维尔分校)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 该研究针对跨数据集图像分类泛化难题,提出ARMDIL模型,通过MLLM智能体动态路由图像到适配的视觉骨干,兼具竞争力、高适应性与可解释性,为通用视觉系统奠定基础。

Comments 15 pages (single column), 4 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17873 2026-08-28 cs.LG cs.AI cs.CL 版本更新 67%

HINT-SD: Targeted Hindsight Self-Distillation for Long-Horizon Agents

HINT-SD:针对长 Horizon 智能体的定向 hindsight 自监督学习

Woongyeong Yeo, Yumin Choi, Taekyung Ki, Sung Ju Hwang

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出 HINT-SD,一种针对长 Horizon 智能体的定向 hindsight 自监督学习框架,通过全轨迹 hindsight 选择失败相关的动作,并仅在目标动作跨度上应用反馈条件自监督学习,实验表明该方法在 BFCL v3 和 AppWorld 上比密集的每回合反馈基线提高了 18.80 个百分点,同时训练时间降低 2.26 倍。

Comments EMNLP Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13029 2026-08-28 cs.CV 版本更新 67%

Think3D: Thinking with Space for Spatial Reasoning

Think3D: 基于空间的思考以实现空间推理

Zaibin Zhang, Yuhan Wu, Lianjie Jia, Yifan Wang, Zhongbo Zhang, Yijiang Li, Binghao Ran, Fuxi Zhang, Zhuohan Sun, Yizhuang Peng, Zhenfei Yin, Lijun Wang, Huchuan Lu

机构 * Dalian University of Technology(大连理工大学) University of California San Diego(加州大学圣地亚哥分校) University of Oxford(牛津大学)

专题命中 规划决策 :tool use(abstract);tool-use(abstract)

AI总结 Think3D通过引入交互式3D推理框架,提升多模态代理的空间推理能力,实现在BLINK Multi-view和MindCube上的7.8%性能提升,并通过Think3D-RL优化小模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11515 2026-08-28 cs.LG cs.AI cs.CL 版本更新 67%

AirLLM: Diffusion Policy-based Adaptive LoRA for Remote Fine-Tuning of LLM over the Air

AirLLM:面向空中远程微调的基于扩散策略的自适应LoRA方法

Shiyi Yang, Xiaoxue Yu, Rongpeng Li, Jianhang Zhu, Zhifeng Zhao, Honggang Zhang

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) Zhejiang Lab(浙江实验室)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 AirLLM是一种分层扩散策略框架,通过PPO智能体与DDIM交替优化实现自适应LoRA秩配置,可提升LLM空中远程微调性能并降低传输成本。

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27046 2026-08-28 cs.LG cs.AI cs.DC cs.PF 新提交 62%

Performance Foundations of Parallel & Distributed Reasoning Language Models

并行与分布式推理语言模型的性能基础

Maciej Besta, Leonard Schmidt, Lara Nonino, Robert Gerstenberger, Pierre Pang, Patrik Okanovic, Ales Kubicek, Tiancheng Chen, Baraq Lipshitz, Torsten Hoefler

机构 * ETH Zurich(苏黎世联邦理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对RL-for-LLM范式,分析主流后训练算法框架,构建RLM并行策略分类体系,提炼实用指南并概述开放方向,以推动开发高性能可扩展的高性价比RLM。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26176 2026-08-28 cs.AI cs.CL 新提交 62%

Knowledge Cards: Structured Knowledge for AI Systems

知识卡片:面向AI系统的结构化知识

Liliana Ferreira

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 本文针对现有AI文档制品未覆盖输入输出间知识层的问题,提出可捕获概念相关结构化知识的Knowledge Card,已在能源等领域构建原型并发布公共草案。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22963 2026-08-28 cs.AI cs.CL 版本更新 62%

Buried in Textual Debt: Context Pruning with Visual Evidence Preservation for MLLM Agents

被文本债务掩埋:面向多模态大语言模型智能体的保留视觉证据的上下文剪枝

Yuchen Huang, Sijia Li, Jun Zhang, Yi R. Fung

机构 * Hong Kong University of Science and Technology(香港科技大学)

专题命中 规划决策 :tool-use(abstract);分类 cs.AI、cs.CL

AI总结 针对多模态大语言模型智能体长轨迹中文本主导上下文、抑制视觉证据的问题,提出基于KL引导的SPARE框架,结合OPSD与SFT实现高效剪枝,在多步视觉工具使用基准中达到最优准确率与剪枝比例的权衡。

Comments 17 pages, 3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03345 2026-08-28 cs.AI cs.CL 版本更新 62%

Do Language Models Follow Occam's Razor? An Evaluation of Parsimony in Inductive and Abductive Reasoning

语言模型遵循奥卡姆剃刀吗?对归纳和反向推理中简约性的评估

Yunxin Sun, Abulhair Saparov

机构 * Purdue University(普渡大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文评估大型语言模型在归纳和反向推理中是否遵循奥卡姆剃刀原则,通过生成综合推理问题测试其在简单和复杂场景中的表现,发现模型在复杂世界模型中难以生成高质量假设。

Comments Accepted at EMNLP 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25160 2026-08-28 cs.CV cs.AI cs.CL 版本更新 62%

GSM8K-V: Can Vision Language Models Solve Grade School Math Word Problems in Visual Contexts

GSM8K-V:视觉语言模型能否在视觉语境下解决小学级数学应用题

Fan Yuan, Yuchen Yan, Yifan Jiang, Haoran Zhao, Tao Feng, Jinyan Chen, Yanwei Lou, Wenqi Zhang, Weiming Lu, Jun Xiao, Yueting Zhuang, Yongliang Shen

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 本研究构建了多图像视觉数学基准GSM8K-V,评估34个VLMs发现其存在显著模态差距,最优模型仅达59%准确率,瓶颈为隐式视觉推理错误,且视觉数学优化模型在此无提升。

Comments 59 pages, 7 figures, Project Page: this https URL (https://zju-real.github.io/GSM8K-V) Code: this https URL (https://github.com/ZJU-REAL/GSM8K-V) Datasets: this https URL (https://huggingface.co/datasets/ZJU-REAL/GSM8K-V) Accepted at EMNLP 2026 Main Conference. Updated to the camera-ready version with additional experiments, analyses, and revisions

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15740 2026-08-28 cs.FL cs.AI cs.SE 版本更新 62%

HybridProver: Augmenting Theorem Proving with LLM-Driven Proof Synthesis and Refinement

HybridProver:结合大语言模型驱动的证明合成与精化增强定理证明

Jilin Hu, Jianyu Zhang, Yongwang Zhao, Talia Ringer

机构 * College of Computer Science and Technology Zhejiang University(浙江大学计算机科学与技术学院) Siebel Center for Computer Science University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机科学中心)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.SE

AI总结 本研究提出HybridProver框架,以证明草图为中间表示集成两种定理证明范式,在miniF2F Isabelle基准上使7B模型成功率达73.8%,优于此前最优水平。

Comments Accepted to EMNLP Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26234 2026-08-28 stat.AP cs.LG 新提交 57%

A causal graph-informed temporal convolution architecture for interpretable retail electricity price forecasting

用于可解释零售电价预测的因果图引导时序卷积架构

Yufan Ji, Abdollah Shafieezadeh, Noah Dormady

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本研究提出CG-TCN模型,通过整合因果图与时序卷积网络提升零售电价预测的精度与可解释性,在俄亥俄州数据上的预测误差优于基准模型,可为电力市场相关决策提供支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27234 2026-08-28 cs.CR cs.SE 新提交 57%

SPA: Securing Persistent LLM Agents Across Queries with Plan-First Information-Flow Control

SPA:通过优先计划的信息流控制保护跨查询的持久化大语言模型智能体

Dylan Girrens, Guangjing Wang

专题命中 规划决策 :planning(abstract);分类 cs.SE

AI总结 SPA是一种优先计划的架构,通过双格信息流控制保护LLM智能体的规划、执行与跨查询状态复用,在AgentDojo和AgentDojo-MQ上可显著降低攻击成功率,同时揭示了安全与效用的权衡。

Comments Submitted to USENIX Security 2027. 24 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27196 2026-08-28 cs.SE 新提交 57%

Twelve Quick Tips for Managing IT Disasters in Small Research Software Teams

小型研究软件团队管理IT灾难的十二条实用建议

Greg Wilson

专题命中 规划决策 :planning(abstract);分类 cs.SE

AI总结 本文为非资深系统管理员的小型研究软件团队提供十二条IT灾难规划与恢复建议,明确“完成”标准,并提示可借助机构相关团队协助。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27088 2026-08-28 cs.RO cs.AI 新提交 57%

Active sensing to characterize the heterogeneity of plant stress

主动传感用于表征植物胁迫的异质性

Ayman Laaroussi, Peter Hanappe, David Colliaux

机构 * Paris Research, Sony Computer Science Laboratories(索尼计算机科学实验室巴黎研究所)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 该研究提出一种结合3D重建、几何分析与运动规划的自主机器人平台,用于对植物叶片进行靶向荧光测量,实现自动化的空间分辨生理测量,为高分辨率植物表型及自主农业检测提供新方法。

Comments UR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26706 2026-08-28 cs.CL 新提交 57%

Towards Expert Financial QA via Self-Improving RAG

面向专家级金融问答的自改进检索增强生成(RAG)

Junjie Xiong, Shawheen Ghezavat, Aum Hirpara

机构 * University of California, Berkeley(加州大学伯克利分校) California Polytechnic State University(加州州立理工大学) Hofstra University(霍夫斯特拉大学)

专题命中 规划决策 :agent(abstract);分类 cs.CL

AI总结 该研究针对专家级金融问答的合规与防幻觉需求,提出自改进RAG框架,通过三个专门智能体及反馈自校正实现,在FinanceBench数据集上获86%神谕引导准确率,为金融监管应用提供可解释方案。

Comments 17 pages, 2 figures. Accepted at the ICLR 2026 Workshop on Advances in Financial AI

详情

展开后加载摘要…

URL PDF HTML 收藏