arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-09-01 至 2026-09-01 共收录 59 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 59 篇

2605.30407 2026-09-01 cs.CL cs.AI cs.IR cs.LG 版本更新 90%

Exploring Autonomous Agentic Data Engineering for Model Specialization

探索用于模型专业化的自主智能体数据工程

Yujie Luo, Xiangyuan Ru, Jingsheng Zheng, Jingjing Wang, Yuqi Zhu, Jintian Zhang, Runnan Fang, Kewei Xu, Ye Liu, Zheng Wei, Jiang Bian, Zang Li, Shumin Deng

机构 * Zhejiang University(浙江大学) Platform and Content Group, Tencent(腾讯平台与内容部)

专题命中 工作流自动化 :autonomous agent(title,abstract);agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出自主智能体数据工程任务,让LLM作为自主数据工程师,通过端到端数据策划驱动模型专业化,实验显示GPT-5.2通过迭代数据适应使学生模型性能提升57.29%。

Comments Accepted by EMNLP 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30976 2026-09-01 cs.LG 新提交 86%

A Human-in-the-Loop Autonomous Agent for Industry Time Series Forecasting

面向工业时间序列预测的人在回路自主智能体

Xiaoyu Tao, Mingyue Cheng, Ze Guo, Bokai Pan, Qi Liu, Shijin Wang, Enhong Chen

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 工作流自动化 :agent(title);autonomous agent(title);workflow(abstract);分类 cs.LG

AI总结 提出面向工业时间序列预测的人在回路自主系统CastClaw,整合多类资源实现预测全流程,在5个电价数据集上优于16个基线,还经电力负荷数据离线验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00685 2026-09-01 cs.AI 版本更新 86%

HumanStudy-Bench: Towards AI Agent Design for Participant Simulation

HumanStudy-Bench: 向参与者模拟的AI代理设计迈进

Xuan Liu, Haoyang Shang, Zizhang Liu, Xinyan Liu, Yunze Xiao, Yiwen Tu, Haojian Jin

机构 * University of California San Diego(加州大学圣地亚哥分校) Tsinghua University(清华大学) Carnegie Mellon University(卡内基梅隆大学) Independent Researcher(独立研究者)

专题命中 工作流自动化 :agent(title,abstract);AI agent(title);分类 cs.AI

AI总结 HUMANSTUDY-BENCH通过代理设计问题重建人类受试者实验,评估代理行为与人类行为的一致性,涵盖个体认知、战略互动和社会心理学领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28944 2026-09-01 cs.AI cs.LG 新提交 86%

Oculi: A Conversational Agentic Platform for Automated Credit Risk Analysis

Oculi:用于自动化信用风险分析的对话式智能体平台

Vennise Ho, Kristian Diana, Sandy Mourad, Milena Pilipovic, Vineel Nagisetty, Hossein Hajimirsadeghi

机构 * Royal Bank of Canada(加拿大皇家银行) RBC Borealis

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 研究人员推出对话式智能体平台Oculi,采用三层架构及结合确定性统计与LLM引导特征选择的细分发现流程,可自动完成信用风险分析,缩短洞察时间并保持严谨性,能发现手动探索难以处理的风险细分领域。

Comments This work was completed at Royal Bank of Canada as part of the RBC Amplify program

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29665 2026-09-01 cond-mat.mtrl-sci cs.SE 新提交 85%

Evaluating a 4B open-weights local LLM for agentic DFT workflows: a literature reproducibility audit

评估用于智能体DFT工作流的4B开放权重本地大语言模型:文献可复现性审计

Shambhu Bhandari Sharma

专题命中 工作流自动化 :agentic(title,abstract);autonomous agent(abstract);workflow(abstract);分类 cs.SE

AI总结 本研究审计4B开放权重本地大语言模型Qwen3:4B在智能体DFT工作流中的表现,发现其参数提取精度较高,完整GPU驻留提升性能,可重现部分文献的晶格常数,证明轻量开放权重模型可可靠驱动自主智能体工作流。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.31006 2026-09-01 eess.SY 新提交 85%

From Prompt to Prototype: Towards a Frontier LLM Driven RF Engineering Workflow

从提示到原型:面向前沿大语言模型驱动的射频工程工作流

Markus Heinrichs, Oscar Moschner, Simon Tewes, Volker Wienstroer, Aydin Sezgin, Rainer Kronberger

专题命中 工作流自动化 :workflow(title,abstract);agent(abstract);agentic(abstract)

AI总结 该研究开发了前沿LLM驱动的射频工程工作流,让LLM智能体自主操作多款专业EDA工具完成射频硬件设计,仅需工程师提供关键输入,拓展了LLM在专业工程领域的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00510 2026-09-01 cs.CL cs.AI 版本更新 84%

Skill or Skip? Learning Selective Skill Invocation in Agentic Tasks via Dual-Granularity Preference Learning

技能还是跳过?通过双粒度偏好学习在智能体任务中学习选择性技能调用

Chishui Chen, Jiaye Lin, Te Sun, Yi Yang, Junxi Wang, Cong Qin, Yangen Hu, Lu Pan, Ke Zeng

机构 * Meituan(美团) Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学) Nanjing University(南京大学) Peking University(北京大学)

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 提出SelSkill框架,通过双粒度偏好学习实现选择性技能调用,在ALFWorld和BFCL上显著提升任务成功率和执行精度。

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29612 2026-09-01 cs.AI cs.DL cs.IR 新提交 83%

LLMs Interpret, Embeddings Organize, Graphs Emerge: Agent-Driven Compilation of Scientific Knowledge

大语言模型(LLMs)进行解释,嵌入(Embeddings)进行组织,图(Graphs)浮现:智能体驱动的科学知识编译

Shi-Ju Ran, Kun Zhang, Xi Wu, Liu-Si Yang, Wen-Jun Li

机构 * Capital Normal University(首都师范大学) Putian University(莆田大学)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 本研究在ASKS系统中实现智能体驱动的科学知识编译,通过LLM生成维基视图与语义、嵌入及图规则整合变更,编译56篇论文得到可追溯研究画像,图内容关联原始来源记录。

Comments 15 (main text) + 6 (SM) pages, 4 + 1 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28597 2026-09-01 cs.AI cs.CY 新提交 83%

The Race between Agentic AI Capabilities and Data Quality Control in Online Surveys

在线调查中智能体AI能力与数据质量控制的竞赛

Sourav Panda, Hillmer Chona, Rupak Kumar Das, Shreyash Kale, Shikha Soneji, Jonathan Dodge

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 该研究针对在线调查的注意力检查防线,探究智能体AI完成调查并通过检查的能力,分析其结构漏洞并提出DOM元数据混淆的防御策略,评估相关模型以平衡不同研究者的需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28590 2026-09-01 cs.AI 新提交 83%

DS-Lighting: Making Agent Harnesses Explicit for Data-Science Automation

DS-Lighting:让智能体管控框架显式化以实现数据科学自动化

Fan Liu, Hao Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 工作流自动化 :agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 DS-Lighting是一款显式化数据科学自动化管控框架的工具包,将管控框架分解为四层,集成多基准实现可控比较,可提升结果的可复现性、可比性与可靠性,减少系统级故障。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00269 2026-09-01 cs.AI 版本更新 83%

Mnemosyne: Agentic Transaction Processing for Validating and Repairing AI-generated Workflows

Mnemosyne: 用于验证和修复AI生成工作流的代理事务处理

Edward Y. Chang, Longling Geng

机构 * Stanford University(斯坦福大学) QuadriumAI

专题命中 工作流自动化 :agentic(title,abstract);workflow(abstract);分类 cs.AI

AI总结 提出代理事务处理(ATP)模型,将生成动作视为不可信提案,通过确定性约束集验证后才提交,并实现运行时修复,确保状态正确性独立于生成层。

Comments 60 pages, added additional experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28790 2026-09-01 cs.MA cs.AI cs.IR cs.LG cs.SE 新提交 82%

ASTRA - Agentic System for Ticket Resolution and Analysis

ASTRA — 用于工单解决与分析的智能体系统

Shashidhar Reddy Javaji, Mohamed Trabelsi, Jin Cao, Huseyin Uzunalioglu

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 提出 ASTRA 智能体系统,通过协调三类专业智能体与优化循环生成证据支持的工单排查报告,在 987 个电信故障工单上取得 4.13/5.0 的平均质量得分,硬件故障诊断存在文本证据渠道的根本局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30543 2026-09-01 cs.AI cs.SE 新提交 81%

Designing an Auditable LLM-Supported Workflow for Qualitative Thematic Analysis

设计一种可审计的、由大语言模型(LLM)支持的定性主题分析工作流程

Nadia Jul Jeldtoft, Tariq Yousef

机构 * University of Southern Denmark(南丹麦大学)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.SE

AI总结 本文提出一种可审计的LLM支持的定性主题分析工作流程,推导五项设计原则,构建两阶段工作流程,经半结构化丹麦访谈记录评估,其编码覆盖与人工相当,主题更紧凑,可扩展适配不同LLM与领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30727 2026-09-01 cs.CV cs.AI 新提交 79%

RailGen: Improving Railway Intrusion Detection via Agent-Guided Small-Scale Foreign Object Generation

RailGen:通过智能体引导的小规模异物生成改进铁路入侵检测

Quan Hao, Ziyang Tao, Chenxi Zhang, Yudong Wang, Rui Shi, Liguo Zhang

机构 * School of Information Science and Technology, Beijing University of Technology(北京工业大学信息科学与技术学院) College of Computer Science, Beijing University of Technology(北京工业大学计算机学院)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 该研究针对铁路异物检测的长尾小样本问题,提出RailGen智能体生成高质量小异物样本,结合FocalDEIM框架优化检测,显著提升了检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29037 2026-09-01 cs.CV cs.AI 新提交 79%

DocIntent: Answerability-Guided Agentic Restoration for Real-World Document Visual Question Answering

DocIntent:面向真实场景文档视觉问答的可回答性引导智能体式恢复方法

Zihan Huang, Shihang Wu, Junle Liu, Peirong Zhang, Yongxin Shi, Xuhan Zheng, Lianwen Jin

机构 * South China University of Technology(华南理工大学)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.AI

AI总结 针对真实场景退化影响多模态大语言模型文档问答的问题,提出无需训练的DocIntent框架,通过评估可回答性、选择性调用恢复工具及比较式回滚机制,提升了各类MLLM在WildDoc基准上的表现。

Comments 25 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28708 2026-09-01 cs.SE cs.CV 新提交 79%

STEP: A Modular Silent Trial Engine for Operational Evaluation of Digital Pathology AI in Routine Workflow

STEP:用于常规工作流程中数字病理学AI操作评估的模块化静默试验引擎

Gabriele Campanella, Matthew Croken, Olga Lukatskaya, Jane Houldsworth, Ricky Kwan, Peter Schüffler, Chad Vanderbilt

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.SE

AI总结 该研究开发了模块化软件平台STEP,用于在异构环境中编排计算病理学AI的前瞻性静默试验,已部署于三家机构支持EAGLE模型评估,可减少工程重复工作量并助力AI的真实世界评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28631 2026-09-01 cs.AI cs.CE cs.CY 新提交 79%

CrossAudit: A Git-Native, Cross-Vendor Audit Loop for Agentic Science

CrossAudit:面向智能体科学的原生Git跨供应商审计循环

Zhaohe Dong, Yuhao Chen

机构 * University of Cambridge(剑桥大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 工作流自动化 :agentic(title);agent(abstract);分类 cs.AI

AI总结 CrossAudit是面向智能体科学的原生Git跨供应商审计协议,通过不同供应商智能体按人类规则审计工作,试验显示不同供应商对规则解读有差异,其自身审计记录为核心证据。

Comments 19 pages, 4 figures, 3 tables, 22 references. Reference implementation, audit ledger, and experiment artefacts: this https URL (https://github.com/dongzhaohe321418-lab/crossaudit)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28601 2026-09-01 cs.AI 新提交 79%

Leveraging Generative AI to Design Accessible Interactive Visualizations for Undergraduate Mathematics: A Six-Phase Workflow

利用生成式人工智能为本科数学设计可访问的交互式可视化:一个六阶段工作流

Mahesh Sunkula, Kuan-Hua Chen

机构 * Purdue University(普渡大学)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI

AI总结 本研究提出六阶段工作流,利用生成式人工智能为本科数学构建符合WCAG 2.2 AA级标准的可访问交互式可视化,无需编程,经四个工具验证,各阶段需人工验证,适用于师生。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28553 2026-09-01 cs.AI cs.MA 版本更新 79%

Logos: An Agent Harness on a Cross-Process Bus

Logos:一种跨进程总线的智能体管控工具

Hanzhang Jia, Liheng Zeng, Hao Cheng, Yi Gao, Bo Ma

机构 * University of Sussex(萨塞克斯大学) Zhejiang Gongshang University(浙江工商大学) Shanghai Shuyuan Information Technology Co., Ltd.(上海数元信息技术有限公司)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 本文基于时空可组合性演算等观察构建了跨进程智能体管控工具Logos,经实验验证其可在故障场景下保障会话恢复且无重复效果,性能优于单进程架构。

Comments Still just draft, version 0.0.7

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03161 2026-09-01 cs.MA cs.AI 版本更新 79%

OpenAgenet / OAN White Paper: Open Infrastructure for Trusted Agent Interconnection

OpenAgenet/OAN:可信智能体互连的开放基础设施

Jinliang Xu

机构 * China Academy of Information and Communications Technology(信息与通信技术研究院)

专题命中 工作流自动化 :agent(title,abstract);分类 cs.AI

AI总结 针对智能体从孤立应用转向开放多运营商网络时面临的身份验证、治理状态、发现授权、新鲜度和信任证据问题,提出协议无关的信任层OAN,通过根治理身份准入、注册商辅助注册、根验证包发布、授权感知发现和签名可信调用来实现可信互连。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01390 2026-09-01 cs.HC cs.AI 版本更新 79%

Toward Scalable Audio Description Quality Control: A Workflow for Evaluating Human and VLM Raters

迈向可扩展的音频描述质量控制:评估人类和VLM评分者的流程

Lana Do, Gio Jung, Juvenal Francisco Barajas, Andrew Taylor Scott, Shasta Ihorn, Alexander Mario Blum, Vassilis Athitsos, Ilmi Yoon

机构 * Northeastern University(东北大学) San Francisco State University(旧金山州立大学) University of Texas at Arlington(德克萨斯大学阿灵顿分校)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI

AI总结 本文提出了一种评估人类和VLM评分者音频描述质量的流程,利用项目反应理论评估其与专家标准的匹配程度,发现VLM在大规模评估中可与人类评分者相当,但其推理可靠性较低。

Comments Accepted to ASSETS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03828 2026-09-01 cs.AI cs.MA 版本更新 79%

AssetOpsBench: Benchmarking AI Agents for Task Automation in Industrial Asset Operations and Maintenance

AssetOpsBench:工业资产运维任务自动化AI代理的基准测试

Dhaval Patel, Shuxin Lin, James Rayfield, Nianjun Zhou, Chathurangi Shyalika, Suryanarayana R Yarrabothula, Roman Vaculin, Natalia Martinez, Fearghal O'donncha, Jayant Kalagnanam

机构 * IBM University of South Carolina(南卡罗来纳大学) IBM Research(IBM研究院)

专题命中 工作流自动化 :AI agent(title);agent(abstract);分类 cs.AI

AI总结 本文提出AssetOpsBench,一个统一框架,用于协调和评估工业4.0中的领域专用代理。该框架包含四个领域代理目录、140+人工撰写的自然语言查询数据集及模拟的CouchDB后端物联网环境,通过三个关键指标分析工具-代理与计划-执行者范式的架构权衡,并系统化发现新兴故障模式。

Comments 25 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29326 2026-09-01 cs.CL cs.AI 新提交 79%

StageWell: A Process-Aligned Chinese Corpus for Positive-Psychology Support Dialogue

StageWell:面向积极心理学支持对话的流程对齐中文语料库

Yuxiong Wang, Ziwei Lin, Bo Wang, Yu Zhang, Shiguang Ni

专题命中 工作流自动化 :agent(abstract);workflow(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本研究构建了流程对齐中文语料库StageWell及HQS协议,用于优化多轮积极心理学支持对话的监督,在多个开源大模型上实现了流程控制、回复质量与安全性的提升。

Comments 29 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28763 2026-09-01 physics.plasm-ph 新提交 78%

ELMO: An Uncertainty-Aware Simulation-to-Surrogate Workflow for Fast Pedestal Linear-Stability Prediction

ELMO:用于快速台基线性稳定性预测的不确定性感知模拟代理工作流

Nami Li, X. Q. Xu, T. Osborne, E. Suchyta, Y. C. Fu, N. Podhorszki, H. Wang, Z. Li

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 本研究提出ELMO工作流,集成多技术实现快速台基线性稳定性预测,其GPR代理预测精度高、速度快,大幅降低计算成本。

Comments 30 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30724 2026-09-01 cs.LG cs.AI 新提交 76%

BAITBENCH: Measuring Agent Reward Hacking with Optional Shortcuts Planted in ML Tasks

BAITBENCH:通过植入ML任务中的可选捷径测量智能体的奖励黑客行为

Pradyumna Shyama Prasad, Meiri Anto, Leon Eshuijs, Julian Moncarz, Kaustubh Kislay, Juan J. Vazquez

机构 * National University of Singapore(新加坡国立大学) MIT(麻省理工学院) Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) University of Toronto(多伦多大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Arb Research(Arb研究机构)

专题命中 工作流自动化 :agent(title);分类 cs.AI、cs.LG

AI总结 BAITBENCH是含三个合成表格型ML任务的基准,用于测量智能体利用可选捷径获得虚高分的奖励黑客行为,实验显示57.1%的运行存在该行为,发布相关资源作为缓解措施评估测试平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30461 2026-09-01 cs.CL 新提交 70%

From Final Artifacts to Trajectories: Retrospective Process Supervision for Evidence-Grounded Long-Form Generation

从最终产物到轨迹:面向证据支撑的长文本生成的回溯过程监督

Junjie Huang, Jiarui Qin, Di Yin, Weiwen Liu, Yong Yu, Xing Sun, Weinan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Tencent Youtu Lab(腾讯优图实验室)

专题命中 工作流自动化 :agent(abstract);agentic(abstract);分类 cs.CL

AI总结 针对开放式长文本生成任务轨迹数据稀缺的问题,提出RetroGen框架,利用预训练数据中丰富的高质量最终产物重构轨迹,训练模型以提升证据支撑等任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30277 2026-09-01 cs.AI cs.MA 新提交 70%

SimCRAFT: Distilling Remote Sensing Agents via Synthetic Trajectories and Contextual Retrieval-Augmented Fine-Tuning

SimCRAFT:通过合成轨迹和上下文检索增强微调蒸馏遥感智能体

Haoran Wang, Jing Yao, Xu Yang, Zeqing Wang, Yang Zhang, Pedram Ghamisi, Zhengchao Chen

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院空天信息创新研究院) University of Chinese Academy of Sciences(中国科学院大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Helmholtz-Zentrum Dresden-Rossendorf(德累斯顿-罗森多夫亥姆霍兹中心)

专题命中 工作流自动化 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 本研究提出SimCRAFT框架,通过合成轨迹与上下文检索增强微调,将复杂遥感编排能力蒸馏到7B模型,性能优于开源LLM,为轻量遥感智能提供开源基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27266 2026-09-01 cs.LG cond-mat.mtrl-sci 版本更新 70%

AutoREC: A reinforcement learning platform for equivalent circuit model generation

AutoREC:一种用于从电化学阻抗谱数据开发强化学习代理以生成等效电路模型的软件平台

Ali Jaberi (1), Yonatan Kurniawan (2), Robert Black (1), Shayan Mousavi M. (1), Kabir Verma (3), Zoya Sadighi (1), Santiago Miret (4), Jason Hattrick-Simpers (2) ((1) Clean Energy Innovation Research Centre, National Research Council Canada, Mississauga, ON, Canada, (2) Department of Materials Science and Engineering, University of Toronto, Toronto, ON, Canada, (3) Cheriton School of Computer Science, University of Waterloo, Waterloo, ON, Canada, (4) Lila Sciences, San Francisco, CA, USA)

机构 * Clean Energy Innovation Research Center, National Research Council Canada(清洁能源创新研究中心,加拿大国家研究委员会) Department of Material Science and Engineering, University of Toronto(材料科学与工程系,多伦多大学) Cheriton School of Computer Science, University of Waterloo(计算机科学学院,滑铁卢大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.LG

AI总结 AutoREC通过将等效电路模型生成建模为马尔可夫决策过程中的序列决策问题,利用深度强化学习解决传统手动试错方法的局限性,实现了高成功率的自动等效电路模型生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.12569 2026-09-01 cs.AI 版本更新 70%

A Mental Model Based Framework of Trust

一种基于心智模型的信任框架

Zahra Zahedi, Sarath Sreedharan, Erin Chiou, Subbarao Kambhampati

专题命中 工作流自动化 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出基于心智模型的信任框架,用于推断人类信任并定义信任演化等,通过人类受试者研究验证调整人类对智能体的信念可改变信任感知。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29249 2026-09-01 cs.AI cs.CL cs.IR cs.LG 新提交 67%

Validating FKG.in: Soundness Assessment in LLM-Augmented Indian Food Knowledge

验证FKG.in:大语言模型增强的印度食品知识的合理性评估

Saransh Kumar Gupta, Armaan Shah, Lipika Dey, Partha Pratim Das, Ramesh Jain

机构 * Ashoka University(阿肖克大学) Mphasis AI and Applied Tech Lab(美斐西斯人工智能与应用技术实验室) Koita Centre for Digital Health, Ashoka University(阿肖克大学科伊塔数字健康中心) Institute for Future Health, UC Irvine(加州大学欧文分校未来健康研究所)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本研究针对LLM生成食谱存在的问题,提出半自动化评估框架,验证LLM增强的印度食品知识图谱FKG.in的合理性,该框架可推广至多语言多元文化烹饪领域,为食品知识基础设施提供支撑。

Comments 15 pages, 2 figures, 5 tables, 27 references

详情

展开后加载摘要…

URL PDF HTML 收藏