arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 10492 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 10492 篇

2607.12382 2026-07-15 cs.LG q-bio.NC 新提交 57%

Differentiable Clone-Structured Causal Graphs for End-to-End Cognitive Map Learning from Image Sequences

用于从图像序列进行端到端认知地图学习的可微克隆结构因果图

Arash Nikzad, Sasan Sarbishegi, Ali Dasmeh, Muhammad Asif, Parsa Gharavi, Erik Husom, Sagar Sen, Andrew B. Lehr, Olivier Penacchio, Ana Clemente, Tristan M. Stöber

机构 * Goethe University Frankfurt(歌德大学法兰克福分校) Max Planck Institute for Human Development(马克斯·普朗克人类发展研究所) Max Planck Institute for Empirical Aesthetics(马克斯·普朗克实验美学研究所) SINTEF(挪威科技工业研究院) University Medical Center Göttingen(哥廷根大学医学中心) Institute of Computer Science and Campus Institute Data Science, University Göttingen(哥廷根大学计算机科学与数据科学研究所) Bridging Research in AI and Neuroscience (brAIN), Computer Vision Center(人工智能与神经科学交叉研究中心(brAIN),计算机视觉中心) Computer Science Department, Universitat Autònoma de Barcelona(巴塞罗那自治大学计算机科学系) Epilepsy Center Frankfurt Rhine-Main, Department of Neurology, Goethe University Frankfurt(歌德大学法兰克福分校莱茵-美因癫痫中心,神经学系) Circulant Labs(循环实验室)

专题命中 工作流自动化 :agent(abstract);分类 cs.LG

AI总结 研究如何让智能体从图像序列构建世界结构化地图。核心方法是将CSCG重构成可微模块gradCSCG并与VQ-VAE前端耦合,有软发射前向传播和损失平衡机制。主要贡献是证明该方法能在多环境下从视觉输入高精度恢复邻接图,CSCG可作深度学习构建块。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11816 2026-07-14 cs.LG stat.ML 新提交 57%

Relaxing Faithfulness with Intervention-Only Causal Discovery

通过仅干预因果发现放松忠实性

Bijan Mazaheri, Jiaqi Zhang, Caroline Uhler

机构 * Thayer School of Engineering Dartmouth College(达特茅斯学院塞耶工程学院) Broad Institute of MIT and Harvard(麻省理工学院和哈佛大学布罗德研究所) Massachusetts Institute of Technology(麻省理工学院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 研究因果发现算法,指出常见流程中第一步的忠实性假设在自然系统中常被违反。提出干预即时忠实性假设,表明其足以用硬干预非参数识别因果结构,将干预作为因果结构信息主要载体,还针对干预范围有限情况指定等价类。

Comments Accepted to UAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10839 2026-07-14 cs.SE 新提交 57%

Maintenance and Support in Community-Driven Scientific Pipeline Ecosystems: A Cross-Platform Empirical Study of nf-core

社区驱动的科学管道生态系统中的维护与支持:对nf-core的跨平台实证研究

Khairul Alam, Kowsik Roy, Md Shamimur Rahman, Banani Roy

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 研究社区驱动的科学管道生态系统nf-core中的维护与支持,通过分析大量GitHub问题、拉取请求及论坛讨论来研究相关问题、解决因素等,发现不同平台作用不同,解决结果与多种因素有关,跨平台分析揭示了内部可追溯性及联系有限的情况。

Comments 42 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10039 2026-07-14 physics.data-an cs.LG hep-ph 新提交 57%

Are We Ready for AI-Driven Discovery? AI Verification Before the Next Fundamental Physics Breakthrough

我们准备好迎接人工智能驱动的发现了吗?在下一次基础物理学突破之前进行人工智能验证

Gaia Grosso, Vinicius Mikuni, Lukas Heinrich

机构 * NSF AI Institute for Artificial Intelligence and Fundamental Interactions(NSF人工智能与基本相互作用研究院) MIT Laboratory for Nuclear Science(MIT核科学实验室) School of Engineering and Applied Sciences, Harvard University(哈佛大学工程与应用科学学院) Nagoya University(名古屋大学) Technical University Munich(慕尼黑技术大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 探讨在基础物理学中,随着机器学习日益自主,确保其可靠性至关重要。通过VERaiPHY计划框架,结合统计发现工作流程确定验证时机,强调归纳偏差等局限,思考物理学家角色,以实现机器学习在物理学中负责任的整合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11712 2026-07-14 cs.LG cond-mat.mtrl-sci 新提交 57%

CatRetriever: Contrastive Representation Learning for Slab-to-Bulk Retrieval in Generative Catalyst Discovery

CatRetriever:用于生成催化剂发现中从平板到体相检索的对比表示学习

Jungho Oh, Woosung Kim, Dong Hyeon Mok, Jonggeol Na, Seoin Back

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 研究针对生成催化剂模型平板与体相连接缺失问题,提出对比表示学习模型CatRetriever,能准确检索体相候选物,还扩展其框架为吸附能目标体相发现管道,为连接催化剂生成模型与体相催化剂发现提供可扩展途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16524 2026-07-14 cs.CV cs.LG physics.comp-ph physics.data-an 版本更新 57%

An Approximate Graph Elicits Detonation Lattice

近似图激发爆轰晶格

Vansh Sharma, Venkat Raman

机构 * Department of Aerospace Engineering, University of Michigan(密歇根大学航空航天工程系)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出基于图论的新型算法,用于精确分割和测量爆轰细胞,解决传统2D边缘检测方法的局限性,通过分割模型实现无训练的准确提取细胞模式。

Comments 3D Detonation; Soot Foil; Graph; Cell Classification; Cellular Detonation; Detonation Lattice; SAM Model

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23993 2026-07-14 cs.CL 版本更新 57%

The GRADIEND Python Package: An End-to-End System for Gradient-Based Feature Learning

GRADIEND Python包:一种基于梯度的特征学习端到端系统

Jonathan Drechsel, Steffen Herbold

机构 * Faculty of Computer Science and Mathematics University of Passau(计算机科学与数学学院 巴伐利亚大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 GRADIEND Python包提供端到端系统,通过语言模型中的事实-反事实MLM和CLM梯度学习特征方向,并支持特征数据创建、训练、评估及多特征比较。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15353 2026-07-14 stat.AP cs.LG stat.ML 版本更新 57%

Reinforcement Learning in the Real World: A Survey of Statistical Challenges and Future Directions

现实世界中的强化学习:统计挑战与未来方向综述

Asim H. Gazi, Yongyi Guo, Daiqi Gao, Ziping Xu, Kelly W. Zhang, Susan A. Murphy

机构 * Department of Computer Science, Harvard University(哈佛大学计算机科学系) Department of Statistics, University of Wisconsin–Madison(威斯康星大学麦迪逊分校统计学系) Department of Statistics, Harvard University(哈佛大学统计学系) School of Data Science and Society, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校数据科学与社会学院) Department of Mathematics, Imperial College London(伦敦帝国理工学院数学系)

专题命中 工作流自动化 :agent(abstract);分类 cs.LG

AI总结 本文综述现实世界强化学习应用,指出其研究与部署存在差距及两大挑战。将应用框架化为三部分过程,回顾应对统计挑战的进展,涵盖在线、离线方法及持续改进设计,还概述受应用启发的未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13330 2026-07-14 cs.CL 版本更新 57%

RegCheck: A tool for structured comparisons between study registrations and papers

RegCheck:一个用于研究注册与论文之间结构化比较的工具

Jamie Cummins, Beth Clarke, Ian Hussey, Malte Elson

机构 * Bennett Institute of Applied Data Science, University of Oxford(贝内特应用数据科学研究所,牛津大学) Institute of Psychology, University of Bern(心理学研究所,伯恩大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 介绍RegCheck工具,用于比较研究注册与论文。利用人工智能,模块化设计,让用户决定比较特征并提供相关文本,生成可共享报告,适用于多领域多格式,有望成为可重复科学的可扩展基础设施。

Comments 26 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03174 2026-07-14 cs.AI 版本更新 57%

InqEduAgent: Adaptive AI Learning Partners with Gaussian Process Augmentation

InqEduAgent:具有高斯过程增强的自适应人工智能学习伙伴

Wen-Xi Yang, Tian-Fang Zhao, Guan Liu

机构 * Guangdong Institute of Smart Education(广东智能教育研究院) Jinan University(暨南大学) School of Journalism and Communication(新闻与传播学院)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 研究针对探究式教育中学习伙伴分配问题,提出InqEduAgent框架,集成高斯过程增强匹配机制,能基于先验知识模式选自适应伙伴,实验证明其性能优越,推进了人机协作学习及相关领域发展。

Comments Accepted by the 2026 8th Asia Conference on Machine Learning and Computing (ACMLC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09378 2026-07-13 quant-ph cs.AI cs.CR 新提交 57%

When Routes Run Out: Adversarial Co-Learning and Explainable Robustness in Quantum Repeater Networks

当路线耗尽时:量子中继器网络中的对抗协同学习与可解释鲁棒性

Brennan Bell, Inti Gabriel Mendoza Estrada, Andreas Trügler, Paul Erker

机构 * RFI-IRFOS and TU Graz(RFI-IRFOS和格拉茨技术大学) openmaind FlexCo and TU Graz(openmaind FlexCo和格拉茨技术大学) Know Center Research GmbH and University of Graz(Know Center Research GmbH和格拉茨大学) Atominstitut, TU Wien and IQOQI, ÖAW(原子院、维也纳技术大学和ÖAW IQOQI)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究量子中继器网络路由对抗博弈问题,通过对抗协同学习,发现保留率与参考值紧密跟踪,拟合决策树解释模型并报告忠实度,构建提示记录形成开源解释工作流程。

Comments 4 pages, 5 figures, submitted to IEEE QCE26, Workshop on Q-GenAI: Synergies between QC & GenAI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07459 2026-07-13 cs.CL 版本更新 57%

Beyond LLMs: A Linguistic Approach to Causal Graph Generation from Narrative Texts

超越大语言模型:一种从叙事文本生成因果图的语言学方法

Zehan Li, Ruhua Pan, Xinyu Pi

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 工作流自动化 :agent(abstract);分类 cs.CL

AI总结 该研究提出从叙事文本生成因果图的框架,先以LLM提取顶点,引入含七个语言特征的“专家索引”并集成到分类模型,结合RoBERTa嵌入提升因果关系识别精度,经五次迭代提示构建因果图,实验证明其优于GPT-4o和Claude 3.5,还提供开源工具。

Comments published at the 7th Workshop on Narrative Understanding, NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10062 2026-07-10 cs.AI cs.MA 新提交 57%

Deployment-Time Memorization in Foundation-Model Agents

基础模型智能体中的部署时记忆

Lei, Chen, Guilin Zhang, Kai Zhao, Dalmo Cirne, Andy Olsen, Xu Chu, Zeke Miller, Alet Blanken, Amine Anoun, Jerry Ting

机构 * Lei (Rachel) Chen Guilin Zhang Kai Zhao Dalmo Cirne Andy Olsen Zeke Miller Xu Chu Alet Blanken Amine Anoun Jerry Ting

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 研究基础模型智能体在部署时记忆的设计选择如何影响个性化效用、提取风险和删除保真度,提出遗忘残差分数并揭示压缩与删除的权衡。

Comments 4 pages, ICML MemFM 2026 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05969 2026-07-10 cs.CR cs.SE 版本更新 57%

Heimdallr: Characterizing and Detecting LLM-Induced Security Risks in GitHub CI Workflows

Heimdallr:在GitHub CI工作流中识别和检测LLM引发的安全风险

Bonan Ruan, Yeqi Fu, Chuqi Zhang, Jiahao Liu, Jun Zeng, Zhenkai Liang

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 本文研究GitHub CI工作流中LLM引发的安全风险,提出Heimdallr框架,通过流程图规范化和威胁向量检测,实现高精度识别LLM节点和威胁向量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04920 2026-07-10 cs.AI 版本更新 57%

Conversational AI for Rapid Scientific Prototyping: A Case Study on ESA's ELOPE Competition

用于快速科学原型设计的对话式人工智能:以欧空局的ELOPE竞赛为例

Nils Einecke

机构 * Honda Research Institute Europe GmbH(本田欧洲研究机构)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 以欧空局ELOPE竞赛为例,探讨用ChatGPT进行快速科学原型设计。介绍其在竞赛中的表现,包括提供代码、推理等,虽有局限但凸显人机协作潜力,分析优缺点,提出将大语言模型集成到科学工作流程可增强快速原型设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06802 2026-07-09 eess.SP cs.AI 新提交 57%

A Multi-Analyst LLM Pipeline for Auditable Rule Discovery Across 68 Public Physiological Corpora

用于跨68个公共生理语料库进行可审计规则发现的多分析师大语言模型管道

Dovy Paukstys

机构 * Komori Care, LLC(科莫里护理公司)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 针对开放生理语料库异质性无法确定新监测平台探测器规则的问题,提出多分析师大语言模型工作流程,通过读取语料库文档、去重、审核、整合等操作,产生可审计规则形状库及探测器组件,推动文献规则向硬件验证发展。

Comments 8 pages, 2 figures, 9 tables; submitted to IEEE SPMB 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07521 2026-07-09 cs.HC cs.AI 新提交 57%

Creativity from Friction: Human-AI Interaction for Exploratory Structural Design

摩擦产生创造力:用于探索性结构设计的人机交互

Ricardo Maia Avelino, Rita Sevastjanova, Tom Van Mele, Philippe Block, Mennatallah El-Assady

机构 * Block Research Group, Department of Architecture, ETH Zurich(建筑系,苏黎世联邦理工学院) IVIA Lab, Department of Computer Science, ETH Zurich(计算机科学系,苏黎世联邦理工学院)

专题命中 工作流自动化 :AI agent(abstract);分类 cs.AI

AI总结 探讨当前生成式AI目标与结构设计师等创作者需求的偏差,提出允许受限人机共同创作的系统设计维度,通过试点设计界面和专家研究,展示其对设计空间探索的支持及设计师看法。

Comments Accepted at ICML 2026, Workshop on Human-AI Co-Creativity

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07504 2026-07-09 cs.AI 新提交 57%

Do LLM-Generated Skills Make Better AI Data Scientists? A Component Ablation Across Data-Science Workflows

大语言模型生成的技能能否造就更好的人工智能数据科学家?跨数据科学工作流程的组件消融

Wei-Jung Huang

机构 * Independent Researcher(独立研究者)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究大语言模型生成的技能在数据科学工作流程中的作用,通过在四个阶段测试及组件消融实验发现,完整生成技能及消融后的技能变体与任务单独提示相比,均未显著提升性能,提醒勿将其作为默认单次提示策略。

Comments KDD 2026 Workshop on AI Data Scientist

Journal ref KDD 2026 Workshop on AI Data Scientist

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06919 2026-07-09 cs.CV cs.LG 新提交 57%

Compass: Prostate Cancer Detection Needs Multi-View Context

Compass:前列腺癌检测需要多视图上下文

Paul F. R. Wilson, Mohamed Harmanani, Zhuoxin Guo, Obed K. Dzikunu, Hannes Cash, Adam Kinnaird, Brian Wodlinger, Purang Abolmaesumi, Parvin Mousavi

机构 * Queen’s University(女王大学) University of British Columbia(英属哥伦比亚大学) Otto von Guericke University Magdeburg(马格德堡奥托·冯·格里克大学) University of Alberta(阿尔伯塔大学) Exact Imaging(精准成像公司) Vector Institute(向量研究所)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 研究针对前列腺癌检测,提出Compass方法,整合多视图信息,通过基于探头旋转角度的变压器聚合证据,经多中心数据集训练评估,性能强大,凸显多视图上下文价值,为PCa诊断提供有力工具。

Comments MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29251 2026-07-09 cs.AI q-fin.CP 版本更新 57%

When Summaries Distort Decisions: Information Fidelity in LLM-Compressed Financial Analysis

当摘要扭曲决策:LLM压缩财务分析中的信息保真度

Hoyoung Lee, Suhwan Park, Seunghan Lee, Jun Seo, Jaehoon Lee, Sungdong Yoo, Minjae Kim, CheolWon Na, Zhangyang Wang, Zach Golkhou, Minkyu Kim, Sotirios Sabanis, Alejandro Lopez-Lira, Dhagash Mehta, Soonyoung Lee, Chanyeol Choi, Wonbin Ahn, Yongjae Lee

机构 * UNIST(全纳科学技术大学) LG AI Research(LG人工智能研究) Sungkyunkwan University(成均馆大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) J.P. Morgan Chase(摩根大通) State Street(州立银行) University of Edinburgh(爱丁堡大学) University of Florida(佛罗里达大学) BlackRock(黑石) LinqAlpha

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI

AI总结 研究LLM压缩财务信息时因丢失决策相关上下文导致投资判断改变的问题,提出通过生成多个候选压缩并审计分歧的代理上下文压缩方法。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23990 2026-07-09 cs.CY cs.AI 57%

From Untamed Black Box to Interpretable Pedagogical Orchestration: The Ensemble of Specialized LLMs Architecture for Adaptive Tutoring

从混沌黑箱到可解释的教育编排:专精LLM集合架构用于自适应辅导

Nizam Kadir

机构 * Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 本文提出ES-LLMS架构,通过分离决策与表达,利用可解释的BKT模型协调专精代理,提升辅导系统的可控性和可靠性,实验显示其在指导与信任方面优于传统模型。

Comments Accepted as a FULL paper at the 27th International Conference on Artificial Intelligence in Education (AIED 2026). 15 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17057 2026-07-09 physics.flu-dyn cs.LG cs.NE math.OC 版本更新 57%

Optimization-Embedded Active Multi-Fidelity Surrogate Learning for Multi-Condition Airfoil Shape Optimization

嵌入优化的主动多保真度代理学习用于多条件机翼形状优化

Isaac Robledo, Alberto Vilariño, Arnau Miró, Oriol Lehmkuhl, Carlos Sanmiguel Vila, Rodrigo Castellanos

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出一种嵌入优化的主动多保真度代理学习方法,用于多条件机翼形状优化,通过低保真度模型和高保真度模拟的结合,减少计算流体力学成本并保持RANS精度。

Comments 24 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06461 2026-07-08 eess.AS cs.CL cs.SD 新提交 57%

WordVoice: Explicit and Decoupled Multi-Dimensional Word-Level Control for LLM-Based TTS

WordVoice:基于大语言模型的文本转语音中显式且解耦的多维词级控制

Sihang Nie, Jinxin Ji, Xiaofen Xing, Deyi Tuo, Chengbin Jin, Jialong Mai, Xiangmin Xu

机构 * South China University of Technology(南方科技大学) Huya Inc.(Huya公司) Tongji University(同济大学) The Hongkong polytechnic university(香港理工大学) Foshan University(佛山大学)

专题命中 工作流自动化 :planning(abstract);分类 cs.CL

AI总结 研究针对基于LLM的TTS系统词级控制粗糙的问题,提出统一框架。构建含五维注释的数据集,引入WordVoice将隐式生成变为显式可控范式,经实验验证其在多声学维度上实现卓越解耦控制且保持零样本合成稳定性。

Comments 10 pages, 4 figures, 6 tables; Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06026 2026-07-08 cs.LG cs.NA math.NA 新提交 57%

SplineNet: An Isogeometric Deep Learning Method for Complex Shells

样条网络:一种用于复杂壳体的等几何深度学习方法

Shizhou Luo, Xiaodong Wei

机构 * Global College, Shanghai Jiao Tong University(上海交通大学全球学院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出样条网络这一等几何深度学习方法,用于复杂壳体结构设计分析。基于封闭样条表示构建,能无数据或数据驱动应用。无数据时可结合CAE需求,数据驱动时可作主干网提供可解释性,经数值示例验证了该方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04371 2026-07-08 cs.AI 新提交 57%

Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs

Nemotron-Labs-3-Puzzle-75B-A9B:压缩混合专家模型的语言模型

Akhiad Bercovich, Talor Abramovich, Daniel Afrimi, Shay Aharon, Nir Ailon, Vladimir Anisimov, Omer Ullman Argov, Maor Ashkenazi, Tomer Asida, Nave Assaf, Tomer Bar Natan, Alexander Bukharin, Grzegorz Chlebus, Marcin Chochowski, Eric Chung, Mohammad Dabbah, Carlo del Mundo, Ewa Dobrowolska, Ido Galil, Yaniv Galron, Amnon Geifman, Yonatan Geifman, Izik Golan, Alex Gronskiy, Tomasz Grzegorzek, Netanel Haber, Lior Kadoch, Grzegorz Karch, Tomer Keren, Abhinav Khattar, Amir Klein, Tugrul Konuk, Roi Koren, Daniel Korzekwa, Shaun Kotek, Konstantinos Krommydas, Itay Levy, Ofri Masad, Yoav Miron, Pavlo Molchanov, Shahar Mor, Zach Moshe, Saurav Muralidharan, Najeeb Nabwani, Besmira Nushi, Mostofa Patwary, Omri Puny, Johannes Rausch, Tomer Ronen, Sepehr Sameni, Itamar Schen, Elad Segal, Daniel Serebrenik, Ido Shahaf, Soumye Singhal, Daniil Sorokin, Sharath Turuvekere Sreenivas, Marta Stepniewska-Dziubinska, Ali Taghibakhshi, Nima Tajbakhsh, Oren Tropp, Dor Tzur, Anna Warno, Yi-Fu Wu, Michal Zawalski, Jiaqi Zeng, Yian Zhang, Ran Zilberstein, Amit Zuker, Ran El-Yaniv

机构 * Nemotron-Labs(奈莫tron实验室)

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI

AI总结 研究为交互式部署优化设计压缩模型Nemotron-Labs-3-Puzzle-75B-A9B,用多阶段管道结合多种方法构建,在多约束下提升服务器吞吐量,压缩后仍保持较强下游能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27106 2026-07-08 cs.CR cs.AI 新提交 57%

Application of LLMs to Threat Assessment of Foreign Peacekeeping Missions

LLMs在外国维和任务威胁评估中的应用

Gerhard Backfried, Christian Schmidt, Diego Pilutti, Michael Suker

机构 * HENSOLDT Austria(海恩索尔特奥地利公司) Austrian Ministry of Defence(奥地利国防部)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 提出利用大语言模型(LLMs)结合风险模型和OSINT媒体数据,自动提取维和任务相关威胁,评估显示自动结果与人工判断高度一致。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03201 2026-07-07 eess.AS cs.LG cs.SD 新提交 57%

Deriving Benchmarking Datasets from Long-Form Recordings: Challenges and Opportunities

从长时长录音推导基准数据集:挑战与机遇

Kaveri K. Sheth, Lawrence Borst, Tarek Kunze, Marvin Lavechin, Okko Räsänen, Sho Tsuji, Loann Peurey, Alix Bourrée, Alejandrina Cristia

机构 * LAAC, LSCP, DEC, ENS, EHESS, CNRS, PSL University, Paris, France(法国巴黎PSL大学、CNRS、EHESS、ENS、DEC、LSCP、LAAC) Laboratoire d'Informatique et Systèmes, Université Aix-Marseille, CNRS, France(法国国家科学研究中心、艾克斯-马赛大学信息与系统实验室) Signal Processing Research Centre, Tampere University, Finland(芬兰塔尔库大学信号处理研究中心)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 针对儿童长时长录音用于早期语言研究的跨库复用难、缺标准基准、隐私合规差问题,提出含标准化数据集、可复现流水线、伦理生态系统的综合框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04907 2026-07-07 cs.AI 新提交 57%

Medi-Gemma: A Hybrid Clinical Decision Support System Integrating Deterministic EMR Analytics and Retrieval-Augmented Generation

Medi-Gemma:一种集成确定性电子病历分析与检索增强生成的混合临床决策支持系统

Mohammed Saim Ahmed Quadri, Yunzhe Xue, Justin W. Ady, Usman Roshan

机构 * New Jersey Institute of Technology(新泽西理工学院) Robert Wood Johnson Hospital(罗伯特·伍德·约翰逊医院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 介绍用于伤口病理分类和工作流程自动化的临床决策支持系统Medi-Gemma,其采用解耦框架,经多阶段管道处理数据请求,关键贡献是地面真值注入模块,验证表明该架构有诸多优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04560 2026-07-07 cs.CL 新提交 57%

Can temporal article-level credibility signals improve domain-level credibility prediction?

时间性文章级可信度信号能否改善领域级可信度预测?

Islam Eldifrawi, Shengrui Wang, Amine Trabelsi

机构 * Usherbrooke

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 研究新兴网络领域可信度评估难题,介绍基于专家评级的领域可信度评估框架DCEF,探讨能否依专家流程从文章评估领域可信度,无需领域先验知识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03194 2026-07-07 cs.SE 新提交 57%

TATG: Tracking-Aware Testing Objective for LLM-based Test Generation

TATG:基于大语言模型的测试生成的跟踪感知测试目标

Guancheng Wang, Qinghua Xu, Lionel C. Briand

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 针对复杂Java方法自动化单元测试生成难的问题,TATG提出基于大语言模型的单元测试生成方法,引入统一目标表示跟踪测试需求,采用两阶段工作流程,实验证明其相比其他方法有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏