Revisiting Salient Object Detection from an Observer-Centric Perspective
重新审视以观察者为中心的显著物体检测
机构 * Dalian University of Technology(大连理工大学)
专题命中 工作流自动化 :agentic(abstract);分类 cs.AI
AI总结 本文提出OC-SOD方法,通过考虑观察者偏好和意图,实现个性化显著性预测,并构建首个OC-SOD数据集和代理基线。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
重新审视以观察者为中心的显著物体检测
机构 * Dalian University of Technology(大连理工大学)
专题命中 工作流自动化 :agentic(abstract);分类 cs.AI
AI总结 本文提出OC-SOD方法,通过考虑观察者偏好和意图,实现个性化显著性预测,并构建首个OC-SOD数据集和代理基线。
T$^3$-S2S:无训练三元组微调用于可控概念艺术生成中的草图到场景合成
机构 * Australian National University(澳大利亚国立大学) ; Vertex Lab(Vertex实验室) ; University of Technology Sydney(悉尼大学)
专题命中 工作流自动化 :workflow(abstract);分类 cs.CL
AI总结 本文提出T3-S2S方法,通过三元组微调实现可控概念艺术生成中的草图到场景合成,提升多实例场景生成的可控性和细节精度。
ClassAid: 课堂编程活动中的实时教师-AI-学生协同系统
专题命中 工作流自动化 :agent(abstract)
AI总结 ClassAid通过实时动态控制AI支持,为课堂编程活动提供个性化反馈,提升教师指导学生与AI互动的效果。
对一种用于辅助颈椎手术的协同机器人系统的初步实验反馈
专题命中 工作流自动化 :workflow(abstract)
AI总结 本研究评估了一种协同机器人系统在辅助颈椎手术钻孔任务中的性能,通过分析其轨迹执行精度,为临床应用提供可靠性和改进方向的反馈。
Journal ref The 7th IFToMM International Conference on Mechanisms, Transmissions, and Applications, Sep 2025, Taoyuan City, France. pp.147-155
设计条件先验引导的狄利克雷过程混合模型:一种用于聚类计数和权重控制的统一框架
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出DCE框架,通过两阶段矩匹配解决DPM模型中浓度参数校准问题,减少后验崩溃并提高聚类计数与权重控制的准确性。
阈值资源再分配在空间结构的亲属网络中的应用
专题命中 工作流自动化 :agent(abstract)
AI总结 该研究探讨了在空间受限条件下,基于亲属网络结构的资源再分配机制,揭示了资源密度、合作与亲属关系之间的相互作用。
Comments 39 pages, 8 figures. Submitted to Journal of Theoretical Biology
TraceCoder: 一个基于跟踪的多智能体框架,用于自动调试LLM生成的代码
机构 * School of Computer Science and Technology, Chongqing University of Posts and Telecommunications(重庆邮电大学计算机科学与技术学院) ; Nanyang Technological University(南洋理工大学) ; Beihang University(北京航空航天大学) ; Southwest University(西南大学)
专题命中 软件智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.SE
AI总结 TraceCoder通过多智能体框架和历史教训学习机制,提升LLM生成代码的自动调试效率和准确性。
面向开源软件的AI代理上下文工程
专题命中 软件智能体 :AI agent(title,abstract);agent(abstract);agentic(abstract);分类 cs.SE
AI总结 本文研究了AI代理在开源软件中上下文文件的采用情况,发现其内容结构尚不统一,且存在多种提供方式,为研究上下文工程质量改进提供了新机会。
Comments 5 pages, 1 figure, 2 tables, 23rd IEEE/ACM International Conference on Mining Software Repositories (MSR 2026)
基于大语言模型的完全自动化混沌工程:实现任何人以低成本构建容错软件系统
机构 * NTT, Inc., Japan(日本NTT公司)
专题命中 软件智能体 :planning(abstract);workflow(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.SE
AI总结 本文提出ChaosEater系统,利用大语言模型自动化混沌工程周期,使任何人能低成本构建容错软件系统。
Comments Accepted at ASE 2025 NIER Track. The code is available at https://github.com/ntt-dkiku/chaos-eater
Journal ref 2025 40th IEEE/ACM International Conference on Automated Software Engineering (ASE)
SWE-Dev:评估和训练自主的基于特征驱动的软件开发
机构 * Shanghai Jiao Tong University(上海交通大学) ; Beijing University of Aeronautics and Astronautics(北京航空航天大学) ; The Chinese University of Hong Kong(香港中文大学) ; University of Michigan(密歇根大学)
专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL、cs.SE
AI总结 SWE-Dev是一个大规模数据集,用于评估和训练自主编码系统在特征驱动软件开发中的能力,通过提供可运行环境和单元测试提升模型性能。
MDAgent2:用于分子动力学中代码生成和知识问答的大型语言模型
机构 * Peking University(北京大学) ; National Key Laboratory of Data Space Technology and System(国家数据空间技术与系统重点实验室) ; The Hong Kong University of Science and Technology(香港科学与技术大学) ; Liaoning Technical University(辽宁技术大学) ; Wenjing Future Lab (Beijing) Technology Co., Ltd(文景未来实验室(北京)科技有限公司)
专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG
AI总结 MDAgent2是首个能同时进行分子动力学知识问答和代码生成的端到端框架,通过领域特定数据集和强化学习方法提升性能。
Comments 24 pages,4 figures
基于大型语言模型的静态空性错误修复
专题命中 软件智能体 :agent(abstract);workflow(abstract);分类 cs.SE
AI总结 基于LLM的NullRepair系统通过结构化工作流自动修复静态空性错误,有效解决残留问题并保留程序语义。
AgentStepper: 软件开发代理的交互式调试
机构 * University of Stuttgart(斯图加特大学) ; CISPA Helmholtz Center for Information Security(CISPA 沃尔夫冈·泡利信息安全中心)
专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE
AI总结 AgentStepper是一种用于LLM软件工程代理的交互式调试工具,通过结构化对话和逐步执行提升调试效率,减少开发者工作量。
SpIDER:面向软件问题定位的时空感知密集嵌入检索
机构 * Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系) ; AWS(亚马逊公司) ; AWS AI Labs(亚马逊人工智能实验室)
专题命中 软件智能体 :agentic(abstract);分类 cs.LG、cs.SE
AI总结 SpIDER通过结合LLM推理和图结构探索信息,提升代码库中相关代码单元的密集检索性能,实验显示在多个编程语言和基准测试中性能提升达13%。
Comments Initial preprint
Meta SecAlign: 一种针对提示注入攻击的 secure LLM 基础
机构 * FAIR at Meta(Meta 的 FAIR 部门) ; UC Berkeley(加州大学伯克利分校)
专题命中 软件智能体 :agentic(abstract);分类 cs.AI
AI总结 Meta SecAlign 是首个开源的 LLM,具备内置的模型级防御,实现了商业级性能,且在复杂代理任务中表现优异,同时在提示注入攻击中展现出更高的安全性。
DECEPTICON:暗模式如何操纵网络代理
机构 * Stanford University(斯坦福大学)
专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI
AI总结 DECEPTICON研究揭示暗模式通过引导代理轨迹对网络代理构成重大风险,表明需加强防御措施以应对操纵性设计。
在源头遏制漂移:面向鲁棒视觉语言导航的回顾性校正
机构 * Xidian University(西安电子科技大学) ; Southwest University of Science and Technology(西南科技大学)
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 BudVLN通过回顾性校正和决策条件监督合成,有效缓解视觉语言导航中的分布偏移问题,提升鲁棒性与导航性能。
少即是多:从有限数据实现可扩展的视觉导航
机构 * ETH Zurich(苏黎世联邦理工学院) ; Stanford University(斯坦福大学) ; UC Berkeley(伯克利加州大学)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 本文提出Less is More方法,通过结合有限专家示范与规划器生成的监督,实现高效视觉导航。
Comments v2: Minor text edits, reference formatting fixes, and project page link added
Refer-Agent:一种具有推理和反思的协作多智能体系统用于指引用视频对象分割
机构 * Sun Yat-sen University(中山大学)
专题命中 记忆与上下文管理 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract)
AI总结 Refer-Agent通过协作多智能体系统结合推理与反思机制,提升指引用视频对象分割的性能与灵活性。
FadeMem: 基于生物机制的高效代理记忆遗忘
机构 * Alibaba International Digital Commerce Group(阿里巴巴国际数字商业集团) ; School of Software and Microelectronics(软件与微电子学院) ; Peking University(北京大学)
专题命中 记忆与上下文管理 :agent(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.CL
AI总结 FadeMem通过生物启发的主动遗忘机制,提升代理记忆的效率与存储容量,实现更有效的信息管理与多跳推理能力。
从开普勒到牛顿:归纳偏置引导变换器中的学习世界模型
机构 * Stanford University(斯坦福大学)
专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG
AI总结 本文通过引入归纳偏置,使通用变换器能够学习世界模型,从开普勒到牛顿,实现从曲线拟合到物理定律发现的转变。
不稳定系统的粗信息主动定位
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 记忆与上下文管理 :agent(abstract)
AI总结 本文提出了一种基于集估计器和Voronoi划分的主动定位算法,用于在粗略传感下恢复不稳定系统的初始状态并保证信息区域的稳定性。
Comments 10 pages, 4 figures, Accepted by International Conference on Hybrid Systems: Computation and Control (HSCC) 2026
面向代理支付协议的零信任运行时验证:缓解AP2中的重放和上下文绑定失败
机构 * eBay Inc(eBay公司)
专题命中 Agent评测 :agentic(title,abstract);agent(abstract);AI agent(abstract);分类 cs.AI
AI总结 本文提出了一种零信任运行时验证框架,通过动态生成非ces强制显式上下文绑定和一次性使用命令语义,以缓解AP2中的重放和上下文重定向攻击。
yunjue代理技术报告:一种完全可重现、零起点现场自我进化代理系统用于开放性任务
机构 * Harbin Institute of Technology(哈尔滨工业大学) ; University of Science and Technology of China(中国科学技术大学)
专题命中 Agent评测 :agent(title,abstract);分类 cs.AI
AI总结 Yunjue代理系统通过现场自我进化范式实现零起点环境下开放性任务的可重现、自适应能力扩展。
信息粒子:一种新的活性代理候选者
专题命中 Agent评测 :agent(title,abstract)
AI总结 本文提出了一种基于OU浴反馈控制的信息粒子,通过调整惯性效应和波动强度,实现两种不同运动模式,展示了其在活性代理中的潜力。
Comments 8 pages, 5 figures including 3 figures in main text and 2 figures in Appendix
PrefIx: 在人机交互中理解并适应用户偏好
专题命中 Agent评测 :agent(title)
AI总结 PrefIx通过交互作为工具范式,评估智能体在人机交互中的偏好适应能力,提升用户体验和偏好对齐度。
通过优化可解释提升机改善信用卡欺诈检测
机构 * ReDi School(ReDi学院)
专题命中 Agent评测 :workflow(abstract);分类 cs.LG
AI总结 本文通过优化可解释提升机算法,提升信用卡欺诈检测的准确性和可解释性,实验结果显示其在ROC-AUC指标上优于多种传统方法。
Comments 22 pages, 5 figures, 5 tables
SAGE:深度研究代理检索的基准测试与改进
机构 * NYU Shanghai(纽约大学上海校区) ; Yale University(耶鲁大学) ; Center for Data Science, New York University(纽约大学数据科学中心)
专题命中 Agent评测 :agent(abstract);分类 cs.CL
AI总结 SAGE基准测试评估了深度研究代理的检索能力,发现BM25在推理密集型检索中表现优于大语言模型检索器,并提出基于语料库的测试时扩展框架提升检索性能。
对高歧义时空视频 footage 的混合标注流程的评估
机构 * IPTC(信息处理与电信中心) ; Telecommunications Center, Escuela Técnica Superior de Ingenieros de Telecomunicación, Av. Complutense 30, 28040 Madrid, Spain(电信中心,电信工程师高级学院,Complutense大道30号,28040马德里,西班牙)
专题命中 Agent评测 :workflow(abstract);分类 cs.LG
AI总结 本文评估了混合标注流程在高歧义时空视频中的有效性,通过实验表明其能显著减少标注时间并提供更严谨的AI辅助工作流程评估框架。
Mut4All:通过从错误报告中学习的LLM合成变异器模糊编译器
专题命中 Agent评测 :agent(abstract);分类 cs.SE
AI总结 Mut4All通过LLM合成变异器自动发现编译器错误,实现高效且跨语言的模糊测试