arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Amazon(亚马逊)

2026-07-28 至 2026-07-28 共收录 5
2607.23735 2026-07-28 cs.LG cs.CV 新提交

Source-Free Controlled Adaptation of Teachers for Continual Test-Time Adaptation

用于持续测试时自适应的无源教师控制自适应

Anurag Roy, Riddhiman Moulick, Vinay Kumar Verma, Saptarshi Ghosh, Abir Das

机构 * IIT Kharagpur(印度理工学院卡拉格普尔分校) IBM Research(IBM 研究院) Amazon(亚马逊) Indian Institute of Technology, Kharagpur(印度理工学院卡拉格普尔分校)

AI总结 研究推理时领域持续变化下的持续测试时自适应问题,提出无源可控教师自适应方法,动态设置动量值并估计类原型,无需源数据,实验表明该方法优于多种需源数据的现有自适应框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22713 2026-07-28 cs.AI 新提交

SEGRA: Structured Experience-Guided Graph Reasoning Agent for Gremlin Based Question Answering

SEGRA:用于基于Gremlin的问答的结构化经验引导图推理代理

Saiyue Lyu, Mariam Dundua, Vishaal Kapoor, Sarthak Ahuja, Neda Kordjazi, Evren Yortucboylu, Harsh Amin, Rebecca Steinert

机构 * University of British Columbia(英属哥伦比亚大学) Amazon(亚马逊)

AI总结 针对企业文本到Gremlin问答难题,SEGRA引入经验引导代理,集成多种技术,包括意图路由、查询生成等。在企业IT支持基准测试中成绩出色,平均评判分数大幅提高,技能库还降低了成本,提升了企业图问答的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22682 2026-07-28 cs.AI cs.LG cs.MA 新提交

A Vocabulary for Multi-Agent Automated Research Systems

多智能体自动研究系统的词汇表

Bardiya Akhbari

机构 * Amazon AGI(亚马逊通用人工智能)

AI总结 介绍多智能体自动研究系统词汇表,规定智能体、操作等多方面内容,将结构设计问题转化为可测试选择,使评估器成系统组件,还区分生成性品味和评估性品味,并在自动研究系统上实例化说明其涵盖多种不同结构设计。

Comments 22 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22658 2026-07-28 cs.AI cs.SD eess.AS 新提交

StanceBench: A Benchmark for Audio LLM-Based Interpersonal Stance Evaluation from Speech

StanceBench:一个基于音频大语言模型的语音人际立场评估基准

Yuzhe Wang, Thomas Thebaud, Jennifer Hu, Jesús Villalba-Lopez, Venkatesh Ravichandran, Georgi Tinchev, Najim Dehak, Laureano Moro-Velázquez

机构 * Johns Hopkins University(约翰斯·霍普金斯大学) Amazon AGI(亚马逊通用人工智能公司) Amazon Research(亚马逊研究院)

AI总结 研究基于音频大语言模型的语音人际立场评估,引入StanceBench基准,通过Seamless Interaction语料库规范评估,明确9个立场维度,报告大语言模型评判的多项指标,指出不同立场的判断难易及特点。

Comments Accepted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22642 2026-07-28 cs.AI cs.CL cs.LG cs.MA cs.SE 新提交

CRAFT: Learn the Schema, Execute the Plan

CRAFT:学习模式,执行计划

Aakash Kolekar, Sahika Genc, Shahriar Shariat, Bunyamin Sisman, Tibor Mezi, Barbara Poblete, Shree Vandana Kachroo, Calvin Chi, Parth Parmar, Ari Singer, Prayaas Jain, Cindy Barker, Benoit Dumoulin

机构 * Amazon Advertising Foundations(亚马逊广告基金会) Amazon Web Services Agentic AI(亚马逊网络服务代理人工智能)

AI总结 研究企业编码代理将自然语言分析请求转换为可执行代码时的问题,提出两阶段训练后方法 CRAFT,先进行模式剥离的 PLAN 监督微调,再用执行形状的强化学习,评估显示其在多方面有提升并减少负担。

详情

展开后加载摘要…

URL PDF HTML 收藏