arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Amazon(亚马逊)

2026-03-23 至 2026-03-23 共收录 7
2603.19921 2026-03-23 cs.CL cs.AI

Span-Level Machine Translation Meta-Evaluation

段级机器翻译元评估

Stefano Perrella, Eric Morales Agostinho, Hugo Zaragoza

机构 * Sapienza University of Rome(罗马萨皮恩扎大学) Amazon(亚马逊)

AI总结 本文研究了段级精度、召回率和F值的不同实现,发现看似相似的方法会产生显著不同的排名,某些常用技术不适合评估机器翻译错误检测。提出MPP与微平均相结合的元评估策略,并评估了当前机器翻译错误检测的最新状态。

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00518 2026-03-23 cs.CV

Vision-TTT: Efficient and Expressive Visual Representation Learning with Test-Time Training

Vision-TTT: 高效的视觉表征学习与测试时间训练

Quan Kong, Yanru Xiao, Yuhao Shen, Cong Wang

机构 * Zhejiang University(浙江大学) Amazon Web Services(亚马逊网络服务)

AI总结 本文提出Vision-TTT,通过测试时间训练方法提升视觉表征效率与表达能力,在ImageNet分类中达到77.7%的Top-1准确率,同时在计算效率和内存消耗上显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22242 2026-03-23 cs.CV

Rethinking Test Time Scaling for Flow-Matching Generative Models

重新思考流匹配生成模型的测试时间扩展

Qingtao Yu, Changlin Song, Minghao Sun, Zhengyang Yu, Vinay Kumar Verma, Soumya Roy, Sumit Negi, Hongdong Li, Dylan Campbell

机构 * Australian National University(澳大利亚国立大学) Amazon Research(亚马逊研究院)

AI总结 本文提出DOG-Trim方法,通过Repel和NARF提升测试时间扩展效果,解决流匹配模型中全局搜索的挑战,实现性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00171 2026-03-23 cs.CV

CompAgent: An Agentic Framework for Visual Compliance Verification

CompAgent:一种用于视觉合规验证的代理框架

Rahul Ghosh, Baishali Chaudhury, Hari Prasanna Das, Meghana Ashok, Ryan Razkenari, Long Chen, Sungmin Hong, Chun-Hao Liu

机构 * Generative AI Innovation Center(生成式人工智能创新中心) Amazon Web Services(亚马逊网络服务)

AI总结 本文提出CompAgent,一种基于代理的视觉合规验证框架,通过集成视觉工具和规划代理,提升多模态推理能力,在公开基准测试中取得76%的F1分数,优于现有方法。

Comments Accepted to IEEE CVPR 2026 GRAIL-V Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24837 2026-03-23 cs.CV

ZOO-Prune: Training-Free Token Pruning via Zeroth-Order Gradient Estimation in Vision-Language Models

ZOO-Prune:基于零阶梯度估计的训练自由token剪枝方法用于视觉-语言模型

Youngeun Kim, Youjia Zhang, Huiling Liu, Aecheon Jung, Sunwoo Lee, Sungeun Hong

机构 * Amazon(亚马逊公司) Sungkyunkwan University(成均馆大学) Inha University(inha大学)

AI总结 本文提出ZOO-Prune方法,通过零阶梯度估计在视觉-语言模型中实现无需训练的token剪枝,实验表明其在剪枝94.4%token的同时保持精度,并提升推理效率2.3倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19481 2026-03-23 cs.CV

Narrative Aligned Long Form Video Question Answering

叙事对齐的长视频问答

Rahul Jain, Keval Doshi, Burak Uzkent, Garin Kessler

机构 * Purdue University(普渡大学) Amazon(亚马逊)

AI总结 本文提出NA-VQA基准,评估长视频中的深度时间与叙事推理能力,通过88部完整电影和4.4K开放性问题测试模型整合分散叙事信息的能力,提出Video-NaRA框架提升远距离推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19267 2026-03-23 cs.CL cs.IR

Reviewing the Reviewer: Graph-Enhanced LLMs for E-commerce Appeal Adjudication

审查审查者:图增强的大语言模型用于电商争议裁决

Yuchen Du, Ashley Li, Zixi Huang

机构 * Purdue University(普渡大学) Amazon(亚马逊)

AI总结 本文提出图增强的大语言模型,通过显式动作建模和冲突建模解决电商争议裁决中的信息不对称问题,提升裁决一致性。

Comments 10 pages, 3 figures, KDD 2026 Applied Data Science Track

详情

展开后加载摘要…

URL PDF HTML 收藏