arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Amazon(亚马逊)

2026-04-03 至 2026-04-03 共收录 3
2604.01977 2026-04-03 cs.CR cs.AI cs.CL cs.LG cs.SE

RuleForge: Automated Generation and Validation for Web Vulnerability Detection at Scale

RuleForge: 用于大规模Web漏洞检测的自动化生成与验证

Ayush Garg, Sophia Hager, Jacob Montiel, Aditya Tiwari, Michael Gentile, Zach Reavis, David Magnotti, Wayne Fullen

机构 * Johns Hopkins University(约翰霍普金斯大学) Amazon Web Services(亚马逊云服务)

AI总结 RuleForge通过自动化生成基于JSON的检测规则,结合LLM作为判断系统和反馈机制,提升漏洞检测的准确性和效率,减少误报。

Comments 11 pages, 10 figures. To be submitted to CAMLIS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01600 2026-04-03 cs.AI

MM-ReCoder: Advancing Chart-to-Code Generation with Reinforcement Learning and Self-Correction

MM-ReCoder:通过强化学习和自我校正推进图表到代码生成

Zitian Tang, Xu Zhang, Jianbo Yuan, Yang Zou, Varad Gunjal, Songyao Jiang, Davide Modolo

机构 * Brown University(布朗大学) Amazon AGI(亚马逊AGI)

AI总结 MM-ReCoder通过强化学习和自我校正机制提升图表到代码生成能力,其两阶段多轮自我校正策略基于Group Relative Policy Optimization,提升代码准确性和可执行性。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05500 2026-04-03 cs.AI

The Illusion of AI Expertise Under Uncertainty: Navigating Elusive Ground Truth via a Probabilistic Paradigm

人工智能专家能力的幻觉:通过概率范式导航 elusive 的真实地面真相

Aparna Elangovan, Lei Xu, Mahsa Elyasi, Ismail Akdulum, Mehmet Aksakal, Enes Gurun, Brian Hur, Saab Mansour, Ravid Shwartz Ziv, Karin Verspoor, Dan Roth

机构 * Independent Researcher(独立研究员) Amazon(亚马逊) Gazi University(加齐大学) University of Colorado(科罗拉多大学) Samsun University(萨姆松大学) The University Of Melbourne(墨尔本大学) New York University(纽约大学) RMIT University(皇家墨尔本理工大学) University of Pennsylvania(宾夕法尼亚大学)

AI总结 本文提出概率范式,揭示高置信度真实答案对专家高分的必要性,指出在真实答案变化大的数据集中,随机标注者与专家表现差异不大,强调在低专家表现时,按真实答案概率分层评估至关重要。

详情

展开后加载摘要…

URL PDF HTML 收藏