arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Carnegie Mellon University(卡内基梅隆大学)

2026-08-24 至 2026-08-24 共收录 4
2608.17882 2026-08-24 cs.RO 版本更新

ControlledShifts: Towards Standardizing Robustness Evaluation in Trajectory Prediction Under Distribution Shifts

ControlledShifts:面向分布偏移下轨迹预测鲁棒性评估的标准化

Ingrid Navarro, Pablo Ortega-Kral, Yutong Duan, Jonathan Francis, Jean Oh

机构 * School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学学院) Lavoro AI(拉沃罗人工智能公司) Stack AV(斯塔克自动驾驶公司) Bosch Center for Artificial Intelligence(博世人工智能中心)

AI总结 本文提出ControlledShifts框架与基准套件,通过标准化划分轨迹数据集及统一鲁棒性评分,评估不同容量Transformer架构在分布偏移下轨迹预测的鲁棒性,揭示其处理潜在相关性与环境结构的差异。

Comments 8 pages, 8 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30949 2026-08-24 cs.AI cs.AR 版本更新

AgRefactor: Self-Evolving Agentic Workflow for HLS Compatibility and Performance

AgRefactor:面向HLS兼容性与性能的自进化智能体工作流

Yang Zou, Zijian Ding, Yizhou Sun, Jason Cong

机构 * Carnegie Mellon University(卡内基梅隆大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

AI总结 提出基于LLM的多智能体工作流AgRefactor,通过自进化记忆系统和自动化重构工具,将软件代码重构为HLS兼容程序,在11个基准测试中9个超越现有方法,并实现6.51x几何平均加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13892 2026-08-24 cs.CR cs.AI 版本更新

Crypto x AI, AI x Crypto: A Survey

Crypto x AI, AI x Crypto: 综述

Sarah Allen, Pranay Anchuri, James Austgen, Maryam Bahrani, Samuel Breckenridge, Aaron Buchwald, Christian Cachin, Andrés Fábrega, Jared Fernandez, James Hsin-yu Chiang, Marwa Mouallem, Roi Bar-Zur, Neil DeSilva, Ittay Eyal, Giulia Fanti, Ari Juels, Andrew Miller, Christian Sillaber, Dani Vilardell, Pramod Viswanath, Wenhao Wang, Matt Weinberg, Sen Yang, Jianzhu Yao, Fan Zhang

机构 * Initiative for CryptoCurrencies and Contracts (IC3)(加密货币与合同倡议(IC3)) Ava Labs(Ava实验室) Carnegie Mellon University(卡内基梅隆大学) Cornell Tech(康奈尔科技) Flashbots Offchain Labs(离链实验室) Ritual Labs(仪式实验室) Technion(技术学院) University of Bern(伯恩大学) Princeton University(普林斯顿大学) ETH Zurich(苏黎世联邦理工学院) Teleport(Teleport;Flashbots(X)) Flashbots(X)(特拉维夫大学) Tel Aviv University

AI总结 本综述系统梳理了AI与区块链(crypto)的交叉研究,总结了现有工作、关键发现、开放问题及行业误解,指出两者仍处于早期融合阶段。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03262 2026-08-24 cs.SE cs.CL 版本更新

Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks

Vibe 编程是否安全?在现实任务中对代理生成代码的漏洞基准测试

Songwen Zhao, Danqing Wang, Kexun Zhang, Jiaxuan Luo, Zhuo Li, Lei Li

机构 * Carnegie Mellon University Language Technologies Institute(卡内基梅隆大学语言技术研究所) Columbia University(哥伦比亚大学) Johns Hopkins University(约翰霍普金斯大学) HydroX AI

AI总结 本文通过基准测试发现,Vibe 编程在现实任务中生成的代码安全性不足,尽管功能正确但存在安全漏洞,警示其在安全敏感领域应用的风险。

Comments Accepted in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏