arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Stanford University(斯坦福大学)

2026-04-21 至 2026-04-21 共收录 23
2604.18547 2026-04-21 stat.ML cs.CL cs.LG

FUSE: Ensembling Verifiers with Zero Labeled Data

FUSE:无需标注数据的验证器集成

Joonhyuk Lee, Virginia Ma, Sarah Zhao, Yash Nair, Asher Spector, Regev Cohen, Emmanuel J. Candès

机构 * Stanford University(斯坦福大学) Google(谷歌)

AI总结 FUSE通过无监督集成验证器提升大语言模型输出验证质量,无需标注数据,在多种生成模型和基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02543 2026-04-21 cs.LG

Inference-Time Distillation: Cost-Efficient Agents Without Fine-Tuning or Manual Prompt Engineering

推理时蒸馏:无需微调或手动提示工程的低成本代理

Vishnu Sarukkai, Asanshay Gupta, James Hong, Michaël Gharbi, Kayvon Fatahalian

机构 * Stanford University(斯坦福大学)

AI总结 本文提出通过推理时技术实现低成本高准确率的代理,无需微调或手动提示工程,在ALFWorld和AppWorld上分别实现2.5倍和3.5倍的成本降低,同时保持高准确率。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18463 2026-04-21 cs.AI cs.LG cs.RO

Using large language models for embodied planning introduces systematic safety risks

使用大型语言模型进行具身规划引入了系统性的安全风险

Tao Zhang, Kaixian Qu, Zhibin Li, Jiajun Wu, Marco Hutter, Manling Li, Fan Shi

机构 * ETH Zurich(苏黎世联邦理工学院) University College London(伦敦大学学院) Stanford University(斯坦福大学) Northwestern University(西北大学) National University of Singapore(新加坡国立大学)

AI总结 研究评估了大型语言模型在机器人规划中的安全性,发现即使规划能力高,安全风险仍显著存在,揭示了规划能力与安全意识之间的乘法关系。

Comments Project page: https://despite-safety.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18459 2026-04-21 cs.CV cs.AI

Progressive Online Video Understanding with Evidence-Aligned Timing and Transparent Decisions

渐进式在线视频理解与证据对齐的透明决策

Kecheng Zhang, Zongxin Yang, Mingfei Han, Haihong Hao, Yunzhi Zhuge, Changlin Li, Junhan Zhao, Zhihui Li, Xiaojun Chang

机构 * University of Science and Technology of China(中国科学技术大学) Harvard University(哈佛大学) Department of CV, MBZUAI(MBZUAI计算机视觉部门) Dalian University of Technology(大连理工大学) Stanford University(斯坦福大学) Chicago University(芝加哥大学)

AI总结 本文提出一种新型框架,通过分离推理控制与记忆整合,解决在线视频理解中的决策透明、时间对齐和计算预算限制问题,显著提升了性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18331 2026-04-21 cs.RO

Will People Enjoy a Robot Trainer? A Case Study with Snoopie the Pacerbot

人们会喜欢机器人教练吗?一项与Snoopie的Pacerbot的案例研究

Maximilian Du, Jennifer Grannen, Shuran Song, Dorsa Sadigh

机构 * Stanford University(斯坦福大学)

AI总结 本文探讨机器人四足机器人能否作为有效的个人训练设备,通过间隔训练案例研究,展示机器人教练在一致性与遵守节奏方面的优势,并证明用户更偏好机器人教练。

Comments 8 pages, 4 figures. To appear at ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18002 2026-04-21 cs.LG

Neural Garbage Collection: Learning to Forget while Learning to Reason

神经垃圾回收:在学习推理的同时学习遗忘

Michael Y. Li, Jubayer Ibn Hamid, Emily B. Fox, Noah D. Goodman

机构 * Stanford University(斯坦福大学)

AI总结 本文提出神经垃圾回收(NGC),通过端到端学习使语言模型在推理时自动管理内存,无需人工设计规则,实现内存压缩与效率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14281 2026-04-21 cs.CR cs.LG cs.SE

XOXO: Stealthy Cross-Origin Context Poisoning Attacks against AI Coding Assistants

XOXO:针对AI编码助手的隐蔽跨域上下文污染攻击

Adam Štorek, Mukur Gupta, Noopur Bhatt, Aditya Gupta, Janie Kim, Prashast Srivastava, Suman Jana

机构 * Columbia University(哥伦比亚大学) Stanford University(斯坦福大学)

AI总结 本文提出XOXO攻击,通过隐蔽的跨域上下文污染使AI编码助手生成漏洞代码。引入GCGS算法,利用Cayley图系统搜索变换空间,实现75.72%的攻击成功率,传统防御方法无效。

Comments Accepted to ACL 2026 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17818 2026-04-21 cs.CV

AnyLift: Scaling Motion Reconstruction from Internet Videos via 2D Diffusion

AnyLift: 通过2D扩散模型从互联网视频中扩展运动重建

Hongjie Li, Heng Yu, Jiaman Li, Hong-Xing Yu, Ehsan Adeli, C. Karen Liu, Jiajun Wu

机构 * Stanford University(斯坦福大学)

AI总结 本文提出AnyLift框架,利用2D扩散模型从互联网视频中重建3D人体运动和人-物交互,通过合成多视角2D运动数据和训练相机条件多视角2D运动扩散模型,提升动态摄像下运动重建的准确性和鲁棒性。

Comments CVPR 2026. Project website: https://awfuact.github.io/anylift/ The first two authors contribute equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17654 2026-04-21 cs.AI

Poly-EPO: Training Exploratory Reasoning Models

Poly-EPO:训练探索性推理模型

Ifdita Hasan Orney, Jubayer Ibn Hamid, Shreya S Ramanujam, Shirley Wu, Hengyuan Hu, Noah Goodman, Dorsa Sadigh, Chelsea Finn

机构 * Stanford University(斯坦福大学)

AI总结 本文提出Poly-EPO框架,通过集强化学习提升语言模型的探索与利用协同,增强推理能力与泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17283 2026-04-21 cs.CL cs.AI

HorizonBench: Long-Horizon Personalization with Evolving Preferences

HorizonBench: 长时间跨度个性化与演变偏好

Shuyue Stella Li, Bhargavi Paranjape, Kerem Oktar, Zhongyao Ma, Gelin Zhou, Lin Guan, Na Zhang, Sem Park, Lin Chen, Diyi Yang, Yulia Tsvetkov, Asli Celikyilmaz

机构 * University of Washington(华盛顿大学) Meta OpenAI Stanford University(斯坦福大学)

AI总结 本文提出HorizonBench,通过生成6个月时间线的对话数据,提供长时间跨度个性化研究的测试平台,揭示状态跟踪能力是长周期个性化的主要瓶颈。

Comments 19 pages, 5 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21257 2026-04-21 cs.CL

MoCo: A One-Stop Shop for Model Collaboration Research

MoCo:模型协作研究的一站式解决方案

Shangbin Feng, Yuyang Bai, Ziyuan Yang, Yike Wang, Zhaoxuan Tan, Jiajie Yan, Zhenyu Lei, Wenxuan Ding, Weijia Shi, Haojin Wang, Zhenting Qi, Yuru Jiang, Heng Wang, Chengsong Huang, Yu Fei, Jihan Yao, Yilun Du, Luke Zettlemoyer, Yejin Choi, Yulia Tsvetkov

机构 * University of Washington(华盛顿大学) University of Notre Dame(诺特大学) University of Virginia(弗吉尼亚大学) New York University(纽约大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Harvard University(哈佛大学) Washington University in St. Louis(圣路易斯华盛顿大学) University of California Irvine(加州大学尔湾分校) Stanford University(斯坦福大学)

AI总结 本文提出MoCo库,提供26种模型协作方法及25个评估数据集,验证协作策略在多数场景下优于非协作模型,分析协作系统的有效性及未来研究方向。

Comments Moco is available at https://github.com/BunsenFeng/model_collaboration

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04609 2026-04-21 cs.CL

When More Words Say Less: Decoupling Length and Specificity in Image Description Evaluation

当更多词语说更少:在图像描述评估中解耦长度与特异性

Rhea Kapur, Robert Hawkins, Elisa Kreiss

机构 * Stanford University(斯坦福大学) University of California, Los Angeles(加州大学洛杉矶分校)

AI总结 本文提出通过对比集定义描述特异性,验证人们更偏好信息密集的描述,无论长度如何,且长度分配影响特异性差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08812 2026-04-21 cs.LG

Test-Time Alignment via Hypothesis Reweighting

测试时对齐 via 假设重加权

Yoonho Lee, Jonathan Williams, Henrik Marklund, Archit Sharma, Eric Mitchell, Anikait Singh, Chelsea Finn

机构 * Stanford University(斯坦福大学)

AI总结 本文提出HyRe方法,通过重加权集成成员实现实时个性化,仅需1-5个标记示例即可超越现有奖励模型。

Comments TMLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17148 2026-04-21 cs.AI

Graph-of-Agents: A Graph-based Framework for Multi-Agent LLM Collaboration

图-智能体:一种基于图的多智能体LLM协作框架

Sukwon Yun, Jie Peng, Pingzhi Li, Wendong Fan, Jie Chen, James Zou, Guohao Li, Tianlong Chen

机构 * UNC Chapel Hill(UNC夏洛茨维尔分校) Eigent AI(Eigent人工智能) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室) Stanford University(斯坦福大学)

AI总结 本文提出Graph-of-Agents框架,通过节点采样、边构建和消息传递提升多智能体协作效率,仅用3个智能体在多个基准测试中优于使用全部6个智能体的基线方法。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17082 2026-04-21 cs.CV

D-Prism: Differentiable Primitives for Structured Dynamic Modeling

D-Prism:用于结构动态建模的可微原始体

Xingyuan Yu, Yijin Li, Chong Zeng, Yuhang Ming, Hujun Bao, Guofeng Zhang

机构 * State Key Lab of CAD&CG, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室) Stanford University(斯坦福大学) Hangzhou Dianzi University(杭州电子科技大学)

AI总结 本文提出D-Prism框架,通过扩展可微原始体到动态领域,实现高保真的结构动态建模,结合3DGS和原始体的优势,引入变形网络和自适应控制策略,提升结构动态建模的精度和效率。

Comments Accepted to CVPR 2026. Project page: https://zju3dv.github.io/d-prism/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16685 2026-04-21 cs.LG cs.AI

Graph Transformer-Based Pathway Embedding for Cancer Prognosis

基于图变换器的通路嵌入用于癌症预后

Koushik Howlader, Md Tauhidul Islam, Wei Le

机构 * Iowa State University(爱荷华州立大学) Stanford University(斯坦福大学)

AI总结 本文提出PATH方法,通过基因共享基础嵌入与患者特定信号动态适应,提升癌症预后预测的准确性与生物学意义。

Comments 25 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16423 2026-04-21 cs.LG cs.AI

Shifting the Gradient: Understanding How Defensive Training Methods Protect Language Model Integrity

梯度偏移:理解防御性训练方法如何保护语言模型完整性

Satchel Grant, Victor Gillioz, Jake Ward, Thomas McGrath

机构 * Stanford University(斯坦福大学) MATS

AI总结 本文通过对比PPS和IP两种防御性训练方法,揭示其在保护语言模型完整性上的不同机制,发现PPS通过调整激活梯度抑制特质表达,而IP则通过解释数据中的特质表达来减少预测损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16381 2026-04-21 cs.RO

Interdisciplinary Workshop on Mechanical Intelligence: Summary Report

机械智能跨学科研讨会:总结报告

Victoria A. Webster-Wood, Nicholas Gravish, Amir Alavi, Andres F Arrieta, Sarah Bergbreiter, Anthony Bloch, Laura Blumenschein, C. Chase Cao, Aja Mia Carter, Paolo Celli, Tony Chen, Margaret Coad, Mark Cutkosky, Michael Dickey, Brian Do, Robert Full, Mahdi Haghshenas-Jaryani, Kaushik Jayaram, Aaron Johnson, Eva Kanso, Emma Lejeune, Chen Li, Suyi Li, Jeffrey Lipton, Rob MacCurdy, Matt McHenry, Jean-Michel Mongeau, Todd Murphey, Mark Plecnik, Jordan Raney, Ryan D. Sochol, Hannah Stuart, Zeynep Temel, Michael Tolley, Barry Trimmer, T. J. Wallin, Kon-Well Wang, Wenzhong Yan, Mark Yim, Wenlong Zhang

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Pittsburgh(匹兹堡大学) Purdue University(Purdue 大学) University of Michigan(密歇根大学) Tufts University(塔夫茨大学) Oregon State University(俄勒冈州立大学) Case Western Reserve University(凯斯西储大学) John’s Hopkins University(约翰·霍普金斯大学) Boston University(波士顿大学) University of Southern California(南加州大学) University of California at Berkeley(加州大学伯克利分校) Penn State University(宾夕法尼亚州立大学) Northeastern University(东北大学) University of Pennsylvania(宾夕法尼亚大学) University of Colorado Boulder(科罗拉多大学 Boulder 分校) New Mexico State University(新墨西哥州立大学) University of Notre Dame(诺丁汉大学) Stanford University(斯坦福大学)

AI总结 本报告总结了2024年机械智能跨学科研讨会的成果,探讨了机械结构自身通过响应性、适应性、记忆和学习编码智能的现象,以及其与计算智能的区别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16364 2026-04-21 cs.CY cs.AI cs.CL

Clinical Note Bloat Reduction for Efficient LLM Use

临床笔记去冗余以提高大语言模型使用效率

Jordan L. Cahoon, Chloe Stanwyck, Asad Aali, Rachel Madding, Emma Sun, Yixing Jiang, Renumathy Dhanasekaran, Emily Alsentzer

机构 * Department of Biomedical Data Science, Stanford University, Stanford, CA(斯坦福大学生物医学数据科学系) Department of Pathology, Stanford University, Stanford, CA(斯坦福大学病理学系) Department of Anesthesiology, Perioperative and Pain Medicine, Stanford University, Stanford, CA(斯坦福大学麻醉学、围术期医学与疼痛医学系) Department of Radiology, Stanford University, Stanford, CA(斯坦福大学放射学系) Department of Obstetrics and Gynecology, Stanford University, Stanford, CA(斯坦福大学妇产科学系) Division of Gastroenterology and Hepatology, Stanford University, Stanford, CA(斯坦福大学消化内科与肝病学系) Department of Computer Science, Stanford University, Stanford, CA(斯坦福大学计算机科学系) Weill Cancer Hub West(韦尔癌症中心西区)

AI总结 本文提出TRACE方法,通过EHR元数据去除临床笔记中的冗余文本,降低LLM计算成本,实验证明在保持信息提取和预测性能的同时,减少47.3%的文本量,节省每年约950万美元的推理成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00857 2026-04-21 cs.LG

Harvesting AlphaEarth: Benchmarking the Geospatial Foundation Model for Agricultural Downstream Tasks

收割AlphaEarth:评估用于农业下游任务的地理空间基础模型

Yuchi Ma, Yawen Shen, Anu Swatantran, David B. Lobell

机构 * Department of Earth System Science and Center on Food Security and the Environment, Stanford University, USA(地球系统科学系和食品安全与环境中心,斯坦福大学,美国) Corteva Agriscience™, USA(科特维亚农业科学公司,美国)

AI总结 本文评估了AlphaEarth基础模型在农业下游任务中的表现,包括作物产量预测、耕作 mapping 和覆盖作物 mapping,揭示了其在农业应用中的优势与局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14240 2026-04-21 cs.AI

LiveResearchBench: A Live Benchmark for User-Centric Deep Research in the Wild

LiveResearchBench: 一个用于真实世界中以用户为中心的深度研究的实时基准

Jiayu Wang, Yifei Ming, Riya Dulepet, Qinglin Chen, Austin Xu, Zixuan Ke, Frederic Sala, Aws Albarghouthi, Caiming Xiong, Shafiq Joty

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Stanford University(斯坦福大学) Salesforce AI Research(Salesforce AI研究院)

AI总结 本文提出LiveResearchBench,一个包含100个专家精选任务的实时基准,涵盖日常生活、企业与学术领域,要求进行广泛、动态的实时网络搜索与综合。通过DeepEval评估17个前沿深度研究系统,揭示其优势、失败模式及关键组件。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02617 2026-04-21 cs.LG cs.AI cs.CV

Improving Dynamic Object Interactions in Text-to-Video Generation with AI Feedback

通过AI反馈提升文本到视频生成中动态物体交互

Hiroki Furuta, Heiga Zen, Dale Schuurmans, Aleksandra Faust, Yutaka Matsuo, Percy Liang, Sherry Yang

机构 * Google DeepMind(谷歌DeepMind) The University of Tokyo(东京大学) Stanford University(斯坦福大学)

AI总结 本文研究如何利用反馈提升文本到视频模型中动态物体交互的质量,提出利用视觉语言模型提供针对性反馈,实验表明该方法在视频交互场景质量上有显著提升。

Comments Website: https://sites.google.com/view/aif-dynamic-t2v/

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15604 2026-04-21 cs.LG stat.ML

Neural Network-Based Score Estimation in Diffusion Models: Optimization and Generalization

基于神经网络的扩散模型分数估计:优化与泛化

Yinbin Han, Meisam Razaviyayn, Renyuan Xu

机构 * Department of Management Science and Engineering, Stanford University(斯坦福大学管理科学与工程系) Daniel J. Epstein Department of Industrial and Systems Engineering, University of Southern California(南加州大学工业与系统工程系)

AI总结 本文提出基于梯度下降训练的神经网络分数估计框架,解决扩散模型中优化与泛化问题,通过参数化方法将去噪分数匹配转化为回归问题,并建立首个最小最大最优泛化界限。

Comments 58 pages

详情

展开后加载摘要…

URL PDF HTML 收藏