arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Stanford University(斯坦福大学)

2026-08-26 至 2026-08-26 共收录 6
2608.24876 2026-08-26 cs.AI cs.CL 新提交

Recursive Experiential-Working Memory Evolution for Long-Horizon Agent Harnesses

面向长 horizon 智能体利用的递归经验-工作记忆演化

Zhaochen Yu, Yingcheng Wu, Zhenfei Yin, Kaiyuan Chen, Zhe Zhao, Mengdi Wang, Shuicheng Yan, Ling Yang

机构 * Princeton University(普林斯顿大学) Stanford University(斯坦福大学) University of Oxford(牛津大学)

AI总结 针对长 horizon 智能体的递归自我改进难题,提出 Recuris 架构,通过递归记忆演化提升任务成功率,在多个基准和模型上实现显著性能提升,为 RSI 提供可扩展基础。

Comments Code: this https URL (https://github.com/Gen-Verse/Recuris)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24858 2026-08-26 cs.LG stat.ML 新提交

Bellman Calibration for Marginalized Importance Weighting in Offline Reinforcement Learning

离线强化学习中边缘化重要性加权的贝尔曼校准

Lars van der Laan, Nathan Kallus

机构 * Stanford University(斯坦福大学) Netflix(网飞) Cornell University(康奈尔大学)

AI总结 本文针对离线强化学习中边缘化重要性加权的残留占用平衡违反问题,提出等渗贝尔曼校准方法,可减少此类违反并保证下游策略价值估计等任务的性能。

Comments 43 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24724 2026-08-26 cs.RO 新提交

Fiber Bragg Grating Whiskers for Bioinspired Hydrodynamic Perception on Underwater Robots

用于水下机器人生物启发式流体动力感知的光纤布拉格光栅触须

Hao Li, Tianyu Tu, Siyue Yao, Ziyang Chang, Juhyun Jung, Xiaochi Xie, Long Yin Chung, Tian-Ao Ren, Genliang Chen, Mark Cutkosky

机构 * Stanford University(斯坦福大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学)

AI总结 受港海豹触须流体感知能力启发,研发光纤布拉格光栅触须并验证其可辅助水下机器人仅通过触须信号区分直行与转弯,正确率达85%,为水下机器人流体感知提供新方案。

Comments 13 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24101 2026-08-26 cs.RO 新提交

TrAct: Bridging Robot Control and Visual Prediction with Visual Tracks

TrAct:通过视觉轨迹连接机器人控制与视觉预测

Zhi Cao, Howard Ji, Kevin Zhang, Kuangzhi Ge, Li Fei-Fei, Jiajun Wu, Huang Huang

机构 * University of Michigan(密歇根大学) Stanford University(斯坦福大学)

AI总结 TrAct是基于世界模型的机器人决策框架,以视觉轨迹为控制与预测的中间接口,在LIBERO-INTEGRAL基准和Franka任务上,相较基线π₀.5显著提升了操作成功率与视频预测质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23780 2026-08-26 cs.CL cs.AI cs.HC 新提交

When Youth Enter The Chat: An Epistemic Shift in the Validation of LLM-Based Measures of Student Talk

当青少年参与对话:基于大语言模型(LLM)的学生话语测量验证中的认知转变

Liliana Santos-Deonizio, James Malamut, Ramón Martínez, Dorottya Demszky

机构 * Stanford University(斯坦福大学)

AI总结 该研究针对基于LLM的学生话语测量的认知排斥问题,通过多民族志方法让青少年参与研究,发现学生解读与LLM测量存在不一致,凸显青少年参与认知过程的必要性。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23568 2026-08-26 cs.AI 新提交

RENDER: Controlling Reader-Facing Evidence in LLM Memory Evaluation

RENDER:控制LLM记忆评估中面向读者的证据

Yuan Si, Simeng Han, Daming Li, Jialu Zhang

机构 * University of Waterloo(滑铁卢大学) Stanford University(斯坦福大学)

AI总结 RENDER是控制LLM记忆评估中面向读者证据的基准,实验显示其相关数据包比原始对话表现更优,效果可迁移,提示需关注评估中的读者面向人工制品。

详情

展开后加载摘要…

URL PDF HTML 收藏