arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Edinburgh(爱丁堡大学)

2026-01-15 至 2026-01-15 共收录 3
2508.19828 2026-01-15 cs.CL cs.MA

Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning

Memory-R1: 通过强化学习增强大语言模型代理以管理并利用记忆

Sikuan Yan, Xiufeng Yang, Zuchao Huang, Ercong Nie, Zifeng Ding, Zonggen Li, Xiaowen Ma, Jinhe Bi, Kristian Kersting, Jeff Z. Pan, Hinrich Schütze, Volker Tresp, Yunpu Ma

机构 * Ludwig Maximilian University of Munich(慕尼黑路德维希-马克西米利安大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Technical University of Munich(慕尼黑技术大学) University of Cambridge(剑桥大学) University of Hong Kong(香港大学) Technical University of Darmstadt(达姆施塔特技术大学) University of Edinburgh(爱丁堡大学)

AI总结 Memory-R1通过强化学习框架,使大语言模型具备主动管理与利用外部记忆的能力,有效提升长跨度推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08701 2026-01-15 cs.LO cs.AI cs.CY

A Personalised Formal Verification Framework for Monitoring Activities of Daily Living of Older Adults Living Independently in Their Homes

为独立居家老年人的日常生活活动提供个性化形式验证框架

Ricardo Contreras, Filip Smola, Nuša Farič, Jiawei Zheng, Jane Hillston, Jacques D. Fleuriot

机构 * School of Informatics, The University of Edinburgh(信息学院,爱丁堡大学) University of Edinburgh(爱丁堡大学) DigitLab, University of Exeter(埃克塞特大学数字实验室)

AI总结 本文提出一个个性化形式验证框架,用于独立居家老年人的日常生活活动监测,通过形式化模型和模型检查器确保安全与福祉。

Comments 19 pages, 6 figures

Journal ref For publication in IEEE Sensors Journal 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08840 2026-01-15 cs.CL cs.AI

Consistency-Aware Editing for Entity-level Unlearning in Language Models

面向实体级去学习的一致性感知编辑

Xiaoqi Han, Víctor Gutiérrez-Basulto, Ru Li, Xiaoli Li, Jiye Liang, Jeff Z. Pan

机构 * Shanxi University, China(山西大学) Cardiff University, UK(卡地夫大学) Singapore University of Technology and Design, Singapore(新加坡科技设计大学) ILCC, School of Informatics, University of Edinburgh, Edinburgh, UK(爱丁堡大学信息学院ILCC)

AI总结 本文提出一致性感知编辑框架,用于高效实体级去学习,通过聚合多样化提示并学习低秩更新,提升遗忘准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏