arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Edinburgh(爱丁堡大学)

2026-09-01 至 2026-09-01 共收录 22
2608.29464 2026-09-01 cs.CL cs.AI 新提交

Chain-of-Thought Faithfulness of Reasoning Models Varies with Where and How Preference Cues Are Delivered

推理模型的思维链忠实性随偏好线索的传递位置与方式变化

Aryo Pradipta Gema, Neel Rajani, Rohit Saxena, Wai-Chung Kwan, Pasquale Minervini

机构 * University of Edinburgh(爱丁堡大学)

AI总结 本研究提出FACE-Eval评估工具,发现15款不同规模模型的思维链忠实性随偏好线索的传递位置与方式变化,工具返回或隐性线索下非口头采用率更高,转录监测器检测能力与非口头采用率呈负相关,提示此类场景下CoT监测可靠性较低。

Comments 42 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29374 2026-09-01 cs.CV 新提交

Think, Look, and Revise: Inconsistency-Aware Visual Self-Correction in MLLMs

思考、观察与修正:多模态大语言模型中基于不一致感知的视觉自我修正

Yu Cheng, Arushi Goel, Hakan Bilen

机构 * University of Edinburgh(爱丁堡大学) NVIDIA Research(英伟达研究院)

AI总结 本研究针对工具增强型多模态推理中工具输出缺乏验证的问题,提出ReVISE框架,通过带监督反思的训练数据集与强化学习目标奖励,实现错误检测与修正,在多个基准上取得性能提升。

Comments accepted by EMNLP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29356 2026-09-01 cs.AI 新提交

Plant-Inspired AI: Plants as Inspiration for Novel Problem Formulations, and Two Case Studies

植物启发的AI:以植物为灵感的新型问题表述及两个案例研究

Deepayan Sanyal, Joel Michelson, Carla E. Cao, Adam B. Roddy, Maithilee Kunda

机构 * New York University(纽约大学) Universidad de Murcia(穆尔西亚大学) University of Edinburgh(爱丁堡大学)

AI总结 本文以植物复杂行为为灵感,提出构建涵盖现有AI框架未关注问题的新型AI框架,并通过叶拟态、根-茎协调生长两个案例提炼计算原理,确定未解决问题,为AI发展提供新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29347 2026-09-01 cs.RO 新提交

A Cognitive Architecture for Shared Autonomy in AUV Operations

用于自主水下航行器(AUV)作业的共享自主权认知架构

Niamh Ellis, Thi Tran, Ignacio Carlucho, Yvan R. Petillot

机构 * School of Informatics, University of Edinburgh(爱丁堡大学信息学院) School of Engineering and Physical Sciences, Heriot-Watt University(赫瑞瓦特大学工程与物理科学学院)

AI总结 本文提出一种由本体和多个LLMs构成的AUV作业共享自主权认知架构,经对比Llama3、GPT-OSS、Qwen2.5后,发现GPT-OSS在可行性评估等任务中表现最优,Qwen2.5则擅长识别自然语言输入的任务类型。

Comments IEEE OES AUV Symposium 2026 Southampton

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28638 2026-09-01 cs.AI 新提交

Self-Evolving Skills via Surrogate-Guided Solve-and-Reproduce

基于代理引导的求解与复现的自进化技能

Jiale Liu, Pinze Ren, Yuqi Xia, Huan Wang, Zhenlin Zhao, Siming Dong

机构 * Cleer Science(克利尔科学公司) The University of Edinburgh(爱丁堡大学) Tsinghua University(清华大学)

AI总结 该研究针对智能体自进化技能的缺陷,提出reSolve框架,通过求解与复现协议、代理验证器增强奖励及束搜索,使廉价模型技能性能超人工策划基线,且在自然科学任务上表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22304 2026-09-01 cs.LG cs.SD 版本更新

Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning

合成语音,真实信号:通过语音克隆实现副语言保留和跨语言增强

Roseline Polle, Owen Parsons, George Fairs, Luis Miguel San Martin Fernandez, Cole Looney, Xiaoliang Wu, Alexandra Livia Georgescu, Stefano Goria

机构 * thymia(胸腺公司) The University of Edinburgh(爱丁堡大学) University of Southampton(南安普顿大学)

AI总结 研究针对语音合成数据增强在副语言任务应用少的问题,对八个语音克隆模型在五个副语言任务上进行基准测试,还将英语临床语音克隆成日语,发现其在低资源语言临床语音数据增强方面有前景。

Comments 5 pages, 3 figures. Accepted at Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28696 2026-09-01 cs.AI 版本更新

COMPASS: Grounding Composition-Intent Guidance in Unified Multimodal Models

COMPASS:在统一多模态模型中锚定构图意图引导

Ziqi Zhou, Weize Quan, Mining Tan, Zhihan Chen, Dandan Zheng, Jingdong Chen, Jun Zhou, Weiming Dong, Dong-Ming Yan

机构 * University of Edinburgh(爱丁堡大学) State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS)(多模态人工智能系统国家重点实验室) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Ant Group(蚂蚁集团)

AI总结 提出统一框架COMPASS,通过共享专家令牌τ_c实现构图感知与生成的双向锚定,结合MoE骨干和Comp-11数据集,显著提升细粒度构图理解与可控生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20624 2026-09-01 cs.AI cs.CL cs.LG stat.ML 版本更新

In LLM Reasoning, there is Irrationality on top of Value Misalignment

在LLM推理中,价值对齐之上存在非理性

Kejiang Qian, Fengxiang He

机构 * University of Edinburgh(爱丁堡大学)

AI总结 本文提出理性价值风险概念,形式化LLM在推理中即使价值对齐也可能无法最大化对齐价值的问题,并通过实验验证该风险普遍存在且无法被对齐消除。

Comments Published in the 2026 Conference on Empirical Methods in Natural Language Processing (EMNLP) as a Main Conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20621 2026-09-01 cs.AI cs.CL cs.LG cs.MA stat.ML 版本更新

PEAR: Permutation-Equivariant Adaptive Routing Multi-Agent Debate

PEAR: 置换等变自适应路由多智能体辩论

Yang Feng, Ziwei Xu, Xia Hu, Fengxiang He

机构 * University of Edinburgh(爱丁堡大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 提出PEAR协议,通过动态重配置通信角色和稀疏拓扑,消除固定拓扑中的位置偏差,提升多智能体辩论的准确性和鲁棒性。

Comments Published in the 2026 Conference on Empirical Methods in Natural Language Processing (EMNLP) as a Main Conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08000 2026-09-01 cs.CL cs.AI 版本更新

Summarization is Not Dead Yet

摘要生成尚未消亡

Dongqi Liu, Chenxi Whitehouse, Zheng Zhao, Zhuchen Cao, Jian Li, Yabiao Wang

机构 * Saarland University(萨尔大学) Max Planck Institute for Informatics(马克斯·普朗克信息学研究所) University of Cambridge(剑桥大学) University of Edinburgh(爱丁堡大学) Zhejiang University(浙江大学) Tencent YouTu Lab(腾讯优图实验室)

AI总结 通过多维度评估,发现人类参考摘要在信息量和忠实度上仍优于大语言模型,后者仅在表面连贯性和流畅性上占优,表明摘要生成研究仍有挑战。

Comments EMNLP 2026 Main & Long Conference Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27243 2026-09-01 cs.CV 版本更新

Can Retrieval Heads See Images? Multimodal Retrieval Heads in Long-Context Vision-Language Models

检索头能看见图像吗?长上下文视觉语言模型中的多模态检索头

Aaron Branson Cigres Li, Zhaowei Wang, Yu Zhao, Yiming Du, Haobo Li, Xiyu Ren, Ginny Wong, Simon See, Lishu Luo, Haodong Duan, Pasquale Minervini, Yangqiu Song

机构 * HKUST(香港科技大学) University of Edinburgh(爱丁堡大学) CUHK(香港中文大学) NVAITC, NVIDIA, Santa Clara, USA(NVIDIA Santa Clara 分公司) Tsinghua University(清华大学)

AI总结 本文提出一种多模态检索头检测方法,发现视觉语言模型中仅有4.4-10.2%的注意力头贡献了50%的正检索分数,这些头对长上下文推理至关重要,且可直接用于文档检索提升性能。

Comments Accepted to EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28643 2026-09-01 cs.CL 版本更新

GraphLit: Learning Text-Enriched Dynamic Character Network Representations for Literary Study

GraphLit:面向文学研究的文本增强动态人物网络表示学习

Gaspard Michel, Elena V. Epure, Romain Hennequin, Christophe Cerisara, Mirella Lapata

机构 * Deezer Research(Deezer研究) Loria(Loria实验室) IDIAP(IDIAP研究所) School of Informatics, University of Edinburgh(爱丁堡大学信息学院)

AI总结 提出动态异质人物网络(DHCN)和自监督框架GraphLit,通过掩码图自编码器学习融合文本上下文的文学表示,在12个角色相关任务上优于纯文本或纯图基线。

Comments EMNLP 2026 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24564 2026-09-01 cs.AI cs.CE cs.LG 版本更新

Summoning the Oracle to Slay It: Mitigating Look-Ahead Bias in Financial Backtesting with Large Language Models

召唤神谕以屠之:利用大语言模型缓解金融回测中的前瞻偏差

Weixian Waylon Li, Mengyu Wang, Tiejun Ma

机构 * University of Edinburgh(爱丁堡大学)

AI总结 提出FinCAD方法,通过对抗性偏差发现和实体日期自适应规则,在不重新训练的情况下抑制大语言模型对历史结果的记忆,从而缓解金融回测中的参数化前瞻偏差。

Comments EMNLP 2026, Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23351 2026-09-01 cs.CL cs.AI cs.LG 版本更新

When Chain-of-Thought Fails, the Solution Hides in the Hidden States

当链式推理失败时,解决方案隐藏在隐藏状态中

Houman Mehrafarin, Amit Parekh, Ioannis Konstas

机构 * Heriot-Watt University(赫瑞斯泰大学) University of Edinburgh(爱丁堡大学)

AI总结 研究通过激活补丁分析发现,链式推理(CoT)中的隐藏状态包含任务相关信息,即使原始推理轨迹错误,也能通过补丁提升准确率,揭示CoT中某些token能编码足够的信息恢复正确答案。

Comments To appear in Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01159 2026-09-01 cs.LG 版本更新

Multi-Marginal Flow Matching with Adversarially Learnt Interpolants

多边际流匹配与对抗性学习插值

Oskar Kviman, Kirill Tamogashev, Nicola Branchini, Víctor Elvira, Jens Lagergren, Esmeralda S. Whitammer

机构 * KTH(皇家理工学院) University of Edinburgh(爱丁堡大学) CIFAR Fellow

AI总结 本文提出了一种新的流匹配方法ALI-CFM,通过GAN启发的对抗损失拟合神经参数化插值曲线,以逼近中间时间点的观测分布,从而提升多边际轨迹推断的性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26364 2026-09-01 cs.LG 版本更新

Data-to-Energy Stochastic Dynamics

数据到能量的随机动力学

Kirill Tamogashev, Esmeralda S. Whitammer

机构 * University of Edinburgh(爱丁堡大学) CIFAR Fellow(蒙特利尔认知研究院研究员)

AI总结 本文提出了一种数据到能量的IPF方法,用于建模Schrödinger桥问题,无需数据样本即可学习多模态分布之间的传输,并改进了扩散系数的学习。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13392 2026-09-01 cs.CV 版本更新

A Study of the Design Space of Motion and Disocclusion Control in Video Generation

超越可见范围:通过代理动态图实现的遮挡感知编辑

Anran Qi, Changjian Li, Adrien Bousseau, Niloy J. Mitra

机构 * Inria - Université Côte d’Azur(法国国家信息与自动化技术研究院-埃克塞特大学) University of Edinburgh(爱丁堡大学) Adobe Research(Adobe研究部) UCL(伦敦大学学院)

AI总结 通过代理动态图实现遮挡感知编辑,结合运动规范与外观合成,实现可控的图像到视频生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18676 2026-09-01 cs.CV cs.AI 版本更新

MedVision: Benchmarking Quantitative Medical Image Analysis

MedVision:定量医学图像分析的基准测试

Yongcheng Yao, Yongshuo Zong, Raman Dutt, Yongxin Yang, Sotirios A Tsaftaris, Timothy Hospedales

机构 * University of Edinburgh(爱丁堡大学) Queen Mary University of London(伦敦大学玛丽女王学院)

AI总结 针对当前医学视觉语言模型缺乏定量推理能力的问题,提出MedVision数据集和基准,涵盖22个公共数据集、3080万图像-标注对,通过监督和强化微调显著提升检测、肿瘤/病变大小估计和角度/距离测量性能。

Comments Paper accepted to EMNLP26 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17007 2026-09-01 cs.LG 版本更新

Discrete Compositional Generation via General Soft Operators and Robust Reinforcement Learning

基于通用软算子与鲁棒强化学习的离散组合生成

Marco Jiralerspong, Esther Derman, Danilo Vucetic, Esmeralda S. Whitammer, Bilun Sun, Tianyu Zhang, Pierre-Luc Bacon, Gauthier Gidel

机构 * Université de Montréal(蒙特利尔大学) Mila University of Edinburgh(爱丁堡大学) CIFAR(加拿大联邦研究院)

AI总结 针对离散组合生成问题,提出通用软算子与鲁棒强化学习框架,研发TGM算法,在合成与真实任务中生成更高质量多样化候选对象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.04355 2026-09-01 stat.ML cs.AI cs.LG stat.ME 版本更新

PQMass: Probabilistic Assessment of the Quality of Generative Models using Probability Mass Estimation

PQMass:基于概率质量估计的生成模型质量概率评估

Pablo Lemos, Sammy Sharief, Esmeralda S. Whitammer, Salma Salhi, Connor Stone, Laurence Perreault-Levasseur, Yashar Hezaveh

机构 * Mila – Québec Artificial Intelligence Institute(魁北克人工智能研究所) Ciela Institute(Ciela研究所) Université de Montréal(蒙特利尔大学) SanboxAQ CCA – Flatiron Institute(CCA-Flatiron研究所) University of Edinburgh(爱丁堡大学) Trottier Space Institute(特罗特里尔空间研究所)

AI总结 研究提出无需似然的PQMass方法,通过划分样本空间并应用卡方检验,可严谨评估生成模型质量、比较模型,适用于多模态及中等高维数据,无需辅助模型或特征提取。

Comments ICLR 2025; code: https://github.com/Ciela-Institute/PQM

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17124 2026-09-01 physics.med-ph cs.AI

Automated neuroradiological support systems for multiple cerebrovascular disease markers -- A systematic review and meta-analysis

Jesse Phitidis, Alison Q. O'Neil, William N. Whiteley, Beatrice Alex, Joanna M. Wardlaw, Miguel O. Bernabeu, Maria Valdés Hernández

机构 * Centre for Clinical Brain Sciences, University of Edinburgh(爱丁堡大学临床脑科学中心) Canon Medical Research Europe(佳能欧洲医学研究院) School of Engineering, University of Edinburgh(爱丁堡大学工程学院) School of Literature, Languages and Culture, University of Edinburgh(爱丁堡大学文学、语言与文化学院) Edinburgh Futures Institute, University of Edinburgh(爱丁堡未来研究院) UK Dementia Research Institute, Centre at The University of Edinburgh(英国痴呆症研究所爱丁堡大学中心) Usher Institute, University of Edinburgh(爱丁堡大学乌舍研究所)

Comments 62 pages, 10 figures

Journal ref Computer Methods and Programs in Biomedicine, 264, 2025, 108715

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18540 2026-09-01 cs.CL cs.CR cs.LG 版本更新

Learning diverse attacks on large language models for robust red-teaming and safety tuning

针对大语言模型学习多样化攻击以用于鲁棒红队测试与安全调优

Seanie Lee, Minsu Kim, Lynn Cherif, David Dobre, Juho Lee, Sung Ju Hwang, Kenji Kawaguchi, Gauthier Gidel, Yoshua Bengio, Esmeralda S. Whitammer, Moksh Jain

机构 * KAIST(韩国科学技术院) Mila – Québec AI Institute(米拉-魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) McGill University(麦吉尔大学) National University of Singapore(新加坡国立大学) University of Edinburgh(爱丁堡大学) CIFAR(加拿大高级研究所)

AI总结 该研究针对现有红队测试方法存在的模式崩塌或攻击有效性不足问题,提出GFlowNet微调加二次平滑的方法生成多样化攻击提示,其攻击对各类LLM有效且可迁移,用该攻击提示调优的模型对其他攻击方法具有鲁棒性。

Comments ICLR 2025; code: https://github.com/GFNOrg/red-teaming

详情

展开后加载摘要…

URL PDF HTML 收藏