arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Edinburgh(爱丁堡大学)

2026-09-01 至 2026-09-01 共收录 16
2607.22304 2026-09-01 cs.LG cs.SD 版本更新

Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning

合成语音,真实信号:通过语音克隆实现副语言保留和跨语言增强

Roseline Polle, Owen Parsons, George Fairs, Luis Miguel San Martin Fernandez, Cole Looney, Xiaoliang Wu, Alexandra Livia Georgescu, Stefano Goria

机构 * thymia(胸腺公司) The University of Edinburgh(爱丁堡大学) University of Southampton(南安普顿大学)

AI总结 研究针对语音合成数据增强在副语言任务应用少的问题,对八个语音克隆模型在五个副语言任务上进行基准测试,还将英语临床语音克隆成日语,发现其在低资源语言临床语音数据增强方面有前景。

Comments 5 pages, 3 figures. Accepted at Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28696 2026-09-01 cs.AI 版本更新

COMPASS: Grounding Composition-Intent Guidance in Unified Multimodal Models

COMPASS:在统一多模态模型中锚定构图意图引导

Ziqi Zhou, Weize Quan, Mining Tan, Zhihan Chen, Dandan Zheng, Jingdong Chen, Jun Zhou, Weiming Dong, Dong-Ming Yan

机构 * University of Edinburgh(爱丁堡大学) State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS)(多模态人工智能系统国家重点实验室) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Ant Group(蚂蚁集团)

AI总结 提出统一框架COMPASS,通过共享专家令牌τ_c实现构图感知与生成的双向锚定,结合MoE骨干和Comp-11数据集,显著提升细粒度构图理解与可控生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20624 2026-09-01 cs.AI cs.CL cs.LG stat.ML 版本更新

In LLM Reasoning, there is Irrationality on top of Value Misalignment

在LLM推理中,价值对齐之上存在非理性

Kejiang Qian, Fengxiang He

机构 * University of Edinburgh(爱丁堡大学)

AI总结 本文提出理性价值风险概念,形式化LLM在推理中即使价值对齐也可能无法最大化对齐价值的问题,并通过实验验证该风险普遍存在且无法被对齐消除。

Comments Published in the 2026 Conference on Empirical Methods in Natural Language Processing (EMNLP) as a Main Conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20621 2026-09-01 cs.AI cs.CL cs.LG cs.MA stat.ML 版本更新

PEAR: Permutation-Equivariant Adaptive Routing Multi-Agent Debate

PEAR: 置换等变自适应路由多智能体辩论

Yang Feng, Ziwei Xu, Xia Hu, Fengxiang He

机构 * University of Edinburgh(爱丁堡大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 提出PEAR协议,通过动态重配置通信角色和稀疏拓扑,消除固定拓扑中的位置偏差,提升多智能体辩论的准确性和鲁棒性。

Comments Published in the 2026 Conference on Empirical Methods in Natural Language Processing (EMNLP) as a Main Conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08000 2026-09-01 cs.CL cs.AI 版本更新

Summarization is Not Dead Yet

摘要生成尚未消亡

Dongqi Liu, Chenxi Whitehouse, Zheng Zhao, Zhuchen Cao, Jian Li, Yabiao Wang

机构 * Saarland University(萨尔大学) Max Planck Institute for Informatics(马克斯·普朗克信息学研究所) University of Cambridge(剑桥大学) University of Edinburgh(爱丁堡大学) Zhejiang University(浙江大学) Tencent YouTu Lab(腾讯优图实验室)

AI总结 通过多维度评估,发现人类参考摘要在信息量和忠实度上仍优于大语言模型,后者仅在表面连贯性和流畅性上占优,表明摘要生成研究仍有挑战。

Comments EMNLP 2026 Main & Long Conference Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27243 2026-09-01 cs.CV 版本更新

Can Retrieval Heads See Images? Multimodal Retrieval Heads in Long-Context Vision-Language Models

检索头能看见图像吗?长上下文视觉语言模型中的多模态检索头

Aaron Branson Cigres Li, Zhaowei Wang, Yu Zhao, Yiming Du, Haobo Li, Xiyu Ren, Ginny Wong, Simon See, Lishu Luo, Haodong Duan, Pasquale Minervini, Yangqiu Song

机构 * HKUST(香港科技大学) University of Edinburgh(爱丁堡大学) CUHK(香港中文大学) NVAITC, NVIDIA, Santa Clara, USA(NVIDIA Santa Clara 分公司) Tsinghua University(清华大学)

AI总结 本文提出一种多模态检索头检测方法,发现视觉语言模型中仅有4.4-10.2%的注意力头贡献了50%的正检索分数,这些头对长上下文推理至关重要,且可直接用于文档检索提升性能。

Comments Accepted to EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28643 2026-09-01 cs.CL 版本更新

GraphLit: Learning Text-Enriched Dynamic Character Network Representations for Literary Study

GraphLit:面向文学研究的文本增强动态人物网络表示学习

Gaspard Michel, Elena V. Epure, Romain Hennequin, Christophe Cerisara, Mirella Lapata

机构 * Deezer Research(Deezer研究) Loria(Loria实验室) IDIAP(IDIAP研究所) School of Informatics, University of Edinburgh(爱丁堡大学信息学院)

AI总结 提出动态异质人物网络(DHCN)和自监督框架GraphLit,通过掩码图自编码器学习融合文本上下文的文学表示,在12个角色相关任务上优于纯文本或纯图基线。

Comments EMNLP 2026 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24564 2026-09-01 cs.AI cs.CE cs.LG 版本更新

Summoning the Oracle to Slay It: Mitigating Look-Ahead Bias in Financial Backtesting with Large Language Models

召唤神谕以屠之:利用大语言模型缓解金融回测中的前瞻偏差

Weixian Waylon Li, Mengyu Wang, Tiejun Ma

机构 * University of Edinburgh(爱丁堡大学)

AI总结 提出FinCAD方法,通过对抗性偏差发现和实体日期自适应规则,在不重新训练的情况下抑制大语言模型对历史结果的记忆,从而缓解金融回测中的参数化前瞻偏差。

Comments EMNLP 2026, Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23351 2026-09-01 cs.CL cs.AI cs.LG 版本更新

When Chain-of-Thought Fails, the Solution Hides in the Hidden States

当链式推理失败时,解决方案隐藏在隐藏状态中

Houman Mehrafarin, Amit Parekh, Ioannis Konstas

机构 * Heriot-Watt University(赫瑞斯泰大学) University of Edinburgh(爱丁堡大学)

AI总结 研究通过激活补丁分析发现,链式推理(CoT)中的隐藏状态包含任务相关信息,即使原始推理轨迹错误,也能通过补丁提升准确率,揭示CoT中某些token能编码足够的信息恢复正确答案。

Comments To appear in Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01159 2026-09-01 cs.LG 版本更新

Multi-Marginal Flow Matching with Adversarially Learnt Interpolants

多边际流匹配与对抗性学习插值

Oskar Kviman, Kirill Tamogashev, Nicola Branchini, Víctor Elvira, Jens Lagergren, Esmeralda S. Whitammer

机构 * KTH(皇家理工学院) University of Edinburgh(爱丁堡大学) CIFAR Fellow

AI总结 本文提出了一种新的流匹配方法ALI-CFM,通过GAN启发的对抗损失拟合神经参数化插值曲线,以逼近中间时间点的观测分布,从而提升多边际轨迹推断的性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26364 2026-09-01 cs.LG 版本更新

Data-to-Energy Stochastic Dynamics

数据到能量的随机动力学

Kirill Tamogashev, Esmeralda S. Whitammer

机构 * University of Edinburgh(爱丁堡大学) CIFAR Fellow(蒙特利尔认知研究院研究员)

AI总结 本文提出了一种数据到能量的IPF方法,用于建模Schrödinger桥问题,无需数据样本即可学习多模态分布之间的传输,并改进了扩散系数的学习。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13392 2026-09-01 cs.CV 版本更新

A Study of the Design Space of Motion and Disocclusion Control in Video Generation

超越可见范围:通过代理动态图实现的遮挡感知编辑

Anran Qi, Changjian Li, Adrien Bousseau, Niloy J. Mitra

机构 * Inria - Université Côte d’Azur(法国国家信息与自动化技术研究院-埃克塞特大学) University of Edinburgh(爱丁堡大学) Adobe Research(Adobe研究部) UCL(伦敦大学学院)

AI总结 通过代理动态图实现遮挡感知编辑,结合运动规范与外观合成,实现可控的图像到视频生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18676 2026-09-01 cs.CV cs.AI 版本更新

MedVision: Benchmarking Quantitative Medical Image Analysis

MedVision:定量医学图像分析的基准测试

Yongcheng Yao, Yongshuo Zong, Raman Dutt, Yongxin Yang, Sotirios A Tsaftaris, Timothy Hospedales

机构 * University of Edinburgh(爱丁堡大学) Queen Mary University of London(伦敦大学玛丽女王学院)

AI总结 针对当前医学视觉语言模型缺乏定量推理能力的问题,提出MedVision数据集和基准,涵盖22个公共数据集、3080万图像-标注对,通过监督和强化微调显著提升检测、肿瘤/病变大小估计和角度/距离测量性能。

Comments Paper accepted to EMNLP26 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17007 2026-09-01 cs.LG 版本更新

Discrete Compositional Generation via General Soft Operators and Robust Reinforcement Learning

基于通用软算子与鲁棒强化学习的离散组合生成

Marco Jiralerspong, Esther Derman, Danilo Vucetic, Esmeralda S. Whitammer, Bilun Sun, Tianyu Zhang, Pierre-Luc Bacon, Gauthier Gidel

机构 * Université de Montréal(蒙特利尔大学) Mila University of Edinburgh(爱丁堡大学) CIFAR(加拿大联邦研究院)

AI总结 针对离散组合生成问题,提出通用软算子与鲁棒强化学习框架,研发TGM算法,在合成与真实任务中生成更高质量多样化候选对象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.04355 2026-09-01 stat.ML cs.AI cs.LG stat.ME 版本更新

PQMass: Probabilistic Assessment of the Quality of Generative Models using Probability Mass Estimation

PQMass:基于概率质量估计的生成模型质量概率评估

Pablo Lemos, Sammy Sharief, Esmeralda S. Whitammer, Salma Salhi, Connor Stone, Laurence Perreault-Levasseur, Yashar Hezaveh

机构 * Mila – Québec Artificial Intelligence Institute(魁北克人工智能研究所) Ciela Institute(Ciela研究所) Université de Montréal(蒙特利尔大学) SanboxAQ CCA – Flatiron Institute(CCA-Flatiron研究所) University of Edinburgh(爱丁堡大学) Trottier Space Institute(特罗特里尔空间研究所)

AI总结 研究提出无需似然的PQMass方法,通过划分样本空间并应用卡方检验,可严谨评估生成模型质量、比较模型,适用于多模态及中等高维数据,无需辅助模型或特征提取。

Comments ICLR 2025; code: https://github.com/Ciela-Institute/PQM

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18540 2026-09-01 cs.CL cs.CR cs.LG 版本更新

Learning diverse attacks on large language models for robust red-teaming and safety tuning

针对大语言模型学习多样化攻击以用于鲁棒红队测试与安全调优

Seanie Lee, Minsu Kim, Lynn Cherif, David Dobre, Juho Lee, Sung Ju Hwang, Kenji Kawaguchi, Gauthier Gidel, Yoshua Bengio, Esmeralda S. Whitammer, Moksh Jain

机构 * KAIST(韩国科学技术院) Mila – Québec AI Institute(米拉-魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) McGill University(麦吉尔大学) National University of Singapore(新加坡国立大学) University of Edinburgh(爱丁堡大学) CIFAR(加拿大高级研究所)

AI总结 该研究针对现有红队测试方法存在的模式崩塌或攻击有效性不足问题,提出GFlowNet微调加二次平滑的方法生成多样化攻击提示,其攻击对各类LLM有效且可迁移,用该攻击提示调优的模型对其他攻击方法具有鲁棒性。

Comments ICLR 2025; code: https://github.com/GFNOrg/red-teaming

详情

展开后加载摘要…

URL PDF HTML 收藏