arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Oxford(牛津大学)

2026-08-27 至 2026-08-27 共收录 9
2608.25924 2026-08-27 cs.CV 新提交

Visual General Intelligence: A White Paper

视觉通用智能:白皮书

Hirokatsu Kataoka, Yoshihiro Fukuhara, Yonglong Tian, Shangzhe Wu, Oishi Deb, Ryousuke Yamada, Christian Rupprecht, Jianyuan Wang, Kohsuke Ide, Koichi Namekata, Xianzheng Ma, Yiming Chen, Robert Geirhos, Aditi Raghunathan, Yuki M. Asano, Deva Ramanan, David Fouhey, Andrew J. Davison, Yilun Du, Jiajun Wu, Zhuang Liu

机构 * National Institute of Advanced Industrial Science and Technology (AIST)(日本国立先进工业科学技术研究所(AIST)) Visual Geometry Group (VGG), University of Oxford(牛津大学视觉几何组(VGG)) CADDi(CADDi公司) OpenAI(OpenAI公司) University of Cambridge(剑桥大学) University of Technology Nuremberg(纽伦堡工业大学) University of Tsukuba(筑波大学) Google DeepMind(谷歌DeepMind) Carnegie Mellon University(卡内基梅隆大学) New York University(纽约大学) Imperial College London(伦敦帝国学院) Harvard University(哈佛大学) Stanford University(斯坦福大学) Princeton University(普林斯顿大学)

AI总结 本文以视觉为中心探讨通用人工智能(AGI)路径,提出视觉通用智能(VGI)概念,明确AGI时代计算机视觉的发展原则、模态、基准等关键方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25864 2026-08-27 cs.RO 新提交

MA-VLA: Multi-Arm Vision-Language-Action Model for Collaboration and Compositional Generalization

MA-VLA:用于协作与组合泛化的多臂视觉-语言-动作模型

Zaibin Zhang, Junlan Xiao, Zhongbo Zhang, Yifan Wang, Li Kang, Yiran Qin, Changxing Xia, Heng Zhou, Talas Fu, Enshen Zhou, Ruimao Zhang, Zhenfei Yin, Huchuan Lu, Lijun Wang

机构 * Dalian University of Technology(大连理工大学) University of Oxford(牛津大学) Sun Yat-sen University(中山大学) Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Beihang University(北京航空航天大学)

AI总结 MA-VLA通过将协作行为分解为原子提示并引入Arm Shuffle训练方法,解决了多臂VLA模型的协作泛化问题,在未见过的协作模式下表现优于现有模型。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25204 2026-08-27 cs.LG cs.CL 新提交

LibriBrain100: One Hundred Hours of Broad and Deep MEG Data for Neural Speech Decoding at Scale

LibriBrain100:用于大规模神经语音解码的一百小时宽深脑磁图数据集

Francesco Mantegna, Dulhan Jayalath, Gereon Elvers, Tasha Kim, Benjamin Ballyk, Alex Fung, SungJun Cho, Teyun Kwon, Luisa Kurth, Miran Özdogan, Gilad Landau, Pratik Somaiya, Natalie Voets, Mark Woolrich, Oiwi Parker Jones

机构 * University of Oxford(牛津大学) FMRIB OHBA

AI总结 本研究推出含100小时脑磁图数据的LibriBrain100数据集,通过深度受试者内数据与多受试者数据结合,验证其可提升单词分类解码性能,助力无创脑机接口发展。

Comments 10 content pages + 22 pages for references and appendices (in total: 32 pages, 16 figures, 6 tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24952 2026-08-27 cs.CL cs.AI cs.LG 新提交

The Dialect Tax: Dialectal Biases Persist throughout the Language Modeling Pipeline

方言税:方言偏见在语言建模流程中持续存在

Elle

机构 * University of Oxford(牛津大学)

AI总结 本研究在自然语言处理全流程追踪“方言税”,发现现代语言模型在分词、预训练等各环节均存在方言偏见,且字符级分词器无法消除相关差距,方言税由流程各环节共同累积而成。

Comments To be published at EMNLP 2026 under the full author name "Elle"

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13940 2026-08-27 cs.AI 版本更新

AI Research Preference Models

AI研究偏好模型

Thomas Simon Foster, Bassel Al Omari, Tingchen Fu, Thomas Mann, Carl Domond, Lucia Cipolina-Kun, Bhavul Gauri, Muna Aghamelu, Alexander D. Goldie, Eryk Helenowski, Jean-Christophe Gagnon-Audet, Alberto Pepe, Saba Nazir, Daniel Izcovich, Noam Levi, Rishi Hazra, Karen Hambardzumyan, Nicolas Baldwin, Xian Li, Martin Josifoski, Paris Giampouras, Masoud Jalili Sabet, Anya Sims, Hela Momand, Tatiana Shavrina, Despoina Magka, Jason Weston, Yulin Wang, Anirudh Goyal, João Henriques, Yoram Bachrach, Emily McMilin, Jakob Nicolaus Foerster

机构 * FAIR at Meta University of Oxford(牛津大学) University College London(伦敦大学学院)

AI总结 该研究针对AI研究智能体的候选方案评估成本过高问题,提出AI研究偏好模型,将其集成到AIRA-dojo智能体后提升了基准任务性能,且达到目标性能的时间更短、预算更少。

Comments 34 pages, 17 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26236 2026-08-27 eess.IV cs.CV eess.SP 版本更新

Rendering Novel Views of MRI Using 3D Gaussian Splatting

使用3D高斯泼溅渲染MRI的新视图

Robin Y. Park, Mark C. Eid, Rhydian Windsor, Amir Jamaludin, Ana I.L. Namburete, João F. Henriques, Andrew Zisserman

机构 * Visual Geometry Group, University of Oxford(视觉几何组,牛津大学) Oxford Machine Learning in NeuroImaging Lab, University of Oxford(牛津大学神经影像学机器学习实验室)

AI总结 通过3D高斯泼溅从稀疏各向异性MRI重建体积并采样与目标解剖对齐的平面,生成更优的放射学分级视图,相比原始扫描和体素插值方法提高了椎管狭窄分级准确性。

Comments Spotlight at AI4M3D workshop at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05925 2026-08-27 cs.AI 版本更新

Towards World Models in Biomedical Research

迈向生物医学研究的世界模型

Guangyu Wang, Jingkun Yue, Siqi Zhang, Yu Liu, Xiaoyu Wang, Mingyuan Meng, Changwei Ji, Zongbo Han, Yulin Wang, Yang Yue, Frank Fu, Ting Chen, Song Wu, Ziwei Liu, Jiangning Song, Ming Li, Gao Huang, Xiaohong Liu, Athanasios Vasilakos, Xingcai Zhang, Ping Zhang, Yong Li

机构 * State Key Laboratory of Networking and Switching Technology, Beijing University of Posts and Telecommunications, Beijing, China(网络与交换技术国家重点实验室,北京邮电大学,北京,中国) Department of Engineering Science, University of Oxford, Oxford, United Kingdom(英国牛津大学工程科学系,牛津,英国) Institute of Medical Artificial Intelligence, South China Hospital, Medical School, Shenzhen University, Shenzhen, Guangdong, China(医学人工智能研究所,南方医院,医学学院,深圳大学,深圳,广东,中国) Zhongguancun Academy & Zhongguancun Institute of Artificial Intelligence, Beijing, China(中关村学院及中关村人工智能研究院,北京,中国) Beijing National Research Center for Information Science and Technology (BNRist), Tsinghua University, 100084, Beijing, China(北京信息科学与技术国家研究中心(BNRist),清华大学,100084,北京,中国) Department of Chemical and Nano Engineering, University of California, San Diego, La Jolla, CA, USA(美国加州大学圣地亚哥分校化学与纳米工程系,La Jolla,CA,美国) Nanyang Technological University, Singapore(新加坡南洋理工大学) Monash Biomedicine Discovery Institute and Department of Biochemistry and Molecular Biology, Monash University, Melbourne, Victoria, Australia(莫纳什大学生物医学发现研究所和生物化学与分子生物学系,墨尔本,维多利亚,澳大利亚) David R. Cheriton School of Computer Science, University of Waterloo, Waterloo, Ontario, Canada(加拿大滑铁卢大学戴维·R·切里顿计算机科学学校,滑铁卢,安大略,加拿大) Department of ICT and Center for AI Research, University of Agder (UiA), Jon Lilletuns vei 9, Grimstad, Norway(挪威阿格德大学(UiA)信息与通信技术系及人工智能研究中心,Jon Lilletuns vei 9,Grimstad,挪威) Department of Electronic Engineering, Tsinghua University, Beijing, China(清华大学电子工程系,北京,中国)

AI总结 提出生物医学世界模型作为AI驱动发现的新范式,通过学习分子、细胞、组织和临床状态的潜在表征及干预条件动态,实现未来轨迹模拟,并探讨其在虚拟细胞、类器官、虚拟患者和手术模拟等应用中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00307 2026-08-27 cs.RO 版本更新

ScaRF-SLAM: Scale-Consistent Reconstruction with Feed-Forward Models and Classical Visual SLAM

ScaRF-SLAM: 基于前馈模型与经典视觉SLAM的尺度一致重建

Yuhao Zhang, Yifu Tao, Frank Dellaert, Maurice Fallon

机构 * Oxford Robotics Institute, University of Oxford(牛津大学机器人研究所) College of Computing, Georgia Institute of Technology(佐治亚理工学院计算机学院)

AI总结 提出一种解耦框架,将经典特征SLAM用于鲁棒跟踪,几何基础模型仅用于建图,通过尺度优化和子图融合实现高质量一致密集重建,在建筑级数据集上重建精度提升10%-20%。

Comments Accepted to IEEE Robotics and Automation Letters (RA-L) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19523 2026-08-27 cs.CV 版本更新

Recognising BSL Fingerspelling in Continuous Signing Sequences

识别连续签署序列中的手语手指拼写

Alyssa Chan, Taein Kwon, Andrew Zisserman

机构 * Visual Geometry Group, Department of Engineering Science, University of Oxford(牛津大学视觉几何组,工程科学系)

AI总结 本文提出FS23K大规模手语手指拼写数据集及改进模型,通过考虑双手交互和口腔线索,将字符错误率降低一半,推动手语理解与自动化标注研究。

Comments 22 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏