arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Google(谷歌)

2026-06-23 至 2026-06-23 共收录 9
2606.22617 2026-06-23 cs.CV 新提交

OmniSpace: Efficient Geometry Awareness for Autonomous Vehicles MLLMs

OmniSpace: 自动驾驶多模态大语言模型的高效几何感知

Hao Vo, Phu Loc Nguyen, Khoa Vo, Sieu Tran, Duc Minh Nguyen, Ngo Xuan Cuong, Nghi D. Q. Bui, Anh Nguyen, Duy Minh Ho Nguyen, Ngan Le

机构 * University of Arkansas(阿肯色大学) Google Research, Google(谷歌研究院) University of Liverpool(利物浦大学) Max Planck Research School for Intelligent Systems(马克斯·普朗克智能系统研究所)

AI总结 提出OmniSpace,一种即插即用的几何感知范式,通过相机位姿注入器、多视图极线注意力模块和3D几何蒸馏目标,从纯2D观测中提升MLLM的空间推理能力,在多个自动驾驶基准上超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22481 2026-06-23 cs.GR cs.CV 新提交

Lighting-Consistent Object Transfer Across Radiance Fields

跨辐射场的一致光照物体迁移

Nicolás Violante, George Kopanas, Linus Franke, Julien Philip, George Drettakis

机构 * Inria Université Côte d’Azur(大学皮埃尔-皮埃尔·德·科蒂尔) Google DeepMind(谷歌DeepMind) Eyeline Labs(Eyeline实验室)

AI总结 针对3D高斯泼溅中物体迁移时光照不一致的问题,提出一种扩散模型调和合成图像,结合合成、生成和真实数据训练,并通过后优化整合为3DGS表示,实现高质量物体迁移。

Comments Project page: https://repo-sam.inria.fr/nerphys/dot3d

Journal ref Computer Graphics Forum (EGSR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21954 2026-06-23 cs.CL 新提交

Are Multilingual Models Actually Improving? Isolating True Cross-Lingual Transfer

多语言模型真的在改进吗?隔离真正的跨语言迁移

Prasoon Bajpai, Eleftheria Briakou, Colin Cherry, Preethi Jyothi, Vihari Piratla

机构 * Google DeepMind(谷歌DeepMind) Indian Institute of Technology Bombay(印度理工学院孟买分校)

AI总结 提出硬度调整迁移(HAT)分数以准确衡量跨语言迁移强度,发现小模型迁移未失效、随模型大小迁移进步慢于预期、但随时间推移有明显进步。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21627 2026-06-23 cs.AI cs.LG 新提交

Counsel: A Meta-Evaluation Dataset for Agentic Tasks

Counsel: 面向智能体任务的元评估数据集

Sashank Pisupati, Henry Broomfield, Eujeong Choi, Antonia Calvi, Charlie Wang, Roman Engeler, Max Bartolo, Patrick Lewis

机构 * Atla AI Cohere AI Mistral AI Google DeepMind(谷歌DeepMind)

AI总结 提出Counsel数据集,通过人工标注对LLM评判的智能体轨迹错误进行元评估,用于校准和改进LLM评判器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21550 2026-06-23 cs.AI 新提交

AI Alignment From Social Choice Perspectives

从社会选择视角看AI对齐

Daniel Halpern, Evi Micha, Ariel D. Procaccia, Benjamin Schiffer, Itai Shapira, Shirley Zhang

机构 * Google Research(谷歌研究院) University of Southern California(南加州大学) Harvard University(哈佛大学)

AI总结 本文从社会选择理论视角审视人类反馈对齐中的偏好聚合问题,识别失败模式并揭示处理分歧的广阔设计空间。

Comments Accepted for publication in ACM SIGecom Exchanges

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21173 2026-06-23 cs.LG cs.AI 新提交

Inverting the Bellman Equation: From $Q$-Values to World Models

逆推贝尔曼方程:从 $Q$ 值到世界模型

Alistair Letcher, Mattie Fellows, Alexander D. Goldie, Jonathan Richens, Jakob N. Foerster, Oliver Richardson

机构 * FLAIR, University of Oxford(FLAIR,牛津大学) Google DeepMind(谷歌DeepMind) Mila, University of Montreal(Mila,蒙特利尔大学)

AI总结 本文证明基于值的智能体在丰富奖励函数上训练时隐式编码世界模型,提出 $P$-learning 从 $Q$ 值提取模型,并给出编码真实转移核的充分条件,实验验证了隐式模型的准确性和泛化能力。

Comments 48 pages, 11 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20970 2026-06-23 cs.CV 新提交

CogniRoute: Learning to Route Social Evidence in Omni-Modal Models

CogniRoute: 在全模态模型中学习路由社会证据

Yifan Shen, Pei Tian, Xinzhuo Li, Bowen Fang, Shujun Xia, Bingxuan Li, Ana Jojic, Wenming Ye, Xu Cao, James Matthew Rehg, Ismini Lourentzou

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Columbia University(哥伦比亚大学) Google(谷歌)

AI总结 提出CogniRoute框架,通过模式引导的专家混合和路由感知强化学习,解决全模态模型在社会视频问答中证据选择不足的问题,在OmniSocialBench上准确率达59.38%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20868 2026-06-23 cs.CR cs.AI 新提交

Can LLMs Reason About Brand Ownership? An Empirical Study of Domain Attribution Intelligence

LLM能否推理品牌所有权?领域归属智能的实证研究

Fathima Mashood, Mohamed Nabeel

机构 * Google(谷歌) Microsoft(微软)

AI总结 针对品牌域名归属歧义问题,首次系统评估LLM在域名枚举、开放归属和二元分类三项任务中的品牌智能表现,发现模型依赖外部工具(如WHOIS)才能实现高精度所有权验证。

Comments llm, brand intelligence, whois, search, squatting domains, brand domains

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17283 2026-06-23 cs.CR cs.AI cs.LG 新提交

ARVO: Atlas of Reproducible Vulnerabilities for Open-Source Software

ARVO:开源软件可复现漏洞图谱

Xiang Mei, Jordi Del Castillo, Pulkit Singh Singaria, Haoran Xi, Abdelouahab Benchikh, Tiffany Bao, Ruoyu Wang, Yan Shoshitaishvili, Adam Doupé, Hammond Pearce, Brendan Dolan-Gavitt

机构 * National Vulnerability Database(国家漏洞数据库) Google(谷歌)

AI总结 提出一种大规模构建可复现漏洞数据集的方法,基于OSS-Fuzz构建含6100+真实漏洞的ARVO数据集,实现81%复现率与89.4%补丁定位精度,解决可复现性、数量与多样性三难问题。

Comments I found my co-author has already submitted one (arXiv:2408.02153)

详情

展开后加载摘要…

URL PDF HTML 收藏