arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Google(谷歌)

2026-08-31 至 2026-08-31 共收录 8
2608.28567 2026-08-31 cs.CV 新提交

GeBDA: Building Damage Assessment as Text-Based Sequence Prediction

GeBDA:基于文本序列预测的建筑物损伤评估

Olivier Dietrich, Krishna Sapkota, Konrad Schindler, Genady Beryozkin

机构 * ETH Zurich(苏黎世联邦理工学院) Google(谷歌公司)

AI总结 本研究提出将建筑物损伤评估(BDA)转化为文本序列预测任务,基于通用视觉语言模型(VLM),用开源Gemma模型初步实现取得了有前景的双时相卫星图像损伤制图结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28534 2026-08-31 cs.AI 新提交

InstructMesh: Selective Refinement of Generative 3D Models for Fabrication

InstructMesh:面向制造场景的生成式3D模型选择性优化

Faraz Faruqi, Ahmed Katary, Demircan Tas, Theresa Hradilak, Ning Zhang, Jiaji Li, Fabian Manhardt, Martin Nisser, Vrushank Phadnis, Ruofei Du, Federico Tombari, Megan Hofmann, Stefanie Mueller

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Google(谷歌公司) University of Washington(华盛顿大学) Khoury College of Computer Sciences, Northeastern University(东北大学科里计算机科学学院) Google XR(谷歌XR部门)

AI总结 InstructMesh是一款交互式3D模型后生成优化工具,可通过区域选择、针对性操作及自然语言或滑块控件,帮助用户修复生成式3D模型的制造相关缺陷,新手无需专业技能即可使用,且用户偏好混合交互界面。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28384 2026-08-31 cs.AI 新提交

MAP: A Benchmark on Multimodal Accessibility Planning for Real World Places

MAP:面向现实场所的多模态可访问性规划基准

Jason Armitage, Ioannis Tsochantaridis, Linda Mazzone, Chuqiao Yan, Srini Narayanan, Sarah Ebling

机构 * University of Zurich(苏黎世大学) Google DeepMind(谷歌DeepMind)

AI总结 研究推出首个多模态可访问性规划基准MAP,含声明验证与视觉证据检索两项评估,支持动态信息下的AI系统对比,为服务可访问性需求用户的多模态AI提供评估框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26263 2026-08-31 cs.AI cs.MA 版本更新

SKILL.state: Scalable Long-Horizon Agent Skills

SKILL.state:可扩展的长程智能体技能

Sanket Badhe, Priyanka Tiwari, Jonghyun Chung

机构 * Google LLC(谷歌公司) Purdue University(普渡大学)

AI总结 针对现有智能体运行时的长程延迟与上下文污染问题,提出SKILL.state架构,用显式可变执行状态替代追加式对话历史,提升任务准确率并降低令牌消耗。

Comments accepted at EMNLP

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17981 2026-08-31 cs.LG 版本更新

Recirculation

再循环

Michael C. Mozer, Shoaib Ahmed Siddiqui, Danny Sawyer, Sunny Sanyal, Rosanne Liu

机构 * Google DeepMind(谷歌DeepMind) University of Texas, Austin(德克萨斯大学奥斯汀分校)

AI总结 该研究提出推理时架构增强技术“再循环”及其自适应变体,无需额外训练,可显著降低Gemma3系列模型的困惑度、提升推理任务准确率,为架构演进提供新方向。

Comments v2: added citations to related work, included more methodological details concerning perplexity evaluation which help explain the large reductions in perplexity observed

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17070 2026-08-31 cs.CL cs.AI 版本更新

Large Reasoning Models Struggle to Transfer Parametric Knowledge Across Scripts

大推理模型在不同脚本间转移参数知识时面临困难

Lucas Bandarkar, Alan Ansell, Trevor Cohn

机构 * Google Research(谷歌研究) University of California, Los Angeles(加州大学洛杉矶分校) University of Melbourne(墨尔本大学)

AI总结 研究发现,大模型在跨语言知识转移中主要受脚本差异影响,通过分析数据和实验表明,提升模型对转写歧义的推理能力可改善跨脚本知识转移。

Comments Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16742 2026-08-31 cs.CV 版本更新

When the City Teaches the Car: Label-Free 3D Perception from Infrastructure

当城市教导汽车:从基础设施实现无标签的3D感知

Zhen Xu, Jinsu Yoo, Cristian Bautista, Zanming Huang, Tai-Yu Pan, Zhenzhen Liu, Katie Z Luo, Mark Campbell, Bharath Hariharan, Wei-Lun Chao

机构 * The Ohio State University(俄亥俄州立大学) Google(谷歌) Cornell University(康奈尔大学) Stanford University(斯坦福大学) Boston University(波士顿大学)

AI总结 本文提出一种无标签的3D感知方法,利用道路设施作为无监督教师,通过固定视角和重复观测学习局部3D检测器,并广播预测作为伪标签监督,无需基础设施即可训练独立的车辆检测器。

Comments ECCV 2026; Project Page: this https URL (https://jinsuyoo.info/civet/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11017 2026-08-31 cs.CL cs.AI 版本更新

Beyond the Rosetta Stone: Unification Forces in Generalization Dynamics

超越罗塞塔石碑:泛化动态中的统一力量

Carter Blum, Katja Filippova, Ann Yuan, Asma Ghandeharioun, Julian Zimmert, Fred Zhang, Jessica Hoffmann, Tal Linzen, Martin Wattenberg, Lucas Dixon, Mor Geva

机构 * Google DeepMind(谷歌DeepMind) Tel Aviv University(特拉维夫大学) Harvard University(哈佛大学) New York University(纽约大学)

AI总结 本研究通过在合成多语言数据集上训练小型Transformer模型,揭示了LLMs跨语言知识迁移困难的原因,提出了统一表征视角,为改善LLMs跨语言迁移提供了方法。

Comments Accepted at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏