arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 8017 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 8017 篇

2606.24123 2026-06-24 cs.SD 新提交 78%

Aligning MusicLLM with Emotion using Instruction Tuning and Feedback-Driven Alignment

使用指令微调和反馈驱动对齐将 MusicLLM 与情感对齐

Takuya Hasumi, Welly Naptali

机构 * LY Corporation

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文研究如何通过指令微调和反馈驱动对齐策略,使音乐大语言模型(MusicLLM)具备情感回归能力,并证明反馈驱动对齐能显著提升唤醒度和效价预测性能,同时保持音乐问答能力。

Comments Accepted to Interspeech 2026, 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22413 2026-06-24 cs.SE cs.FL 新提交 78%

Formal-Method-Guided Vibe Coding: Closing the Verification Loop on AI-Generated Safety-Critical Software Through Model-Driven Engineering

形式化方法引导的Vibe编码:通过模型驱动工程关闭AI生成安全关键软件的验证循环

Ran Wei, Le Zhu, Haochi Wang, Jim Woodcock, Fang Yan, Simon Foster, Xiangyang Ji

专题命中 其他安全 :safety(title,abstract)

AI总结 提出Forge管道,结合Vibe编码与模型驱动工程,通过多种形式化验证(Dafny、CSP、Isabelle)迭代修正LLM生成的Java代码,生成符合安全标准的验证证据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22366 2026-06-24 physics.optics 新提交 78%

Alignment-Free Nanometric Optical Metrology Enabled by Structured Light

基于结构光的无对准纳米光学计量

Yu Wang, Benquan Wang, Eng Aik Chan, Songze Li, Zhenyu Guo, Xi Xie, Masako Kishida, Che-Chin Chen, Yijie Shen, Jun-Yu Ou

专题命中 其他安全 :alignment(title,abstract)

AI总结 提出利用拉盖尔-高斯或厄米-高斯结构光照明,结合AI分析方法,实现单次、无标记、无对准的亚波长结构一维位置测量,精度达λ/110(7.2 nm)。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21915 2026-06-23 cs.CV 新提交 78%

GTA-Net: Cooperative Game Theory for Vision-Language Alignment in Chest X-Ray Report Generation

GTA-Net:合作博弈论在胸部X光报告生成中的视觉-语言对齐

Saif ur Rehman Khan, Imad Ahmed Waqar, Sebastian Vollmer, Andreas Dengel, Muhammad Nabeel Asim

机构 * Department of Computer Science, Rhineland-Palatinate Technical University of Kaiserslautern-Landau(莱茵兰-普法尔茨凯泽斯劳滕-兰道工业大学计算机科学系) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心) IntelligentX GmbH

专题命中 其他安全 :alignment(title,abstract)

AI总结 提出GTA-Net,利用合作博弈论实现图像区域与文本的显式对齐,通过二元和三元对齐器提升胸部X光报告生成的临床一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17410 2026-06-17 cs.CV 新提交 78%

Attention Alignment Between Humans and Vision-Language Models

人类与视觉语言模型之间的注意力对齐

Isaac R. Christian, Udith Haputhanthrige, Hanna Hornfeld, Declan Campbell, Samuel Nastase, Taylor Webb, Michael Graziano

机构 * Princeton Neuroscience Institute, Princeton University(普林斯顿大学普林斯顿神经科学研究所) Department of Psychology, Princeton University(普林斯顿大学心理学系) Department of Computer Science, Princeton University(普林斯顿大学计算机科学系) Department of Psychology and Center for Computational Language Sciences, University of Southern California(南加州大学心理学系与计算语言科学中心) Department of Psychology, Université de Montréal(蒙特利尔大学心理学系)

专题命中 其他安全 :alignment(title,abstract)

AI总结 本研究比较了六种视觉语言模型的空间注意力图与人类注视热图,发现解码器架构(LSTM vs Transformer)主导对齐程度,LSTM解码器对齐度更高但空间分散且任务区分度低,而Transformer解码器注意力更集中且任务区分度强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14049 2026-06-15 cs.SD cs.CV 新提交 78%

FoleyGenEx: Unified Video-to-Audio Generation with Multi-Modal Control, Temporal Alignment, and Semantic Precision

FoleyGenEx: 统一视频到音频生成,具备多模态控制、时间对齐与语义精度

Shiyao Wang, Xijuan Zeng, Hui Wang, Shiwan Zhao, Feng Deng, Chen Zhang, Yong Qin

机构 * Academy for Advanced Interdisciplinary Studies, Nankai University(南开大学前沿交叉学科研究院) Kling Team, Kuaishou Technology(快手科技Kling团队)

专题命中 其他安全 :alignment(title,abstract)

AI总结 提出FoleyGenEx统一框架,通过条件注入、多模态动态掩码和副词数据增强,实现视频到音频生成中多模态控制、帧级时间对齐与细粒度语义的同步合成。

Comments Accepted by INTERSPEECH 2026

Journal ref INTERSPEECH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12005 2026-06-11 cs.GT cs.IT math.IT 新提交 78%

Game-Theoretic Latent Space Alignment for Multi-user Semantic MIMO Communications

博弈论潜在空间对齐用于多用户语义MIMO通信

Giuseppe Di Poce, Mattia Merluzzi, Emilio Calvanese Strinati, Paolo Di Lorenzo

专题命中 其他安全 :alignment(title,abstract)

AI总结 针对多用户语义MIMO干扰网络中的语义失配问题,提出非合作博弈框架,通过闭式解联合优化线性语义MIMO收发机,并设计迭代语义注水算法,实现潜在空间对齐与干扰管理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11096 2026-06-10 cs.CV 新提交 78%

IDEAL: In-DEpth ALignment Makes A Discrete Representation AutoEncoder

IDEAL: 深度对齐实现离散表示自编码器

Yitong Chen, Zijie Diao, Junke Wang, Lingyu Kong, Yixuan Ren, Bo He, Yu-Gang Jiang, Zuxuan Wu

机构 * Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究所) Shanghai Innovation Institute(上海创新研究院) University of Maryland, College Park(马里兰大学帕克分校)

专题命中 其他安全 :alignment(title,abstract)

AI总结 提出IDEAL框架,通过联合对齐量化令牌与浅层和深层VFM特征,提升离散表示自编码器的重建质量,在ImageNet上实现0.61 rFID,并创下自回归图像生成新纪录(gFID 1.89)。

Comments Code is available at https://github.com/Row11n/IDEAL

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09966 2026-06-10 cs.SD 新提交 78%

RespiraMFM: A Multimodal Foundation Model with Contrastive Audio-Language Alignment for Respiratory Disease Identification

RespiraMFM:一种用于呼吸道疾病识别的对比音频-语言对齐多模态基础模型

Shakhrul Iman Siam, Tiantian Feng, Jiankun Zhang, Shrikanth Narayanan, Mi Zhang

机构 * The Ohio State University(俄亥俄州立大学) University of Southern California(南加州大学) University of Chicago(芝加哥大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 提出RespiraMFM多模态基础模型,通过对比音频-文本对齐策略整合呼吸音与临床信息,在监督和零样本任务中分别提升AUROC 9.15%和20.98%。

Comments ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10599 2026-06-10 math.NA cs.NA 新提交 78%

Nonlocal modeling of opinion alignment and environmental feedback: Spatial aggregation and non-consensus patterns

意见对齐与环境反馈的非局部建模:空间聚集与非共识模式

Rui Wang, Yunfeng Xiong, Zhengru Zhang, Xiaofei Zhao

专题命中 其他安全 :alignment(title,abstract)

AI总结 提出一个注意力介导反馈的空间意见动力学模型,通过非局部对齐与注意力场耦合,推导出非局部对流-交叉扩散系统,分析显示注意力反馈扩大非共识聚类参数区间,促进空间异质性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07800 2026-06-10 cs.CV 版本更新 78%

SARA: Semantically Adaptive Relational Alignment for Video Diffusion Models

SARA: 语义自适应关系对齐用于视频扩散模型

Jiesong Lian, Zixiang Zhou, Ruizhe Zhong, Yuan Zhou, Qinglin Lu, Rui Wang, Long Hu, Yixue Hao, Baoru Huang

机构 * Tencent Hunyuan(腾讯文英)

专题命中 其他安全 :alignment(title,abstract)

AI总结 提出SARA方法,通过文本条件显著性引导令牌对监督,提升视频扩散模型的文本对齐和运动质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04385 2026-06-04 cs.CV 78%

Geometry-Preserving Unsupervised Alignment for Heterogeneous Foundation Models

保持几何结构的异质基础模型无监督对齐

Shuwen Yu, Zhanxuan Hu, Yi Zhao, Yonghang Tai, Huafeng Li

机构 * Yunnan Normal University, Kunming, China(云南师范大学,昆明,中国) Kunming University of Science and Technology, Kunming, China(昆明理工大学,昆明,中国)

专题命中 其他安全 :alignment(title,abstract)

AI总结 提出GPUA框架,通过正交映射将视觉基础模型特征对齐到视觉语言模型语义空间,无需标签或参数更新,提升跨模型兼容性并在零样本识别与分割任务中取得显著增益。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
1805.09944 2026-06-04 eess.SY cs.SY 78%

Reachability Analysis and Safety Verification for Neural Network Control Systems

神经网络控制系统可达性分析与安全性验证

Weiming Xiang, Taylor T. Johnson

专题命中 其他安全 :safety(title,abstract)

AI总结 本文提出利用线性规划算法对神经网络控制器的可达集进行过近似,并结合常微分方程模型进行闭环系统可达集估计,最终通过检查估计可达集与不安全区域的交集实现神经网络控制系统的安全性验证。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1602.08150 2026-06-04 cs.MA cs.SY eess.SY 78%

Reachability-Based Safety and Goal Satisfaction of Unmanned Aerial Platoons on Air Highways

基于可达性的无人机编队安全性和目标满足性研究

Mo Chen, Qie Hu, Jaime Fisac, Kene Akametalu, Casey Mackin, Claire Tomlin

专题命中 其他安全 :safety(title,abstract)

AI总结 本文提出利用空气高速路结构对无人机编队进行 tractable 分析,通过混合系统模型和 Hamilton-Jacobi 可达性方法,确保编队在不同模式转换中的安全性和目标满足性,同时通过仿真验证了该方法的有效性。

Comments American Institute of Aeronautics and Astronautics Journal of Guidance, Control, and Dynamics, January 30, 2017

详情

展开后加载摘要…

URL PDF HTML 收藏
1609.07006 2026-06-04 cs.RO cs.MA cs.SY eess.SY 78%

SafeGuardPF: Safety Guaranteed Reactive Potential Fields for Mobile Robots in Unknown and Dynamic Environments

SafeGuardPF: 保障安全的反应势场用于未知和动态环境中的移动机器人

Rafael Rodrigues da Silva, Samuel Silva, Grigoriy Dubrovskiy, Hai Lin

专题命中 其他安全 :safety(title,abstract)

AI总结 本文提出SafeGuardPF方法,通过将反应势场运动控制器建模为混合自动机,并利用微分动态逻辑形式化验证其安全性,确保机器人在动态环境中避免碰撞。

Comments 8 pages, 9 figures, Submitted for publication in 2017 American Control Conference (ACC2017)

详情

展开后加载摘要…

URL PDF HTML 收藏
1408.6362 2026-06-04 math.DS cs.NA math.NA math.OC 78%

Sparse Control of Alignment Models in High Dimension

高维中对齐模型的稀疏控制

Mattia Bongini, Massimo Fornasier, Oliver Junge, Benjamin Scharf

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出在高维空间中通过随机线性映射降低维度,实现对共识涌现模型的稀疏控制,以高效引导系统趋近共识。

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28995 2026-06-02 cs.CV 78%

GAP3D: Generative Alignment of VLM Latents to Patch-Level Embeddings for 3D Generation

GAP3D: 将VLM潜在表示与补丁级嵌入进行生成式对齐以实现3D生成

Polytimi Anna Gkotsi, Andrii Zadaianchuk, Mohammad Mahdi Derakhshani

机构 * Polytimi Anna Gkotsi Andrii Zadaianchuk Mohammad Mahdi Derakhshani

专题命中 其他安全 :alignment(title,abstract)

AI总结 提出GAP3D,一种基于扩散的模块化方法,将VLM生成的潜在表示直接对齐到预训练图像编码器的完整补丁级特征空间,使冻结的下游生成模型能够利用VLM作为提示编码器,同时保持空间结构化的条件信号,在3D资产生成中无需大规模3D数据训练,并展现出多模态提示的零样本能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29776 2026-05-29 cs.CV 78%

Improving CLIP Adaptation by Breaking Tail Alignment for Source-Free Cross-Domain Few-Shot Learning

通过打破尾部对齐改进CLIP适应:用于源无关跨域小样本学习

Shuai Yi, Yixiong Zou, Yuhua Li, Ruixuan Li

机构 * School of Computer Science and Technology, Huazhong University of Science and Technology, Wuhan, China(华中科技大学计算机科学与技术学院) Institute of Artificial Intelligence, Huazhong University of Science and Technology, Wuhan, China(华中科技大学人工智能研究院)

专题命中 其他安全 :alignment(title,abstract)

AI总结 针对CLIP在跨域小样本学习中的性能下降问题,提出自适应尾头对齐策略(ATHA),通过有选择地削弱低相似度图像令牌的对齐来减少过拟合,在四个基准上取得最优结果。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22484 2026-05-22 cs.CV 78%

Supervised Classification Heads as Semantic Prototypes: Unlocking Vision-Language Alignment via Weight Recycling

监督分类头作为语义原型:通过权重重用解锁视觉-语言对齐

David Méndez, Roberto Confalonieri, Natalia Díaz Rodríguez

机构 * Department of Computer Science and Artificial Intelligence, DaSCI Institute, University of Granada, Granada, Spain(计算机科学与人工智能系,DaSCI研究所,格拉纳达大学,格拉纳达,西班牙) Department of Mathematics ``Tullio Levi-Civita'', University of Padova, Padova, Italy(托里利-西维塔数学系,帕多瓦大学,帕多瓦,意大利)

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出利用预训练视觉模型的分类头作为语义原型,通过权重重用实现视觉-语言对齐,提升跨模态检索、零样本和少样本分类任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20808 2026-05-21 cs.CV 78%

Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis

基于超高清图像合成的空间图对齐

Jinjin Zhang, Xiefan Guo, Di Huang

机构 * Beihang University(北航大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出空间图对齐(SGA)方法,通过利用视觉基础模型的表示先验,保留LDMs的生成能力,解决超高清图像合成中生成质量与结构完整性之间的冲突,实现高质量的文本到图像合成。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19727 2026-05-20 cs.CV 78%

Tango3D: Towards Alignment for Global and Local 2D-3D Correspondence

Tango3D: 向全局和局部2D-3D对应关系对齐迈进

Zebin He, Mingxin Yang, Shuhui Yang, Hanxiao Sun, Xintong Han, Chunchao Guo, Wenhan Luo

机构 * HKUST(香港科技大学) Tencent Hunyuan(腾讯混元)

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出Tango3D,一种统一密集对应和全局检索的3D基础模型,通过几何感知的2D视觉骨干网络和预训练的3D VAE将图像编码为2D片段,点云编码为3D标记,并映射到共享空间以实现局部像素-点对齐和全局语义对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17627 2026-05-19 cond-mat.soft nlin.PS 78%

Collective dynamics of active matter with orientation-weighted alignment

具有方向加权对齐的主动物质集体动力学

Bohdan Dobosh, Alexander Yakimenko

专题命中 其他安全 :alignment(title,abstract)

AI总结 研究一种具有速度依赖对齐规则的基于代理的自驱动粒子模型,通过调整对齐强度产生多种集体状态,包括无序气体态、有序编队、高密度阻塞态和具有活性晶体行为的密集有序移动簇。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16949 2026-05-19 cs.CV 78%

Beyond Point-Wise Matching: Structural Representation Alignment for Accelerating Diffusion Transformers

超越点对点匹配:为加速扩散变换器的结构表示对齐

Shaodong Xu, Zhendong Wang, Litong Gong, Zexian Li, Wengang Zhou, Tiezheng Ge, Houqiang Li

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出sREPA框架,通过显式结构约束来对齐特征图的相对几何关系,以提高生成质量并加速收敛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16783 2026-05-19 physics.geo-ph 78%

Pretrain-to-alignment learning paradigm to improve geophysical AI applicability under scarce field labels and synthetic-to-field gaps: A case study of relative geologic time estimation in global shelf-edge clinothems

预训练到对齐学习范式以提高在稀少实地标签和合成到实地差距下的地球物理AI适用性:全球岸缘cline-thems中相对地质时间估计的案例研究

Hui Gao, Xinming Wu, Jiarun Yang, Zhixiang Gao, Yimin Dou

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出了一种预训练到对齐的学习范式,通过整合自监督预训练、合成监督、先验驱动细化和领域适应微调,提升地球物理AI在稀少实地标签和合成到实地差距下的适用性,通过全球岸缘cline-thems中相对地质时间估计的案例研究验证了该范式的有效性。

Comments 50 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14795 2026-05-15 cs.CV 78%

COAL: Counterfactual and Observation-Enhanced Alignment Learning for Discriminative Referring Multi-Object Tracking

COAL: 基于反事实和观察增强的对齐学习用于判别性参照多目标跟踪

Shukun Jia, Shiyu Hu, Yipei Wang, Ximeng Cheng, Yichao Cao, Xiaobo Lu

机构 * School of Automation, Southeast University, Nanjing, China(东南大学自动化学院,南京,中国) Key Laboratory of Measurement and Control of Complex Systems of Engineering, Ministry of Education, Nanjing, China(工程复杂系统测量与控制国家重点实验室,教育部,南京,中国) School of Physical & Mathematical Sciences, Nanyang Technological University, Singapore(南洋理工大学物理与数学科学学院,新加坡) Big Data Institute, Central South University, Changsha, China(中南大学大数据研究院,长沙,中国)

专题命中 其他安全 :alignment(title,abstract)

AI总结 COAL通过知识正则化解决RMOT中高判别性需求与稀疏语义监督的矛盾,引入显式语义注入和反事实学习提升多目标跟踪的判别能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20206 2026-05-15 cs.CV 78%

RAPO++: Cross-Stage Prompt Optimization for Text-to-Video Generation via Data Alignment and Test-Time Scaling

RAPO++: 通过数据对齐和测试时缩放实现文本到视频生成的跨阶段提示优化

Bingjie Gao, Qianli Ma, Xiaoxue Wu, Shuai Yang, Guanzhou Lan, Haonan Zhao, Jiaxuan Chen, Qingyang Liu, Yu Qiao, Xinyuan Chen, Yaohui Wang, Li Niu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 其他安全 :alignment(title,abstract)

AI总结 RAPO++通过数据对齐和测试时缩放,结合训练数据对齐、测试时迭代缩放和大语言模型微调,提升文本到视频生成效果,无需修改生成基础模型。

Comments arXiv admin note: text overlap with arXiv:2504.11739

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11385 2026-05-13 cs.CV cs.RO 78%

JACoP: Joint Alignment for Compliant Multi-Agent Prediction

JACoP:联合对齐的合规多智能体预测

Qingze Liu, Alen Mrdovic, Danrui Li, Mathew Schwartz, Sejong Yoon, Mubbasir Kapadia

机构 * Rutgers University, New Brunswick(新泽西州罗格斯大学) The College of New Jersey(新泽西州学院)

专题命中 其他安全 :alignment(title,abstract)

AI总结 JACoP通过多阶段框架确保场景级合理性,结合锚点基于的智能体中心分析器和马尔可夫随机场对齐器,有效减少环境和社交冲突,提升多智能体轨迹预测的合规性与实用性。

Comments Accepted by CVPRF 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10712 2026-05-12 cs.SE cs.CR 78%

AutoSOUP: Safety-Oriented Unit Proof Generation for Component-level Memory-Safety Verification

AutoSOUP:面向组件级内存安全验证的安全导向单元证明

Paschal C. Amusuo, Ricardo Calvo, Dharun Anandayuvaraj, Taylor Le Lievre, Kevin Kolyakov, Elijah Jorgensen, Aravind Machiry, James C. Davis

专题命中 其他安全 :safety(title,abstract)

AI总结 AutoSOUP通过安全导向单元证明自动化组件级内存安全验证,结合确定性程序合成与LLM,生成可验证的证明以提高内存安全验证的自动化水平。

Comments 13 main pages, 7 appendix pages, 2 figures, 5 listings

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08874 2026-05-12 cs.CV 78%

Semantic Alignment in Hyperbolic Space for Open-Vocabulary Semantic Segmentation

超几何空间中的语义对齐用于开放词汇语义分割

Hoang M. Truong, Hai Nguyen-Truong, Dang Huynh

机构 * Fulbright University Vietnam(富布赖特大学越南分校)

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出HyRo框架,通过解耦超几何空间中的层次和语义对齐,提升开放词汇语义分割性能。

Comments Accepted to the PVUW Workshop at CVPR 2026. Project page: https://tmhoanggg.github.io/HyRo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08064 2026-05-11 cs.CV 78%

Proxy3D: Efficient 3D Representations for Vision-Language Models via Semantic Clustering and Alignment

Proxy3D: 通过语义聚类和对齐实现视觉-语言模型的高效3D表示

Jerry Jiang, Haowen Sun, Denis Gudovskiy, Yohei Nakata, Tomoyuki Okuno, Kurt Keutzer, Wenzhao Zheng

机构 * Tsinghua University(清华大学) Panasonic AI Lab(松下人工智能实验室) Panasonic DX-CPS(松下DX-CPS) UC Berkeley(伯克利大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出Proxy3D方法,通过语义和几何编码器提取场景特征并进行语义感知聚类,生成紧凑且全面的3D代理表示,提升视觉-语言模型在3D视觉问答、视觉定位和空间智能任务中的性能。

Comments Accepted by CVPR 2026. Project page: https://wzzheng.net/Proxy3D

详情

展开后加载摘要…

URL PDF HTML 收藏