arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 70159 信号源:cs.CV, cs.GR, cs.MM

1. 扩散模型 70159 篇

2604.08048 2026-04-10 cs.CV 79%

Guiding a Diffusion Model by Swapping Its Tokens

通过交换令牌引导扩散模型

Weijia Zhang, Yuehao Liu, Shanyan Guan, Wu Ran, Yanhao Ge, Wei Li, Chao Ma

机构 * MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(上海交通大学人工智能研究院教育部人工智能重点实验室) vivo Mobile Communication Co., Ltd.(维沃移动通信有限公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种简单方法,通过交换令牌实现条件和无条件生成的CFG引导,提升图像质量和提示对齐。

Comments Accepted by CVPR 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07273 2026-04-10 cs.CV 79%

GenLCA: 3D Diffusion for Full-Body Avatars from In-the-Wild Videos

GenLCA:从真实视频中生成全身体素的3D扩散模型

Yiqian Wu, Rawal Khirodkar, Egor Zakharov, Timur Bagautdinov, Lei Xiao, Zhaoen Su, Shunsuke Saito, Xiaogang Jin, Junxuan Li

机构 * Codec Avatars Lab, Meta(Meta Codec Avatars实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出GenLCA,一种基于扩散的生成模型,能从文本和图像输入生成逼真全身体素并进行编辑。通过利用预训练的avatar重建模型作为可动画的3D分词器,解决视频中部分观测导致的模糊或透明问题,提升生成质量与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03134 2026-04-10 cs.CV 79%

SD-FSMIS: Adapting Stable Diffusion for Few-Shot Medical Image Segmentation

SD-FSMIS:利用稳定扩散适应少样本医学图像分割

Meihua Li, Yang Zhang, Weizhao He, Hu Qu, Yisong Li

机构 * Computer Vision Institute, College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机与软件学院计算机视觉研究所)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出SD-FSMIS框架,通过引入支持-查询交互和视觉到文本条件翻译模块,利用预训练的稳定扩散模型提升少样本医学图像分割的效率与鲁棒性。

Comments CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16570 2026-04-10 cs.CV 79%

Face2Scene: Using Facial Degradation as an Oracle for Diffusion-Based Scene Restoration

Face2Scene:利用面部退化作为扩散基于场景恢复的 oracle

Amirhossein Kazerouni, Maitreya Suin, Tristan Aumentado-Armstrong, Sina Honari, Amanpreet Walia, Iqbal Mohomed, Konstantinos G. Derpanis, Babak Taati, Alex Levinshtein

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所) AI Center–Toronto, Samsung Electronics(三星电子多伦多AI中心) University Health Network(大学健康网络) York University(约克大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出Face2Scene框架,通过面部作为感知oracle估计退化并指导全图恢复,有效恢复身体和背景。

Comments Accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06774 2026-04-10 cs.CV cs.AI 79%

RDSplat: Robust Watermarking for 3D Gaussian Splatting Against 2D and 3D Diffusion Editing

RDSplat: 3D高斯散射中针对2D和3D扩散编辑的鲁棒水印

Longjie Zhao, Ziming Hong, Zhenyang Ren, Runnan Chen, Mingming Gong, Tongliang Liu

机构 * The University of Sydney(悉尼大学) The University of Melbourne(墨尔本大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 RDSplat是首个能抵御2D和3D扩散编辑的3D高斯散射水印框架,通过在低频高斯基元中嵌入100位水印,结合频率感知基元选择和替代策略,实现高效训练和强鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11435 2026-04-10 cs.CV cs.AI 79%

The Persistence of Cultural Memory: Investigating Multimodal Iconicity in Diffusion Models

文化记忆的延续:探究扩散模型中的多模态图标性

Maria-Teresa De Rosa Palmini, Eva Cetinic

机构 * University of Zurich(苏黎世大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文研究扩散模型在文化共享视觉参考提示下的泛化与记忆模糊性,提出CRT指标评估模型对文化参考的识别与实现能力,揭示模型行为依赖于对参考的识别与再现方式,推动评估向更丰富的语境理解发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23310 2026-04-10 cs.CV 79%

Balanced Diffusion-Guided Fusion for Multimodal Remote Sensing Classification

多模态遥感分类的平衡扩散引导融合

Hao Liu, Yongjie Zheng, Yuhan Kang, Mingyang Zhang, Maoguo Gong, Lorenzo Bruzzone

机构 * Department of Information Engineering and Computer Science, University of Trento(特伦托大学信息工程与计算机科学系) College of Electrical and Information Engineering, Hunan University(湖南大学电气与信息工程学院) Key Laboratory of Collaborative Intelligent Systems of Ministry of Education, Xidian University(西安电子科技大学教育部协同智能系统重点实验室) School of Electronic Engineering, Xidian University(西安电子科技大学电子工程学院) Academy of Artificial Intelligence, Inner Mongolia Normal University(内蒙古师范大学人工智能学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出平衡扩散引导融合框架,通过多模态扩散特征指导多分支网络进行土地覆盖分类,采用自适应模态掩码策略和跨模态注意力机制提升分类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05398 2026-04-10 cs.GR 79%

2ndMatch: Finetuning Pruned Diffusion Models via Second-Order Jacobian Matching

2ndMatch: 通过二阶雅可比匹配进行剪枝扩散模型的微调

Caleb Zheng, Eli Shlizerman

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.GR

AI总结 本文提出2ndMatch框架,通过二阶雅可比匹配损失提升剪枝扩散模型性能,实验表明其能显著改善输出质量。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08637 2026-04-10 cs.CV cs.AI cs.LG 79%

DMin: Scalable Training Data Influence Estimation for Diffusion Models

DMin:用于扩散模型的可扩展训练数据影响估计

Huawei Lin, Yingjie Lao, Weijie Zhao

机构 * Rochester Institute of Technology(罗切斯特理工学院) Tufts University(塔夫茨大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出DMin框架,用于高效估计扩散模型中每个训练样本对生成图像的影响,解决了传统方法在大规模模型上的计算限制问题,实现了存储和计算效率的显著提升。

Comments Accepted to CVPR 2026 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00436 2026-04-10 cs.CV 79%

Diff-PCR: Diffusion-Based Correspondence Searching in Doubly Stochastic Matrix Space for Point Cloud Registration

Diff-PCR: 基于双随机矩阵空间的扩散对应搜索用于点云配准

Haihua Shi, Qianliang Wu

机构 * Jinling Institute of Technology(金陵科技学院) PCA Lab, Key Lab of Intelligent Perception and Systems for High-Dimensional Information of Ministry of Education, and Jiangsu Key Lab of Image and Video Understanding for Social Security, School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院,教育部高维信息智能感知与系统重点实验室,江苏省社会安全图像与视频理解重点实验室,PCA实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出Diff-PCR框架,利用去噪扩散模型在双随机矩阵空间中预测最优匹配矩阵的搜索梯度,通过迭代优化提升点云配准的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07026 2026-04-09 cs.CV 79%

Not all tokens contribute equally to diffusion learning

并非所有标记对扩散学习贡献相等

Guoqing Zhang, Lu Shi, Wanru Xu, Linna Zhang, Sen Wang, Fangfang Wang, Yigang Cen

机构 * School of Mechanical Engineering, Guizhou University, Guizhou, China(贵州大学机械工程学院) School of Information Science and Technology, Hangzhou Normal University, Zhejiang, China(杭州师范大学信息科学与技术学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出DARE框架,通过分布偏见缓解和空间一致性提升扩散模型的语义引导,解决训练数据长尾分布和交叉注意力空间对齐问题,提升文本到视频生成的准确性和语义对齐性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05743 2026-04-09 cs.CV cs.AI 79%

On the Robustness of Diffusion-Based Image Compression to Bit-Flip Errors

扩散基图像压缩对位翻转错误的鲁棒性

Amit Vaisman, Gal Pomerants, Raz Lapid

机构 * Technion - Israel Institute of Technology(以色列理工学院) Deepkeep

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 研究探讨了基于扩散的图像压缩在位翻转错误下的鲁棒性,提出更稳健的Turbo-DDCM变体,改进鲁棒性的同时保持率-失真-感知权衡。

Comments Accepted at AIGENS @ CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26588 2026-04-09 cs.CV cs.LG 79%

From Synthetic Data to Real Restorations: Diffusion Model for Patient-specific Dental Crown Completion

从合成数据到真实修复:一种针对患者特定牙齿冠的扩散模型

Dávid Pukanec, Tibor Kubík, Michal Španěl

机构 * Department of Computer Graphics and Multimedia, Brno University of Technology, Czechia(捷克布尔诺科技大学计算机图形与多媒体系)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出ToothCraft模型,通过合成数据生成患者特定的牙齿冠修复,解决训练数据不足问题,实验显示其在IoU和CD指标上的优异表现。

Comments VISAPP 2026 Conference / CVPR Workshop GenRecon3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26167 2026-04-09 cs.CV cs.CR 79%

Gaussian Shannon: High-Precision Diffusion Model Watermarking Based on Communication

高斯香农:基于通信的高精度扩散模型水印技术

Yi Zhang, Hongbo Huang, Liang-Jie Zhang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出Gaussian Shannon水印框架,通过将扩散过程视为噪声通信信道,实现鲁棒追踪和精确位恢复,适用于无损元数据应用。

Comments Accepted by CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03468 2026-04-09 cs.CV 79%

D-Garment: Physically Grounded Latent Diffusion for Dynamic Garment Deformations

D-Garment:基于物理的潜在扩散模型用于动态服装变形

Antoine Dumoulin, Adnane Boukhayma, Laurence Boissieux, Bharath Bhushan Damodaran, Pierre Hellier, Stefanie Wuhrer

机构 * Inria Centre at the University Grenoble Alpes(格勒诺布尔阿尔卑斯大学Inria研究中心) Inria, University of Rennes, CNRS, IRISA-UMR 6074(雷恩大学Inria、CNRS、IRISA-UMR 6074) InterDigital Inc.(InterDigital公司)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出D-Garment,通过基于物理的模拟器生成新数据,学习基于物理材料属性的3D生成模型,实现更准确的服装变形和动态皱纹模拟。

Comments 18 pages, 11 figures

Journal ref Transactions on Machine Learning Research (TMLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06113 2026-04-08 cs.CV 79%

SEM-ROVER: Semantic Voxel-Guided Diffusion for Large-Scale Driving Scene Generation

SEM-ROVER:语义体素引导的扩散模型用于大规模驾驶场景生成

Hiba Dahmani, Nathan Piasco, Moussab Bennehar, Luis Roldão, Dzmitry Tsishkou, Laurent Caraffa, Jean-Philippe Tarel, Roland Brémond

机构 * Noah's Ark, Huawei Paris Research Center, France(诺亚方舟实验室,华为巴黎研究中心,法国) COSYS, Gustave Eiffel University, France(COSYS,古斯塔夫·埃菲尔大学,法国) LASTIG, IGN-ENSG, Gustave Eiffel University, France(LASTIG,IGN-ENSG,古斯塔夫·埃菲尔大学,法国)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出基于Σ-Voxfield网格的3D生成框架,通过语义条件扩散模型生成大规模一致驾驶场景,采用渐进空间外推和延迟渲染模块实现高效生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05961 2026-04-08 cs.CV 79%

HumANDiff: Articulated Noise Diffusion for Motion-Consistent Human Video Generation

HumANDiff: 关节化噪声扩散用于运动一致的人体视频生成

Tao Hu, Varun Jampani

机构 * Stability AI

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 HumANDiff通过关节化噪声采样、联合外观-运动学习和几何运动一致性学习,实现高保真人体视频生成,支持多样化的服装风格。

Comments Project page: https://taohuumd.github.io/projects/HumANDiff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05727 2026-04-08 cs.CV 79%

Single-Stage Signal Attenuation Diffusion Model for Low-Light Image Enhancement and Denoising

单阶段信号衰减扩散模型用于低光照图像增强与去噪

Ying Liu, Junchao Zhang, Caiyun Wu

机构 * School of Aeronautics and Astronautics, Central South University(中南大学航空航天学院) Hunan Provincial Key Laboratory of Optic-Electronic Intelligent Measurement and Control(湖南省光电智能测控重点实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出单阶段信号衰减扩散模型,通过整合信号衰减机制实现亮度调整与噪声抑制,避免了传统两阶段方法的优化不一致问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05497 2026-04-08 cs.AI cs.CV 79%

Thinking Diffusion: Penalize and Guide Visual-Grounded Reasoning in Diffusion Multimodal Language Models

Thinking Diffusion: 通过惩罚和引导在扩散多模态语言模型中抑制和引导视觉推理

Keuntae Kim, Mingyu Kang, Yong Suk Choi

机构 * Department of Computer Science, Hanyang University(汉阳大学计算机科学系) Department of Artificial Intelligence, Hanyang University(汉阳大学人工智能系)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文针对扩散多模态语言模型在视觉推理中生成过早答案的问题,提出位置与步数惩罚和视觉推理引导方法,提升推理准确率并加快推理速度。

Comments CVPR 2026 - main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05110 2026-04-08 cs.CV cs.AI 79%

Simultaneous Dual-View Mammogram Synthesis Using Denoising Diffusion Probabilistic Models

同时双视角乳腺X线合成使用去噪扩散概率模型

Jorge Alberto Garza-Abdala, Gerardo A. Fumagal-González, Eduardo de Avila-Armenta, Sadam Hussain, Jasiel H. Toscano-Martínezb, Diana S. M. Rosales Gurmendi, Alma A. Pedro-Pérez, Jose G. Tamez-Pena

机构 * Tecnologico de Monterrey, School of Engineering and Sciences(蒙特雷科技大学工程与科学学院) School of Engineering, Pontificia Universidad Católica de Chile(智利天主教大学工程学院) Tecnologico de Monterrey, School of Medicine and Health Sciences(蒙特雷科技大学医学与健康科学学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出一种三通道去噪扩散概率模型,同时生成乳腺的CC和MLO视角,通过绝对差编码保持全局结构,用于乳腺影像数据增强和交叉视角AI应用。

Comments Accepted and presented at SPIE Medical Imaging 2025 (Vancouver, Canada)

Journal ref Proc. SPIE 13925, 139251C (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04576 2026-04-08 cs.CV 79%

PR-IQA: Partial-Reference Image Quality Assessment for Diffusion-Based Novel View Synthesis

PR-IQA:基于扩散模型的新型视角合成的部分参考图像质量评估

Inseong Choi, Siwoo Lee, Seung-Hun Nam, Soohwan Song

机构 * Dongguk University(东国大学) NAVER WEBTOON AI

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 PR-IQA通过部分参考图像评估扩散生成的视角合成图像质量,提升3D重建效果,无需真实地面真值。

Comments Accepted at CVPR 2026. Project Page: https://kakaomacao.github.io/pr-iqa-project-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04924 2026-04-07 cs.CV cs.AI 79%

Your Pre-trained Diffusion Model Secretly Knows Restoration

你的预训练扩散模型秘密知道修复

Sudarshan Rajagopalan, Vishal M. Patel

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文揭示预训练扩散模型固有修复能力,通过直接学习文本编码器输出的提示嵌入解锁,提出扩散桥框架解决训练与推理不一致问题,实现高效修复模型。

Comments Project page: https://sudraj2002.github.io/yptpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04451 2026-04-07 cs.CV 79%

Beyond Few-Step Inference: Accelerating Video Diffusion Transformer Model Serving with Inter-Request Caching Reuse

超越少量步骤推理:利用跨请求缓存重用加速视频扩散变换器模型服务

Hao Liu, Ye Huang, Chenghuan Huang, Zhenyi Zheng, Jiangsu Du, Ziyang Ma, Jing Lyu, Yutong Lu

机构 * Sun Yat-sen University, China(中山大学) Independent Researcher(独立研究者)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出Chorus方法,通过跨请求缓存重用加速视频扩散模型服务,实现45%的速度提升,特别在中间去噪步骤中结合Token-Guided Attention Amplification提升语义对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00408 2026-04-07 cs.CV cs.AI 79%

Low-Bitrate Video Compression through Semantic-Conditioned Diffusion

基于语义的低比特率视频压缩

Lingdong Wang, Guan-Ming Su, Divya Kothandaraman, Tsung-Wei Huang, Mohammad Hajiesmaili, Ramesh K. Sitaraman

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Dolby Laboratories(杜比实验室)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出DiSCo框架,通过语义条件扩散模型在低比特率下实现高质量视频压缩,采用文本描述、空间时间退化视频和可选草图等模态,提升感知质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07435 2026-04-07 cs.CV 79%

DreamLifting: A Plug-in Module Lifting MV Diffusion Models for 3D Asset Generation

DreamLifting:一种插件模块用于提升MV扩散模型以生成3D资产

Ze-Xin Yin, Jiaxiong Qiu, Liu Liu, Xinjie Wang, Wei Sui, Zhizhong Su, Jian Yang, Jin Xie

机构 * PCA Lab, VCIP, College of Computer Science, Nankai University(南开大学计算机学院VCIP实验室PCA Lab) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院) Horizon Robotics(地平线机器人) D-Robotics

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出LGAA框架,通过多视角扩散先验统一几何与PBR材质建模,结合模块化设计和改进的VAE实现高效3D资产生成,实验表明其在文本和图像条件下均表现优异。

Comments 16 pages, 9 figures, TVCG 2026, project page: https://zx-yin.github.io/dreamlifting/

Journal ref IEEE Transactions on Visualization and Computer Graphics 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03581 2026-04-07 cs.RO cs.CV 79%

HAD: Combining Hierarchical Diffusion with Metric-Decoupled RL for End-to-End Driving

HAD:结合分层扩散与度量解耦RL的端到端驾驶

Wenhao Yao, Xinglong Sun, Zhenxin Li, Shiyi Lan, Zi Wang, Jose M. Alvarez, Zuxuan Wu

机构 * Fudan University(复旦大学) NVIDIA(英伟达)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 HAD提出一种端到端规划框架,结合分层扩散策略与度量解耦RL,通过结构保持轨迹扩展生成真实轨迹并提升驾驶目标优化效果,实验表明在NAVSIM和HUGSIM上取得新突破。

Comments 17 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03552 2026-04-07 cs.RO cs.AI cs.CV cs.LG 79%

CRAFT: Video Diffusion for Bimanual Robot Data Generation

CRAFT:基于视频扩散的双臂机器人数据生成

Jason Chen, I-Chun Arthur Liu, Gaurav Sukhatme, Daniel Seita

机构 * University of Southern California(南加州大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 CRAFT通过视频扩散生成双臂机器人演示数据,利用边缘结构线索提升生成多样性与鲁棒性,提升多视角任务的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03448 2026-04-07 cs.CV cs.AI cs.HC cs.LG 79%

ExpressEdit: Fast Editing of Stylized Facial Expressions with Diffusion Models in Photoshop

ExpressEdit: 在Photoshop中使用扩散模型快速编辑风格化面部表情

Kenan Tang, Jiasheng Guo, Jeffrey Lin, Yao Qin

机构 * University of California, Santa Barbara(加州大学圣塔芭芭拉分校)

专题命中 扩散模型 :diffusion(title);image editing(abstract);分类 cs.CV

AI总结 ExpressEdit通过开放源代码的Photoshop插件,实现快速且无伪影的风格化面部表情编辑,结合Liquify等原生功能,提升编辑效率与艺术创作灵活性。

Comments Accepted to CVPR 2026 Workshop on Generative AI for Storytelling (AISTORY)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03353 2026-04-07 eess.IV cs.CV 79%

NeuralLVC: Neural Lossless Video Compression via Masked Diffusion with Temporal Conditioning

NeuralLVC:基于掩码扩散与时间条件的神经损失视频压缩

Tiberio Uricchio, Marco Bertini

机构 * Università di Pisa(比萨大学) Università degli Studi di Firenze(佛罗伦萨大学)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 NeuralLVC通过结合掩码扩散与I/P帧架构,实现损失视频压缩,利用时间冗余性,实验表明其在Xiph CIF序列中优于H.264和H.265无损压缩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03310 2026-04-07 cs.CV 79%

Diffusion Path Alignment for Long-Range Motion Generation and Domain Transitions

扩散路径对齐用于长程运动生成与领域转换

Haichao Wang, Alexander Okupnik, Yuxing Han, Gene Wen, Johannes Schneider, Kyriakos Flouris

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Institute of Information Systems, Universität Liechtenstein(列支敦士登大学信息系统研究所) Department of Computer Science, New York University(纽约大学计算机科学系) MRC Biostatistics Unit, University of Cambridge(剑桥大学MRC生物统计单元)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出基于扩散的优化框架,通过控制能量目标实现运动领域间流畅过渡,提升长程人类运动生成的连贯性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏