arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4233 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4233 篇

2412.19458 2024-12-31 cs.CV 57%

DriveEditor: A Unified 3D Information-Guided Framework for Controllable Object Editing in Driving Scenes

Yiyuan Liang, Zhiying Yan, Liqun Chen, Jiahuan Zhou, Luxin Yan, Sheng Zhong, Xu Zou

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19759 2024-12-31 cs.CV 57%

MotionLCM: Real-time Controllable Motion Generation via Latent Consistency Model

Wenxun Dai, Ling-Hao Chen, Jingbo Wang, Jinpeng Liu, Bo Dai, Yansong Tang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments MotionLCM project version 1.0 (ECCV 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20327 2024-12-31 cs.CV 57%

Motion Transfer-Driven intra-class data augmentation for Finger Vein Recognition

Xiu-Feng Huang, Lai-Man Po, Wei-Feng Ou

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 5 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20162 2024-12-31 cs.CV 57%

Multi-Modality Driven LoRA for Adverse Condition Depth Estimation

Guanglei Yang, Rui Tian, Yongqiang Zhang, Zhun Zhong, Yongqiang Li, Wangmeng Zuo

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19518 2024-12-30 cs.CV 57%

Dust to Tower: Coarse-to-Fine Photo-Realistic Scene Reconstruction from Sparse Uncalibrated Images

Xudong Cai, Yongcai Wang, Zhaoxin Fan, Deng Haoran, Shuo Wang, Wanting Li, Deying Li, Lun Luo, Minhang Wang, Jintao Xu

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17290 2024-12-30 cs.CV 57%

Free-viewpoint Human Animation with Pose-correlated Reference Selection

Fa-Ting Hong, Zhan Xu, Haiyang Liu, Qinjie Lin, Luchuan Song, Zhixin Shu, Yang Zhou, Duygu Ceylan, Dan Xu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Under review; Project page: https://harlanhong.github.io/publications/fvhuman/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15798 2024-12-30 eess.IV cs.CV 57%

M3-CVC: Controllable Video Compression with Multimodal Generative Models

Rui Wan, Qi Zheng, Yibo Fan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10889 2024-12-23 cs.CV cs.AI 57%

Synthesizing Moving People with 3D Control

Boyi Li, Junming Chen, Jathushan Rajasegaran, Yossi Gandelsman, Alexei A. Efros, Jitendra Malik

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15673 2024-12-23 cs.CV 57%

Learning Group Interactions and Semantic Intentions for Multi-Object Trajectory Prediction

Mengshi Qi, Yuxin Yang, Huadong Ma

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15664 2024-12-23 cs.CV 57%

SCENIC: Scene-aware Semantic Navigation with Instruction-guided Control

Xiaohan Zhang, Sebastian Starke, Vladimir Guzov, Zhensong Zhang, Eduardo Pérez Pellitero, Gerard Pons-Moll

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15590 2024-12-23 cs.CV cs.CR 57%

SemDP: Semantic-level Differential Privacy Protection for Face Datasets

Xiaoting Zhang, Tao Wang, Junhao Ji

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13635 2024-12-19 cs.CV 57%

Self-control: A Better Conditional Mechanism for Masked Autoregressive Model

Qiaoying Qu, Shiyu Shen

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11067 2024-12-19 cs.CV 57%

CFSynthesis: Controllable and Free-view 3D Human Video Synthesis

Liyuan Cui, Xiaogang Xu, Wenqi Dong, Zesong Yang, Hujun Bao, Zhaopeng Cui

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12129 2024-12-18 cs.LG cs.AI cs.CV 57%

SceneDiffuser: Efficient and Controllable Driving Simulation Initialization and Rollout

Chiyu Max Jiang, Yijing Bai, Andre Cornman, Christopher Davis, Xiukun Huang, Hong Jeon, Sakshum Kulshrestha, John Lambert, Shuangyu Li, Xuanyu Zhou, Carlos Fuertes, Chang Yuan, Mingxing Tan, Yin Zhou, Dragomir Anguelov

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15595 2024-12-17 cs.CV cs.AI 57%

An adversarial feature learning based semantic communication method for Human 3D Reconstruction

Shaojiang Liu, Jiajun Zou, Zhendan Liu, Meixia Dong, Zhiping Wan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments It was published to arXiv without consulting the corresponding author, so the corresponding author requested a withdrawal first

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10219 2024-12-16 cs.CV 57%

Learning Complex Non-Rigid Image Edits from Multimodal Conditioning

Nikolai Warner, Jack Kolb, Meera Hahn, Vighnesh Birodkar, Jonathan Huang, Irfan Essa

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09623 2024-12-13 cs.CV 57%

OmniDrag: Enabling Motion Control for Omnidirectional Image-to-Video Generation

Weiqi Li, Shijie Zhao, Chong Mou, Xuhan Sheng, Zhenyu Zhang, Qian Wang, Junlin Li, Li Zhang, Jian Zhang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09160 2024-12-13 cs.CV 57%

Pinpoint Counterfactuals: Reducing social bias in foundation models via localized counterfactual generation

Kirill Sirotkin, Marcos Escudero-Viñolo, Pablo Carballeira, Mayug Maniparambil, Catarina Barata, Noel E. O'Connor

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01916 2024-12-13 cs.CV 57%

FastLGS: Speeding up Language Embedded Gaussians with Feature Grid Mapping

Yuzhou Ji, He Zhu, Junshu Tang, Wuyi Liu, Zhizhong Zhang, Xin Tan, Yuan Xie

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments This paper is accepted to AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16767 2024-12-11 cs.LG cs.CL cs.CV 57%

REBEL: Reinforcement Learning via Regressing Relative Rewards

Zhaolin Gao, Jonathan D. Chang, Wenhao Zhan, Owen Oertell, Gokul Swamy, Kianté Brantley, Thorsten Joachims, J. Andrew Bagnell, Jason D. Lee, Wen Sun

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments New experimental results on general chat

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06673 2024-12-10 cs.CV 57%

ILLUME: Illuminating Your LLMs to See, Draw, and Self-Enhance

Chunwei Wang, Guansong Lu, Junwei Yang, Runhui Huang, Jianhua Han, Lu Hou, Wei Zhang, Hang Xu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03520 2024-12-10 cs.CV 57%

Seeing Beyond Views: Multi-View Driving Scene Video Generation with Holistic Attention

Hannan Lu, Xiaohe Wu, Shudong Wang, Xiameng Qin, Xinyu Zhang, Junyu Han, Wangmeng Zuo, Ji Tao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09386 2024-12-10 cs.CV 57%

SimGen: Simulator-conditioned Driving Scene Generation

Yunsong Zhou, Michael Simon, Zhenghao Peng, Sicheng Mo, Hongzi Zhu, Minyi Guo, Bolei Zhou

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments arXiv admin note: text overlap with arXiv:2403.09630 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05630 2024-12-10 cs.CV 57%

Ctrl-V: Higher Fidelity Video Generation with Bounding-Box Controlled Object Motion

Ge Ya Luo, Zhi Hao Luo, Anthony Gosselin, Alexia Jolicoeur-Martineau, Christopher Pal

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03517 2024-12-09 cs.CV 57%

NVComposer: Boosting Generative Novel View Synthesis with Multiple Sparse and Unposed Images

Lingen Li, Zhaoyang Zhang, Yaowei Li, Jiale Xu, Wenbo Hu, Xiaoyu Li, Weihao Cheng, Jinwei Gu, Tianfan Xue, Ying Shan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://lg-li.github.io/project/nvcomposer

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03079 2024-12-06 cs.CV 57%

Align3R: Aligned Monocular Depth Estimation for Dynamic Videos

Jiahao Lu, Tianyu Huang, Peng Li, Zhiyang Dou, Cheng Lin, Zhiming Cui, Zhen Dong, Sai-Kit Yeung, Wenping Wang, Yuan Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://igl-hkust.github.io/Align3R.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07500 2024-12-06 cs.CV 57%

SPIN: Spacecraft Imagery for Navigation

Javier Montalvo, Juan Ignacio Bravo Pérez-Villar, Álvaro García-Martín, Pablo Carballeira, Jesús Bescós

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00754 2024-12-03 cs.CV cs.AI 57%

CtrlNeRF: The Generative Neural Radiation Fields for the Controllable Synthesis of High-fidelity 3D-Aware Images

Jian Liu, Zhen Yu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22059 2024-12-03 cs.RO cs.CV 57%

PACA: Perspective-Aware Cross-Attention Representation for Zero-Shot Scene Rearrangement

Shutong Jin, Ruiyu Wang, Kuangyi Chen, Florian T. Pokorny

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by WACV2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00397 2024-12-03 cs.CV 57%

DreamDance: Animating Human Images by Enriching 3D Geometry Cues from 2D Poses

Yatian Pang, Bin Zhu, Bin Lin, Mingzhe Zheng, Francis E. H. Tay, Ser-Nam Lim, Harry Yang, Li Yuan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏