arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4233 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4233 篇

2410.10815 2025-03-13 cs.CV cs.AI 57%

Depth Any Video with Scalable Synthetic Data

Honghui Yang, Di Huang, Wei Yin, Chunhua Shen, Haifeng Liu, Xiaofei He, Binbin Lin, Wanli Ouyang, Tong He

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://depthanyvideo.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10782 2025-03-13 cs.CV cs.HC 57%

3DArticCyclists: Generating Synthetic Articulated 8D Pose-Controllable Cyclist Data for Computer Vision Applications

Eduardo R. Corral-Soto, Yang Liu, Tongtong Cao, Yuan Ren, Liu Bingbing

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08663 2025-03-12 cs.RO cs.AI cs.CV cs.CY cs.HC 57%

Generating Robot Constitutions & Benchmarks for Semantic Safety

Pierre Sermanet, Anirudha Majumdar, Alex Irpan, Dmitry Kalashnikov, Vikas Sindhwani

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08168 2025-03-12 cs.CV 57%

TSCnet: A Text-driven Semantic-level Controllable Framework for Customized Low-Light Image Enhancement

Miao Zhang, Jun Yin, Pengyu Zeng, Yiqing Shen, Shuai Lu, Xueqian Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07152 2025-03-11 cs.CV 57%

Controllable 3D Outdoor Scene Generation via Scene Graphs

Yuheng Liu, Xinke Li, Yuning Zhang, Lu Qi, Xin Li, Wenping Wang, Chongshou Li, Xueting Li, Ming-Hsuan Yang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://yuheng.ink/project-page/control-3d-scene/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06660 2025-03-11 cs.CV 57%

AxisPose: Model-Free Matching-Free Single-Shot 6D Object Pose Estimation via Axis Generation

Yang Zou, Zhaoshuai Qi, Yating Liu, Zihao Xu, Weipeng Sun, Weiyi Liu, Xingyuan Li, Jiaqi Yang, Yanning Zhang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18150 2025-03-11 cs.CV 57%

Realistic Clothed Human and Object Joint Reconstruction from a Single Image

Ayushi Dutta, Marco Pesavento, Marco Volino, Adrian Hilton, Armin Mustafa

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11925 2025-03-11 cs.AI cs.CV cs.LG 57%

GRAPHGPT-O: Synergistic Multimodal Comprehension and Generation on Graphs

Yi Fang, Bowen Jin, Jiacheng Shen, Sirui Ding, Qiaoyu Tan, Jiawei Han

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06070 2025-03-11 cs.CV 57%

ControlNeXt: Powerful and Efficient Control for Image and Video Generation

Bohao Peng, Jian Wang, Yuechen Zhang, Wenbo Li, Ming-Chang Yang, Jiaya Jia

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments controllable generation

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04829 2025-03-10 cs.CV cs.AI 57%

StickMotion: Generating 3D Human Motions by Drawing a Stickman

Tao Wang, Zhihua Wu, Qiaozhi He, Jiaming Chu, Ling Qian, Yu Cheng, Junliang Xing, Jian Zhao, Lei Jin

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 11 pages, 5 figures, accepted by CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18335 2025-03-10 cs.RO cs.AI cs.CV 57%

FloNa: Floor Plan Guided Embodied Visual Navigation

Jiaxin Li, Weiqi Huang, Zan Wang, Wei Liang, Huijun Di, Feng Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04842 2025-03-07 cs.CV 57%

UniMLVG: Unified Framework for Multi-view Long Video Generation with Comprehensive Control Capabilities for Autonomous Driving

Rui Chen, Zehuan Wu, Yichen Liu, Yuxin Guo, Jingcheng Ni, Haifeng Xia, Siyu Xia

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05738 2025-03-06 cs.CV 57%

StdGEN: Semantic-Decomposed 3D Character Generation from Single Images

Yuze He, Yanning Zhou, Wang Zhao, Zhongkai Wu, Kaiwen Xiao, Wei Yang, Yong-Jin Liu, Xiao Han

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments CVPR 2025. 13 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02883 2025-03-05 cs.CV 57%

ARINAR: Bi-Level Autoregressive Feature-by-Feature Generative Models

Qinyu Zhao, Stephen Gould, Liang Zheng

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Technical report. Our code is available at https://github.com/Qinyu-Allen-Zhao/Arinar

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05470 2025-03-04 cs.CR cs.AI cs.CV 57%

Image Watermarks are Removable Using Controllable Regeneration from Clean Noise

Yepeng Liu, Yiren Song, Hai Ci, Yu Zhang, Haofan Wang, Mike Zheng Shou, Yuheng Bu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ICLR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02112 2025-03-04 cs.CV 57%

S-NeRF++: Autonomous Driving Simulation via Neural Reconstruction and Generation

Yurui Chen, Junge Zhang, Ziyang Xie, Wenye Li, Feihu Zhang, Jiachen Lu, Li Zhang

专题命中 可控生成 :image editing(abstract);分类 cs.CV

Comments IEEE TPAMI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03168 2025-03-03 cs.CV 57%

LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control

Jianzhu Guo, Dingyun Zhang, Xiaoqiang Liu, Zhizhou Zhong, Yuan Zhang, Pengfei Wan, Di Zhang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19868 2025-02-28 cs.CV 57%

C-Drag: Chain-of-Thought Driven Motion Controller for Video Generation

Yuhao Li, Mirana Claire Angel, Salman Khan, Yu Zhu, Jinqiu Sun, Yanning Zhang, Fahad Shahbaz Khan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04989 2025-02-26 cs.CV cs.LG 57%

SG-I2V: Self-Guided Trajectory Control in Image-to-Video Generation

Koichi Namekata, Sherwin Bahmani, Ziyi Wu, Yash Kant, Igor Gilitschenski, David B. Lindell

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ICLR 2025. Project page: https://kmcode1.github.io/Projects/SG-I2V/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09349 2025-02-26 cs.CV 57%

DisPose: Disentangling Pose Guidance for Controllable Human Image Animation

Hongxiang Li, Yaowei Li, Yuhang Yang, Junjie Cao, Zhihong Zhu, Xuxin Cheng, Long Chen

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10126 2025-02-26 cs.CV 57%

Training-free Camera Control for Video Generation

Chen Hou, Zhibo Chen

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17258 2025-02-25 cs.CV 57%

VideoGrain: Modulating Space-Time Attention for Multi-grained Video Editing

Xiangpeng Yang, Linchao Zhu, Hehe Fan, Yi Yang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ICLR 2025, code and demos are available at https://knightyxp.github.io/VideoGrain_project_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17056 2025-02-25 cs.CV 57%

SpecDM: Hyperspectral Dataset Synthesis with Pixel-level Semantic Annotations

Wendi Liu, Pei Yang, Wenhui Hong, Xiaoguang Mei, Jiayi Ma

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16475 2025-02-25 cs.CV cs.AI 57%

Dragen3D: Multiview Geometry Consistent 3D Gaussian Generation with Drag-Based Control

Jinbo Yan, Alan Zhao, Yixin Hu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02309 2025-02-25 cs.CV 57%

Decoupling Layout from Glyph in Online Chinese Handwriting Generation

Min-Si Ren, Yan-Ming Zhang, Yi Chen

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ICLR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06141 2025-02-25 cs.CV 57%

CHAMP: Conformalized 3D Human Multi-Hypothesis Pose Estimators

Harry Zhang, Luca Carlone

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13894 2025-02-20 cs.RO cs.CV 57%

NavigateDiff: Visual Predictors are Zero-Shot Navigation Assistants

Yiran Qin, Ao Sun, Yuze Hong, Benyou Wang, Ruimao Zhang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ICRA2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11642 2025-02-18 cs.CV 57%

GaussianMotion: End-to-End Learning of Animatable Gaussian Avatars with Pose Guidance from Text

Gyumin Shim, Sangmin Lee, Jaegul Choo

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10606 2025-02-18 cs.CV cs.RO 57%

HIPPo: Harnessing Image-to-3D Priors for Model-free Zero-shot 6D Pose Estimation

Yibo Liu, Zhaodong Jiang, Binbin Xu, Guile Wu, Yuan Ren, Tongtong Cao, Bingbing Liu, Rui Heng Yang, Amir Rasouli, Jinjun Shan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10444 2025-02-18 cs.CV 57%

A Survey of Representation Learning, Optimization Strategies, and Applications for Omnidirectional Vision

Hao Ai, Zidong Cao, Lin Wang

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 37 pages, 24 figures, accepted by IJCV

详情

展开后加载摘要…

URL PDF HTML 收藏