arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-02-18 至 2026-02-18 共收录 5 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 5 篇

2509.23607 2026-02-18 cs.GR cs.CV 73%

ZeroScene: A Zero-Shot Framework for 3D Scene Generation from a Single Image and Controllable Texture Editing

ZeroScene: 一种基于单张图像的3D场景生成零样本框架及可控纹理编辑

Xiang Tang, Ruotong Li, Xiaopeng Fan

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Pengcheng Laboratory, China(鹏城实验室) Harbin Institute of Technology, China(哈尔滨工业大学) Harbin Institute of Technology, Suzhou Research Institute, China(哈尔滨工业大学苏州市研究院)

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV、cs.GR

AI总结 ZeroScene通过零样本方法实现单图像3D场景生成与可控纹理编辑,结合大视觉模型先验知识,提升场景连贯性和渲染真实感。

Comments 16 pages, 15 figures, Eurographics 2026, Project page: https://xdlbw.github.io/ZeroScene/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20367 2026-02-18 cs.GR cs.CV 62%

DreamAnywhere: Object-Centric Panoramic 3D Scene Generation

DreamAnywhere: 基于对象的全景3D场景生成

Edoardo Alberto Dominici, Jozef Hladky, Floor Verhoeven, Lukas Radl, Thomas Deixelberger, Stefan Ainetter, Philipp Drescher, Stefan Hauswiesner, Arno Coomans, Giacomo Nazzaro, Konstantinos Vardis, Markus Steinberger

机构 * Huawei Technologies(华为技术有限公司) Graz University of Technology(格拉茨技术大学)

专题命中 可控生成 :inpainting(abstract);分类 cs.CV、cs.GR

AI总结 DreamAnywhere通过模块化系统实现快速生成和原型设计3D场景,提升新视角合成的连贯性并实现高质量图像输出。

Comments WACV 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14841 2026-02-18 cs.GR cs.CV 62%

Towards Geometric and Textural Consistency 3D Scene Generation via Single Image-guided Model Generation and Layout Optimization

面向几何与纹理一致性的单图像引导模型生成与布局优化的3D场景生成

Xiang Tang, Ruotong Li, Xiaopeng Fan

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳分校) Peng Cheng Laboratory(鹏城实验室) Harbin Institute of Technology(哈尔滨工业大学) Harbin Institute of Technology, Suzhou Research Institute(哈尔滨工业大学苏州研究院)

专题命中 可控生成 :inpainting(abstract);分类 cs.CV、cs.GR

AI总结 本文提出一种三阶段框架,通过单图像引导的模型生成和空间布局优化,实现具有高几何准确性和纹理保真的3D场景生成。

Comments 14 pages, 9 figures, Project page: https://xdlbw.github.io/sing3d/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13159 2026-02-18 cs.CV 57%

Digital Twin Generation from Visual Data: A Survey

从视觉数据生成数字孪生:一项调查

Andrew Melnik, Benjamin Alt, Giang Nguyen, Artur Wilkowski, Maciej Stefańczyk, Qirui Wu, Sinan Harms, Helge Rhodin, Manolis Savva, Michael Beetz

机构 * University of Bremen(不莱梅大学) Warsaw University of Technology(华沙技术大学) Bielefeld University(比勒菲尔德大学) Simon Fraser University(西蒙弗雷泽大学)

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

AI总结 本文综述了从视觉数据生成数字孪生的最新方法,探讨了多种技术及其挑战,为实际应用提供了全面的视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15045 2026-02-18 cs.IT cs.LG math.IT 50%

VQ-DSC-R: Robust Vector Quantized-Enabled Digital Semantic Communication With OFDM Transmission

VQ-DSC-R:基于OFDM传输的鲁棒向量量化数字语义通信

Jianqiao Chen, Nan Ma, Xiaodong Xu, Tingting Zhu, Huishi Song, Chen Dong, Wenkai Liu, Rui Meng, Ping Zhang

机构 * ZGC Institute of Ubiquitous-X Innovation and Applications(ubiquitous-X 创新与应用研究所) Beijing Key Laboratory of 6G DOICT converged and Cloud-Native Mobile Information Networks(北京6G DOICT融合与云原生移动信息网络重点实验室) State Key Laboratory of Networking and Switching Technology(网络与交换技术国家重点实验室) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出VQ-DSC-R系统,通过Swin Transformer和ANDVQ方案实现鲁棒的语义通信,提升压缩比和实际性能。

详情

展开后加载摘要…

URL PDF HTML 收藏