arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-01-30 至 2026-01-30 共收录 7 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 7 篇

2601.21498 2026-01-30 cs.CV cs.AI 83%

SimGraph: A Unified Framework for Scene Graph-Based Image Generation and Editing

SimGraph:基于场景图的图像生成与编辑统一框架

Thanh-Nhan Vo, Trong-Thuan Nguyen, Tam V. Nguyen, Minh-Triet Tran

机构 * University of Science, VNU-HCM(越南国家大学胡志明市分校) Vietnam National University(越南国家大学) University of Dayton(戴维森大学)

专题命中 可控生成 :image generation(title,abstract);diffusion(abstract);分类 cs.CV

AI总结 SimGraph通过整合基于场景图的生成与编辑,实现了对物体关系和空间布局的精准控制,提升图像生成与编辑的一致性和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21633 2026-01-30 cs.CV 79%

A Tilted Seesaw: Revisiting Autoencoder Trade-off for Controllable Diffusion

倾斜的锯齿:重新审视自动编码器在可控扩散中的权衡

Pu Cao, Yiyang Ma, Feng Zhou, Xuedan Yin, Qing Song, Lu Yang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学)

专题命中 可控生成 :diffusion(title,abstract);分类 cs.CV

AI总结 本文研究了自动编码器在可控扩散中的权衡问题,发现gFID指标在可控性评估中表现不佳,而重建导向的指标更能反映可控性,提出了更可靠的评估方法。

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06279 2026-01-30 cs.CV cs.AI cs.GR cs.MA 62%

NoiseNCA: Noisy Seed Improves Spatio-Temporal Continuity of Neural Cellular Automata

NoiseNCA: 噪声种子提升神经细胞自动机的时空连续性

Ehsan Pajouheshgar, Yitao Xu, Sabine Süsstrunk

机构 * School of Computer and Communication Sciences, EPFL, Switzerland(计算机与通信科学学院,瑞士联邦理工学院)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 NoiseNCA通过引入噪声种子提升神经细胞自动机的时空连续性,实现对模式形成速度和尺度的连续控制,拓展了NCA在动态系统中的应用。

Comments 9 pages, 12 figures

Journal ref ALIFE 2024: Proceedings of the 2024 Artificial Life Conference July 22-26, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22522 2026-01-30 cs.LG cs.CV 57%

JointDiff: Bridging Continuous and Discrete in Multi-Agent Trajectory Generation

JointDiff: 在多智能体轨迹生成中弥合连续与离散

Guillem Capellera, Luis Ferraz, Antonio Rubio, Alexandre Alahi, Antonio Agudo

机构 * Kognia Sports Intelligence(Kognia体育智能) Visual Intelligence for Transportation, EPFL(交通视觉智能,EPFL) Institut de Robòtica i Informàtica Industrial, CSIC-UPC(机器人与信息工业研究所,CSIC-UPC)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 JointDiff通过联合生成连续和离散事件,提升多智能体轨迹生成的可控性和真实性。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21899 2026-01-30 cs.LG 50%

Breaking the Regional Barrier: Inductive Semantic Topology Learning for Worldwide Air Quality Forecasting

突破区域壁垒:为全球空气质量预测的归纳语义拓扑学习

Zhiqing Cui, Siru Zhong, Ming Jin, Shirui Pan, Qingsong Wen, Yuxuan Liang

机构 * The Hong Kong University of Science(香港科学与技术大学) Griffith University, Australia(格里菲斯大学)

专题命中 可控生成 :diffusion(abstract)

AI总结 OmniAir通过语义拓扑学习框架提升全球空气质量预测的泛化能力,实现高效准确的预测并弥补数据稀疏区域的监测缺口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16740 2026-01-30 cs.HC 50%

Evaluating Generative AI in the Lab: Methodological Challenges and Guidelines

在实验室中评估生成式AI:方法学挑战与指南

Hyerim Park, Khanh Huynh, Malin Eiband, Jeremy Dillmann, Sven Mayer, Michael Sedlmair

专题命中 可控生成 :image generation(abstract)

AI总结 本文探讨了在实验室环境中评估生成式AI的方法学挑战,提出了五个指南和十八项建议,以帮助研究人员设计更透明和稳健的评估研究。

Comments 18 pages, 3 figures, IUI '26 (the 31st International Conference on Intelligent User Interfaces)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03147 2026-01-30 cs.HC cs.CL cs.LG cs.SD eess.AS 50%

A conversational gesture synthesis system based on emotions and semantics

基于情感和语义的对话手势合成系统

Thanh Hoang-Minh

机构 * Department of Information Technology, VNUHCM -- University of Science(越南科学大学信息科技系)

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出DeepGesture,一种基于扩散的 gesture 合成系统,通过多模态信号生成具有情感和语义条件的手势,提升数字人类的自然表达能力。

详情

展开后加载摘要…

URL PDF HTML 收藏