arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2025-10-15 至 2025-10-15 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 3 篇

2510.11738 2025-10-15 cs.SD cs.AI cs.CV cs.MM 73%

SeeingSounds: Learning Audio-to-Visual Alignment via Text

Simone Carnemolla, Matteo Pennisi, Chiara Russo, Simone Palazzo, Daniela Giordano, Concetto Spampinato

机构 * University of Catania(卡塔尼亚大学)

专题命中 可控生成 :image generation(abstract);diffusion(abstract);分类 cs.CV、cs.MM

Comments accepted to ACM Multimedia Asia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12069 2025-10-15 cs.CV 57%

VIDMP3: Video Editing by Representing Motion with Pose and Position Priors

Sandeep Mishra, Oindrila Saha, Alan C. Bovik

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06243 2025-10-15 math.OC math.PR 50%

Verification theorem related to a zero sum stochastic differential game, based on a chain rule for non-smooth functions

Carlo Ciccarella, Francesco Russo

专题命中 可控生成 :diffusion(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏