arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-09-01 至 2026-09-01 共收录 7 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 7 篇

2608.31053 2026-09-01 cs.CV 新提交 77%

Identity-Conditioned Latent Consistency Distillation for Face Synthesis

用于人脸合成的身份条件潜在一致性蒸馏

Tiago Kienen Chaves, Bernardo Biesseck, David Menotti

机构 * Federal University of Paraná(巴拉那联邦大学) Federal Institute of Mato Grosso (IFMT)(马托格罗索联邦学院(IFMT))

专题命中 个性化与一致性 :text-to-image(abstract);diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 本研究针对扩散模型人脸合成计算成本高的问题,通过将Arc2Face知识蒸馏为潜在一致性模型,实现4.36倍加速且保持竞争力,相关方案已公开。

Comments Accepted for presentation at the 2026 Conference on Graphics, Patterns and Images (SIBGRAPI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10293 2026-09-01 math.NA 版本更新 71%

An improved estimate of the intermediate internal energy in the energy-consistent HLLD scheme

关于《HLL型MHD黎曼求解器中间状态的能量一致性》中HLLD型格式的数值扩散问题

Fan Zhang

专题命中 个性化与一致性 :diffusion(title)

AI总结 研究针对戴 - 伍德沃德激波管问题中HLLD-ec格式出现的密度振荡,提出对该格式的简单修改,核心方法是修改格式,主要贡献是消除了密度振荡。

Comments An error was found in the source code and thus the conclusion of this note is not fully valid

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23515 2026-09-01 cs.CV 版本更新 70%

FreeFuse: Multi-Subject LoRA Fusion via Adaptive Token-Level Routing at Test Time

FreeFuse: 通过测试时自适应的token级路由实现多主体LoRA融合

Yaoli Liu, Yao-Xiang Ding, Kun Zhou

机构 * State Key Laboratory of CAD&CG(计算机辅助设计与图形学国家重点实验室)

专题命中 个性化与一致性 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 FreeFuse通过测试时自适应token级路由实现多主体LoRA融合,无需额外训练或模型修改,仅需主体激活词即可实现无缝图像生成。

Comments Our code is available at this https URL (https://github.com/yaoliliu/FreeFuse)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01684 2026-09-01 cs.CV 版本更新 70%

DisCo3D: Distilling Multi-View Consistency for 3D Scene Editing

DisCo3D:用于3D场景编辑的多视图一致性蒸馏

Yufeng Chi, Huimin Ma, Kafeng Wang, Jianmin Li

机构 * Institute for Artificial Intelligence, Beijing National Research Center for Information Science and Technology, Department of Computer Science and Technology, Tsinghua University(人工智能研究院、北京信息科学与技术国家研究中心、计算机科学与技术系、清华大学) College of Computer, National University of Defense Technology(计算机学院、国防科技大学)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出DisCo3D框架,通过微调3D生成器、一致性蒸馏训练2D编辑器并结合Gaussian Splatting,实现了稳定的3D场景编辑多视图一致性,且编辑质量优于现有SOTA方法。

Comments 14 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29905 2026-09-01 cs.CV 新提交 57%

OrnaStyler: Ornament-Aware Latent Editing for Content-Preserving 3D Stylization

OrnaStyler:面向内容保留的3D风格化的感知装饰潜在编辑

Tomohiro Aizawa, Shigeru Kuriyama, Chunzhi Gu

机构 * University of Fukui(福井大学) Toyohashi University of Technology(丰桥技术科学大学) CyberAgent, Inc.(CyberAgent公司)

专题命中 个性化与一致性 :inpainting(abstract);分类 cs.CV

AI总结 OrnaStyler是一种零样本3D风格化框架,通过分阶段恢复几何与外观层面的潜在表示,实现文本引导下兼顾内容保留与风格表达的3D资产装饰编辑,性能优于现有方法

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01988 2026-09-01 cs.CV 版本更新 57%

Grounding and Explaining Visual Evidence for AI-Generated Image Detection in Human-Centric Scenes

面向以人为中心场景中AI生成图像检测的视觉证据定位与解释

Kun Guo, Yuzhou Yang, Haoyue Wang, Qichao Ying, Sheng Li, Zhenxing Qian

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

AI总结 针对以人为中心场景AI生成图像检测的证据定位与解释局限,提出HAVE数据集及PAVE框架,实现真伪预测、证据定位与解释生成,实验表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23295 2026-09-01 cs.CV 版本更新 57%

Mamba-driven MRI-to-CT Synthesis for MRI-only Radiotherapy Planning

基于Mamba的MRI到CT合成用于仅MRI的放疗计划

Konstantinos Barmpounakis, Theodoros P. Vagenas, Maria Vakalopoulou, George K. Matsopoulos

机构 * School of Electrical Computer Engineering, National Technical University of Athens Archimedes, Athena Research Center CentraleSup\'elec, University of Paris-Saclay

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

AI总结 本文提出基于Mamba架构的MRI到CT合成方法,以提高跨模态翻译的准确性与效率,通过3D Mamba架构捕捉复杂体积特征和长距离依赖,实现快速且精确的CT合成。

详情

展开后加载摘要…

URL PDF HTML 收藏