arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-31 至 2026-08-31 共收录 4 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4 篇

2608.27776 2026-08-31 math.OC math.NA 新提交 71%

Optimal control of fractional diffusion with Dirac measures

带有Dirac测度的分数阶扩散的最优控制

Enrique Otarola, Abner J. Salgado

专题命中 可控生成 :diffusion(title)

AI总结 针对带有谱分数阶拉普拉斯算子和Dirac测度线性组合的椭圆方程,研究其偏微分方程约束优化问题,证明最优解的存在唯一性,推导一阶最优性条件,提出有限元离散化方法并推导先验误差界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28082 2026-08-31 cs.CV 新提交 70%

Attribute Token Arithmetic: Disentangled and Continuous Semantic Control for Visual Autoregressive Models

属性标记算术:面向视觉自回归模型的解耦连续语义控制

Xindi Yang, Yicheng Wu, Cheng Zhang, Jianfei Cai, Tien-Tsin Wong

机构 * Monash University(莫纳什大学)

专题命中 可控生成 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文提出ATA方法,在预训练自回归隐空间中学习视觉属性语义方向,通过简单算术操作实现连续多属性调整,在可控性等指标上优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26971 2026-08-31 cs.CV cs.MM 版本更新 62%

TempJail: Temporal Jailbreak Attacks against Image-to-Video Generation Models

TempJail:针对图像到视频生成模型的时序越狱攻击

Qi Lu, Zehui Guo, David Yuanda Gan, Zijing Li, Hengda Zhang, Weijun Xu, Qiankun Zhang

机构 * School of Cyber Science and Engineering, Huazhong University of Science and Technology(华中科技大学网络空间科学与工程学院) School of Mathematical Sciences, Peking University(北京大学数学科学学院) School of Software and engineering, Huazhong University of Science and Technology(华中科技大学软件学院) School of Computer Science, Nanjing University(南京大学计算机学院)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV、cs.MM

AI总结 本文提出TempJail时序越狱框架,针对图像到视频生成模型的时序漏洞,通过分解恶意提示、受控潜在扰动等方式提升攻击成功率,在Kling等模型上获显著效果。

Comments Accepted by ACM Multimedia 2026 (ACM MM '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04438 2026-08-31 cs.CV cs.CL 版本更新 57%

The Telephone Game: Evaluating Semantic Drift in Unified Models

电话游戏:评估统一模型中的语义漂移

Sabbir Mollah, Rohit Gupta, Sirnam Swetha, Qingyang Liu, Ahnaf Munir, Mubarak Shah

机构 * Center For Research in Computer Vision, University of Central Florida, USA(计算机视觉研究中心,中央佛罗里达大学)

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

AI总结 该研究提出语义漂移协议(SDP)等方法,评估统一模型在交替执行图像-文本理解与生成时的语义漂移,发现现有孤立基准无法预测模型的多轮表现,为统一模型可靠性评估提供了更准确的方案。

详情

展开后加载摘要…

URL PDF HTML 收藏