arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-28 至 2026-08-28 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 2 篇

2507.11515 2026-08-28 cs.LG cs.AI cs.CL 版本更新 78%

AirLLM: Diffusion Policy-based Adaptive LoRA for Remote Fine-Tuning of LLM over the Air

AirLLM:面向空中远程微调的基于扩散策略的自适应LoRA方法

Shiyi Yang, Xiaoxue Yu, Rongpeng Li, Jianhang Zhu, Zhifeng Zhao, Honggang Zhang

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) Zhejiang Lab(浙江实验室)

专题命中 个性化与一致性 :diffusion(title,abstract)

AI总结 AirLLM是一种分层扩散策略框架,通过PPO智能体与DDIM交替优化实现自适应LoRA秩配置,可提升LLM空中远程微调性能并降低传输成本。

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27280 2026-08-28 cs.CV 新提交 57%

Sidecar: Training-Free Semantic Reuse for Character-Consistent Free-form Visual Storytelling

Sidecar:用于保持角色一致性的自由形式视觉叙事的无需训练的语义复用

Sibo Dong, Sarah Adel Bargal

机构 * Georgetown University(乔治城大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 该研究针对自由形式视觉叙事中角色一致性难维持的问题,提出无需训练的即插即用语义增强模块Sidecar,可提升提示-图像对齐度与角色一致性,且计算开销小。

详情

展开后加载摘要…

URL PDF HTML 收藏