arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1887 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 49 篇

2505.17571 2026-08-25 cs.CL 版本更新 71%

Reasoning Meets Personalization: Unleashing the Potential of Large Reasoning Model for Personalized Generation

推理与个性化结合:释放大型推理模型在个性化生成中的潜力

Sichun Luo, Guanzhi Deng, Jian Xu, Zerui Yang, Xiaojie Zhang, Hanxu Hou, Linqi Song

机构 * Dongguan University of Technology(东莞理工大学) City University of Hong Kong(香港城市大学) Tsinghua University(清华大学) Guangzhou University(广州大学)

专题命中 个性化与一致性 :personalized generation(title)

AI总结 本研究针对大型推理模型在个性化任务中存在的局限,提出强化推理框架及相关机制,经实验验证其性能显著优于现有技术。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10293 2026-07-16 math.NA cs.NA 版本更新 71%

An improved estimate of the intermediate internal energy in the energy-consistent HLLD scheme

关于《HLL型MHD黎曼求解器中间状态的能量一致性》中HLLD型格式的数值扩散问题

Fan Zhang

专题命中 个性化与一致性 :diffusion(title)

AI总结 研究针对戴 - 伍德沃德激波管问题中HLLD-ec格式出现的密度振荡,提出对该格式的简单修改,核心方法是修改格式,主要贡献是消除了密度振荡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01973 2026-08-05 cs.CV 版本更新 70%

NearID: Identity Representation Learning via Near-identity Distractors

NearID: 通过近身份干扰实现身份表示学习

Aleksandar Cvejic, Rameen Abdal, Abdelrahman Eldesokey, Bernard Ghanem, Peter Wonka

机构 * King Abdullah University of Science and Technology (KAUST)(阿卜杜拉国王科技大学) Snap Research(Snap研究院)

专题命中 个性化与一致性 :image editing(abstract);personalized generation(abstract);分类 cs.CV

AI总结 本文提出NearID框架,通过近身份干扰消除背景影响,提升身份识别精度,改进模型在个性化生成和图像编辑任务中的表现。

Comments Accepted to ECCV 2026, Code, model, and dataset are released, visit https://github.com/Gorluxor/NearID

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26633 2026-07-23 cs.CV cs.AI 版本更新 70%

SynSur: An end-to-end generative pipeline for synthetic industrial surface defect generation and detection

SynSur:一种端到端的生成管道用于合成工业表面缺陷的生成与检测

Paul Julius Kühn, Mika Pommeranz, Arjan Kuijper, Saptarshi Neil Sinha

机构 * Fraunhofer IGD(弗劳恩霍夫工业驱动研究所)

专题命中 个性化与一致性 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出SynSur端到端生成管道,结合视觉-语言模型提示、LoRA适应扩散、掩码引导修复和样本筛选,通过合成数据缓解工业缺陷检测数据稀缺问题,并在跨领域迁移中验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22679 2026-06-23 cs.LG cs.CV 版本更新 70%

Stabilizing Consistency Training: A Flow Map Analysis and Self-Distillation

稳定一致性训练:流映射分析与自蒸馏

Youngjoong Kim, Duhoe Kim, Woosung Kim, Jaesik Park

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Seoul National University(首尔国立大学) Interdisciplinary Program in Artificial Intelligence(人工智能跨学科项目)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文从流映射角度分析一致性模型的不稳定性与退化解,提出基于自蒸馏的优化策略以避免梯度爆炸,并在图像生成和扩散策略学习中验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12583 2026-07-23 cs.DC 版本更新 67%

Scaling Synthetic-Image Pre-Training for Federated Fine-Tuning of Large Vision Models

扩展用于大型视觉模型联邦微调的合成图像预训练

Qianpiao Ma, Xiaozhu Song, Junlong Zhou, Yue Zeng, Jianchun Liu, Huaqing Tu

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract)

AI总结 研究针对联邦微调中资源限制、系统异构性和非IID数据等挑战,提出统一框架FeDiSyn。通过缩放定律、基于扩散的合成图像生成及贡献感知LoRA配置和带宽分配算法,减少训练时间和通信成本,提升训练和准确率。

Comments This paper has been accepted by International Conference on Parallel Processing (ICPP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09303 2026-06-24 cs.LG cs.NA math.NA 版本更新 67%

Stabilizing Physics-Informed Consistency Models via Structure-Preserving Training

通过保结构训练稳定物理信息一致性模型

Che-Chia Chang, Chen-Yang Dai, Te-Sheng Lin, Ming-Chih Lai, Chieh-Hsin Lai

机构 * Institute of Artificial Intelligence Innovation(人工智能创新研究所) National Yang Ming Chiao Tung University(国立阳明交通大学) Department of Applied Mathematics(应用数学系) National Center for Theoretical Sciences(理论科学研究中心) National Taiwan University(国立台湾大学)

专题命中 个性化与一致性 :diffusion(abstract);inpainting(abstract)

AI总结 提出物理信息一致性建模框架,通过保结构两阶段训练策略和两步残差目标,解决物理约束下一致性训练的不稳定性,实现快速、高保真的PDE求解。

Comments Accepted to KDD 2026

Journal ref Proceedings of the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining V.2 (KDD '26), August 09--13, 2026, Jeju Island, Republic of Korea

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23094 2026-08-11 cs.CV cs.GR cs.LG 版本更新 62%

FusionRelight: Relighting Portraits in Real Time via Hybrid Domain Knowledge Fusion

面向真实场景中人像重照明的混合领域知识融合

Qian Huang, Mayoore Selvarasa Jaiswal, Zhen Zhong, Rochelle Pereira, Jianyuan Min

机构 * NVIDIA

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV、cs.GR

AI总结 本文提出混合领域知识融合方法,通过融合合成、单光源和真实数据集的优势,提升人像重照明的实用性与效率,实现6至240倍的推理加速且保持SOTA视觉质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14486 2026-08-25 cs.CV 版本更新 57%

Reduce the Artifacts Bias for More Generalizable AI-Generated Image Detection

降低艺术偏差以提高通用性的人工智能生成图像检测

Yiheng Li, Yang Yang, Wenhao Wang, Zichang Tan, Zecheng Lin, Li Gao, Zhen Lei

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS部门) Sangfor Technologies Inc.(Sangfor技术公司) China Mobile Financial Technology Co., Ltd.(中国移动金融科技有限公司) CAIR, HKSIS, Chinese Academy of Sciences(中国科学院CAIR、HKSIS部门) SCSE, FIE, M.U.S.T, Macau, China(澳门SCSE、FIE、M.U.S.T部门) Vast Intelligence Lab, Sydney, Australia(悉尼澳大利亚Vast Intelligence Lab)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出SEF框架,通过分离专家融合减少领域干扰,提升AI生成图像检测的通用性与鲁棒性,实验表明在13个基准上表现优异。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13971 2026-08-24 cs.CV 版本更新 57%

Prompt2Effect: Training-Free Image-to-Video Model Specialization via LoRA Generation

Prompt2Effect: 通过LoRA生成实现免训练图像到视频模型特化

Xiaomeng Yang, Yanyu Li, Gordon Guocheng Qian, Ivan Skorokhodov, Viacheslav Ivanov, Avalon Vinella, Xuan Zhang, Yanzhi Wang, Sergey Tulyakov, Anil Kag

机构 * Northeastern University(东北大学) Snap Inc.(Snap公司)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 提出Prompt2Effect,一种权重驱动超网络,通过单次前向传播直接合成效果特定的LoRA权重,无需训练,在保持视频质量的同时将计算成本从56 GPU小时降至3.3秒。

Comments Accepted to ECCV 2026, project page: https://xiaomeng-yang.github.io/Prompt2Effect

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16114 2026-08-18 cs.CV 版本更新 57%

Towards In-Context Tone Style Transfer with A Large-Scale Triplet Dataset

面向大规模三元数据集的上下文内调色风格迁移

Yuhai Deng, Huimin She, Wei Shen, Meng Li, Ruoxi Wu, Lunxi Yuan, Xiang Li

机构 * VCIP, School of Computer Science, Nankai University(VCIP,计算机科学学院,南开大学) Nankai International Advanced Research Institute (Shenzhen Futian)(南开国际先进研究院(深圳福田)) OPPO AI Center, OPPO Inc.(OPPO AI中心,OPPO公司)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出ICTone框架,通过上下文内联合条件生成实现调色风格迁移,利用生成模型语义先验提升风格一致性和视觉质量。

Comments ECCV2026, https://dengyuhai.github.io/ICTone_Project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07546 2026-08-18 cs.CV 版本更新 57%

PickStyle: Video-to-Video Style Transfer with Context-Style Adapters

PickStyle:基于上下文-风格适配器的视频到视频风格迁移

Soroush Mehraban, Vida Adeli, Jacob Rommann, Kyryl Truskovskyi, Harrison Sanborn, Babak Taati, Cole Clifford

机构 * Pickford AI University of Toronto(多伦多大学) Vector Institute(向量研究所)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 PickStyle是一种视频到视频风格迁移框架,通过在预训练视频扩散骨干中插入低秩适配器、构建合成训练片段并提出CS-CFG,实现了优于现有基线的视频风格迁移效果。

Comments Accepted to the European Conference on Computer Vision (ECCV) 2026 Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11752 2026-08-14 cs.CV cs.SD 版本更新 57%

UniSwap: Streaming Audio-Visual Identity Swapping for Talking Videos

UniSwap:用于说话视频的流音频-视觉身份交换

Yuxuan Zhang, Haozhong Xiong, Jiayi Song, Jinpeng Yu, Yang Shi, Jiaming Liu, Ruihua Huang, Liwei Wang

机构 * The Chinese University of Hong Kong(香港中文大学) Qwen Applications Business Group of Alibaba(阿里巴巴通义千问应用业务集团)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 UniSwap是首个流音频-视觉身份替换框架,通过多阶段适配技术解决现有方法音视频一致性差等问题,实现高效稳定的说话视频身份替换。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06009 2026-08-11 cs.CV 版本更新 57%

Wan-Animate-2: Pushing the Application Boundaries of Character Animation

Wan-Animate-2:拓展角色动画的应用边界

Guangyuan Wang, Li Hu, Dechao Meng, Zhongyi Zhang, Peng Zhang, Xindi Zhang, Mingyang Huang, Ruoshi Zhang, Ke Sun, Zhe Zhang, Xingjun Wang, Gang Cheng, Hai Xu, Bang Zhang

机构 * Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出Wan-Animate-2角色动画框架,通过消除中间运动提取器提升动画保真度,新增文本驱动视角控制,推出实时高效变体Wan-Animate-2-Lite,将发布其基础模型权重。

Comments Project page: https://humanaigc.github.io/wan-animate-2/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21138 2026-08-07 cs.CV 版本更新 57%

SEED: Simple ViT and Evolving Harness for Explainable Text Forgery Detection

SEED: 用于可解释文本伪造检测的简单ViT与演化框架

Kahim Wong, Kemou Li, Yiming Chen, Haiwei Wu, Jiantao Zhou

机构 * State Key Laboratory of Internet of Things for Smart City, Department of Computer and Information Science, University of Macau(澳门大学计算机与信息科学系智慧城市物联网国家重点实验室) School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院)

专题命中 个性化与一致性 :image editing(abstract);分类 cs.CV

AI总结 提出SEED系统,结合相似性引导数据增强、单一ViT联合检测与定位、以及基于MLLM的演化报告生成,在ACM MM 2026文本伪造挑战赛中获得第三名。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17020 2026-08-04 cs.CV cs.AI 版本更新 57%

FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning

FusionRS: 用于双模态视觉-语言基础模型的大规模RGB-红外遥感数据集

Jiaju Han, Ben Zhang, Xuemeng Sun, Qike Zhang, Yuxian Dong, Dingyi Lu, Chengyin Hu, Luwei Yang, Fengyu Zhang, Yiwei Wei, Jiujiang Guo

机构 * China University of Petroleum-Beijing at Karamay(中国石油大学(北京)克拉玛依校区) University of Electronic Science and Technology of China(电子科技大学) Tianjin University(天津大学)

专题命中 个性化与一致性 :generative vision(abstract);分类 cs.CV

AI总结 针对遥感视觉-语言模型缺乏红外数据的问题,提出首个大规模RGB-红外-文本数据集FusionRS,通过翻译RGB图像为红外风格并配以红外感知描述,训练双模态基础模型,提升RGB-红外对齐和双模态字幕生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26976 2026-08-03 cs.CR cs.CV 版本更新 57%

InkShield: Writing Style Protection Against Unauthorized Handwriting Mimicry

InkShield:抵御未授权笔迹模仿的书写风格保护

Jian Xiong, Wenbo Jiang, Zihan Wang, Rui Zhang, Wenshu Fan, Hongwei Li, Guowen Xu

专题命中 个性化与一致性 :image editing(abstract);分类 cs.CV

AI总结 InkShield是一种主动书写风格防御方案,通过限制扰动在墨迹笔画边缘保护手写参考图像,可降低未授权笔迹模仿的检索率,且视觉质量与可读性良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07861 2026-07-31 cs.CV 版本更新 57%

From Synthetic to Real: Toward Identity-Consistent Makeup Transfer with Synthetic and Real Data

从合成到真实:迈向身份一致的化妆转移的合成与真实数据

Yue Yu, Jiayu Wang, Jiajia Shi, Zhiyu Tan, Hao Li, Jingjing Chen

机构 * College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究院)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出ConsistentBeauty和RealBeauty方法,通过合成数据筛选和强化学习提升化妆转移的逼真度与身份一致性,并建立多样化基准测试以评估模型在复杂真实场景中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13349 2026-07-31 cs.CV cs.AI 版本更新 57%

ID-Guard: A Universal Framework for Combating Facial Manipulation via Breaking Identification

ID-Guard:一种通过破坏身份特征来对抗面部操纵的通用框架

Zuomin Qu, Wei Lu, Xiangyang Luo, Qian Wang, Xiaochun Cao

专题命中 个性化与一致性 :inpainting(abstract);分类 cs.CV

AI总结 本研究针对面部操纵滥用的问题,提出ID-Guard通用框架,通过身份破坏模块生成跨模型可迁移扰动,可防御多种操纵模型并集成到其他任务中。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23023 2026-07-29 cs.CV 版本更新 57%

OmniMate: Open-Ended Real-Time Streaming Audio-Visual Generation for Interactive Avatars

OmniMate:用于交互式虚拟化身的开放式实时流视听生成

Quanyue Song, Yishan He, Yanbo Ding, Zhixiang He, Yongxiang Li, Caigui Jiang, Zhi Zhi Guo

机构 * China Telecom Artificial Intelligence Technology (Beijing) Co., Ltd.(中国电信人工智能技术(北京)有限公司)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 研究针对实时交互式流中生成范围未知和跨模态身份一致性退化的挑战,提出OmniMate框架,通过生成进度控制器和多参考条件模块,实现高质量、低延迟的开放式实时交互式视听虚拟化身生成及长期跨模态身份一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20233 2026-07-29 cs.CV 版本更新 57%

Cinematic Compositing Using Character-Environment-Harmonized Video Generation Models

使用角色-环境协调视频生成模型的电影级合成

Tianyi Xiang, Mingming He, Li Ma, Jing Liao

机构 * City University of Hong Kong(香港城市大学) Independent Researcher(独立研究员)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 提出端到端视频扩散框架,通过三掩码引导和RGB-D联合去噪建模角色与环境的双向物理与光照交互,实现高质量动态视频合成。

Comments Project Page: https://cehcomposition.github.io/demo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22098 2026-07-17 cs.CV 版本更新 57%

WorldWander: Bridging Egocentric and Exocentric Worlds in Video Generation

WorldWander:在视频生成中连接自我中心和外中心世界

Quanjian Song, Yiren Song, Kelly Peng, Yuan Gao, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 研究聚焦视频生成中自我中心与外中心世界转换,提出WorldWander框架,基于视频扩散变换器,整合上下文视角对齐与协作位置编码,精心策划数据集,实验证明该框架在视角同步、角色一致性和泛化能力上表现卓越,设定了新基准。

Comments Accepted by ECCV 2026; Code: https://github.com/showlab/WorldWander

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12752 2026-07-16 cs.CV cs.AI 版本更新 57%

Hallo4D: Multi-Modal Hallucination Mitigation for Consistent Spatio-Temporal Generation

Hallo4D:用于一致时空生成的多模态幻觉缓解

Hongbo Wang, Huaibo Huang, Jie Cao, Jin Liu, Haoyang Tong, Ran He

机构 * Institute of Automation, Chinese Academy of Science(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Shanghaitech University(上海科技大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 研究针对3D和4D内容生成中的时空幻觉问题,提出Hallo4D框架,利用多模态语言模型,通过生成-检测-校正范式及多种技术提升一致性,实验证明其在多样生成设置下优于基线,提供了可扩展通用的一致性感知内容生成方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06280 2026-07-14 cs.CV 版本更新 57%

Eulerian Motion Guidance: Robust Image Animation via Bidirectional Geometric Consistency

欧拉运动引导:基于双向几何一致性的鲁棒图像动画

Thong Nguyen, Khoi M. Le, Cong-Duy Nguyen, Luu Anh Tuan, See-Kiong Ng, Chunyan Miao

机构 * National University of Singapore(新加坡国立大学) Centre for AI Research, VinUniversity(Vin大学人工智能研究中心) Nanyang Technological University(南洋理工大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 提出使用相邻帧欧拉运动场引导生成,并通过双向几何一致性机制解决遮挡问题,实现加速训练、保持时间连贯性和减少动态伪影。

Comments Accepted by ACM MM 2026. Code is available at https://github.com/nguyentthong/eulerian_motion_guidance

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09030 2026-07-07 cs.CV cs.LG 版本更新 57%

When Style Similarity Scores Fail: Diagnosing Raw CSD Cosine in Artist-Style Evaluation

当风格相似性评分失效时:诊断原始CSD余弦在艺术家风格评估中的问题

Jörg Frochte

机构 * Bochum University of Applied Sciences(博湖应用科学大学)

专题命中 个性化与一致性 :text-to-image(abstract);分类 cs.CV

AI总结 本文提出一种诊断方法,用于检验对比风格描述符(CSD)的原始余弦是否能作为绝对风格保真度评分。通过实验发现,CSD+方法在不同模型上均能有效减少负差距,提升评估准确性。

Comments 24 pages, 7 figures, 19 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08572 2026-07-07 cs.CV 版本更新 57%

ECTraj: Enhanced Consistency Training for Multi-Agent Trajectory Prediction

增强多智能体轨迹预测的一致性模型

Alen Mrdovic, Qingze, Liu, Danrui Li, Mathew Schwartz, Kaidong Hu, Sejong Yoon, Mubbasir Kapadia, Vladimir Pavlovic

机构 * Rutgers University - New Brunswick(罗格斯大学-新不伦瑞克分校) New Jersey Institute of Technology(新泽西理工学院) The College of New Jersey(新泽西学院)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出ECTraj,通过改进训练和条件生成方法,提升多智能体轨迹预测的一致性模型性能,实现更快推理和更准确预测,建立新的基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02208 2026-07-07 eess.IV cs.CV cs.LG 版本更新 57%

MACS: Measurement-Aware Consistency Sampling for Inverse Problems

MACS:用于逆问题的测量感知一致性采样

Amirreza Tanevardi, Pooria Abbas Rad Moghadam, Seyed Mohammad Eshtehardian, Sajjad Amini, Babak Khalaj

机构 * Department of Electrical Engineering(电气工程系) Sharif University of Technology(谢里夫大学) Electronics Research Institute(电子研究所)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 针对逆成像问题,改进一致性采样框架,利用测量一致性机制调控采样随机性,兼顾数据保真与计算效率,实验表明该方法在多指标上有提升,少量采样步就能实现有竞争力或更优的重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22411 2026-06-25 cs.CV 版本更新 57%

StyleFusion360: View-Consistent Head Stylization via Adaptive Style Modulation

StyleFusion360: 通过自适应风格调制实现视图一致的人头风格化

Furkan Guzelant, Arda Goktogan, Tarık Kaya, Aysegul Dundar

机构 * Bilkent University(比尔肯特大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 提出StyleFusion360,一种基于扩散的框架,通过自适应风格调制实现单风格参考图像的多视图一致、身份保持的3D人头风格化,无需逐风格训练,并支持强度控制和局部编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15287 2026-06-08 cs.CV 版本更新 57%

Consistency-Preserving Diverse Video Generation

保持一致性的多样化视频生成

Xinshuang Liu, Runfa Blark Li, Truong Nguyen

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 个性化与一致性 :image generation(abstract);分类 cs.CV

AI总结 提出一种联合采样框架,在保持时间一致性的同时提高文本到视频生成中批次内视频的多样性,通过轻量级潜在空间模型避免视频解码和反向传播。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05011 2026-08-24 q-fin.PR q-fin.MF q-fin.TR 版本更新 50%

Reaction-boundary variance and adjoint-consistent local-volatility projection

反应边界方差与伴随一致的局部波动率投影

Chris Angstmann, Tim Gebbie

专题命中 个性化与一致性 :diffusion(abstract)

AI总结 推导潜在订单簿反应边界的运行时间方差核,分离日历时间波动率模型中常合并的三个对象,给出确定性活动时钟的局部波动率投影,指出伴随一致性是对运行到日历时间投影的现实约束。

Comments 13 pages, 12 figures, 1 table; expanded reaction-boundary volatility-surface analysis, clarified adjoint-consistency and clock-projection conditions, and minor reference corrections; Code reproducibility see: https://github.com/timgebbie/reaction-boundary-vol-surface-reproducibility

详情

展开后加载摘要…

URL PDF HTML 收藏