arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-27 至 2026-08-27 共收录 67 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 2 篇

2608.25933 2026-08-27 cs.CV cs.AI 新提交 70%

When Composition Doesn't Add Up: Humans Identifying Defects in AI-Generated Images

当组合失效时:人类识别AI生成图像中的缺陷

Ruoqi Hu, Chulin Zhao, Jiashuo Chang, Ramon Ruiz-Dolz, Hanhe Lin

机构 * Dundee International Institute of Central South University(中南大学邓迪国际学院) Central South University(中南大学) Faculty of Science, Engineering and Business, University of Dundee(邓迪大学科学、工程与商学院) University of Dundee(邓迪大学)

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 本文探究人类识别T2I模型生成图像组合缺陷的方法,构建CO-AID数据集,训练深度模型可预测并优化AI图像生成,验证了其可用性与有效性。

Comments 6 pages, accepted at IEEE MMSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25192 2026-08-27 cs.RO 新提交 50%

CRESSim-Neo: A Batched GPU Simulation Engine for Surgical Robotics and Robot Learning

CRESSim-Neo:面向外科机器人与机器人学习的批量GPU仿真引擎

Yafei Ou, Ahnaf Naheen, Tleukhan Mussin, Hans Jarales, Melwin Moncy, Mahdi Tavakoli

机构 * University of Alberta(阿尔伯塔大学)

专题命中 文生图 :image synthesis(abstract)

AI总结 本文推出CRESSim-Neo,一款面向外科机器人与机器人学习的批量GPU仿真引擎,支持多类外科相关仿真任务,在RTX 4090上实现高并行环境步性能,为相关研究提供统一可扩展平台。

Comments 8 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 图像编辑 2 篇

2608.26101 2026-08-27 cs.CV 新提交 57%

RefVideo-6M: A Reliable Reference-Based Dataset for Instructional Video Editing

RefVideo-6M:一个用于教学视频编辑的可靠基于参考的数据集

Bojia Zi, Xiaoyan Yang, Yu Zhou, Ruijie Sun, Lihan Zhang, Bin Liang, Kam-Fai Wong, Haibin Huang, Chi Zhang, Xuelong Li

机构 * Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院(TeleAI)) The Chinese University of Hong Kong (CUHK)(香港中文大学) Sun Yat-sen University(中山大学) Fudan University(复旦大学) Tsinghua University(清华大学)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

AI总结 本文针对现有视频编辑数据集的局限,构建含600万样本的RefVideo-6M参考引导编辑数据集,训练Ref-MoT模型,实验证明其监督更可靠,可提升编辑模型的视觉质量、可控性与参考一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18227 2026-08-27 cs.CV 版本更新 57%

FlowMimic: Mask-free Visual Editing and Generation with Pixel-pair Warped Flow Field for Online Video Editing Data Generation and Modality Mimicry

FlowMimic:基于像素对扭曲流场的无掩码视觉编辑与生成,用于在线视频编辑数据生成及模态模仿

Dingyun Zhang, Lixue Gong, Wei Liu

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

AI总结 研究探索在单一模型中整合视频和图像模态的生成与编辑能力,开发像素对时间扭曲流场实时生成视频编辑样本,设计模态模仿损失对齐模态能力,引入相关任务及损失让模型内化基于语言的视觉编辑能力。

Comments Due to file size constraints, the figures in the arXiv file have been heavily lossy-compressed. Please visit the uncompressed file at: this https URL (https://huggingface.co/datasets/FlowMimic/Uncompressed/blob/main/main.pdf)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 扩散模型 43 篇

2608.25380 2026-08-27 cs.AR 新提交 82%

APT: Accelerating Diffusion Transformers via Attention Probability-Guided Pruning and Quantization

APT:基于注意力概率引导剪枝与量化的扩散Transformer加速方案

Sungyeob Yoo, Seeyeon Kim, Joonyong Park, Seunghee Han, Joo-Young Kim

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文提出软硬件协同设计的APT加速器,通过APDT与TAFA优化DiTs的自注意力计算,在多款SOTA DiT模型上实现显著加速与能效提升。

Comments 9 pages, 17 figures, 3 tables. Accepted to the IEEE/ACM International Conference on Computer-Aided Design (ICCAD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25998 2026-08-27 cs.CV 新提交 79%

Uncertainty-Guided Latent Diffusion Models for Faithful Super Resolution

用于忠实超分辨率的不确定性引导潜在扩散模型

Ren Wang, Yung-Yu Chuang

机构 * National Taiwan University(国立台湾大学) NTU AI-CoRE(台大AI核心研究中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 针对单图像超分辨率的感知-失真权衡问题,提出新型UGDiff不确定性引导潜在扩散模型,通过结合重建不确定性与扩散采样器后验方差引导采样,实现更优的感知-失真平衡,性能优于现有同类方法。

Comments ICIP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25693 2026-08-27 cs.CV cs.AI cs.LG 新提交 79%

Unsupervised Anatomical Feature Learning via Diffusion Models: Enhanced Medical Image Segmentation with Denoising Diffusion Probabilistic Models

基于扩散模型的无监督解剖特征学习:用去噪扩散概率模型增强医学图像分割

Akshat G, Divyansh Gupta, Shaleen Bhatnagar, Shilpa Ankalaki, Tusar Kanti Mishra

机构 * Manipal Institute of Technology Bengaluru, Manipal Academy of Higher Education(马尼帕尔理工学院班加罗尔分校,马尼帕尔高等教育学院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 该研究提出用无监督DDPM预训练提取解剖特征,将编码器权重迁移至U-Net实现医学图像分割,在BTCV数据集上显著提升多器官分割性能,低数据场景下仍保持稳健表现。

Comments 15 pages, 5 figures. Submitted for peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25675 2026-08-27 cs.CV 新提交 79%

Deep Learning Segmentation of Diffusion-Weighted MRI Acute Ischaemic Stroke: A Pragmatic Evaluation Across Three Datasets

扩散加权MRI急性缺血性脑卒中的深度学习分割:跨三个数据集的实用评估

Atle Bjørnerud, Till Schellhorn, Thor H. Skattør, Terje Nome, Jon André Ottesen, Anne Hege Aamodt, Bradley J MacIntosh

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 本研究训练nnU-Net模型,对比不同输入配置与架构,发现仅用DWI训练的基线nnU-Net可快速准确分割急性缺血性脑卒中病灶,性能优于DeepISLES,或可支持临床工作。

Comments 19 pages, 8 figure and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25652 2026-08-27 cs.CV 新提交 79%

Diffusion Transformers for Roof Graph Synthesis and Reconstruction

用于屋顶图合成与重建的扩散Transformer

Daniel Panangian, Ksenia Bittner

机构 * The Remote Sensing Technology Institute(遥感技术研究所) German Aerospace Center (DLR)(德国航空航天中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出RoofDiT框架,以扩散Transformer和边预测模块为核心,结合几何感知注意力与多条件信号,在屋顶图合成与重建任务中取得优于基线的性能。

Comments Pre-review manuscript. Accepted at the ICPR 2026 Workshop on Pattern Recognition in Remote Sensing (PRRS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25858 2026-08-27 cs.CV cs.LG physics.ao-ph 新提交 79%

Precipitation Downscaling Using Foundation Model-Conditioned Diffusion

基于基础模型条件扩散的降水降尺度方法

Victor Nascimento Ribeiro, Jorge Guevara, Jorge Sebastian Moraga, Chris Lucas, Natalie Lord, Andrew Taylor, Edward Lockhart, Will Trojak, Johannes Schmude, Anne Jones

机构 * IBM Research(IBM研究院) Fathom STFC Hartree Centre(STFC哈特雷中心)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 该研究针对降水降尺度问题,探究三种扩散模型条件策略,发现交叉注意力条件优于通道拼接,且Prithvi WxC基础模型在数据有限场景下性能良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20818 2026-08-27 cs.LG cs.AI cs.CV 版本更新 79%

Scaling Muon for Diffusion Transformers

针对扩散Transformer的Muon优化器的缩放研究

Chenghao Li, Xiao Han, Xinxin Huang, Wei Liu, Boyang Li, Bing Xiao, Heran Zhang, Juanma Perez Rua, Ke Xu, Kangning Liu, Linjun Kuang, Na Li, Tan Wang, Tian Xie, Wei Peng, Yang Pei, Yifan Xu, Yuanhao Zhai, Yuwei Lin, Zhe Wang, Zihao He, Daniel Li, Junbiao Tang, Ziyang Jiang, Dake Chen

机构 * University of Southern California(南加州大学) Meta

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 该研究针对大型扩散Transformer的Muon优化器,提出周期性行级Muon,在保留其生成质量优势的同时,大幅降低训练的计算、通信开销与时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03539 2026-08-27 cs.CV 版本更新 79%

IRIS: Visual-Semantic Binding for Forgery-Resistant Watermarking of Diffusion Images

IRIS:用于扩散图像防伪造水印的视觉-语义绑定

Xiaoyan Feng, Zheng Gao, Tong Guan, Rui Bao, Bokang Zeng, Xiaoyu Li, Jiaojiao Jiang

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 IRIS是一种无需训练的扩散图像防伪造水印方案,通过视觉-语义绑定抵御固定图案移植与事后再生剥离,在三个提示数据集上检测可靠且保真度优异。

Comments Substantial revisions

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17415 2026-08-27 cs.LG cs.AI cs.CV 版本更新 79%

Reward Score Matching: Unifying Reward-based Fine-tuning for Flow and Diffusion Models

奖励分数匹配:统一流模型和扩散模型的基于奖励的微调

Jeongjae Lee, Jinho Chang, Jeongsol Kim, Jong Chul Ye

机构 * Graduate School of AI, KAIST, Korea(人工智能研究生院,韩国科学技术院)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 提出奖励分数匹配(RSM)框架,统一了多种基于奖励的微调方法,通过分数匹配与值引导目标对齐,简化了设计空间并提高了效率。

Comments 50 pages, 15 figures. Best Paper Award at SPIGM workshop, ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16296 2026-08-27 cs.CV cs.AI cs.LG 版本更新 79%

Memory-V2V: Memory-Augmented Video-to-Video Diffusion for Consistent Multi-Turn Editing

Memory-V2V: 通过记忆增强的视频到视频扩散模型实现一致的多轮编辑

Dohun Lee, Chun-Hao Paul Huang, Xuelin Chen, Jong Chul Ye, Duygu Ceylan, Hyeonho Jeong

机构 * Adobe Research(Adobe研究实验室) KAIST AI(韩国科学技术院人工智能研究所) Adobe Internship(Adobe实习) Project Lead(项目负责人)

专题命中 扩散模型 :diffusion(title,abstract);分类 cs.CV

AI总结 Memory-V2V通过引入外部记忆模块,解决多轮视频编辑中的跨轮一致性问题,提升编辑连贯性并保持视觉质量,优于现有基线模型。

Comments 38 pages, 22 figures, ECCV 2026, Project page: this https URL (https://dohunlee1.github.io/MemoryV2V)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25443 2026-08-27 cs.LG 新提交 78%

Joint Initialization of Flux Networks and Effective Multiplication Factor for Physics-Informed Neural Networks Solving Neutron Diffusion Problems

求解中子扩散问题的物理信息神经网络的通量网络与有效倍增因子的联合初始化

Qin Hang, Yangdi Yi, Jiayi Li, Xu Wang, Heng Zhang

机构 * School of Computer Science and Technology, Chongqing University of Posts and Telecommunications(重庆邮电大学计算机科学与技术学院) Center for Scientific Intelligence Innovation, University of Science and Technology of China(中国科学技术大学科学智能创新中心) Institute of Advanced Technology, University of Science and Technology of China(中国科学技术大学先进技术研究院)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对PINNs求解中子扩散K本征值问题效率不足的问题,提出JI-PINN方法,通过联合初始化通量网络参数与keff,在多测试案例上实现计算时间显著减少且精度相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25428 2026-08-27 cs.CL cs.AI 新提交 78%

DCGC: Draft-Conditioned Global Correction for Complex Reasoning with Masked Diffusion Models

DCGC:基于草稿条件的全局修正,用于带掩码扩散模型的复杂推理

Minhae Oh, Nakyung Lee, Jungwoo Lee

机构 * Seoul National University(首尔大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 DCGC是结合SFT与动态双CFG机制的MDM框架,用于修正LLMs推理错误,在多推理基准中优于现有方法,可作为无验证器的全局修正模块。

Comments 21 pages, 3 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25311 2026-08-27 cs.LG 新提交 78%

Prefix-Denoising Consistency: Test-Time Verification for Diffusion Language Models

前缀去噪一致性:扩散语言模型的测试时验证方法

Yuki Ichihara, Naoto Iwase, Mohammad Atif Quamar, Junpei Komiyama

机构 * MBZUAI(穆罕默德·本·扎耶德人工智能大学) Nagoya University(名古屋大学) RIKEN AIP(理化学研究所人工智能项目)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究针对扩散语言模型提出测试时自验证方法PDC,通过前缀条件再生的轨迹稳定性差异修正初始生成样本,在两类推理基准中提升性能且具鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25223 2026-08-27 q-fin.MF math.PR 新提交 78%

On the hedging problem in general 1D diffusion markets

一般一维扩散市场中的对冲问题

Alexis Anagnostakis, David Criens, Mikhail Urusov

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对一般一维扩散市场的欧式或有债权,提出基于PDE的自融资对冲策略,推导最小对冲资本的充要条件,通过数值实验验证方法的有效性与局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25672 2026-08-27 math.AP 新提交 78%

The high dimensional monostable reaction-diffusion equation with free boundary and radial symmetry

具自由边界与径向对称性的高维单稳反应-扩散方程

Hongkai Cao, Jingyi Cui, Chengzhe Tang, Xiaoyan Zhang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本文研究具自由边界的高维径向对称单稳反应-扩散方程,建立含扩散、过渡、消失的三分法,证明扩散情形解收敛并揭示对数偏移,关联对应 Cauchy 问题的扩散行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25454 2026-08-27 physics.flu-dyn 新提交 78%

Physics-Guided Generative Surrogates for Parametric Rarefied Flows with Neural-Field Auto-Decoders: A Pipeline-Level Study of Flow Matching and Diffusion

基于神经场自动解码器的参数化稀薄流动的物理引导生成代理:流匹配与扩散的管道级研究

Yiming Qi, Guan Zhang, Xu Wang, Yonghao Zhang, Tianbai Xiao

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究提出一种物理引导的条件隐式生成框架,以神经场自动解码器为核心,通过流匹配与扩散技术实现参数化稀薄流动的高效代理建模,在稳态基准测试中表现出高精度,且具备向多值或随机解扩展的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26096 2026-08-27 gr-qc quant-ph 新提交 78%

Torsion balances as operational probes of semiclassical gravity: Matched-filter bounds, torque-diffusion constraints, and quantum-noise benchmarks

扭秤作为半经典引力的运作探针:匹配滤波界限、扭矩扩散约束与量子噪声基准

Jyotirmaya Mohanta, Yutaka Shikano

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 该研究以扭秤为探针,推导了半经典引力的匹配滤波界限、扭矩扩散约束等,通过室温卡文迪什基准及 Yan 等人的实验数据给出相关噪声与系数的保守界限,搭建了扭秤数据与半经典引力搜索的连接接口。

Comments 16 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23798 2026-08-27 cs.LG 版本更新 78%

A Theory of Speciation in Generative Diffusion Models on Compact Riemannian Manifolds

紧致黎曼流形上生成式扩散模型的物种形成理论

Alessio Marta, Paola Causin

机构 * University of Milan(米兰大学)

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 本研究建立紧致黎曼流形上生成式扩散模型的物种形成内蕴理论,刻画其分岔机制,推导相关估计与稳定性结论,经球面实验及神经网络学习方案验证。

Comments 48 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25924 2026-08-27 eess.IV physics.optics 版本更新 78%

Improving Richardson--Lucy Deconvolution with Diffusion Priors for Fluorescence Microscopy

利用扩散先验改进荧光显微镜的Richardson-Lucy反卷积

Hao Chen, Scott S. Howard

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 针对荧光显微镜反卷积的ill-posed问题,提出将基于分数的扩散先验集成到Richardson-Lucy迭代框架中,在保持泊松数据一致性的同时抑制噪声放大,改善低光子计数下弱丝状和点状结构的重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21450 2026-08-27 cs.CE q-bio.BM 版本更新 78%

CMADiff: Cross-Modal Aligned Diffusion for Controllable Protein Generation

CMADiff: 用于可控蛋白质生成的跨模态对齐扩散

Changjian Zhou, Yuexi Qiu, Jiafeng Li, Jia Song, Wensheng Xiang

专题命中 扩散模型 :diffusion(title,abstract)

AI总结 提出CMADiff框架,通过条件变分自编码器整合理化特征,并利用对比学习模块BioAligner对齐文本描述与蛋白质特征,实现基于文本驱动的可控蛋白质序列生成。

Comments Further improvement is needed in the content

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25492 2026-08-27 physics.chem-ph cond-mat.mtrl-sci 新提交 71%

Battery Recycling: Mechanistic Modelling of LiCoO$_2$ Leaching with Coupled Diffusion-Reaction Kinetics and Film Passivation

电池回收:耦合扩散-反应动力学与薄膜钝化的LiCoO₂浸出机理建模

Uddipta Sarma, Ganesh Madabattula

专题命中 扩散模型 :diffusion(title)

AI总结 本研究开发了耦合扩散-反应动力学与薄膜钝化的LiCoO₂浸出机理模型,经多组酸与H₂O₂浓度实验验证,可用于电池回收的锂钴浸出过程,且可扩展至其他相关体系。

Comments 45 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25360 2026-08-27 cs.CV 新提交 70%

FlashNormal: Detailed Surface Normal Estimation from Flash and No-Flash Images

FlashNormal:基于闪光与非闪光图像的详细表面法向量估计

Ruiyang Chen, Feiran Li, Heng Guo, Zhanyu Ma

机构 * Beijing University of Posts and Telecommunications (BUPT)(北京邮电大学)

专题命中 扩散模型 :diffusion(abstract);image editing(abstract);分类 cs.CV

AI总结 针对现有单图像法向量估计的细节恢复不足与模糊性问题,提出基于扩散模型的FlashNormal,利用闪光图像对的阴影变化与曲率引导增强,结合新数据集EvalFlash,实现法向量估计性能提升。

Comments (c) 2026 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25872 2026-08-27 cs.RO 新提交 67%

VISTA: Visually Inferred Spatial ConTact Attention for Contact-Rich Manipulation

VISTA:用于接触丰富操作的视觉推断空间接触注意力机制

Jiayi Chen, Wenlong Dong, Yan Huang, Xianglin Chen, Zijian Lin, Jiaqi Yin, Yushan Liu, Wenbo Ding

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Southern University of Science and Technology(南方科技大学) School of Future Technology, Harbin Institute of Technology(哈尔滨工业大学未来技术学院)

专题命中 扩散模型 :diffusion(abstract,abstract_cn)

AI总结 针对接触丰富操作的视觉反馈不足问题,提出基于VDF的VISTA-Policy,通过整合物理感知编码引擎等模块,在多任务上优于纯视觉与触觉基准,具分布外泛化及抗干扰能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26924 2026-08-27 cs.LG cs.RO 版本更新 67%

Temporally Centered SIGReg Improves LeWorldModel Representations for Robot Policy Learning

时间中心SIGReg改进多任务LeWorldModel学习:从分析到方法

Chang Liu, Fei Suo, Yanzhou Jin, Zeyu Ping, Yusuke Iwasawa, Yutaka Matsuo, Yaonan Zhu

机构 * Graduate School of Engineering, The University of Tokyo(东京大学工程学院)

专题命中 扩散模型 :diffusion(abstract,abstract_cn)

AI总结 该研究针对SIGReg在多任务LeWM中导致表示混叠的问题,提出将其应用于时间中心残差的改进方法,在LIBERO基准上显著提升了多任务世界模型的下游性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25851 2026-08-27 cs.CV 新提交 57%

DEFUSE: Generalizable Backdoor Defense for Self-Supervised Encoders with Generative Priors

DEFUSE:面向带生成先验的自监督编码器的可泛化后门防御方法

Tuo Chen, Jie Gui, Minjing Dong, Lanting Fang, Ju Jia, Benlei Cui, Jian Liu

机构 * Ant Group(蚂蚁集团) Purple Mountain Laboratories(紫金山实验室) City University of Hong Kong(香港城市大学) Beijing Institute of Technology(北京理工大学) Alibaba Group(阿里巴巴集团)

专题命中 扩散模型 :diffusion(abstract);分类 cs.CV

AI总结 本文提出DEFUSE,一种基于条件扩散生成模型的可泛化后门检测框架,用于防御自监督学习编码器的后门攻击,实验表明其性能优于现有方法且泛化性更强。

Comments Accepted at ACM Multimedia 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25301 2026-08-27 eess.SP 新提交 50%

Security-Aware Pinching-Antenna Systems (PASS): Physical-Layer Security Transmission

感知安全的捏天线系统(PASS):物理层安全传输

Zhaoming Hu, Xiaochen Nie, Ruikang Zhong, Haochen Li, Dengao Li, Xidong Mu

专题命中 扩散模型 :diffusion(abstract)

AI总结 本文针对捏天线系统(PASS)的异构安全多用户传输问题,建立含三类安全模式的统一传输框架,开发HSPPO与MRHA-DPO两种学习控制器,实现兼顾效率与能力的物理层安全传输。

Comments 13 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏