arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4236 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4236 篇

2602.05331 2026-02-06 math.AP 50%

Dynamics of a nonlocal epidemic model with a new free boundary condition, part 1: Spreading-vanishing dichotomy

非局部流行病模型的动力学研究:带有新自由边界条件的扩散-反应系统,第一部分:扩散-消失二元性

Yao Chen, Yihong Du, Wan-Tong Li, Rong Wang

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出了一种新的自由边界条件,研究非局部流行病模型的长期动力学行为,揭示了扩散与消失的二元性及其精确阈值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21200 2026-02-06 stat.ML cs.LG 50%

Provably Reliable Classifier Guidance via Cross-Entropy Control

通过交叉熵控制实现可证明可靠的分类器引导

Sharan Sahu, Arisina Banerjee, Yuchen Wu

专题命中 可控生成 :diffusion(abstract)

AI总结 本文通过交叉熵控制证明了分类器引导扩散模型的可靠性,建立了分类器训练与引导对齐的理论联系。

Comments 31 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11523 2026-02-06 math.OC 50%

An infinite horizon sufficient stochastic maximum principle for regime switching diffusions and applications

无限时间充分随机最大原理及其在 regime switching 扩散中的应用

Kai Ding, Xun Li, Siyu Lv, Xin Zhang

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出了一种无限时间 horizon 的随机最大原理,用于 regime switching 扩散的最优控制问题,并通过线性二次生产计划问题展示了其应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05207 2026-02-06 eess.AS cs.AI 50%

ARCHI-TTS: A flow-matching-based Text-to-Speech Model with Self-supervised Semantic Aligner and Accelerated Inference

ARCHI-TTS: 一种基于流匹配的文本到语音模型,配备自监督语义对齐器和加速推理

Chunyat Wu, Jiajun Deng, Zhengxi Liu, Zheqi Dai, Haolin He, Qiuqiang Kong

机构 * The Chinese University of Hong Kong, Hong Kong SAR, China(香港中文大学)

专题命中 可控生成 :diffusion(abstract)

AI总结 ARCHI-TTS通过自监督语义对齐器和高效推理策略,实现了高效率的文本到语音合成,优于现有最先进系统。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13264 2026-02-04 physics.optics physics.atom-ph quant-ph 50%

High-Precision Phase Control of an Optical Lattice with up to 50 dB Noise Suppression

光学晶格高精度相位控制及50dB噪声抑制

Kendall Mehling, Murray Holland, Catie LeDesma

专题命中 可控生成 :diffusion(abstract)

AI总结 本研究提出了一种高精度光学晶格相位控制方法,通过双频差锁技术实现50dB噪声抑制,支持高带宽调制,用于原子干涉仪的复杂相位操控。

Comments 8 pages, 4 figures

Journal ref Phys. Rev. Applied 25, 024008 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01321 2026-02-03 math.OC cs.NA math.NA 50%

Global stabilization and finite element analysis of the viscous Burgers' equation with memory subject to Neumann boundary feedback control

带有记忆项的粘性Burgers方程的全局稳定性及有限元分析及Neumann边界反馈控制

Shishu Pal Singh, Sudeep Kundu

专题命中 可控生成 :diffusion(abstract)

AI总结 本文研究了带有记忆项的粘性Burgers方程的全局稳定性,采用Neumann边界反馈控制并结合有限元方法进行分析,验证了稳定性及误差估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00574 2026-02-03 cs.AI 50%

Learning Modal-Mixed Chain-of-Thought Reasoning with Latent Embeddings

通过潜在嵌入学习模态混合的思考链推理

Yifei Shao, Kun Zhou, Ziming Xu, Mohammad Atif Quamar, Shibo Hao, Zhen Wang, Zhiting Hu, Biwei Huang

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出模态混合CoT方法,通过潜在嵌入结合视觉与文本信息,提升多模态推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00368 2026-02-03 physics.optics eess.IV physics.app-ph physics.med-ph 50%

Enhancing Imaging Depth and Sensitivity in Reflectance Mode Near Infrared Optical Imaging with Scatter Reducing Agents

在近红外光学成像反射模式中使用散射减少剂以增强成像深度和灵敏度

Mannu Bardhan Paul, Kaiser Niknam, Mini Das

专题命中 可控生成 :diffusion(abstract)

AI总结 本研究通过使用柠檬黄染料作为散射减少剂,在近红外反射模式成像中提升深度灵敏度和弱吸收体检测能力,利用折射率梯度增强反射信号。

Comments 26 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22986 2026-02-02 cond-mat.mtrl-sci 50%

Hydrogen at GaN(0001) surface control of Fermi level pinning: Mg activation of p-type conductivity -- Nakamura process deciphered

氮化镓(0001)表面氢原子控制费米能级钉扎:Mg激活p型导电性——纳克拉马过程解密

Konrad Sakowski, Pawel Strak, Pawel Kempisty, Izabella Grzegory, Stanislaw Krukowski

专题命中 可控生成 :diffusion(abstract)

AI总结 通过从头计算揭示了氮化镓(0001)表面氢原子控制费米能级钉扎机制,解析了Mg掺杂对p型导电性激活的纳克拉马过程。

Comments 28 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21899 2026-01-30 cs.LG 50%

Breaking the Regional Barrier: Inductive Semantic Topology Learning for Worldwide Air Quality Forecasting

突破区域壁垒:为全球空气质量预测的归纳语义拓扑学习

Zhiqing Cui, Siru Zhong, Ming Jin, Shirui Pan, Qingsong Wen, Yuxuan Liang

机构 * The Hong Kong University of Science(香港科学与技术大学) Griffith University, Australia(格里菲斯大学)

专题命中 可控生成 :diffusion(abstract)

AI总结 OmniAir通过语义拓扑学习框架提升全球空气质量预测的泛化能力,实现高效准确的预测并弥补数据稀疏区域的监测缺口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16740 2026-01-30 cs.HC 50%

Evaluating Generative AI in the Lab: Methodological Challenges and Guidelines

在实验室中评估生成式AI:方法学挑战与指南

Hyerim Park, Khanh Huynh, Malin Eiband, Jeremy Dillmann, Sven Mayer, Michael Sedlmair

专题命中 可控生成 :image generation(abstract)

AI总结 本文探讨了在实验室环境中评估生成式AI的方法学挑战,提出了五个指南和十八项建议,以帮助研究人员设计更透明和稳健的评估研究。

Comments 18 pages, 3 figures, IUI '26 (the 31st International Conference on Intelligent User Interfaces)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03147 2026-01-30 cs.HC cs.CL cs.LG cs.SD eess.AS 50%

A conversational gesture synthesis system based on emotions and semantics

基于情感和语义的对话手势合成系统

Thanh Hoang-Minh

机构 * Department of Information Technology, VNUHCM -- University of Science(越南科学大学信息科技系)

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出DeepGesture,一种基于扩散的 gesture 合成系统,通过多模态信号生成具有情感和语义条件的手势,提升数字人类的自然表达能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11471 2026-01-29 math.PR math.OC 50%

De Finetti's Control for Refracted Skew Brownian Motion

德芬尼控制下的折射斜布朗运动

Zhongqin Gao, Yan Lv, Xiaowen Zhou

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出折射斜布朗运动作为风险模型,研究其最优分红策略的充分条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19385 2026-01-28 cs.HC 50%

MIRAGE: Enabling Real-Time Automotive Mediated Reality

MIRAGE:实现实时汽车中介现实

Pascal Jansen, Julian Britten, Mark Colley, Markus Sasalovici, Enrico Rukzio

专题命中 可控生成 :inpainting(abstract)

AI总结 MIRAGE是一个开源工具,通过先进的计算模型实现实时汽车中介现实,提升驾驶安全并探索其伦理与交互设计影响。

Comments Conditionally accepted at CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04056 2026-01-28 cs.RO cs.LG 50%

Problem Space Transformations for Out-of-Distribution Generalisation in Behavioural Cloning

行为克隆中面向分布外泛化的问题空间变换

Kiran Doshi, Marco Bagatella, Stelian Coros

机构 * Department of Computer Science at ETH Zürich(苏黎世联邦理工学院计算机科学系)

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出通过问题空间变换提升行为克隆在分布外泛化中的性能,通过实验验证了姿态等价性和局部性对动作预测的改进作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18270 2026-01-27 math.OC 50%

Exact Controllability for Stochastic First-Order Multi-Dimensional Hyperbolic Systems

对随机一阶多维双曲系统的精确可控性

Zengyu Li, Qi Lü, Yu Wang, Haitian Yang

专题命中 可控生成 :diffusion(abstract)

AI总结 本文研究了随机多维双曲系统的精确可控性,通过建立新的Carleman估计和加权能量恒等式,证明了在特定几何条件下可控性成立,并探讨了其在交通流、流行病模型等领域的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09101 2026-01-27 cs.RO cs.AI 50%

Masked Generative Policy for Robotic Control

遮蔽生成策略用于机器人控制

Lipeng Zhuang, Shiyu Fan, Florent P. Audonnet, Yingdong Ru, Edmond S. L. Ho, Gerardo Aragon Camarasa, Paul Henderson

机构 * University of Glasgow(格拉斯哥大学)

专题命中 可控生成 :diffusion(abstract)

AI总结 MGP通过并行生成和动态细化技术,实现了在复杂非马尔可夫任务中高效可靠的机器人控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19893 2026-01-27 cs.LG cs.AI cs.IT eess.IV math.IT 50%

Distillation-Enabled Knowledge Alignment for Generative Semantic Communications of AIGC Images

基于知识对齐的生成语义通信中的知识蒸馏

Jingzhi Hu, Geoffrey Ye Li

机构 * Department of Electrical and Electronic Engineering, Imperial College London(帝国理工学院伦敦分校电子与电气工程系)

专题命中 可控生成 :image generation(abstract)

AI总结 本文提出DeKA-g算法,通过知识蒸馏和低秩适应,提升生成语义通信中边缘与云生成图像的一致性及传输质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03400 2026-01-27 cs.RO 50%

Close-Fitting Dressing Assistance Based on State Estimation of Feet and Garments with Semantic-based Visual Attention

基于足部与衣物状态估计的近身穿衣辅助

Takuma Tsukakoshi, Tamon Miyake, Tetsuya Ogata, Yushi Wang, Takumi Akaishi, Shigeki Sugano

机构 * Creative Science and Engineering Faculty, Waseda Univ.(早稻田大学创意科学与工程学部) Future Robotics Organization, Waseda Univ.(早稻田大学未来机器人组织) Faculty of Science and Engineering, Waseda Univ.(早稻田大学科学与工程学部) The National Institute of Advanced Science and Technology(日本国家先进科学与技术研究院)

专题命中 可控生成 :diffusion(abstract)

AI总结 本研究提出基于语义信息的穿衣辅助方法,通过多模态数据融合实现对足部和衣物状态的精准估计,成功帮助10名受试者穿袜子,优于其他方法。

Comments Accepted at RA-L, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17443 2026-01-27 cs.CL cs.AI cs.LG 50%

Clustering-driven Memory Compression for On-device Large Language Models

基于聚类的记忆压缩用于设备端大语言模型

Ondrej Bohdal, Pramit Saha, Umberto Michieli, Mete Ozay, Taha Ceritli

机构 * University of Oxford(牛津大学)

专题命中 可控生成 :personalized generation(abstract)

AI总结 本文提出一种基于聚类的记忆压缩方法,通过分组和合并相似记忆以提升设备端大语言模型的上下文效率和生成质量。

Comments Accepted at ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16722 2026-01-26 eess.SY cs.SY 50%

Model Predictive Control for Coupled Adoption-Opinion Dynamics

基于耦合采纳-意见动态的模型预测控制

Martina Alutto, Qiulin Xu, Fabrizio Dabbene, Hideaki Ishii, Chiara Ravazzi

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出基于模型预测控制的策略,通过塑造意见间接促进可持续行为的扩散,提升干预效果和可扩展性。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09822 2026-01-23 cs.RO 50%

Multi-Layered Reasoning from a Single Viewpoint for Learning See-Through Grasping

从单一视角进行多层推理以学习透视抓取

Fang Wan, Chaoyang Song

机构 * Southern University of Science and Technology(南方科技大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 可控生成 :inpainting(abstract)

AI总结 本研究提出了一种基于视觉的透视感知架构,通过单一视觉输入实现多模态感知,无需外部摄像头或力传感器即可学习反应抓取。

Comments 39 pages, 13 figures, 2 tables, for supplementary videos, see https://bionicdl.ancorasir.com/?p=1658, for opensourced codes, see https://github.com/ancorasir/SeeThruFinger

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09371 2026-01-21 astro-ph.SR 50%

Constraining the outer boundary condition for the Babcock-Leighton dynamo models

约束Babcock-Leighton动力学模型的外边界条件

Yukun Luo, Jie Jiang, Binghang Li, Zebin Zhang, Ruihui Wang

专题命中 可控生成 :diffusion(abstract)

AI总结 提出零径向扩散外边界条件,使BL动力学模型与表面磁流输送模拟一致,再现太阳周期特性并更符合观测结果。

Comments 8 pages, 4 figures, 1 table, accepted by A&A

Journal ref A&A 705, A237 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01493 2026-01-21 cs.RO 50%

Floor Plan-Guided Visual Navigation Incorporating Depth and Directional Cues

结合深度和方向线索的平面图引导视觉导航

Weiqi Huang, Jiaxin Li, Zan Wang, Huijun Di, Wei Liang, Zhu Yang

机构 * Beijing Institute of Technology(北京理工大学) Yangtze Delta Region Academy of Beijing Institute of Technology(北京理工大学长江三角洲地区学院)

专题命中 可控生成 :diffusion(abstract)

AI总结 GlocDiff通过结合局部深度线索和全局方向指导,实现高效的平面图引导视觉导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10990 2026-01-19 math.OC 50%

The Optimal Control Problem of Stochastic Differential System with Extended Mixed Delays and Applications

具有扩展混合延迟的随机微分系统的最优控制问题及其应用

Xinpo Li, Jingtao Shi

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出了一种解决具有扩展混合延迟的随机微分系统最优控制问题的方法,通过引入反向随机Volterra积分方程和Malliavin导数,建立了随机最大原理,并应用到非零和随机博弈和线性二次问题中。

Comments 45 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09961 2026-01-16 cs.GT 50%

A Control Theoretic Approach to Decentralized AI Economy Stabilization via Dynamic Buyback-and-Burn Mechanisms

通过动态买回-烧毁机制实现去中心化人工智能经济稳定性的控制论方法

Zehua Cheng, Wei Dai, Zhipeng Wang, Rui Sun, Nick Wen, Jiahao Sun

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出动态控制买回机制,通过控制论框架降低去中心化人工智能经济的波动性与操作员流失率,提升系统稳定性。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08028 2026-01-14 physics.flu-dyn 50%

Transport and mixing in control volumes through the lens of probability

通过概率视角研究控制体积内的传输与混合

John Craske, Paul Mannix

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出一种基于全局概率视角的传输与混合模型,通过控制体积作为样本空间,利用散度定理分析不确定边界通量和内部混合对联合概率分布演化的影响,并应用于不可逆混合的分析。

Comments 28 pages, 10 figures

Journal ref J. Fluid Mech. 1020 (2025) A26

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06049 2026-01-13 cs.CY cs.AI 50%

The Violation State: Safety State Persistence in a Multimodal Language Model Interface

违规状态:多模态语言模型接口中的安全状态持续

Bentley DeVilling

专题命中 可控生成 :image generation(abstract)

AI总结 研究发现多模态语言模型在面对版权拒绝后,会持续拒绝无关图像生成请求,揭示了会话级安全状态的持续性问题。

Comments 19 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15338 2026-01-09 econ.TH math.OC 50%

Network-Based Optimal Control of Pollution Growth

基于网络的污染增长最优控制

Fausto Gozzi, Marta Leocata, Giulia Pucci

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出了一种基于网络结构的污染扩散最优控制模型,通过分析绿色与非绿色技术的权衡,解决了线性污染成本下的最优控制问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23650 2026-01-06 cs.RO 50%

Do You Have Freestyle? Expressive Humanoid Locomotion via Audio Control

你有即兴能力吗?通过音频控制实现 expressive 人形 locomotion

Zhe Li, Cheng Chi, Yangyang Wei, Boan Zhu, Tao Huang, Zhenguo Sun, Yibo Peng, Pengwei Wang, Zhongyuan Wang, Fangzhou Liu, Chang Xu, Shanghang Zhang

机构 * BAAI(北京人工智能研究院) University of Sydney(悉尼大学) Harbin Institute of Technology(哈尔滨工业大学) Hong Kong University of Science and Technology(香港科学与技术大学) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学)

专题命中 可控生成 :diffusion(abstract)

AI总结 RoboPerform 是首个通过音频直接生成音乐舞蹈和语音手势的人形运动框架,实现了低延迟、高保真的即兴运动表现。

详情

展开后加载摘要…

URL PDF HTML 收藏