arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1887 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 112 篇

2311.07795 2026-08-17 math.OC math.AP math.PR 版本更新 50%

Optimal control formulation of transition path problems for Markov Jump Processes

马尔可夫跳跃过程的过渡路径问题的最优控制公式

Yuan Gao, Jian-Guo Liu, Oliver Tse

专题命中 可控生成 :diffusion(abstract)

AI总结 该研究将马尔可夫跳跃过程的过渡路径问题转化为路径空间随机最优控制问题,通过committor函数、Γ-收敛等方法得到最优路径测度与受控过程,为过渡路径问题提供了严格的最优控制框架。

Comments 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11143 2026-08-14 cs.RO 版本更新 50%

APEX: Learning Adaptive High-Platform Traversal for Humanoid Robots

APEX: 为双足机器人学习适应性高平台穿越

Yikai Wang, Tingxuan Leng, Changyi Lin, Shiqi Liu, Shir Simon, Bingqing Chen, Jonathan Francis, Ding Zhao

机构 * Carnegie Mellon University(卡内基梅隆大学) Bosch Center for Artificial Intelligence(博世人工智能中心)

专题命中 可控生成 :inpainting(abstract)

AI总结 APEX通过感知和攀爬行为实现双足机器人高平台穿越,结合地形适应和安全正则化,实现高效探索与稳健适应。

Comments Project Website: https://apex-humanoid.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01836 2026-08-11 math.OC 版本更新 50%

A noncommunicative Kalman condition for null controllability of backward stochastic parabolic systems

后向随机抛物系统零能控性的非交换卡尔曼条件

Mohamed Fadili

专题命中 可控生成 :diffusion(abstract)

AI总结 该研究针对一类带耦合的后向随机热方程系统,建立了其零能控性的充要非交换卡尔曼条件,通过分离随机动力学与热半群等方法完成证明并验证条件的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15521 2026-08-11 cond-mat.mes-hall quant-ph 版本更新 50%

Entropy Production from Spin--Vibrational Coupling in Endohedral-Fullerene Qubits Encapsulated in Suspended Carbon Nanotubes

端帽 fullerene 量子比特封装在悬空碳纳米管中的自旋-振动耦合熵产

Cristian Staii

专题命中 可控生成 :diffusion(abstract)

AI总结 研究端帽 fullerene 量子比特与悬空碳纳米管振动模式的耦合,分析熵生成机制及非平衡量子热力学中的不可逆性分布。

Comments 21 pages, 7 figures

Journal ref Entropy (Basel). 2026 Jun 8;28(6):646

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15150 2026-08-11 cs.DL 版本更新 50%

A Semantic Geometry for Uncovering Paradigm Dynamics via Scientific Publications

一种通过科学出版物揭示范式动态的语义几何

Jinchang Liu, Qingshan Zhou, Hongkan Chen, Yi Bu

专题命中 可控生成 :diffusion(abstract)

AI总结 提出基于R-P-C(参考文献、焦点出版物、引文)框架的语义几何,通过量化出版物的知识基础与扩散的语义相似性和距离,识别巩固型、探索型和平衡型三类出版物,揭示范式动态。

Comments 40 pages, 17 figures. Published in the Journal of the Association for Information Science and Technology

Journal ref Liu, J., Zhou, Q., Chen, H., & Bu, Y. (2026). A Semantic Geometry for Uncovering Paradigm Dynamics via Scientific Publications. Journal of the Association for Information Science and Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
1902.01907 2026-08-11 math.OC 版本更新 50%

Null controllability of degenerate parabolic equations with a time-varying delay

带时变延迟的退化抛物型方程的零能控性

E. L. Mustapha Ait Benhassi, Mohamed Fadili, Lahcen Maniar

专题命中 可控生成 :diffusion(abstract)

AI总结 本文研究带时变状态延迟且在单端点退化的一维线性抛物型方程的零能控性,结合退化Carleman估计与单调性泛函得到可观性不等式,还通过空间延拓获得非退化端点的Dirichlet边界能控性,常延迟方程为特例。

Comments Substantially revised and extended version. The constant-delay framework has been generalized to a time-varying delay. The adjoint formulation, observability argument, and boundary controllability result have been revised accordingly. Title changed to reflect the broader scope. 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24015 2026-08-06 math.OC cs.GT cs.SY econ.TH eess.SY 版本更新 50%

Continuous-Time Information-Mechanism Control

多区域电力系统协调的分布鲁棒联合信息与机制设计

Furkan Sezer

专题命中 可控生成 :diffusion(abstract)

AI总结 针对多区域电力系统协调问题,提出分布鲁棒的联合信息与机制设计框架,通过高斯公共信号和Groves转移机制实现激励对齐,并利用Isaacs方程求解,在2021年Uri暴风雪案例中验证了信息设计和市场耦合的互补性。

Comments 41 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01634 2026-08-05 cs.LG cs.AI 版本更新 50%

E4GEN: Event-level Explainable Extreme-Enhanced Time-series Generation

E4GEN:事件级可解释的极端增强时间序列生成

Lin Jiang, Dahai Yu, Ximiao Li, Guang Wang

机构 * Florida State University(佛罗里达州立大学)

专题命中 可控生成 :diffusion(abstract)

AI总结 提出E4GEN可解释扩散框架,通过E-Activator、E-Predictor和E-Control三个组件实现事件级极端事件可控生成,在整体保真度、极端事件保真度和下游效用上优于现有方法。

Comments 48 pages,26 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14315 2026-08-05 physics.med-ph cs.NA math.NA 版本更新 50%

Complex Wavelet-Based Sinogram Segmentation for Metal Artifact Reduction in Cone-Beam CT

基于复波let的sinogram分割用于锥束CT中金属伪影的减少

Siiri Rautio, Alexander Meaney, Salla-Maaria Latva-Äijö, Harshit Agrawal, Mikael Brix, Dinidu Jayakody, Samuli Siltanen

专题命中 可控生成 :inpainting(abstract)

AI总结 本文提出基于复波let的投影域金属伪影减少方法,通过分析性金属分割提升锥束CT图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11885 2026-08-03 cs.RO 版本更新 50%

Choose What to Manipulate: Revealing Data Scaling Laws in Bounding-Box Guided Policies for Semantic Manipulation

学习操控一切:揭示在边界框引导策略中的数据扩展定律

Yihao Wu, Jinming Ma, Junbo Tan, Yanzhao Yu, Shoujie Li, Mingliang Zhou, Diyun Xiang, Xueqian Wang

机构 * Center for Intelligent Control and Telescience, Tsinghua Shenzhen International Graduate School(智能控制与遥科学中心,清华大学深圳国际研究生院) Beijing Xiaomi Robot Technology Co., Ltd(北京小米机器人科技有限公司)

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出利用边界框指令提升语义操控的泛化能力,并揭示数据扩展定律,通过高效数据收集和解耦框架实现85%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04521 2026-08-03 math.OC cs.LG q-fin.CP 版本更新 50%

Unified continuous-time q-learning for mean-field game and mean-field control problems

面向平均场博弈与平均场控制问题的统一连续时间Q学习方法

Xiaoli Wei, Xiang Yu, Fengyi Yuan

专题命中 可控生成 :diffusion(abstract)

AI总结 本文针对环境模拟器无法直接获取群体分布的场景,提出解耦Iq函数,设计统一参数化Q学习算法,验证其在MFG与MFC学习任务中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23969 2026-07-31 cs.RO 版本更新 50%

LeapBot-WA: World-Anchor Action Models via Predictive Latent Alignments

LeapBot-WA:通过预测性潜在对齐实现的世界锚定动作模型

Pei Liu, Nan Zheng, Lang Zhang, Daojie Peng, Yanan Zhang, Feilong Kong, Mingyue Feng, Jiachao Liu, Yaonong Wang, Qifeng Chen, Jun Ma

专题命中 可控生成 :diffusion(abstract)

AI总结 研究针对世界动作模型依赖像素级视频生成的瓶颈,提出LeapBot-WA,通过预测性潜在对齐建立新范式,引入ISAE弥合模态差距,设计MoT架构,在多数据集上表现出色,实现高效强大的潜在中心范式及零样本鲁棒性和现实世界迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18584 2026-07-31 cond-mat.mes-hall 版本更新 50%

Boundary condition for phonon distribution functions at a smooth crystal interface and interfacial angular momentum transfer

声子分布函数在光滑晶体界面处的边界条件及界面角动量转移

Yuta Suzuki, Shuntaro Sumita, Yusuke Kato

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出声子在光滑晶体界面处的边界条件,揭示了界面角动量转移机制,阐明了自旋角动量与轨道角动量在声子传输中的作用。

Comments Revised version. Main text (35 pages, 9 figures, 1 table) + supplementary material (4 pages, 2 figures, no tables). This manuscript provides a detailed analysis of an accompanying Letter (latest version of arXiv:2409.08874)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12109 2026-07-29 cs.RO cs.AI 版本更新 50%

InDex: Empowering VLA Models with Intent-Conditioned Arm-Hand Coordination for Dexterous Manipulation

弥合形态差距:通过意图条件微调使VLA模型适应灵巧操作

Chuanke Pang, Junyi Huang, Zhijun Zhao, Yaobing Wang, Kun Xu, Xilun Ding

机构 * Beihang University(北京航空航天大学) China Academy of Space Technology(中国空间技术研究院)

专题命中 可控生成 :diffusion(abstract)

AI总结 提出InDex框架,通过将预训练的1-DoF平行抓取输出重用作宏观虚拟抓取意图代理,结合两阶段解耦学习架构,实现VLA模型从低自由度夹爪到高自由度灵巧手的适应,有效缓解灾难性遗忘和动作流形坍缩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17904 2026-07-27 math.OC 版本更新 50%

Reflected Schrodinger Bridge Problem over Sub-Riemannian Manifold

次黎曼流形上的反射薛定谔桥问题

Daniel Owusu Adu

专题命中 可控生成 :diffusion(abstract)

AI总结 研究次黎曼流形上反射薛定谔桥问题,针对几何和退化性困难,引入内在斜反射机制,证明相关过程有光滑正转移密度,通过正反向偏微分方程系统及基于偏微分方程的Sinkhorn迭代求解最优控制并举例说明。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04910 2026-07-24 cs.RO cs.AI cs.LG 版本更新 50%

VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory

VPWEM:非马尔可夫视觉-运动策略与工作记忆与事件记忆

Yuheng Lei, Zhixuan Liang, Hongyuan Zhang, Ping Luo

机构 * School of Computing and Data Science, University of Hong Kong(计算与数据科学学院,香港大学)

专题命中 可控生成 :diffusion(abstract)

AI总结 VPWEM通过引入工作记忆和事件记忆,提升机器人在非马尔可夫任务中的动作生成性能。

Comments Accepted to IEEE Robotics and Automation Letters (RA-L). \textcopyright 2026 IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26887 2026-07-21 math.AP 版本更新 50%

Local well-posedness for hyperbolic systems of equations with fractional dissipation

分数阶正则化双曲方程组的局部适定性

Felipe Angeles

专题命中 可控生成 :diffusion(abstract)

AI总结 针对具有分数阶耗散和非局部交换子的双曲拟线性演化系统,利用分数阶拉普拉斯的自伴性和傅里叶乘子交换子的代数恒等式,结合非齐次Littlewood-Paley理论建立局部适定性,并通过Schauder不动点定理克服Banach收缩原理失效的困难。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13204 2026-07-21 math.OC 版本更新 50%

Indefinite Stochastic Linear-Quadratic Optimal Control Problems with Random Coefficients and Poisson Jumps: Closed-Loop Representation of Open-Loop Optimal Controls

不定随机线性二次最优控制问题:带有随机系数和泊松跳跃的闭环表示法

Kai Ding, Jiaqiang Wen, Jie Xiong, Xin Zhang

专题命中 可控生成 :diffusion(abstract)

AI总结 本文研究了具有随机系数和泊松跳跃的有限时间随机线性二次最优控制问题,证明了在均匀凸性条件下,带跳跃的随机黎曼-西格纳方程有唯一强正则解,从而得到开环最优控制的闭环表示。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27497 2026-07-21 cs.LG cs.AI 版本更新 50%

InertialAR: Autoregressive 3D Molecule Generation with Inertial Frames

InertialAR:基于惯性框架的自回归3D分子生成

Haorui Li, Weitao Du, Yuqiang Li, Hongyu Guo, Shengchao Liu

机构 * The Chinese University of Hong Kong(香港中文大学) Alibaba DAMO Academy(阿里巴巴达摩院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Ottawa(渥太华大学)

专题命中 可控生成 :diffusion(abstract)

AI总结 研究探索基于Transformer的自回归模型在3D分子生成上的应用。提出InertialAR,通过规范标记化、几何位置编码及分层自回归范式应对挑战,在无条件和可控生成任务中表现出色,多个指标达领先水平。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17678 2026-07-20 math.OC 版本更新 50%

Optimal control of variable-exponent subdiffusion

变指数次扩散的最优控制

Yiqun Li, Mengmeng Liu, Wenlin Qiu

专题命中 可控生成 :diffusion(abstract)

AI总结 研究变指数次扩散的最优控制问题,采用卷积方法将模型转化为更易处理的形式,证明最优控制相关性质,通过离散卷积核方法得到状态方程和伴随方程格式的精度,经数值实验证实理论发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11345 2026-07-17 math.OC math.PR 版本更新 50%

Long-Term Average Impulse Control with Mean Field Interactions

长期平均冲击控制与均场交互

K. L. Helmes, R. H. Stockbridge, C. Zhu

专题命中 可控生成 :diffusion(abstract)

AI总结 本文研究了具有均场交互的长期平均冲击控制问题,通过建立均衡策略和解决均场控制问题,探讨了个体合作实现长期平均利润的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01054 2026-07-17 math.OC 版本更新 50%

Optimal control of SDEs with merely measurable drift: an HJB approach

具有仅可测漂移的随机微分方程的最优控制:一种HJB方法

Kai Du, Qingmeng Wei

专题命中 可控生成 :diffusion(abstract)

AI总结 研究具有仅可测漂移的随机微分方程最优控制问题,通过分析HJB方程,利用偏微分方程技术和策略迭代方案,证明方程有唯一强解且与值函数一致,恢复贝尔曼最优性原理,还研究了平滑方案及控制集条件对收敛性的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27947 2026-07-15 cs.RO 版本更新 50%

SANTS: A State-Adaptive Scheduler for World Action Models

SANTS:面向世界动作模型的状态自适应调度器

Yirui Sun, Guangyu Zhuge, Keliang Liu, Jie Gu, Xinyu Bing, Zhongxue Gan, Chunxu Tian

机构 * Fudan University(复旦大学) Harbin Institute of Technology(哈尔滨工业大学) Deep Computing Era Technology Co., Ltd(深计算时代科技有限公司)

专题命中 可控生成 :diffusion(abstract)

AI总结 提出状态自适应噪声轨迹调度器(SANTS),通过根据视频状态动态选择去噪深度来优化视频到动作的扩散策略,在保持控制性能的同时大幅降低推理延迟。

Comments 17 pages, 5 figures, 8 tables. Project page: https://advanced-robotics-lab.github.io/SANTS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06558 2026-07-14 cs.RO 版本更新 50%

RynnWorld-Teleop: An Action-Conditioned World Model for Digital Teleoperation

RynnWorld-Teleop:用于数字遥操作的动作条件世界模型

Haoyu Zhao, Xingyue Zhao, Hangyu Li, Biao Gong, Kehan Li, Siteng Huang, Xin Li, Deli Zhao, Zhongyu Li

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团) Hong Kong Embodied AI Lab(香港具身人工智能实验室) CUHK(香港中文大学) Hupan Lab(湖畔实验室) Alibaba Group(阿里巴巴集团) Ant Group(蚂蚁集团)

专题命中 可控生成 :diffusion(abstract)

AI总结 研究针对机器人学习数据收集瓶颈,提出数字遥操作范式,用生成世界模型解耦数据收集与物理约束。以RynnWorld-Teleop系统实现,含多种技术,能实时生成,训练策略可零样本转移,还能增强数据集,是高保真可扩展数据引擎。

Comments Project Page: https://alibaba-damo-academy.github.io/RynnWorld-Teleop.github.io, Github: https://github.com/alibaba-damo-academy/RynnWorld-Teleop

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08317 2026-07-08 math.OC 版本更新 50%

Stationary Mean-Field Games of Singular Control under Knightian Uncertainty

奈特不确定性下奇异控制的平稳平均场博弈

Giorgio Ferrari, Ioannis Tzouanas

专题命中 可控生成 :diffusion(abstract)

AI总结 研究奈特不确定性下奇异控制的平稳平均场博弈,主体通过单边奇异随机控制调整动力学以最大化奖励,利用构造性方法证明平稳平均场均衡的存在唯一性,并给出数值基准及分析不确定性对均衡的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24589 2026-07-07 eess.AS cs.SD 版本更新 50%

YingMusic-Singer: Controllable Singing Voice Synthesis with Flexible Lyric Manipulation and Annotation-free Melody Guidance

YingMusic-Singer-Plus: 可控歌唱语音合成与灵活歌词操控及无标注旋律引导

Chunbo Hao, Junjie Zheng, Guobin Ma, Yuepeng Jiang, Huakang Chen, Wenjie Tian, Gongyu Chen, Zihao Chen, Lei Xie

机构 * AI Lab, GiantNetwork(巨人网络AI实验室)

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出YingMusic-Singer-Plus,一种基于扩散模型的可控歌唱语音合成方法,支持灵活歌词操控和无标注旋律引导,优于现有基准模型。

Comments INTERSPEECH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02948 2026-07-07 cs.LG cs.NA math.NA 版本更新 50%

Variational Sparse Paired Autoencoders (vsPAIR) for Inverse Problems and Uncertainty Quantification

用于逆问题和不确定性量化的变分稀疏配对自动编码器(vsPAIR)

Jack Michael Solomon, Rishi Leburu, Matthias Chung

机构 * Emory University Department of Mathematics(埃默里大学数学系)

专题命中 可控生成 :inpainting(abstract)

AI总结 针对逆问题,提出变分稀疏配对自动编码器(vsPAIR)。架构通过学习的潜在映射连接标准VAE和稀疏VAE,能进行不确定性估计,鼓励可解释性,提供结构化不确定性估计,实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03324 2026-07-07 math.PR 版本更新 50%

Strong law of large numbers and L log L condition for supercritical branching processes

超临界分支过程的强大数定律和L log L条件

Vincent Bansaye, Tresnia Berah, Bertrand Cloez

专题命中 可控生成 :diffusion(abstract)

AI总结 研究结构化种群的超临界分支过程,在重正化半群加权全变差范数收敛假设下,结合鞅族、半群收缩等技术,证明归一化经验测度强收敛等,在Llog L条件下扩展大数定律适用范围。

Comments MISTEA - Axe syst{è}mes dynamiques

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08580 2026-07-03 math.OC cs.LG 版本更新 50%

Adjoint Matching through the Lens of the Stochastic Maximum Principle in Optimal Control

通过随机最大原理视角的伴随匹配

Carles Domingo-Enrich, Jiequn Han

机构 * Microsoft Research New England(微软研究院新英格兰) Flatiron Institute(熨斗研究所)

专题命中 可控生成 :diffusion(abstract)

AI总结 本文基于随机最优控制问题,重新推广并严谨推导了伴随匹配方法,将其置于随机最大原理基础上,提出通用Hamiltonian伴随匹配目标,并展示其在连续时间下的实现方法,为随机控制问题提供新的可实施目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18368 2026-07-03 cs.RO 版本更新 50%

Learning Semantic Atomic Skills for Multi-Task Robotic Manipulation

学习多任务机器人操作的语义原子技能

Yihang Zhu, Weiqing Wang, Shijie Wu, Ye Shi, Jingya Wang

机构 * ShanghaiTech University(上海科技大学)

专题命中 可控生成 :diffusion(abstract)

AI总结 提出AtomSkill框架,通过语义对比对齐和关键姿态想象,从演示中学习可重用原子技能,实现多任务机器人操作,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏