arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

共收录 4515
2609.04070 2026-09-04 cs.CV cs.RO 新提交

Continuous Actions from Discrete Minds: Latent-Aligned Planning for End-to-End Autonomous Driving

离散思维到连续动作:面向端到端自动驾驶的隐式对齐规划

Ruoyu Yao, Yusen Xie, Qingzhao Liu, Pei Liu, Zewei Yang, Yipeng Zhu, Xiaolong Wang, Jun Ma

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Central Media Technology Institute, Huawei(华为中央媒体技术研究院)

AI总结 该研究提出具备隐式对齐规划的VLA框架LaPla,通过残差VQ-VAE消除量化误差,在nuScenes基准和AlpaSim模拟器上分别实现长时程L2误差降低、驾驶成功率提升的效果。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.04031 2026-09-04 cs.CV 新提交

DSAQuant: Denoising-Stage-Aligned Quantization-Aware Training for Video Generation

DSAQuant:面向视频生成的去噪阶段对齐量化感知训练

Shuaiting Li, Zelin Gao, Haibin Shen, Yujun Shen, Haotong Qin, Yinghao Xu

机构 * Robbyant(睿冰科技(Robbyant)) ZJU(浙江大学) HKUST(香港科技大学) PolyU(香港理工大学)

AI总结 DSAQuant是面向VDMs的去噪阶段对齐量化感知训练框架,适配视频去噪阶段特性,在W3A3量化下将VBench平均分数提升最高6.60,优于SOTA基线。

Comments Project page: \url{https://robbyant-research.github.io/DSAQuant/}; Code: \url{https://github.com/robbyant-research/DSAQuant}

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.03915 2026-09-04 cs.CL cs.IR 新提交

RuleMem: Active Rule Memory for Long-Term Conversational Agents

RuleMem:面向长期对话智能体的主动规则记忆

Xingyuan Zeng, Zuohan Wu, Quanming Yao, Yue Wang, Wei Liu, Libin Zheng, Jiuke Wang, Jian Yin

机构 * Sun Yat-sen University(中山大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Shenzhen Institute of Computing Sciences(深圳计算科学研究院) The Hong Kong Polytechnic University(香港理工大学) Tsinghua University(清华大学)

AI总结 针对长期对话智能体记忆机制的被动性局限,提出RuleMem规则记忆框架,通过归纳逻辑规则指导推理,在LoCoMo基准上较14个基线实现最高准确率,相对提升54.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.03804 2026-09-04 cs.CV 新提交

Urban Boundaries, Social Barriers: A Benchmark and Vision-Centric Framework for Mapping Gated Communities and Equity Implications

城市边界,社会壁垒:用于绘制封闭社区及其公平性影响的基准与以视觉为中心的框架

Minwei Zhao, Weiming Zhang, Jiawang Du, Qiming Liu, Weiming Zhuang, Pei Nie, Cai Wu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) School of Public Administration and Policy, Renmin University of China(中国人民大学公共管理学院) Sony AI(索尼人工智能) University of South China(南华大学)

AI总结 本文针对中国封闭社区研究的不足,构建了大湾区封闭/开放社区识别的多模态基准GBA-GCs,提出以视觉为中心的多模态框架MCGC,其性能优于基线模型,可用于大都市级绘制并揭示相关公平性问题。

Comments ECCV 2026 camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.03729 2026-09-04 cs.CV 新提交

Unfold The World: Factorize 4D Properties in Reinforcing Spatial Reasoning

展开世界:分解四维属性以增强空间推理能力

Yijun Yang, Shenghe Zheng, Wenbo Li, Jianhui Liu, Haoze Sun, Yanbing Zhang, Jiaxiu Jiang, Lin Song, Haoyang Huang, Nan Duan, Lei Zhu

机构 * Joy Future Academy(京东探索研究院) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学) The University of Hong Kong(香港大学)

AI总结 该研究针对VLMs的空间推理瓶颈,提出分解式强化学习框架FactoSR,将世界一致性推理分解为三个几何子目标,在相关基准上实现三维、四维推理性能的显著提升,为发展具世界感知的VLMs提供关键路径。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.03557 2026-09-04 cs.CV cs.GR 新提交

Building Pretraining Data for World Models: An Unreal Engine-Based Pipeline for Action-Conditioned Video Generation

构建世界模型的预训练数据:基于Unreal Engine的动作条件视频生成流水线

Haoyu Wang, Songchun Zhang, Haoran Li, Haoyang Huang, Zeyue Xue, Nan Duan

机构 * Joy Future Academy, JD(京东探索研究院) Tsinghua University(清华大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 该研究开发了基于Unreal Engine的分布式流水线,用于生成动作条件多视角合成视频,为世界模型提供大规模预训练数据,已产出大量不同分辨率的视频。

Comments 16 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.03483 2026-09-04 cs.RO cs.AI 新提交

Air-Ground Collaborative Vision-and-Language Navigation via Shared Bird's-Eye Maps

基于共享鸟瞰图的空地协同视觉语言导航

Shuning Zhang, Liang Li, Yunheng Wang, Tao Wang, Yihang Kang, Renjing Xu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Nanjing University of Posts and Telecommunications(南京邮电大学)

AI总结 本文提出首个空地协同视觉语言导航的无训练基线AGC-VLN,通过共享鸟瞰图实现无人机与地面无人车的协同,在CARLA-Air场景中联合成功率达77.0%,显著优于单智能体基线。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.03407 2026-09-04 cs.AI 新提交

Caught in the Story: Narrative Captivity in Multi-turn LLMs Conversation

陷入叙事:多轮大语言模型对话中的叙事俘获

Yuhe Wu, Guangyu Wang, Yujie Chen, Jiatong Zhang, Yuran Chen, Yutong Zhang, Xiyin Cheng, Wenpeng Cao, Zhuang Liu, Guang Zhang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Dongbei University of Finance and Economics(东北财经大学)

AI总结 该研究提出多轮LLM对话中的叙事俘获失效模式,构建含5078个场景的基准,发现17个LLMs中该现象普遍存在,偏移达25个百分点,偏好优化是主因,部分推理策略可缓解,旨在培养具独立判断的LLM顾问。

Comments Accepted by EMNLP 2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.03860 2026-09-04 cs.AI math.OC 新提交

Adapting to Evolving Requirements: Agentic AI for Retail Supply Chain Operations

适应不断变化的需求:面向零售供应链运营的智能体AI

Lei Zheng, Liping Yang, Zihao Li, Guodong Lyu, Chaik Ming Koh, Chung-Piaw Teo

机构 * School of Business and Management, Hong Kong University of Science and Technology(香港科技大学工商管理学院) School of Management, University of Science and Technology of China(中国科学技术大学管理学院) Institute of Operations Research and Analytics, National University of Singapore(新加坡国立大学运筹学与分析研究所) NUS Business School, National University of Singapore(新加坡国立大学商学院)

AI总结 该研究针对零售供应链运营需求演变的问题,提出图约束的智能体框架,结合GPT、Qwen、DeepSeek等大语言模型,可提升需求重构的正确性与端到端成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31343 2026-09-04 cs.RO 版本更新

Learning Terrain-Aware Whole-Body Control for Perceptive Legged Loco-Manipulation

学习面向感知的腿式移动操作的地形感知全身控制

Sikai Guo, Yudong Zhong, Guoyang Zhao, Botao Dang, Zhihai Bi, Jun Ma

机构 * Robotics and Autonomous Systems Thrust, The Hong Kong University of Science and Technology (Guangzhou)(机器人与自主系统方向,香港科技大学(广州))

AI总结 提出TA-WBC框架,通过混合外感受编码器提取地形特征、基于脚接触平面的末端执行器采样方法以及双策略蒸馏模块,实现腿式机械臂在复杂地形上的全身移动操作控制。

Comments Accepted by RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28053 2026-09-04 cs.LG 版本更新

RW-TTT: Batched Serving for Request-Owned Test-Time Training State

RW-TTT:面向请求自有测试时训练状态的批量服务

Jian Yang, Zhizhuo Kou, Yao Tian, Hao Zhang, Han Chen, Sirui Han, Yike Guo

机构 * HKUST(香港科技大学) CUHK(香港大学) NUS(新加坡国立大学)

AI总结 提出RW-TTT框架,通过标记解码步骤的所有者、版本和读写效果,实现请求自有测试时训练状态下的高效批量LLM服务,在单GPU上达到274.61 tok/s聚合吞吐,较顺序服务提升9.31倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03570 2026-09-04 cs.CY cs.IT cs.LG math.IT

From Street Form to Spatial Justice: Explaining Urban Exercise Inequality via a Triadic SHAP-Informed Framework

从街道形态到空间正义:通过三元SHAP指导框架解释城市运动不平等

Minwei Zhao, Guosheng Yang, Zhuoni Zhang, Filip Biljecki, Hanzhi Zu, Cai Wu

机构 * Thrust of Urban Governance and Design, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)城市治理与设计研究所)

AI总结 本文通过整合空间三元理论与多源数据,构建可解释框架,揭示城市街道运动 deprivation 的影响因素,提出七种 deprivation 类型,为促进空间正义提供理论和实践工具。

Comments 41 pages, 4 tables and 15 figures

Journal ref Building and Environment 304 (2026) 115095

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09968 2026-09-04 cs.CV 版本更新

ReCoSplat: Online Feed-Forward Gaussian Splatting via Render-and-Compare

ReCoSplat: 基于渲染与比较的自回归前馈高斯点云生成

Freeman Cheng, Botao Ye, Xueting Li, Junqi You, Fangneng Zhan, Ming-Hsuan Yang

机构 * University of California Merced(加州大学默塞德分校) ETH Zurich(苏黎世联邦理工学院) NVIDIA Shanghai Jiao Tong University(上海交通大学) Hong Kong University of Science and Technology(香港科技大学)

AI总结 ReCoSplat通过引入渲染与比较模块,解决高斯点云生成中姿态误差问题,实现高效稳定的视角合成。

Comments v2: Corrected OF3GS evaluation results after fixing an implementation bug, added baseline evaluations, updated efficiency benchmarks following a codebase refactor, and added code and pretrained model release links

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13312 2026-09-04 cs.MA cs.AI 版本更新

PeroMAS: A Multi-agent System of Perovskite Material Discovery

PeroMAS:钙钛矿材料发现的多智能体系统

Yishu Wang, Wei Liu, Yifan Li, Shengxiang Xu, Xujie Yuan, Ran Li, Yuyu Luo, Jia Zhu, Shimin Di, Min-Ling Zhang, Guixiang Li

机构 * School of Computer Science and Engineering, Southeast University, Nanjing, China(东南大学计算机科学与工程学院) School of Materials Science and Engineering, Southeast University, Nanjing, China(东南大学材料科学与工程学院) School of Artificial Intelligence, Sun Yat-Sen University, Zhuhai, China(中山大学人工智能学院) Information Hub, Hong Kong University of Science and Technology (Guangzhou), Guangzhou, China(香港科技大学(广州)信息中心) School of Computer Science and Engineering, Zhejiang Normal University, Jinhua, China(浙江师范大学计算机科学与工程学院)

AI总结 PeroMAS通过多智能体系统实现钙钛矿材料的多目标优化发现,提升材料发现效率并验证其在现实中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04736 2026-09-04 cs.CL 版本更新

Towards Multi-modal Multi-turn Safety: From Agentic Interaction to Strategic Alignment

AM$^3$Safety: 向多模态多轮安全对齐的数据高效方法

Han Zhu, Jiale Chen, Chengkun Cai, Shengjie Sun, Haoran Li, Yujin Zhou, Chi-Min Chan, Pengcheng Wen, Lei Li, Yike Guo, Sirui Han

机构 * Hong Kong University of Science and Technology(香港科技大学) Zhongshan School of Medicine, SUN YAT-SEN UNIVERSITY(中山医学院,孙中山大学) University of Edinburgh(爱丁堡大学) University of Washington(华盛顿大学)

AI总结 AM$^3$Safety通过结合冷启动拒绝阶段和组相对策略优化,有效提升多模态多轮对话的安全性,降低攻击成功率并增强模型的无害与帮助维度。

Comments EMNLP Main 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12037 2026-09-04 cs.LG 版本更新

Adaptive Resolving Methods for Markov Decision Processes with Function Approximations

基于函数近似的马尔可夫决策过程自适应求解方法

Jiashuo Jiang, Yinyu Ye, Yiming Zong

机构 * Department of Industrial Engineering & Decision Analytics, The Hong Kong University of Science and Technology(香港科学与技术大学工业工程与决策分析系) Department of Management Science & Engineering, Stanford University(斯坦福大学管理科学与工程系)

AI总结 本研究针对带函数近似的马尔可夫决策过程,提出基于线性规划重构的自适应求解算法,其实例依赖保证更紧且经验性能高效,具有广泛应用价值。

Comments Accepted for publication in Operations Research Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02886 2026-09-03 cs.CV 新提交

SolarWM: Open Data and Scalable Training for Long-Horizon Video World Models

SolarWM:面向长时序视频世界模型的开放数据与可扩展训练

Junchao Huang, Guian Fang, Shengju Qian, Xianghao Kong, Zhuoran Zhao, Wei Huang, Yihua Du, Zixin Zhang, Justin Cui, Yuchao Gu, Yukang Chen, Xinting Hu, Tianyu He, Shaoshuai Shi, Zhuotao Tian, Xin Wang, Mike Zheng Shou, Li Jiang

机构 * CUHK-SZ(香港中文大学(深圳)) SLAI(深圳先进人工智能研究院) NUS(新加坡国立大学) CUHK(香港中文大学) HKUST(香港科技大学) HKUST-GZ(香港科技大学(广州)) NVIDIA(英伟达公司) UCLA(加利福尼亚大学洛杉矶分校) MSRA(微软亚洲研究院)

AI总结 SolarWM是面向长时序视频世界模型的开放基础框架,通过多源数据引擎与适配框架实现异构数据训练,实例化多款5B至33B模型,仅用5秒序列训练即可支持长时序实时交互,为相关研究提供可复扩展的基础。

Comments https://junchao-cs.github.io/SolarWM-Web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02786 2026-09-03 cs.AI cs.CR 新提交

SafeEvolve: Harness-Policy Co-Evolution from Agent Experience for Safety Alignment

SafeEvolve:利用智能体经验进行安全对齐的 harness-策略协同进化

Qinghua Mao, Wanying Qu, Dadi Guo, Leitao Yuan, Qingyu Liu, Yu Li, Guanxu Chen, Yanwei Fu, Xi Lin, Xia Hu, Dongrui Liu

机构 * Shanghai AI Laboratory(上海人工智能实验室) SJTU(上海交通大学) Fudan University(复旦大学) HKUST(香港科技大学) Zhejiang University(浙江大学)

AI总结 SafeEvolve是一种基于智能体经验的安全对齐自进化框架,通过harness-策略协同进化实现更优的安全-效用权衡,在Qwen3.5-4B上可降低AgentDojo的ASR并提升良性效用

Comments Project: https://github.com/MaoPopovich/SafeEvolve

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02672 2026-09-03 cs.CL cs.LG 新提交

oHC: Orthogonal Hyper-Connections on SO(4) via Quaternions

oHC:基于四元数的SO(4)上的正交超连接

Haoqiang Guo, Xuyi Chen, Bo Ke, Yishu Lei, Ziyang Xu, Shikun Feng, Ximen, Wenhan Luo

机构 * The Hong Kong University of Science and Technology(香港科技大学) Baidu Inc.(百度公司)

AI总结 本文针对HC训练不稳定及残差流多样性耗尽问题,提出基于SO(4)与四元数的正交超连接oHC,在多下游任务上性能优于单流基线、mHC与iHC。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02367 2026-09-03 cs.MM cs.CV 新提交

The Missing Temporal Link: Temporal Context Routing for Script-Driven Audio-Video Generation

缺失的时间关联:面向脚本驱动的音视频生成的时间上下文路由

Yichen Liu, Quanwei Zhang, Haozhe Wang, Donghao Zhou, Xiaojie Li, Yang Shi, Jiaming Liu, Ruihua Huang, Yingtian Zou, Daquan Zhou

机构 * PKU(北京大学) Qwen Applications(通义千问应用公司) HKUST(香港科技大学) CUHK(香港中文大学) SJTU(上海交通大学)

AI总结 针对脚本驱动音视频生成中时序对齐不足的问题,提出时间上下文路由(TCR)方法,将脚本时序映射到音视频共享时间轴,显著提升了镜头边界和对话时序的准确性,且保持了音视频质量与同步性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02250 2026-09-03 cs.MA cs.CL cs.ET cs.LG 新提交

RideSkill: A Hierarchical Algorithm for Generalized Ride Sharing with LLM-Driven Automatic Evolution

RideSkill:一种基于大语言模型驱动自动演化的通用拼车分层算法

Zijian Zhao, Sen Li, Xialiang Tong, Mingxuan Yuan

机构 * The Hong Kong University of Science and Technology(香港科技大学) Noah’s Ark Lab, Huawei(华为诺亚方舟实验室) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 针对现有拼车算法泛化性差、推理需频繁调用LLM的问题,本文提出RideSkill分层算法,通过LLM自动演化训练组件,实现支持车辆共享的高效拼车调度,保障实时性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02231 2026-09-03 cs.AI 新提交

PhoenixNest-Video: Evidence-Grounded Multimodal Agent Framework for Automated Video Interview Assessment

PhoenixNest-Video:基于证据的多模态智能体框架用于自动视频面试评估

Fan Yuxuan, Huang Miaojun, Zhang Haimei, Wu Jingshen, Liu Hao

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 针对纯人工视频面试评估成本高、一致性差及现有AI方法分数不透明的问题,提出PhoenixNest-Video多模态智能体框架,在VInterview-2025数据集上获91.50%等级准确率,优于更大的专有模型,且分数可追溯。

Comments Accepted by EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.02134 2026-09-03 cs.RO cs.GR 新提交

Unified Motion Retargeting for Humanoids with Learned Point Cloud Correspondence

基于学习点云对应关系的人形机器人统一运动重定向

Hanyang Cao, Yuetong Fang, Taesoo Kwon, Runyi Yu, Ji Ma, Jing Tan, Yangchen Zhou, Baoze Du, Yi Gu, Yukang Gao, Ruoli Dai, Lei Han, Renjing Xu

机构 * HKUST(GZ)(香港科技大学(广州)) Noitom Robotics(诺亦腾机器人公司) Hanyang University(汉阳大学) HKUST(香港科技大学) HKU(香港大学)

AI总结 本文提出UMR框架,通过学习密集点云对应关系实现无需人工映射的人形机器人统一运动重定向,在多场景下比现有最优方法实现更高运动保真度,为大规模人类运动数据转机器人训练数据提供可扩展基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.01423 2026-09-03 cs.CV 版本更新

MegaStyle++: Scaling Image Style Space through Hierarchical Style Definition

MegaStyle++:通过分层风格定义扩展图像风格空间

Junyao Gao, Sibo Liu, Jiaxing Li, Yanan Sun, Weidong Zhang, Jun Zhang, Cairong Zhao

机构 * Tongji University(同济大学) Tencent(腾讯) Nanyang Technological University(南洋理工大学) Hong Kong University of Science and Technology(香港科技大学)

AI总结 针对图像风格缺乏统一定义的问题,提出分层风格定义,构建含多类数据的大规模风格数据集MegaStyle++-8M,扩展了风格空间并提供研究图像风格的可扩展基础。

Comments The dataset and code will be updated at https://github.com/Tencent/MegaStyle, 10pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12406 2026-09-03 cs.AI 版本更新

Isolation as a First-Class Principle for LLM-Agent System Safety: Concepts, Taxonomy, Challenges and Future Directions

隔离作为大语言模型智能体系统安全的头等原则:概念、分类法、挑战及未来方向

Huihao Jing, Wenbin Hu, Shaojin Chen, Haochen Shi, Sirui Zhang, Hanyu Yang, Changxuan Fan, Zhongwei Xie, Hongyu Luo, Wun Yu Chan, Wei Fan, Haoran Li, Yangqiu Song

机构 * HKUST(香港科技大学) NYU(纽约大学) SWUPL(西南政法大学)

AI总结 探讨大语言模型智能体系统安全问题,将隔离作为头等原则,用边界中心分类法组织文献,助于识别隔离丧失位置、妥协传播方式及相关防御,还总结了故障路径,讨论挑战并勾勒研究议程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08448 2026-09-03 cs.RO 版本更新

Harness VLA: Steering Frozen VLAs into Reliable Manipulation Primitives via Memory-Guided Agents

利用VLA:通过记忆引导智能体将冻结的视觉语言动作模型转化为可靠的操作原语

Yixian Zhang, Huanming Zhang, Feng Gao, Xiao Li, Zhihao Liu, Chunyang Zhu, Jiaxing Qiu, Yuchen Yan, Jiyuan Liu, Wenhao Tang, Zhengru Fang, Yi Nie, Changxu Wei, Yu Wang, Wenbo Ding, Chao Yu

机构 * Tsinghua University(清华大学) Striding AI(驰行人工智能公司) Purdue University(普渡大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Infinigence AI(英飞智研人工智能公司) Zhongguancun Academy(中关村学院) Hong Kong University of Science and Technology(香港科技大学)

AI总结 研究语言条件下操作问题,提出Harness VLA框架,将冻结VLA与分析原语库结合,通过学习操作范围扩展预训练VLA,在多种扰动操作任务中相比基线有大幅提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06349 2026-09-03 cs.AI 版本更新

TopoBrick: Agentic Topology Sampling of Exogenous Variables for Zero-Shot Building IoT Forecasting

TopoBrick:用于零样本建筑物联网预测的外源变量的智能拓扑采样

Xiachong Lin, Du Yin, Arian Prabowo, Hao Xue, Wen Hu, Imran Razzak, Matthew Amos, Sam Behrens, Flora D. Salim

机构 * University of New South Wales(新南威尔士大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) MBZUAI(穆罕默德·本·扎耶德人工智能大学) CSIRO Energy Centre(联邦科学与工业研究组织能源中心)

AI总结 针对建筑物联网预测中现有方法的不足,提出无训练框架TopoBrick,利用建筑知识图和智能拓扑采样器选择外源变量,按部署时间可用性组织,在三座真实建筑实验中性能出色,拓扑感知采样更可靠。

Comments 13 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25184 2026-09-03 cs.LG cs.AI 版本更新

Train at Moving Edge: Online-Verified Prompt Selection for Efficient RL Training of Large Reasoning Model

在移动边缘训练:一种在线验证的提示选择方法用于大型推理模型的高效强化学习训练

Jiahao Wu, Ning Lu, Shengcai Liu, Kun Wang, Yanting Yang, Baijiong Lin, Chen Jason Zhang, Li Qing, Ke Tang

机构 * Southern University of Science and Technology(南方科技大学) The Hong Kong Polytechnic University(香港理工大学) The Hong Kong University of Science and Technology(香港科学理工大学) Nanyang Technological University(南洋理工大学) Rutgers University(罗格斯大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学理工大学(广州))

AI总结 本文提出HIVE方法,通过历史奖励轨迹和实时提示熵实现高效RL训练,提升提示选择效率而不牺牲性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23722 2026-09-03 cs.DC cs.AI 版本更新

OctoPipe: Reducing Pipeline Bubbles for Heterogeneous Models via Co-Optimizing Partitioning, Placement, and Scheduling

OctoPipe:通过共同优化分区、放置和调度减少异构模型的流水线气泡

Jihu Guo, Tenghui Ma, Wei Gao, Peng Sun, Xun Chen, Jiaxing Li, Zhisheng Ye, Yuyang Jin, Dahua Lin

机构 * FDU & Shanghai AI Laboratory(复旦大学及上海人工智能实验室) HKUST(香港科技大学) Unaffiliated(无隶属机构) Tsinghua University(清华大学) CUHK & SenseTime Research(香港大学及SenseTime研究院)

AI总结 研究针对模型架构异构性加剧流水线气泡降低训练效率的问题,提出OctoPipe系统,通过构建模拟器、开发调谐器、实现执行器共同优化分区、放置和调度,提升了吞吐量。

Comments 14 pages, 13 Figures; Accepted by SC'26;

详情

展开后加载摘要…

URL PDF HTML 收藏
2609.00615 2026-09-02 eess.SP cs.LG 新提交

BeamRMX: Radiation-Pattern-Driven Learning for Generalizable Beam Radio Map Prediction and Beam Management

BeamRMX:用于通用波束无线电地图预测和波束管理的辐射图驱动学习

Yue Zhang, Xiucheng Wang, Wenshuo Chen, Nan Cheng

机构 * Xidian University(西安电子科技大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 提出BeamRMX框架,将空间辐射图作为BeamRM查询学习场景几何到接收功率场的转换,实验显示在未见场景和配置上平均绝对误差显著降低,跨配置证据可改善重建与波束细化。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏