arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-01-30 至 2026-01-30 共收录 13
2601.22153 2026-01-30 cs.RO cs.CV

DynamicVLA: A Vision-Language-Action Model for Dynamic Object Manipulation

DynamicVLA: 一种用于动态物体操控的视觉-语言-动作模型

Haozhe Xie, Beichen Wen, Jiarui Zheng, Zhaoxi Chen, Fangzhou Hong, Haiwen Diao, Ziwei Liu

机构 * S-Lab, Nanyang Technological University(南洋理工大学S实验室)

AI总结 DynamicVLA通过整合时间推理和闭环适应,提出了一种用于动态物体操控的视觉-语言-动作模型,提升了响应速度和泛化能力。

Comments Project Page: https://www.infinitescript.com/project/dynamic-vla/ GitHub: https://github.com/hzxie/DynamicVLA

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21933 2026-01-30 cs.CV

Just Noticeable Difference Modeling for Deep Visual Features

深度视觉特征的可察觉差异建模

Rui Zhao, Wenrui Li, Lin Zhu, Yajing Zheng, Weisi Lin

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(新加坡南洋理工大学计算与数据科学学院) Department of Computer Science and Technology, Harbin Institute of Technology, Harbin, China(哈尔滨工业大学计算机科学与技术学院) School of Artificial Intelligence, Beijing Normal University, Beijing, China(北京师范大学人工智能学院) School of Computer Science, Peking University, Beijing, China(北京大学计算机学院)

AI总结 本文提出FeatJND模型,用于深度视觉特征的可察觉差异建模,通过任务对齐的容忍边界提升特征质量控制和量化效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22718 2026-01-30 cs.IT cs.CV math.IT

Edge Collaborative Gaussian Splatting with Integrated Rendering and Communication

边缘协同高斯点散布与集成渲染与通信

Yujie Wan, Chenxuan Liu, Shuai Wang, Tong Zhang, James Jianqiao Yu, Kejiang Ye, Dusit Niyato, Chengzhong Xu

机构 * Southern University of Science and Technology(南方科技大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Nanyang Technological University(南洋理工大学) University of Macau(澳门大学)

AI总结 本文提出边缘协同高斯点散布与集成渲染与通信方法,通过联合优化协作状态和边缘功率分配,解决低成本设备渲染质量退化问题,并通过PMM和ILO算法提升性能与效率。

Comments IEEE ICASSP, Barcelona, Spain, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21742 2026-01-30 cs.AI cs.CL cs.MA

Epistemic Context Learning: Building Trust the Right Way in LLM-Based Multi-Agent Systems

知识上下文学习:在基于大语言模型的多智能体系统中以正确方式建立信任

Ruiwen Zhou, Maojia Song, Xiaobao Wu, Sitao Cheng, Xunjian Yin, Yuxi Xie, Zhuoqun Hao, Wenyue Hua, Liangming Pan, Soujanya Poria, Min-Yen Kan

机构 * National University of Singapore(国立新加坡大学) Singapore University of Technology(新加坡科技学院) Nanyang Technological University(南洋理工大学) Duke University(杜克大学) University of Waterloo(滑铁卢大学) Microsoft(微软公司) Peking University(北京大学) University of Pennsylvania(宾夕法尼亚大学)

AI总结 本文提出Epistemic Context Learning(ECL),通过历史交互构建同伴资料以提升多智能体系统中信任建模的准确性,使小型模型在性能上超越大模型,并在多种配置中表现出良好的泛化能力。

Comments Codes and data are available at https://github.com/skyriver-2000/epistemic-context-learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21722 2026-01-30 cs.CL cs.AI

Enhancing Language Models for Robust Greenwashing Detection

增强语言模型以实现稳健的绿色洗脑检测

Neil Heinrich Braun, Keane Ong, Rui Mao, Erik Cambria, Gianmarco Mengaldo

机构 * National University of Singapore(新加坡国立大学) Massachusetts Institute of Technology(麻省理工学院) Nanyang Technological University(南洋理工大学)

AI总结 本文提出了一种参数高效框架,通过结合对比学习和顺序排名目标来增强语言模型在绿色洗脑检测中的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21634 2026-01-30 cs.CV

RSGround-R1: Rethinking Remote Sensing Visual Grounding through Spatial Reasoning

RSGround-R1: 重新思考通过空间推理的遥感视觉定位

Shiqi Huang, Shuting He, Bihan Wen

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University(电气电子工程学院,南洋理工大学) MoE Key Laboratory of Interdisciplinary Research of Computation and Economics, Shanghai University of Finance and Economics(教育部计算与经济交叉学科重点实验室,上海财经大学)

AI总结 RSGround-R1通过引入空间推理引导的后训练框架,提升遥感图像中目标物体的定位精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21208 2026-01-30 cs.AI cs.IR

When should I search more: Adaptive Complex Query Optimization with Reinforcement Learning

我应该何时搜索更多:基于强化学习的自适应复杂查询优化

Wei Wen, Sihang Deng, Tianjun Wei, Keyu Chen, Ruizhi Qiao, Xing Sun

机构 * Tencent Youtu Lab(腾讯云图实验室) The University of Hong Kong(香港大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出自适应复杂查询优化框架ACQO,通过强化学习解决复杂查询优化中的子查询数量确定、文档排序与合并问题,实现更稳定高效的查询处理。

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15930 2026-01-30 cs.IR cs.AI

MMGRid: Navigating Temporal-aware and Cross-domain Generative Recommendation via Model Merging

MMGRid: 通过模型融合实现时间感知和跨领域生成推荐

Tianjun Wei, Enneng Yang, Yingpeng Du, Huizhong Guo, Jie Zhang, Zhu Sun

机构 * Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学) Singapore University of Technology and Design(新加坡科技设计大学)

AI总结 MMGRid通过模型融合解决跨领域生成推荐中的时间感知和上下文融合问题,揭示参数冲突和近期偏差的解决方法。

Comments https://github.com/Joinn99/MMGRid

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09828 2026-01-30 cs.CV

UniHash: Unifying Pointwise and Pairwise Hashing Paradigms

UniHash:统一点对点和配对哈希范式

Xiaoxu Ma, Runhao Li, Xiangbo Zhang, Zhenyu Weng

机构 * South China University of Technology(南方科技大学) Georgia Institute of Technology(佐治亚理工学院) Nanyang Technological University(南洋理工大学)

AI总结 UniHash通过统一点对点和配对哈希范式,提升图像检索在已见过和未见过类别上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01774 2026-01-30 cs.CV

Evaluating SAM2 for Video Semantic Segmentation

评估SAM2用于视频语义分割

Syed Hesham Syed Ariff, Yun Liu, Guolei Sun, Jing Yang, Henghui Ding, Xue Geng, Xudong Jiang

机构 * School of EEE(电子工程系) Nanyang Technological University(南洋理工大学) Institute for Infocomm Research(信息通信研究所) A*STAR College of Computer Science(计算机科学学院) Nankai University(南开大学) State Key Laboratory of Public Big Data(公共大数据国家重点实验室) Guizhou University(贵州大学) Fudan Vision and Learning Lab(复旦大学视觉与学习实验室)

AI总结 本文评估了SAM2在视频语义分割中的应用,通过两种方法提升分割性能,利用SAM2的精确边界预测增强整体效果。

Comments 17 pages, 3 figures and 7 tables

Journal ref Machine Intelligence Research (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10890 2026-01-30 cs.CL

LLM$\times$MapReduce-V3: Enabling Interactive In-Depth Survey Generation through a MCP-Driven Hierarchically Modular Agent System

LLM×MapReduce-V3:通过MCP驱动的分层模块化代理系统实现交互式深入调研生成

Yu Chao, Siyu Lin, xiaorong wang, Zhu Zhang, Zihan Zhou, Haoyu Wang, Shuo Wang, Jie Zhou, Zhiyuan Liu, Maosong Sun

机构 * Dept. of Comp. Sci. & Tech., Institute for AI, BNRist Center, Tsinghua University(计算机科学与技术系,人工智能研究院,BNRist中心,清华大学) Peking University(北京大学) Modelbest Inc.(Modelbest公司) Nanyang Technological University(南洋理工大学)

AI总结 LLM×MapReduce-V3通过MCP驱动的分层模块化代理系统实现交互式深入调研生成,提升调研内容深度与长度。

Comments Accepted by EMNLP2025 System Demonstration

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26157 2026-01-30 cs.CV cs.AI cs.LG

Entropy Guided Dynamic Patch Segmentation for Time Series Transformers

熵引导的动态补丁分割用于时间序列变换器

Sachith Abeywickrama, Emadeldeen Eldele, Min Wu, Xiaoli Li, Chau Yuen

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(南洋理工大学电子与电气工程学院) Institute for Infocomm Research, A*STAR, Singapore(信息通信研究所,A*STAR,新加坡) Department of Computer Science, Khalifa University, UAE(计算机科学系,哈利法大学,阿联酋) Information Systems Technology and Design, Singapore University of Technology and Design, Singapore(信息系统技术与设计,新加坡科技与设计大学,新加坡)

AI总结 本文提出熵引导的动态补丁编码器,通过动态检测时间转换点来提升时间序列建模的准确性和效率。

Comments Preprint. Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18546 2026-01-30 cs.CV

SEGA: A Transferable Signed Ensemble Gaussian Black-Box Attack against No-Reference Image Quality Assessment Models

SEGA:一种可转移的带符号集成高斯黑盒攻击,用于无参考图像质量评估模型

Yujia Liu, Dingquan Li, Zhixuan Li, Tiejun Huang

机构 * School of Computer Science, the National Key Laboratory for Multimedia Information Processing, National Engineering Research Center of Visual Technology, Peking University(计算机科学学院、多媒体信息处理国家级重点实验室、视觉技术工程研究中心、北京大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院、南洋理工大学) Department of Networked Intelligence, Pengcheng Laboratory(网络智能系、鹏城实验室)

AI总结 SEGA提出了一种可转移的黑盒攻击方法,通过高斯平滑和集成梯度来提升对无参考图像质量评估模型的攻击效果。

详情

展开后加载摘要…

URL PDF HTML 收藏