arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-08-26 至 2026-08-26 共收录 9
2608.24885 2026-08-26 cs.RO cs.CV 新提交

Do Robotic World Models Really Follow Actions? Diagnosing and Aligning Action-Conditioned Generation for Policy Learning

机器人世界模型真的会遵循动作吗?面向策略学习的动作条件生成诊断与对齐

Sixiang Chen, Jiaming Liu, Jixian Wu, Yichen Guo, Tinghao Wang, Siyuan Qian, Hao Chen, Jiajun Cao, Jian Tang, Shanghang Zhang

机构 * Peking University(北京大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) New York University(纽约大学) University of Electronic Science and Technology of China(电子科技大学) Nanyang Technological University(南洋理工大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文针对动作条件世界模型的动作遵循问题,提出WorldEcho诊断工具与WorldSync改进方法,经实验验证WorldSync可提升动作遵循性能,作为可靠模拟器助力策略改进并提高任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24621 2026-08-26 cs.CL 新提交

Beyond Semantic Accuracy: Consequence-Aware Evaluation for Safety-Critical Language Understanding

超越语义准确率:面向安全关键型语言理解的后果感知评估

Yujing Chang, Thinh Pham, Van-Phat Thai, Chunyao Ma, Yash Guleria, Pham Nhut Huy, Sameer Alam

机构 * ATMRI, Nanyang Technological University (NTU)(南洋理工大学ATMRI) Centre of AI Research, VinUniversity(文大学人工智能研究中心) School of Management, Indian Institute of Technology Mandi(印度理工大学曼迪分校管理学院)

AI总结 针对空管场景,研究发现传统NLP指标会误判语言模型的操作可靠性,提出后果感知评估可弥补语义-安全差距,为安全关键型部署提供必要补充。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24534 2026-08-26 cs.AI 新提交

Neurosymbolic Alignment for Physiologically-Safe Clinical Language Models

面向生理安全临床语言模型的神经符号对齐

Abdulhady Abas Abdullah, Erik Cambria, Milena Zivkovic

机构 * University of Kurdistan Hewlêr(库尔德斯坦大学) Nanyang Technological University(南洋理工大学) Massachusetts Institute of Technology(麻省理工学院) University of Kragujevac(克拉古耶瓦茨大学)

AI总结 提出神经符号对齐框架,耦合临床LLM与HGNN生理世界模型,在CSB基准上显著提升临床LLM的生理安全性能,优于ORPO、GPT-4等方法,为临床LLM安全对齐提供新路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24482 2026-08-26 cs.LG cs.AI cs.CL 新提交

Beyond Static Interpretability: Anticipating Post-SFT Mechanisms from Pre-SFT Parameters for Better Tuning

超越静态可解释性:基于预SFT参数预测后SFT机制以实现更优微调

Hang Chen, Jiaying Zhu, Wenya Wang

机构 * College of Computing and Data Science(计算与数据科学学院) Nanyang Technological University(南洋理工大学) School of Computer Science and Engineering(计算机科学与工程学院) The Chinese University of Hong Kong(香港中文大学)

AI总结 本研究针对传统机制可解释性无法在训练前识别任务关键机制的局限,提出前瞻性定位框架,结合双粒度定位流程,实现了更优的SFT指导与稳健的可扩展性能。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24134 2026-08-26 cs.CV 新提交

EgoErrorVQA: Assess Egocentric Comprehension Capabilities through Procedural Errors for Ego-Agentic AI

EgoErrorVQA:通过程序错误评估自我主体人工智能的以自我为中心的理解能力

Junlong Li, Junxi Li, Jianjun Gao, Chen Cai, Lap-Pui Chau, Yi Wang

机构 * The Hong Kong Polytechnic University(香港理工大学) Nanyang Technological University(南洋理工大学)

AI总结 针对现有视觉智能体和VLMs忽略以自我为中心视角评估程序理解能力的问题,本文提出EgoErrorVQA任务,开发基于A2A协议的评估智能体,引入Ego-ADR框架提升模型对程序错误的理解,取得良好效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24107 2026-08-26 cs.CV cs.AI 新提交

MatReplace: A Reference-Free, Conditioning-Aligned Benchmark for Material Replacement in Interior Scenes

MatReplace:用于室内场景材料替换的无参考、条件对齐基准

Mingzhe Du, Thong Thanh Nguyen, Nguyen Tran Cong Duy, See-Kiong Ng, Luu Anh Tuan

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) VinUniversity

AI总结 研究针对室内场景材料替换任务推出无参考基准MatReplace,定义三个条件轨道,实验发现命名材料渲染基本解决但像素视觉定位仍存挑战,专家评分验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24039 2026-08-26 cs.RO cs.AI 新提交

Design-to-Plan: A Large Language Model-Based Multi-Agent Framework for Manufacturing Process Planning from 3D CAD Models and 2D Engineering Drawings

Design-to-Plan:基于大语言模型的多智能体框架,用于从3D CAD模型和2D工程图生成制造工艺规划

Muhammad Tayyab Khan, Lequn Chen, Wenhe Feng, Seung Ki Moon

机构 * Singapore Institute of Manufacturing Technology (SIMTech), Agency for Science, Technology and Research (A*STAR)(新加坡制造技术研究院(新加坡科学、技术与研究局)) Advanced Remanufacturing and Technology Centre (ARTC), Agency for Science, Technology and Research (A*STAR)(先进再制造与技术中心(新加坡科学、技术与研究局)) School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与宇航工程学院)

AI总结 该研究提出Design-to-Plan多智能体框架,结合LLM与确定性模块,实现从3D CAD及2D图纸到制造工艺规划的端到端自动化,经300个基准案例验证,性能优异且令牌用量显著降低。

Comments Submitted to Elsevier Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23839 2026-08-26 cs.RO cs.AI 新提交

Resilience Matters for Embodied Agents System: New Metrics, Systematic Evaluation, and Optimization

弹性对具身智能体系统的重要性:新指标、系统评估与优化

Yapeng Liu, Yuanzhao Zhai, Xudong Gong, Dawei Feng, Bo Ding, Lin Wang, Huaimin Wang

机构 * National University of Defense Technology(国防科技大学) Nanyang Technological University(南洋理工大学)

AI总结 该研究针对具身智能体系统忽略弹性属性的问题,提出弹性评估框架与指标集,经400项家庭任务实验验证其诊断优化效果,揭示弹性特征间的权衡关系。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23723 2026-08-26 cs.CV 新提交

DriftAD: Visually-Guided Text Drift for Few-Shot Industrial Anomaly Detection

DriftAD:用于小样本工业异常检测的视觉引导文本漂移

Wenyang Liu, Tianyi Liu, Dongshuo Zhang, Kejun Wu, Adams Wai-Kin Kong

机构 * Nanyang Technological University(南洋理工大学) Huazhong University of Science and Technology(华中科技大学)

AI总结 针对现有小样本工业异常检测方法无法捕捉缺陷局部性与尺度依赖性的问题,提出含ASA、VGTD、DGSG模块及对应损失的DriftAD框架,在MVTec-AD和VisA数据集的1/2/4次设置下取得最优性能。

Comments Accepted by ACM Multimedia 2026 (ACM MM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏