arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

National University of Singapore(新加坡国立大学)

2026-02-06 至 2026-02-06 共收录 12
2602.06013 2026-02-06 cs.CV cs.AI

GenArena: How Can We Achieve Human-Aligned Evaluation for Visual Generation Tasks?

GenArena: 如何在视觉生成任务中实现人对齐的评估?

Ruihang Li, Leigang Qu, Jingxu Zhang, Dongnan Gui, Mengde Xu, Xiaosong Zhang, Han Hu, Wenjie Wang, Jiaqi Wang

机构 * University of Science(科学大学) Shanghai Innovation Institute(上海创新研究所) Tencent(腾讯) National University of Singapore(新加坡国立大学)

AI总结 GenArena通过成对比较范式实现视觉生成任务的人对齐评估,使开源模型超越专有模型,提升评估准确性达20%以上。

Comments Project Page: https://genarena.github.io/, Code: https://github.com/ruihanglix/genarena

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05927 2026-02-06 stat.ML cs.LG

Transformers Are Born Biased: Structural Inductive Biases at Random Initialization and Their Practical Consequences

Transformer 诞生时的偏见:随机初始化下的结构归纳偏见及其实际影响

Siquan Li, Yao Tong, Haonan Wang, Tianyang Hu

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) National University of Singapore(新加坡国立大学)

AI总结 研究揭示了随机初始化的 Transformer 存在结构偏见,通过 SeedPrint 方法区分初始化差异的模型,并解释了注意力机制导致的汇现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05789 2026-02-06 cs.CV cs.AI

Allocentric Perceiver: Disentangling Allocentric Reasoning from Egocentric Visual Priors via Frame Instantiation

非自体参照感知器:通过帧实例化解耦非自体参照推理与自体参照视觉先验

Hengyi Wang, Ruiqiang Zhang, Chang Liu, Guanjie Wang, Zehua Ma, Han Fang, Weiming Zhang

机构 * Anhui Province Key Laboratory of Digital Security, University of Science(安徽数字安全重点实验室,科学大学) National University of Singapore(新加坡国立大学)

AI总结 非自体参照感知器通过帧实例化解耦非自体参照推理与自体参照视觉先验,提升空间推理任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05690 2026-02-06 cs.LG cs.IT math.IT

Almost Asymptotically Optimal Active Clustering Through Pairwise Observations

通过成对观测实现近似最优的主动聚类

Rachel S. Y. Teo, P. N. Karthik, Ramya Korlakai Vinayak, Vincent Y. F. Tan

机构 * National University of Singapore(国立新加坡大学) Indian Institute of Technology Hyderabad(印度海得拉巴理工学院) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

AI总结 通过成对观测实现近似最优的主动聚类,利用测度变化技术建立查询次数下界,并设计渐近最优算法。

Comments 31 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05590 2026-02-06 cs.CV cs.ET cs.GR

EgoPoseVR: Spatiotemporal Multi-Modal Reasoning for Egocentric Full-Body Pose in Virtual Reality

EgoPoseVR:用于虚拟现实中的自体空间时间多模态推理以实现中心全身体姿

Haojie Cheng, Shaun Jing Heng Ong, Shaoyu Cai, Aiden Tat Yang Koh, Fuxi Ouyang, Eng Tat Khoo

机构 * National University of Singapore(新加坡国立大学) Singapore University of Technology and Design(新加坡科技设计大学)

AI总结 EgoPoseVR通过融合头戴设备运动信息与中心RGB-D观测,实现了在虚拟现实中的准确全身姿态跟踪,提高了姿态估计的准确性和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05588 2026-02-06 cs.CV cs.ET cs.GR

A Mixed Reality System for Robust Manikin Localization in Childbirth Training

一种用于产科培训中鲁棒人偶定位的混合现实系统

Haojie Cheng, Chang Liu, Abhiram Kanneganti, Mahesh Arjandas Choolani, Arundhati Tushar Gosavi, Eng Tat Khoo

机构 * National University of Singapore(新加坡国立大学) National University Health System(国立大学医疗系统)

AI总结 本研究提出一种混合现实系统,通过结合虚拟指导与触觉人偶交互,实现产科培训中人偶的鲁棒定位,提升学员学习效率并提高培训效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01999 2026-02-06 cs.CL

From Latent Signals to Reflection Behavior: Tracing Meta-Cognitive Activation Trajectory in R1-Style LLMs

从潜在信号到反射行为:在R1风格大语言模型中追踪元认知激活轨迹

Yanrui Du, Yibo Gao, Sendong Zhao, Jiayun Li, Haochun Wang, Qika Lin, Kai He, Bing Qin, Mengling Feng

机构 * SCIR Lab, Harbin Institute of Technology(哈尔滨工业大学SCIR实验室) National University of Singapore(新加坡国立大学)

AI总结 研究通过分析R1风格大语言模型中反思行为的激活轨迹,揭示了元认知过程从潜在监控到话语调节再到自我反思的阶段性特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15075 2026-02-06 cs.AI cs.CL

The Why Behind the Action: Unveiling Internal Drivers via Agentic Attribution

行动背后的缘由:通过代理归因揭示内部驱动因素

Chen Qian, Peng Wang, Dongrui Liu, Junyao Yang, Dadi Guo, Ling Tang, Jilin Mei, Qihan Ren, Shuai Shao, Yong Liu, Jie Fu, Jing Shao, Xia Hu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Renmin University of China(中国人民大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出通用代理归因框架,通过分层方法识别代理行为的内部驱动因素,提升代理系统的安全性和可问责性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01151 2026-02-06 cs.CV cs.AI

Personalized Safety Alignment for Text-to-Image Diffusion Models

面向文本到图像扩散模型的个性化安全对齐

Yu Lei, Jinbin Bai, Qingyu Shi, Aosong Feng, Hongcheng Gao, Xiao Zhang, Rex Ying

机构 * National University of Singapore(新加坡国立大学) Peking University(北京大学) Yale University(耶鲁大学) Collov Labs(Collov实验室)

AI总结 本文提出个性化安全对齐框架PSA,通过用户条件适应提升文本到图像扩散模型的安全性与生成质量,实现安全与质量的动态平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04925 2026-02-06 cs.LG cs.AI cs.CL

Internalizing LLM Reasoning via Discovery and Replay of Latent Actions

将LLM推理内化:通过发现和重播潜在动作

Zhenning Shi, Yijia Zhu, Junhan Shi, Xun Zhang, Lei Wang, Congcong Miao

机构 * Tsinghua University(清华大学) National University of Singapore(新加坡国立大学) Fuzhou University(福州大学)

AI总结 STIR通过动态潜在轨迹控制实现LLM推理内化,提升准确率并减少token消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04919 2026-02-06 cs.LG

Gradually Compacting Large Language Models for Reasoning Like a Boiling Frog

逐步压缩大型语言模型以像沸 frog 一样进行推理

Yiran Zhao, Shengyang Zhou, Zijian Wu, Tongyan Hu, Yuhui Xu, Rengan Dou, Kenji Kawaguchi, Shafiq Joty, Junnan Li, Michael Qizhe Shieh

机构 * Salesforce AI Research(Salesforce AI研究部) National University of Singapore(新加坡国立大学)

AI总结 本文提出了一种渐进压缩方法,通过剪枝-微调循环逐步减少大型语言模型大小,同时保持推理性能,适用于多种剪枝策略和后期训练方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11007 2026-02-06 cs.CV cs.AI cs.LG

VisMem: Latent Vision Memory Unlocks Potential of Vision-Language Models

VisMem: 通过潜在视觉记忆解锁视觉-语言模型的潜力

Xinlei Yu, Chengming Xu, Guibin Zhang, Zhangquan Chen, Yudong Zhang, Yongbo He, Peng-Tao Jiang, Jiangning Zhang, Xiaobin Hu, Shuicheng Yan

机构 * National University of Singapore(新加坡国立大学) Fudan University(复旦大学) Tsinghua University(清华大学) Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学) vivo

AI总结 VisMem通过引入动态潜在视觉记忆模块,提升视觉-语言模型在复杂视觉任务中的性能,实现感知准确性和语义一致性之间的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏