arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Northeastern University(东北大学)

2026-01-06 至 2026-01-06 共收录 3
2601.01392 2026-01-06 cs.SD cs.CL eess.AS

SAFE-QAQ: End-to-End Slow-Thinking Audio-Text Fraud Detection via Reinforcement Learning

SAFE-QAQ: 通过强化学习实现端到端的慢思考音频-文本欺诈检测

Peidong Wang, Zhiming Ma, Xin Dai, Yongkang Liu, Shi Feng, Xiaocui Yang, Wenxing Hu, Zhihao Wang, Mingjun Pan, Li Yuan, Daling Wang

机构 * Northeastern University, China(东北大学) China Mobile Internet Company Ltd.(中国移动互联网有限公司) Shanghai University of Electric Power, China(上海电力大学) Peking University, Shenzhen, China(北京大学深圳分校)

AI总结 SAFE-QAQ通过强化学习实现端到端音频-文本欺诈检测,有效提升准确性、效率和实时处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01022 2026-01-06 cs.CV cs.AI cs.LG

Decoupling Amplitude and Phase Attention in Frequency Domain for RGB-Event based Visual Object Tracking

频域中解耦幅度与相位注意力以实现RGB-事件视觉目标跟踪

Shiao Wang, Xiao Wang, Haonan Zhao, Jiarui Xu, Bo Jiang, Lin Zhu, Xin Zhao, Yonghong Tian, Jin Tang

机构 * School of Computer Science and Technology, Anhui University(安徽大学计算机科学与技术学院) Northeastern University(东北大学) Beijing Institute of Technology(北京理工大学) School of Computer and Communication Engineering, University of Science and Technology Beijing(北京科技大学计算机与通信工程学院) Peng Cheng Laboratory(鹏城实验室) National Key Laboratory for Multimedia Information Processing, School of Computer Science, Peking University(北京大学多媒体信息处理国家重点实验室) School of Electronic and Computer Engineering, Shenzhen Graduate School, Peking University(北京大学深圳研究生院电子与计算机工程学院)

AI总结 本文提出了一种在频域中解耦幅度与相位注意力的RGB-事件视觉目标跟踪方法,通过高频信息融合和运动引导稀疏化模块提升跟踪性能和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09907 2026-01-06 cs.CV

VisualActBench: Can VLMs See and Act like a Human?

VisualActBench: VLMs能否像人一样看见并行动?

Daoan Zhang, Pai Liu, Xiaofei Zhou, Yuan Ge, Guangchen Lan, Jing Bi, Christopher Brinton, Ehsan Hoque, Jiebo Luo

机构 * University of Rochester(罗切斯特大学) Purdue University(普渡大学) Northeastern University(东北大学)

AI总结 VisualActBench通过评估VLMs在视觉行动推理任务中的表现,揭示了其在主动推理和高优先级动作生成方面与人类能力的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏