arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

2025-11-17 至 2025-11-17 共收录 7
2511.11552 2025-11-17 cs.CV cs.CL

DocLens : A Tool-Augmented Multi-Agent Framework for Long Visual Document Understanding

Dawei Zhu, Rui Meng, Jiefeng Chen, Sujian Li, Tomas Pfister, Jinsung Yoon

机构 * Google Cloud AI Research(谷歌云人工智能研究) School of Computer Science, Peking University(北京大学计算机学院)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09915 2025-11-17 cs.CL cs.MM cs.SD

HI-TransPA: Hearing Impairments Translation Personal Assistant

Zhiming Ma, Shiyu Gan, Junhao Zhao, Xianming Li, Qingyun Pan, Peidong Wang, Mingjun Pan, Yuhao Mo, Jiajie Cheng, Chengxin Chen, Zhonglun Cao, Chonghan Liu, Shi Cheng

机构 * SmartFlowAI Research(SmartFlowAI研究院) Tongji University(同济大学) CMIC Guangzhou(广州CMIC) BUPT Beijing(北京邮电大学) Northeastern University Shenyang(沈阳东北大学) Peking University(北京大学) Qiyuan Tech Beijing(北京启元科技)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21244 2025-11-17 cs.AI

VoiceAgentEval: A Dual-Dimensional Benchmark for Expert-Level Intelligent Voice-Agent Evaluation of Xbench's Professional-Aligned Series

Pengyu Xu, Shijia Li, Ao Sun, Feng Zhang, Yahan Li, Bo Wu, Zhanyu Ma, Jiguo Li, Jun Xu, Jiuchong Gao, Jinghua Hao, Renqing He, Rui Wang, Yang Liu, Xiaobo Hu, Fan Yang, Jia Zheng, Guanghua Yao

机构 * Meituan(美团) Xbench Agora Beijing Jiaotong University(北京交通大学) BUPT(北京邮电大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Jilin University(吉林大学) Peking University(北京大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25187 2025-11-17 cs.CV

FlashI2V: Fourier-Guided Latent Shifting Prevents Conditional Image Leakage in Image-to-Video Generation

Yunyang Ge, Xinhua Cheng, Chengshu Zhao, Xianyi He, Shenghai Yuan, Bin Lin, Bin Zhu, Li Yuan

机构 * Peking University, Shenzhen Graduate School(北京大学深圳研究生院) Peng Cheng Laboratory(鹏城实验室) Rabbitpre AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11018 2025-11-17 cs.CL cs.AI cs.CR cs.LG cs.SE

Automata-Based Steering of Large Language Models for Diverse Structured Generation

Xiaokun Luan, Zeming Wei, Yihao Zhang, Meng Sun

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院)

Comments ICFEM 2025 (Best Paper Award)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10953 2025-11-17 cs.CV

Language-Guided Graph Representation Learning for Video Summarization

Wenrui Li, Wei Han, Hengyu Man, Wangmeng Zuo, Xiaopeng Fan, Yonghong Tian

机构 * Department of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术系) Harbin Institute of Technology Suzhou Research Institute(哈尔滨工业大学苏州研究所) School of AI for Science, the Shenzhen Graduate School, Peking University(北京大学人工智能科学学院、深圳研究生院) Peng Cheng Laboratory(鹏城实验室) School of Computer Science, Peking University(北京大学计算机学院)

Comments Accepted by IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16533 2025-11-17 cs.CV

Motion Matters: Compact Gaussian Streaming for Free-Viewpoint Video Reconstruction

Jiacong Chen, Qingyu Mao, Youneng Bao, Xiandong Meng, Fanyang Meng, Ronggang Wang, Yongsheng Liang

机构 * College of Applied Technology, Shenzhen University(深圳大学应用技术学院) College of Big Data and Internet, Shenzhen Technology University(深圳科技大学大数据与互联网学院) College of Electronics and Information Engineering, Shenzhen University(深圳大学电子与信息工程学院) Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系) Pengcheng Laboratory, Shenzhen(深圳鹏城实验室) School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院)

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏