arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Tencent(腾讯)

2026-03-23 至 2026-03-23 共收录 6
2603.19616 2026-03-23 cs.CV

UniPR: Unified Object-level Real-to-Sim Perception and Reconstruction from a Single Stereo Pair

UniPR: 一种统一的基于单立体对的物体级实拍到仿真感知与重建框架

Chuanrui Zhang, Yingshuang Zou, ZhengXian Wu, Yonggen Ling, Yuxiao Yang, Ziwei Wang

机构 * NTU(国立新加坡大学) Tencent Robotics X(腾讯机器人实验室) Futian Laboratory(福田实验室) HKUST(香港科技大学) THU(清华大学)

AI总结 本文提出UniPR,一种端到端的物体级实拍到仿真感知与重建框架,通过几何约束解决尺度模糊问题,消除了对类别特定规范的依赖,并通过大规模立体数据集LVS6D提升研究效率和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20945 2026-03-23 cs.CL cs.AI

The Art of Efficient Reasoning: Data, Reward, and Optimization

高效推理的艺术:数据、奖励与优化

Taiqiang Wu, Zenan Xu, Bo Zhou, Ngai Wong

机构 * The University of Hong Kong(香港大学) LLM Department, Tencent(腾讯人工智能实验室)

AI总结 本文系统研究了大型语言模型的高效推理机制,通过精细化指标评估发现训练过程分为长度适应与推理优化两阶段,提出保持正奖励密度以避免短即正确陷阱,并验证了在不同领域和难度下的通用性。

Comments Tech Report, Insights on Efficient Reasoning via Reward Shaping

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07901 2026-03-23 cs.CV

Stand-In: A Lightweight and Plug-and-Play Identity Control for Video Generation

Stand-In: 一种轻量级且即插即用的身份控制方法用于视频生成

Bowen Xue, Zheng-Peng Duan, Qixin Yan, Wenjing Wang, Hao Liu, Chun-Le Guo, Chongyi Li, Chen Li, Jing Lyu

机构 * WeChat Vision, Tencent Inc.(腾讯微信视觉实验室) VCIP, CS, Nankai University(南开大学计算机科学与技术学院)

AI总结 本文提出Stand-In框架,通过引入条件图像分支和受限自注意力机制,实现轻量级身份控制,仅用1%额外参数和2000训练对即可提升视频质量和身份保持性,并支持多种视频生成任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10985 2026-03-23 cs.CL

Taking a Deep Breath: Enhancing Language Modeling of Large Language Models with Sentinel Tokens

深呼吸:通过哨兵令牌增强大语言模型的语言建模

Weiyao Luo, Suncong Zheng, Heming Xia, Weikang Wang, Yan Lei, Tianyu Liu, Shuang Chen, Zhifang Sui

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,北京大学计算机学院) School of Software & Microelectronics, Peking University(北京大学软件与微电子学院) Tencent Hunyuan(腾讯文言) Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Alibaba Group(阿里巴巴集团)

AI总结 本文提出通过插入哨兵令牌使大语言模型能够总结离散文本块信息,提升长文本建模能力,实验验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.02831 2026-03-23 cs.CV

Deep Face Restoration: A Survey

深度人脸修复:综述

Tao Wang, Kaihao Zhang, Jiankang Deng, Tong Lu, Wei Liu, Stefanos Zafeiriou

机构 * The State Key Lab for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Australian National University(澳大利亚国立大学) Imperial College London(伦敦帝国理工学院) Tencent(腾讯)

AI总结 本文综述了基于深度学习的人脸修复方法,分析了问题 formulations、挑战及最新技术,提供了系统评估和开源资源。

Comments Accepted by ACM Computing Surveys, 39 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02435 2026-03-23 cs.LG

Efficient Cross-Domain Offline Reinforcement Learning with Dynamics- and Value-Aligned Data Filtering

高效跨领域离线强化学习中的动态与价值对齐数据筛选

Zhongjian Qiao, Rui Yang, Jiafei Lyu, Chenjia Bai, Xiu Li, Siyang Gao, Shuang Qiu

机构 * City University of Hong Kong University of Illinois Urbana-Champaign Tencent Institute of Artificial Intelligence, China Telecom (TeleAI) Tsinghua University. Corresponding Author

AI总结 本文提出DVDF方法,通过动态和价值对齐筛选源域样本,提升跨领域离线强化学习性能,实验表明其在多种任务和数据集上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏