arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Tencent(腾讯)

2026-08-10 至 2026-08-10 共收录 3
2608.03020 2026-08-10 cs.AI 版本更新

LoCA: Forward-Only LLM Tuning after One-Shot Calibration with Local Credit Assignment

LoCA:基于局部信用分配的一次性校准后仅前向的大语言模型调优

Linhan Xia, Rui Liu, Zhaofeng Zhang, Yihao Wang, Binrui Shen, Shengxin Zhu

机构 * University of Oklahoma(俄克拉荷马大学) Imperial College London(伦敦帝国学院) University of Michigan(密歇根大学) Tencent(腾讯) University of Edinburgh(爱丁堡大学) University of Southern California(南加州大学) Beijing Normal University(北京师范大学) Beijing Normal-Hong Kong Baptist University(北京师范大学-香港浸会大学联合国际学院)

AI总结 本文提出LoCA方法,通过一次性校准替换大语言模型调优的重复反向传播,在多个基准上优于LoRA,降低了GPU峰值内存、CPU稳态内存与前向传递时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25291 2026-08-10 cs.CL 版本更新

CoSA: Accelerating Long-Context Inference via Proxy-Kernel Co-Designed Sparse Attention

CoSA:通过代理内核协同设计的稀疏注意力加速长上下文推理

Yufei Xue, Lin Niu, Hong Liu, Siran Liu, Hanyong Shao, Wei Liu, Guanghua Yu, Jianchen Zhu, Jun Zhang

机构 * Tencent(腾讯)

AI总结 研究针对自注意力长上下文推理成本高的问题,提出CoSA方法,通过结合内核感知代理与有序跳过内核,在两阶段实现高效稀疏注意力,在主流LLM和长上下文基准测试中,以低预算获高精度,加速注意力并减少端到端时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17889 2026-08-10 cs.CV 版本更新

Identity as Presence: Towards Appearance and Voice Personalized Joint Audio-Video Generation

身份作为存在:迈向基于外观和声音的联合音频视频生成

Qin Chen, Yingjie Chen, Shilun Lin, Cai Xing, Binxin Yang, Long Zhou, Qixin Yan, Wenjing Wang, Dingming Liu, Hao Liu, Chen Li, Jing Lyu

机构 * Tencent Inc.(腾讯公司) Peking University(北京大学)

AI总结 本文提出一个统一的框架,实现身份感知的音频视频生成,通过数据整理管道和灵活的身份注入机制,提升生成内容的高保真度和一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏