PACE: A Unified Condense-and-Extract Paradigm for Fast VLM Inference
PACE:用于快速视觉语言模型推理的统一压缩-提取范式
Junjie Liu, Shengyuan Ye, Xu Chen
机构
*
Sun Yat-sen University(中山大学)
;
Power Dispatch Control Center, Guangdong Power Grid Co., Ltd.(广东电网有限责任公司电力调度控制中心)
;
Shenzhen Loop Area Institute(深圳河套学院)
Understanding Evolution Strategies for LLM Reasoning: Broader Reasoning Coverage than GRPO
理解用于大语言模型推理的进化策略:比GRPO更广泛的推理覆盖范围
Yunpeng Ba, Zhi Zheng, Yue Xie, Jiaqing Li, Xialiang Tong, Tao Zhong, Mingxuan Yuan, Zhichao Lu, Xuyang Wu, Zhenkun Wang
机构
*
Southern University of Science and Technology(南方科技大学)
;
National University of Singapore(新加坡国立大学)
;
Harbin Institute of Technology, Weihai(哈尔滨工业大学(威海))
;
Huawei Noah’s Ark Lab(华为诺亚方舟实验室)
;
City University of Hong Kong(香港城市大学)
ClueWeaver: Reward-Guided Dual-Agent Evidence Reasoning for Compact LLMs on Literary Long Narratives
ClueWeaver:面向紧凑型大语言模型的、针对文学长篇叙事的奖励引导双智能体证据推理框架
Jihao Zhu, Zhiwei Yang, Wenxiao Zhang, Junqian Zhao, Qi You, Fangqi Wang, Zheyuan Deng, Hanzhe Yang, Yu Liu, Jin B. Hong
机构
*
Institute of Information Engineering, CAS(中国科学院信息工程研究所)
;
University of Aberdeen(阿伯丁大学)
;
The University of Western Australia(西澳大学)
;
Brown University(布朗大学)