2508.18473 2026-04-29 cs.CL cs.AI cs.LG Principled Detection of Hallucinations in Large Language Models via Multiple Testing 通过多重检验原则检测大语言模型中的幻觉 Jiawei Li, Akshayaa Magesh, Venugopal V. Veeravalli 机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; Meta 纠错 AI总结 本文提出通过多重检验方法系统整合多个评估分数,实现受控的幻觉检测,验证了方法在不同模型和数据集上的鲁棒性。 Comments 14 pages, 2 figures 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2604.25164 2026-04-29 cs.CV IAM: Identity-Aware Human Motion and Shape Joint Generation IAM:基于身份的人体运动与形状联合生成 Wenqi Jia, Zekun Li, Abhay Mittal, Chengcheng Tang, Chuan Guo, Lezi Wang, James Matthew Rehg, Lingling Tao, Size An 机构 * UIUC(伊利诺伊大学香槟分校) ; Meta Reality Labs(Meta现实实验室) ; Brown University(布朗大学) 纠错 AI总结 本文提出一种基于身份的人体运动与形状联合生成框架,通过多模态信号建模身体形态与运动动态的关系,提升运动真实性和身份一致性。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2604.07927 2026-04-29 cs.AI EigentSearch-Q+: Enhancing Deep Research Agents with Structured Reasoning Tools EigentSearch-Q+: 通过结构化推理工具增强深度研究代理 Boer Zhang, Mingyan Wu, Dongzhuoran Zhou, Yuqicheng Zhu, Wendong Fan, Puzhen Zhang, Zifeng Ding, Guohao Li, Yuan He 机构 * Meta ; Northeastern University, China(东北大学) ; University of Oslo(奥斯陆大学) ; Bosch Center for AI(博世人工智能中心) ; University of Stuttgart(斯图加特大学) ; University of Cambridge(剑桥大学) ; Mina AI ; Amazon(亚马逊) 纠错 AI总结 本文提出Q+工具,通过引导查询规划和证据提取提升深度研究代理的搜索效率,实验显示在多个基准测试中提升了模型准确性。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2603.15954 2026-04-29 cs.LG cs.AI MobileLLM-Flash: Latency-Guided On-Device LLM Design for Industry Scale Deployment MobileLLM-Flash: 用于工业级部署的延迟引导设备端大语言模型设计 Hanxian Huang, Igor Fedorov, Andrey Gromov, Bernard Beckerman, Naveen Suda, David Eriksson, Maximilian Balandat, Rylan Conway, Patrick Huber, Chinnadhurai Sankar, Ayushi Dalmia, Zechun Liu, Lemeng Wu, Tarek Elgamal, Adithya Sagar, Vikas Chandra, Raghuraman Krishnamoorthi 机构 * Meta AI 纠错 AI总结 本文提出MobileLLM-Flash,通过硬件循环架构搜索在移动端延迟约束下设计高效的大语言模型,支持8k上下文长度,实现更快的预填和解码速度。 Comments Accepted to ACL Industry Track 2026 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图