arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

大厂专区

Microsoft(微软)

2026-04-27 至 2026-04-27 共收录 3
2505.20435 2026-04-27 cs.LG cs.AI cs.CG math.AT

The Shape of Adversarial Influence: Characterizing LLM Latent Spaces with Persistent Homology

对抗影响的形状:利用持久同调表征大语言模型的潜在空间

Aideen Fay, Inés García-Redondo, Qiquan Wang, Haim Dubossarsky, Anthea Monod

机构 * Microsoft Security Response Center(微软安全响应中心) AIDOS Lab, University of Fribourg(弗里堡大学AIDOS实验室) Department of Mathematics, Imperial College London(伦敦帝国理工学院数学系) Queen Mary University of London(伦敦大学量子玛丽学院) Imperial College London(伦敦帝国理工学院) Language Technology Lab, University of Cambridge(剑桥大学语言技术实验室) The Alan Turing Institute(艾伦·图灵研究所)

AI总结 本文利用持久同调方法分析对抗输入如何改变大语言模型潜在空间的几何拓扑结构,揭示了潜在空间压缩和拓扑特征的普遍性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03963 2026-04-27 cs.AI

Can Large Language Models Adequately Perform Symbolic Reasoning Over Time Series?

大型语言模型能否在时间序列上进行充分的符号推理?

Zewen Liu, Juntong Ni, Xianfeng Tang, Max S. Y. Lau, Qi He, Wenpeng Yin, Wei Jin

机构 * Emory University(埃默里大学) Amazon(亚马逊) Microsoft(微软) Penn State University(宾夕法尼亚州立大学)

AI总结 本文提出SymbolBench基准,评估大型语言模型在时间序列上的符号推理能力,结合遗传编程构建闭环系统,揭示模型在科学发现中的优势与局限。

Comments camera_ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06148 2026-04-27 cs.CV

V-MAGE: A Game Evaluation Framework for Assessing Vision-Centric Capabilities in Multimodal Large Language Models

V-MAGE:一种用于评估多模态大语言模型视觉能力的游戏评估框架

Xiangxi Zheng, Linjie Li, Zhengyuan Yang, Ping Yu, Alex Jinpeng Wang, Rui Yan, Yuan Yao, Lijuan Wang

机构 * Nanjing University(南京大学) Microsoft Research(微软研究院) Central South University(中南大学) Nanjing University of Science and Technology(南京理工大学)

AI总结 V-MAGE通过游戏化评估框架系统评估多模态大语言模型在动态交互环境中的视觉推理能力,揭示其在复杂场景中的性能局限,为提升模型视觉与推理能力提供改进方向。

详情

展开后加载摘要…

URL PDF HTML 收藏