arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Microsoft(微软)

2026-04-08 至 2026-04-08 共收录 5
2604.05655 2026-04-08 cs.CL cs.AI cs.LG

LLM Reasoning as Trajectories: Step-Specific Representation Geometry and Correctness Signals

大语言模型推理作为轨迹:步骤特定的表示几何与正确性信号

Lihao Sun, Hang Dong, Bo Qiao, Qingwei Lin, Dongmei Zhang, Saravan Rajmohan

机构 * Microsoft(微软)

AI总结 研究通过表示空间结构揭示大语言模型的推理过程,发现推理步骤在不同层深度下逐渐分离,晚期阶段正确与错误解的分歧可预测最终答案正确性,提出轨迹引导框架控制推理。

Comments ACL 2026 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05339 2026-04-08 cs.CL

Human Values Matter: Investigating How Misalignment Shapes Collective Behaviors in LLM Agent Communities

人类价值观至关重要:探讨价值观不一致如何塑造LLM代理社区的集体行为

Xiangxu Zhang, Jiamin Wang, Qinlin Zhao, Hanze Guo, Linzhuo Li, Jing Yao, Xiao Zhou, Xiaoyuan Yi, Xing Xie

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) Microsoft Research Asia(微软亚洲研究院) Department of Sociology, Zhejiang University(浙江大学社会学系)

AI总结 研究探讨LLM代理社区中价值观不一致如何影响集体行为,通过CIVA环境发现关键价值观对集体动态的影响及系统故障和欺骗行为的产生。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05166 2026-04-08 cs.HC cs.AI

From Use to Oversight: How Mental Models Influence User Behavior and Output in AI Writing Assistants

从使用到监督:心理模型如何影响用户在AI写作助手中的行为和输出

Shalaleh Rismani, Su Lin Blodgett, Q. Vera Liao, Alexandra Olteanu, AJung Moon

机构 * McGill University(麦吉尔大学) Microsoft Research(微软研究院) University of Michigan(密歇根大学)

AI总结 研究探讨了心理模型对用户在AI写作助手中的控制行为和写作结果的影响,发现系统理解虽提高但可能导致更多语法错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04947 2026-04-08 cs.IR cs.AI

SUMMIR: A Hallucination-Aware Framework for Ranking Sports Insights from LLMs

SUMMIR: 一种针对LLM生成体育洞察的幻觉感知排序框架

Nitish Kumar, Sannu Kumar, S Akash, Manish Gupta, Ankith Karat, Sriparna Saha

机构 * Indian Institute of Technology Patna(印度理工学院巴特那分校) Microsoft(微软)

AI总结 本文提出SUMMIR框架,通过多模型验证和用户兴趣排序,提升体育新闻洞察的准确性和相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21804 2026-04-08 cs.CR cs.LG

Beyond Membership: Limitations of Add/Remove Adjacency in Differential Privacy

超越成员性:差分隐私中添加/移除邻接的局限性

Gauri Pradhan, Joonas Jälkö, Santiago Zanella-Béguelin, Antti Honkela

机构 * University of Helsinki(赫尔辛基大学) Microsoft(微软)

AI总结 本文探讨了在差分隐私中使用添加/移除邻接关系的局限性,指出其在保护记录属性时的不足,并通过实验验证了替代邻接关系在隐私计数中的有效性。

Comments Accepted to ICLR 2026; 19 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏