arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-01 至 2025-12-01 共收录 2 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 2 篇

2503.22738 2025-12-01 cs.LG cs.CR 83%

ShieldAgent: Shielding Agents via Verifiable Safety Policy Reasoning

ShieldAgent: 通过可验证的安全策略推理实现安全代理

Zhaorun Chen, Mintong Kang, Bo Li

机构 * University of Chicago, Chicago IL, USA(芝加哥大学) University of Illinois at Urbana-Champaign, Champaign IL, USA(伊利诺伊大学厄巴纳-香槟分校)

专题命中 代码与定理证明 :reasoning(title,abstract);logical reasoning(abstract);分类 cs.LG

AI总结 ShieldAgent通过逻辑推理实现对代理动作轨迹的安全策略合规性,有效提升代理防护性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23188 2025-12-01 cs.HC 50%

Can Intelligent User Interfaces Engage in Philosophical Discussions? A Longitudinal Study of Philosophers' Evolving Perceptions

智能用户界面能否参与哲学讨论?哲学家们观念演变的纵向研究

Yibo Meng, Lyumanshan Ye, Eve He, Zhe Yan, Zhiming Liu, Yipeng Yu, Yan Guan, Xiaolan Ding

专题命中 代码与定理证明 :reasoning(abstract)

AI总结 本研究通过纵向研究探讨哲学学者对生成式AI智能用户界面参与哲学讨论态度的演变,发现其从抵制到接受再到质疑的三阶段变化,揭示IUI在哲学推理中的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏