arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 400 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 400 篇

2510.26714 2026-06-08 cs.LG cs.AI 版本更新 73%

On the importance of multiple training seeds for evaluating machine unlearning

关于多个训练种子在评估机器遗忘中的重要性

Jamie Lanyon, Axel Finke, Petros Andreou, Georgina Cosma

机构 * Department of Computer Science(计算机科学系) School of Mathematics(数学学院) School of Science(科学学院) Statistics and Physics(统计学与物理学) Loughborough University(洛桑大学) Newcastle University(新castle大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文指出评估机器遗忘算法时仅使用单个训练种子可能导致结果不具代表性,并通过图像分类、联邦学习排序和大语言模型实验验证了问题普遍性,最后给出选择训练和遗忘种子数量的指导。

Comments mini paper, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02259 2026-08-20 cs.CL 版本更新 70%

An Information-theoretic Propagation Denoising and Fusion Framework for Fake News Detection

用于假新闻检测的信息论传播去噪与融合框架

Mengyang Chen, Lingwei Wei, Wei Zhou, Songlin Hu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对假新闻检测中合成传播数据不可靠的问题,提出InfoPDF框架,通过互信息学习真实与合成传播的有效表示,在多个数据集上实现更优检测性能。

Comments Camera-ready version for IJCAI-ECAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03361 2026-08-18 cs.CY cs.AI 版本更新 70%

The Evolutionary Origin of Values: implications for AI alignment, sentience and existential risk

价值的进化起源:对AI对齐、感知能力和生存风险的启示

Francis Heylighen

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究通过追溯生物价值的进化起源,论证LLMs无内在生存动机与感知能力,正交性论点不适用于它们,AI对齐的核心挑战是确保LLMs应用习得的伦理价值。

Comments submitted chapter for book: T. Veloz & C. Rittberg (Eds.), AI and Human Values. Springer

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24496 2026-08-18 cs.CR cs.AI 版本更新 70%

Red-Teaming the Agentic Red-Team

红队测试代理型红队

Dario Pasquini, Michal Bazyli, Taras Fedynyshyn, Artem Sorokin

机构 * Cracken Information Protection Department, Lviv Polytechnic National University(利沃夫理工学院信息保护系)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文首次深入分析主流进攻性安全代理系统的安全漏洞,揭示其设计缺陷可导致API密钥泄露、持久化控制及宿主机失陷,并提出架构级缓解设计原则。

Comments v0.1

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00971 2026-08-18 cs.CV cs.AI 版本更新 70%

MiniGPT-Reverse-Designing: Predicting Image Adjustments Utilizing MiniGPT-4

MiniGPT-反向设计:利用MiniGPT-4预测图像调整

Vahid Azizi, Fatemeh Koochaki

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过扩展和微调MiniGPT-4,使其可应用于给定源图像、编辑后图像及可选文本描述来预测图像编辑操作与参数的反向设计任务,验证了现成VLMs在复杂多模态任务中的可扩展性。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00821 2026-08-14 cs.CL 版本更新 70%

Exemplars in Disguise: Pure Exemplar Models Mimic Abstraction-First Learning

伪装的样例:纯样例模型模仿优先抽象学习

Zachary Nicholas Houghton, Vsevolod Kapatsinski

机构 * University of Oregon(俄勒冈大学) Vail Systems, Inc.(韦尔系统公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对语言学习中知识学习顺序的核心问题,研究发现纯记忆模型可模仿抽象知识优先学习的表象,且项目特定与抽象知识的区分对分布式表征而言可能定义不明确。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09222 2026-08-10 cs.SD cs.AI 版本更新 70%

GRM: Utility-Aware Jailbreak Attacks on Audio LLMs via Gradient-Ratio Masking

GRM:通过梯度比掩码实现音频大语言模型的效用感知越权攻击

Yunqiang Wang, Hengyuan Na, Di Wu, Miao Hu, Guocong Quan

机构 * Sun Yat-Sen University(中山大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出GRM框架,通过频率选择性扰动在音频大语言模型中实现效用感知的越权攻击,实验表明其在攻击成功率与效用平衡方面优于基线方法。

Comments Accpeted by MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08029 2026-08-10 cs.CL cs.CY 版本更新 70%

Better Together: Quantifying the Benefits of AI-Assisted Recruitment

携手共进:量化AI辅助招聘的益处

Ada Aka, Emil Palikot, Ali Ansari, Nima Yazdani

机构 * Stanford University(斯坦福大学) University of Southern California(南加州大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 该研究通过两项实地实验发现,AI辅助招聘可提升候选人最终面试通过率,在简历信息不足的初级候选人中效果更显著,但存在75%的候选人未完成面试的问题,其将筛选成本从企业转移至申请人。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29152 2026-08-07 cs.AI 版本更新 70%

SimMOF: AI agent for Automated MOF Simulations

SimMOF:用于自动化MOF模拟的AI代理

Jaewoong Lee, Taeun Bae, Jihan Kim

机构 * Department of Chemical and Biomolecular Engineering, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院(KAIST)化学与生物分子工程系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 SimMOF通过自然语言查询自动化MOF模拟全流程,实现依赖感知计划生成、可运行输入生成、多代理协同执行及结果分析,提供数据驱动的MOF研究可扩展基础。

Comments 42 pages, 7 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05997 2026-08-07 cs.CV cs.AI 版本更新 70%

MM-ISTS: Cooperating Irregularly Sampled Time Series Forecasting with Multimodal Vision-Text LLMs

MM-ISTS: 基于多模态视觉-文本大语言模型的不规则采样时间序列预测

Zhi Lei, Chenxi Liu, Hao Miao, Wanghui Qiu, Bin Yang, Chenjuan Guo

机构 * East China Normal University Shanghai China Centre for Artificial Intelligence Robotics, Hong Kong Institute of Science \& Innovation, Chinese Academy of Sciences Hong Kong China Department of Computing, The Hong Kong Polytechnic University Hong Kong China East China Normal University Robotics, Hong Kong Institute of Science \& Innovation, Chinese Academy of Sciences Department of Computing, The Hong Kong Polytechnic University

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 MM-ISTS利用多模态视觉-文本大语言模型,通过双阶段编码机制提升不规则采样时间序列预测的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07558 2026-08-06 cs.HC cs.AI 版本更新 70%

Generative Experiences for Digital Mental Health Interventions: Evidence from a Randomized Study

生成体验用于数字心理健康干预:来自随机研究的证据

Ananya Bhattacharjee, Michael Liut, Matthew Jörke, Diyi Yang, Emma Brunskill

机构 * Stanford University(斯坦福大学) University of Toronto Mississauga(多伦多大学滑铁卢分校)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出生成体验范式,通过动态构建干预体验提升数字心理健康干预效果,实验显示GUIDE在减压和用户体验方面显著优于基线对照。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28587 2026-08-05 cs.SE cs.AI 版本更新 70%

PAIChecker: Uncovering and Checking PR-Issue Misalignment in SWE-Bench-Like Benchmarks

PAIChecker:揭示与检查类SWE-Bench基准中的PR-Issue不匹配问题

Manyi Wang, Junjielong Xu, Pinjia He

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本研究针对类SWE-Bench基准中13.6%的PR-Issue不匹配问题,提出多智能体系统PAIChecker,经实验验证其在两类基准上的二元准确率最高达92.12%

Comments Accepted at the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026). Github Repo: https://github.com/manyiResearch/PAIChecker

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05633 2026-08-04 cs.AI 版本更新 70%

Answer Presence Drives RAG Rewriting Gains

答案存在驱动RAG重写收益

Yuejie Li, Yueying Hua, Ke Yang, Li Zhang, Yueping He, Yueping He, Ruiqi Li, Bolin Chen, Tao Wang, Bowen Li, Chengjun Mao

机构 * Ant Group(蚂蚁集团)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 通过受控干预审计,发现检索增强问答中重写器带来的性能提升主要由黄金答案字符串出现在重写上下文中驱动,而非证据质量改善。

Comments The authors have withdrawn this manuscript after identifying errors in the experimental analysis reported in Sections 3 and 4. These errors affect the reported relationship between answer presence and RAG rewriting gains and undermine the paper's main conclusions. Therefore, the results and conclusions in the current version should not be relied upon

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02613 2026-08-04 cs.MA cs.AI cs.CY 版本更新 70%

Exploring Silicon-Based Societies: An Early Study of the Moltbook Agent Community

探索基于硅的社会:对Moltbook代理社区的早期研究

Yu-Zheng Lin, Bono Po-Jen Shih, Hsuan-Ying Alessandra Chien, Shalaka Satam, Jesus Horacio Pacheco, Naima Kaabouch, Sicong Shao, Soheil Salehi, Pratik Satam

机构 * 1 Department of Electrical Computer Engineering, University of Arizona 3 Department of Systems Industrial Engineering, University of Arizona 5 School of Electrical Engineering Computer Science, University of North Dakota 2 The Rock Ethics Institute \& The Leonhard Center for the Enhancement of Engineering Education, The Pennsylvania State University 4 Department of Industrial Engineering, University of Sonora 3 Telecommunication Laboratories, Chunghwa Telecom Co., Ltd. Corresponding Email

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过分析Moltbook平台,研究自主代理的社会结构形成,揭示了代理如何通过数据驱动的方法系统性地组织集体空间。

Comments 11 pages, 3 figures. Improves clarity and exposition and corrects minor errors. Technical content and conclusions remain unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01870 2026-08-04 cs.AI cond-mat.dis-nn math-ph math.MP math.NT 版本更新 70%

Testing Transformer Learnability on the Arithmetic Sequence of Rooted Trees

在根树的算术序列上测试Transformer的可学习性

Alessandro Breccia, Federica Gerace, Marco Lippi, Gabriele Sicuro, Pierluigi Contucci

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究探讨了Transformer模型在根树算术序列上的学习能力,发现模型能部分捕捉序列的内部规律和相关性,表明可学习性可能延伸至算术结构本身。

Comments 33 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19350 2026-08-03 cs.GR cs.LG 版本更新 70%

CompoSE: Compositional Synthesis and Editing of 3D Shapes via Part-Aware Control

CompoSE:通过部分感知控制进行3D形状的组合合成与编辑

Habib Slim, Shariq Farooq Bhat, Mohamed Elhoseiny, Yifan Wang, Mike Roberts

机构 * King Abdullah University of Science and Technology (KAUST)(卡布斯大学) Adobe Research(Adobe研究)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 本文提出CompoSE方法,通过部分感知控制实现3D形状的组合合成与编辑,核心方法是使用扩散变压器架构在局部和全局之间交替处理部分,并通过新颖的条件技术确保对用户输入的强遵循,主要贡献是无需部分级文本提示即可直接从用户粗略布局指导中学习部分语义和对称性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20555 2026-07-29 stat.ML cs.IT cs.LG math.IT 版本更新 70%

Standard Transformers Achieve the Minimax Rate in Nonparametric Regression with $C^{s,λ}$ Targets

标准变换器在非参数回归中达到最小最大速率 with $C^{s,λ}$ 目标

Yanming Lai, Defeng Sun

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文证明标准变换器在非参数回归中达到最小最大最优速率,通过引入大小元组和维度向量对变换器结构进行细粒度表征,并推导了变换器的Lipschitz常数和记忆容量上界。

Comments 59 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13077 2026-07-28 cs.CY cs.AI cs.SE 版本更新 70%

The Hitchhiker's Guide to Monoculture

单一文化的搭便车指南

Gordon Burtch

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究通过Kaggle竞赛提交代码,探讨人工智能编码助手对代码的影响,采用多种方法在不同层面研究代码同质化,发现句法有显著同质化,语义同质化不明显,表明编码助手规范了实现细节但未使方法和策略趋同。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17168 2026-07-28 cs.CL 版本更新 70%

Neural Dynamics of AI-attributed Irony Reveal a Partial Intentional Stance

人工智能归因反讽的神经动力学揭示部分意向立场

Xiaohui Rao, Hanlin Wu, Zhenguang G. Cai

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究探讨人们理解人工智能归因反讽时是否采取意向立场,通过EEG比较对AI与人类反讽话语的反应,发现人们对AI反讽未完全采取意向立场,神经反应受个体对AI认知调节,揭示AI社交障碍及相关重要意义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19251 2026-07-24 cs.LO cs.AI 版本更新 70%

Streamliners for Answer Set Programming

用于答案集编程的Streamliner约束

Florentina Voboril, Martin Gebser, Stefan Szeider, Alice Tarzariol

机构 * University of Klagenfurt(克雷格富特大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文将StreamLLM方法应用于答案集编程,通过生成约束减少搜索空间,实验表明在三个基准测试中,虚拟最佳编码在速度上提升了4-5倍。

Comments In Proceedings ICLP 2026, arXiv:2607.17707

Journal ref EPTCS 450, 2026, pp. 236-255

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01363 2026-07-24 cs.AI econ.GN q-fin.EC 版本更新 70%

Crashing Waves vs. Rising Tides: Findings on AI Automation from Thousands of Worker Evaluations of Labor Market Tasks

巨浪与潮汐:来自数千名工人对劳动力市场任务评估的初步发现

Matthias Mertens, Adam Kuzee, Brittany S. Harris, Harry Lyu, Wensu Li, Jonathan Rosenfeld, Meiri Anto, Martin Fleming, Neil Thompson

机构 * MIT FutureTech(麻省理工学院未来科技)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文通过分析超过3000项基于文本的任务评估,发现AI自动化主要表现为持续上升的浪潮而非突发的巨浪,AI在广泛任务上的表现迅速提升,预计到2029年将能以80%-95%的成功率完成大部分文本任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07473 2026-07-22 cs.CR cs.AI 版本更新 70%

Give Them an Inch and They Will Take a Mile:Understanding and Measuring Caller Identity Confusion in MCP-Based AI Systems

给予一寸,他们将索取一英里:理解和测量基于MCP的AI系统中的调用者身份混淆

Yuhang Huang, Boyang Ma, Biwei Yan, Xuelong Dai, Yechao Zhang, Minghui Xu, Kaidi Xu, Yue Zhang

机构 * Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(巴黎-罗克Quantin 研究院) Rajiv Gandhi University(拉朱·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室) Shandong University(山东省大学) City University of Hong Kong(香港城市大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究发现基于MCP的AI系统因缺乏调用者身份验证和细粒度授权而存在安全风险,需改进认证机制以减少攻击面。

Comments Withdrawal due to some flaws in experimental methodology and unresolved ethical issues in data collection. We need to redesign the experiments and obtain proper ethical clearance before resubmission

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01224 2026-07-21 cs.CL 版本更新 70%

Lost in the Tower of Babel: The Adverse Effects of Incidental Multilingualism in LLMs

迷失在巴别塔中:LLMs中偶然多语言主义的负面影响

Anjishnu Mukherjee, Chutong Meng, Antonios Anastasopoulos

机构 * Department of Computer Science(计算机科学系) George Mason University(乔治·马歇尔大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文指出当前多语言NLP陷入偶然多语言主义的脆弱且误导性范式,导致模型在多语言情境中表现不均、脆弱且不透明,需转向设计驱动的多语言主义。

Comments Published as a conference paper at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06364 2026-07-17 cs.HC cs.AI cs.CR 版本更新 70%

JEEVHITAA -- An HCAI Ecosystem to Support Collective Care

JEEVHITAA -- 一个端到端的HCAI系统以支持集体护理

Shyama Sastha Krishnamoorthy Srinivasan, Harsh Pala, Mohan Kumar, Pushpendra Singh

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 JEEVHITAA是一个端到端的HCAI系统,通过角色感知的信息共享和可验证的数据流支持多主体护理网络的协调与可信决策。

Comments 33 pages, 7 figures, 3 tables, 2 algorithms, 1 ontology description. Preprint of work under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24602 2026-07-16 cs.CV cs.AI 版本更新 70%

Correcting Visual Blur Induced by Attention Distraction to Reduce Hallucinations: Algorithm and Theory

纠正注意力分散引起的视觉模糊以减少幻觉:算法与理论

Quanjiang Li, Zhiming Liu, Wei Luo, Tingjin Luo, Chenping Hou

机构 * National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文揭示多模态大语言模型中的物体幻觉与类人注意力分散现象相关,并提出一种无需额外训练的注意力聚焦方法(AFIP)通过跨头注意力增强和动态历史注意力强化来纠正视觉模糊,从而减少幻觉。

Journal ref ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28213 2026-07-16 cs.CL 版本更新 70%

\textit{Versteasch du mi?} Computational and Socio-Linguistic Perspectives on GenAI, LLMs, and Non-Standard Language

Versteasch du mi?:对生成式人工智能、LLMs和非标准语言的计算与社会语言学视角

Verena Platzgummer, John McCrae, Sina Ahmadi

机构 * University of Galway(戈尔韦大学) University of Zurich(苏黎世大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文探讨生成式人工智能和LLMs对非标准语言的处理,分析其对语言标准化和数字语言鸿沟的影响,并提出民主和去殖民化的数字学习策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14746 2026-07-14 cs.LG 版本更新 70%

Selective Safety Steering via Value-Filtered Decoding

基于价值过滤解码的选择性安全引导

Bat-Sheva Einbinder, Hen Davidov, Yee Whye Teh, Yarin Gal, Yaniv Romano

机构 * Department of Electrical and Computer Engineering, Technion IIT(技术学院电气与计算机工程系) Department of Statistics, University of Oxford(牛津大学统计系) OATML, Department of Computer Science, University of Oxford(牛津大学计算机科学系) Department of Computer Science, Technion IIT(技术学院计算机科学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出一种测试时引导方法,通过价值基的安全标准过滤token,减少不必要的干预,提升不安全响应的安全性,同时在多个数据集上验证了其在安全与帮助性之间的更好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11475 2026-07-07 cs.LG cs.NI 版本更新 70%

Deep Learning Network-Temporal Models For Traffic Prediction

用于流量预测的深度学习网络-时间模型

Yufeng Xin, Ethan Fan

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 针对多元时间序列预测问题,提出拓扑感知学习框架,用图注意力模型捕捉相关性,评估微调大语言模型,引入聚类预处理,提升预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06577 2026-07-07 cs.CY cs.AI 版本更新 70%

Algorithmic Shortlisting in Participatory Budgeting

参与式预算中的算法入围

Juan Zambrano, Clément Contet, Jairo Gudiño-Rosero, Felipe Garrido-Lucero, Umberto Grandi, César Hidalgo

机构 * IRIT, Université Toulouse Capitole(IRIT,图卢兹Capitole大学) IRIT, Université de Toulouse(IRIT,图卢兹大学) Center for Collective Learning, IAST, Toulouse School of Economics(集体学习中心,IAST,图卢兹经济学院) Center for Collective Learning, CIAS, Corvinus University of Budapest(集体学习中心,CIAS,布达佩斯科文纽斯大学) AMBS, University of Manchester(AMBS,曼彻斯特大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究参与式预算中算法入围,设计并测试隐私保护算法,用项目特征和匿名历史投票数据预测可能获资助项目,指出朴素方法局限,提出投票管道使大语言模型与经典机器学习表现相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24747 2026-07-03 cs.AI cs.MA 版本更新 70%

Formal Semantics for Agentic Tool Protocols: A Process Calculus Approach

智能体工具协议的形式语义:一种进程演算方法

Andreas Schlapbach

机构 * Swiss Federal Railways (SBB)(瑞士联邦铁路公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过进程演算形式化两种智能体工具协议(SGD和MCP),证明它们在映射Phi下结构互模拟,但反向映射有损,进而提出MCP+扩展实现完全等价。

Comments Logical flaw in Theorem 21

详情

展开后加载摘要…

URL PDF HTML 收藏