arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 9400 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 安全评测 9400 篇

2607.04436 2026-07-07 cs.SE cs.AI 新提交 57%

A Retrieval-Augmented Framework for Detecting and Resolving Pragmatic Ambiguities in Natural Language Requirements

一种用于检测和解决自然语言需求中语用歧义的检索增强框架

Pavithra PM Nair, Preethu Rose Anish

机构 * Tata Consultancy Services(塔塔咨询公司)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 研究自然语言需求中的语用歧义,利用检索增强技术和不同领域知识库模拟不同专业利益相关者,生成候选消歧需求并验证,评估该方法在需求文档上的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04401 2026-07-07 cs.CV cs.LG 新提交 57%

The Good, the Bad, and the Brittle: Benchmarking Robustness and Generalisation of Histopathology Foundation Models

好的、坏的和脆弱的:病理基础模型的稳健性和泛化基准测试

Dhyey Yajnik, Amina Asif, Fayyaz Minhas

专题命中 安全评测 :alignment(abstract);分类 cs.LG

AI总结 用REET工具和NR-Kfold协议对12个病理基础模型及ResNet基线进行基准测试,引入PPI分析,表明病理基础模型在稳健性和泛化上优于CNNs,模型扩展收益递减,强调需评估分布变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03585 2026-07-07 cs.LG 新提交 57%

Modular Foundation Models for Time-Series Perception in Digital Twins

数字孪生中用于时间序列感知的模块化基础模型

Quang Hung Pham, Ryad Zemouri, Martin Gagnon, Luc Vouligny

机构 * Hydro-Québec(魁北克水电公司)

专题命中 安全评测 :alignment(abstract);分类 cs.LG

AI总结 针对数字孪生和PHM系统中时间序列感知挑战,提出基于预训练表示编码器集合的模块化基础模型,利用自监督学习,引入选通机制,支持多下游任务,消融研究验证各部分作用,实验有竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03418 2026-07-07 cs.SD cs.AI 新提交 57%

DETECT-3B-Omni is Agnostic of Content and Demographics

DETECT-3B-Omni对内容和人口统计学特征不敏感

Nicolas M. Müller, Aditya Tirumala Bukkapatnam, Dominik Schnieders, Zohaib Ahmed

机构 * Resemble AI(相似人工智能公司) Deutsche Telekom(德国电信公司)

专题命中 安全评测 :trustworthy(abstract);分类 cs.AI

AI总结 研究Resemble AI的DETECT-3B-Omni检测器语义独立性,用来自不同AI语音克隆系统的多样音频样本测试,通过等价测试表明其检测准确率不受语音内容、说话者性别、年龄和地区影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03220 2026-07-07 cs.CR cs.AI 新提交 57%

CONTRA: Red-Teaming Configurations of Personalizable Agents

CONTRA:可个性化代理的红队配置

Jonathan Nöther, Adish Singla, Goran Radanovic

机构 * Max Planck Institute for Software Systems(马克斯·普朗克软件研究所)

专题命中 安全评测 :safety(abstract);分类 cs.AI

AI总结 探讨代理配置与执行危险行为风险的关系,提出CONTRA算法,通过推理评估良性但危险的配置发现导致恶意行为的代理配置,构建数据集分析发现多数技能有恶意配置,CONTRA能成功识别部分危险配置。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02972 2026-07-07 cs.CY 新提交 57%

A Scalable Approach to Evaluating Moral Sensitivity in LLMs

一种评估大语言模型道德敏感性的可扩展方法

Daniel Kilov, Secil Yanik Guyot, Caroline Hendy, Sichao Li, Seth Lazar

专题命中 安全评测 :alignment(abstract);分类 cs.CY

AI总结 研究如何评估大语言模型道德敏感性,提出新方法解决AI对齐研究中行为评估的问题,引入MORPH-1K基准测试并应用于八个模型,证明相关特征语义内容稳定。

Comments 9 pages, 3 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02599 2026-07-07 cs.SE cs.AI cs.LO 新提交 57%

AgentLTL: A Trace-Verification Framework for Measuring, Enforcing, and Training Procedural Compliance in Tool-Using LLM Agents

AgentLTL:一种用于测量、执行和训练使用工具的语言模型代理程序合规性的跟踪验证框架

Laïla Elkoussy, Julien Perez

机构 * EPITA Bpifrance

专题命中 安全评测 :safety(abstract);分类 cs.AI

AI总结 介绍基于一阶线性时态逻辑的AgentLTL语言,用于表达代理跟踪的程序规则,产生确定性无评判的合规分数,此框架可用于约束和微调,提升模型合规性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02586 2026-07-07 cs.LG cs.SE 新提交 57%

Auditing the Audit: Five Failure Modes in Benchmark-Validity Audits

审核审核:基准有效性审核中的五种失败模式

Yanhang Li, Zhichao Fan, Zexin Zhuang

机构 * European Parliament and Council(欧洲议会和理事会) National Institute of Standards and Technology(美国国家标准与技术研究院) State Administration for Market Regulation and Standardization Administration of China(中国国家市场监督管理总局和中国国家标准化管理委员会)

专题命中 安全评测 :safety(abstract);分类 cs.LG

AI总结 研究治理框架要求的基于扰动的构造有效性审核的脆弱性,指出五种管道失败类型并通过案例展示,提出六点尽职调查关卡,定位其为保证级证据的协议。

Comments 18 pages, 4 figures. Accepted at the TAIGR Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04072 2026-07-07 cs.SE cs.AI quant-ph 新提交 57%

Benchmarking API Drift in LLM-Generated Quantum Code Across Successive SDK Versions

跨连续软件开发工具包版本对大语言模型生成的量子代码中的 API 漂移进行基准测试

Mohammad Arif Rasyidi, Syahirul Faiz

机构 * Department of Computer Science(计算机科学系) Khalifa University(卡利法大学)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 研究大语言模型生成的量子代码能否可靠适配特定 SDK 版本(API 漂移问题),引入量子 API 漂移基准,以 Qiskit 为例评估 17 个模型,揭示版本对齐是量子代码生成评估新维度及 API 漂移恢复情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00527 2026-07-07 cs.AI 新提交 57%

AI Native Games: A Survey and Roadmap

AI原生游戏:综述与路线图

Zhiyue Xu, Fandi Meng, Kaijie Xu, Clark Verbrugge, Simon Lucas, Jian Zhao

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Zhongguancun Academy(中关村学院) Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究所) School of Computer Science, McGill University, Montreal, Quebec, Canada(麦吉尔大学计算机科学学院) Game AI Research Group, Queen Mary University of London, London, United Kingdom(伦敦女王学院游戏人工智能研究组)

专题命中 安全评测 :safety(abstract);分类 cs.AI

AI总结 本文定义AI原生游戏为运行时生成式AI构成核心循环的游戏,提出G/N分类法分析53个实例,指出核心设计问题是将语义开放性组织为稳定游戏玩法,并给出路线图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24107 2026-07-07 cs.CV cs.AI 新提交 57%

DramaDirector: Geometry-Guided Short Drama Generation

DramaDirector: 几何引导的短剧生成

Hengji Zhou, Sijie Liu, Jianrun Chen, Xingchen Zou, Lianghao Xia, Liqiang Nie

机构 * South China University of Technology(华南理工大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 提出几何引导框架DramaDirector,通过检索真实短剧的深度-姿态参考,结合模式约束SFT和GRPO训练规划器,实现从情节到多镜头短剧的生成,在忠实度、一致性和可控性上优于基线。

Comments 20 pages, 17 figures, 6 tables. Code is available at https://github.com/iLearn-Lab/DramaDirector

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22726 2026-07-07 cs.AI 新提交 57%

Text Dictates, Music Decorates: Energy-based Attention for Editable Dance Motion Generation

文本主导,音乐装饰:基于能量的注意力机制用于可编辑舞蹈动作生成

Seong Jong Yoo, Siyuan Peng, Felix Gu, Stratis Aloimonos, Cornelia Fermüller

机构 * University of Maryland, College Park(马里兰大学帕克分校)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 提出STREAM模型,通过模态解耦的扩散变压器分离文本语义和音乐节奏控制,实现可编辑舞蹈动作生成,并引入新数据集Motorica++和评估指标EDS。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06890 2026-07-07 cs.AI cs.MA 版本更新 57%

Beyond the Black Box: Interpretability of Agentic AI Tool Use

超越黑箱:代理AI工具使用的可解释性

Hariom Tatsat, Ariye Shater

机构 * Quantitative Analytics, Barclays(巴克莱证券量化分析部)

专题命中 安全评测 :safety(abstract);分类 cs.AI

AI总结 本文提出了一种基于稀疏自编码器(SAEs)和线性探针的机制可解释性工具包,旨在提升代理AI在长周期任务中对工具调用的可观测性和可解释性,通过分析模型内部状态来识别工具决策的关键特征,从而揭示代理失败的深层原因。

Comments 12 pages, 4 figures, 17 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18895 2026-07-07 q-fin.RM cs.LG 57%

Could Large Language Models work as Post-hoc Explainability Tools in Credit Risk Models?

大语言模型能否在信用风险模型中作为事后可解释性工具?

Wenxi Geng, Dingyuan Liu, Liya Li, Yiqing Wang

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Georgia Institute of Technology(佐治亚理工学院) Southern Methodist University(南方 Methodist 大学)

专题命中 安全评测 :alignment(abstract);分类 cs.LG

AI总结 本文研究大语言模型是否能作为信用风险模型的事后可解释性接口,评估其在保持特征重要性排名和生成自主解释方面的能力。

Comments 39 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09448 2026-07-07 cs.SD cs.AI 版本更新 57%

One Prompt, Many Sounds: Modeling Listener Variability in LLM-Based Equalization

一个提示,多种声音:在基于大语言模型的均衡中建模听众差异

Ioannis Stylianou, Jon Francombe, Pablo Martinez-Nuevo, Sven Ewan Shepstone, Zheng-Hua Tan

机构 * Bang & Olufsen A/S, Struer, Denmark(丹麦Bang & Olufsen A/S公司,Struer) Department of Electronic Systems, Aalborg University(奥胡斯大学电子系统系) Pioneer Centre for AI, Copenhagen, Denmark(哥本哈根先锋人工智能中心)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 本文提出利用大语言模型将自然语言提示映射到均衡设置,通过上下文学习和参数高效微调技术,实现更灵活的音频均衡控制。

Comments 13 pages, 15 figures, 2 tables, Accepted for publication in the IEEE Journal of Selected Topics in Signal Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20677 2026-07-07 cs.CR cs.CL 版本更新 57%

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models

基于学习的自动化对抗红队测试用于大型语言模型的鲁棒性评估

Zhang Wei, Hanxuan Chen, Peilu Hu, Zhenyuan Wei, Chenwei Liang, Jiayi Gu, Wenqian Weng, Jacqueline Pang, Hao Yan, Li Mei, Shengning Lang, Kuan Lu, Xi Xiao, Zhimo Han, Yijin Wang, Yichao Zhang, Chen Yang, Zhenyu Yu, Riyang Bao, Xinyuan Song, Junfeng Hao, Mu-Jiang-Shan Wang

机构 * Independent Researcher(独立研究者) Hunan University(湖南大学) Shenzhen Kaihong Digital Industry Development Co., Ltd.(深圳凯鸿数字产业开发有限公司) Central University of Finance and Economics(中央财经大学) Chongqing University(重庆大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Stevens Institute of Technology(斯蒂文斯理工学院) Cornell University(康奈尔大学) Oak Ridge National Laboratory(橡树岭国家实验室) Zhengzhou University of Light Industry(郑州轻工业大学) Xidian University(西安电子科技大学) The University of Texas at Dallas(德克萨斯大学达拉斯分校) AI Safety Research Lab, Institute of Advanced Computing(高级计算研究所人工智能安全研究实验室) University of Malaya(马来亚大学) Emory University(埃默里大学) Department of Nephrology, Affiliated Hospital of Guangdong Medical University(广东医学院附属医院肾内科)

专题命中 安全评测 :safety(abstract);分类 cs.CL

AI总结 本文提出一种学习驱动的自动化红队测试框架,用于高效发现大型语言模型的漏洞,通过元提示引导的对抗性提示生成和分层执行检测流程,在六个威胁类别中实现标准化评估,实验发现47个漏洞,包括21个高严重性失败和12种新攻击模式。

Comments ACL ARR minor revision

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00392 2026-07-07 cs.SE cs.AI 版本更新 57%

Beyond Task Completion: A Verification-vs.-Conformance Gap in Tool-Evolving Agents

EvolveTool-Bench:评估LLM生成的工具库作为软件 artifact 的质量

Alibek Kaliyev, Artem Maryanskyy

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Uber Technologies(优步科技公司)

专题命中 安全评测 :safety(abstract);分类 cs.AI

AI总结 本文提出EvolveTool-Bench,通过评估LLM生成的工具库在软件工程流程中的质量,揭示任务完成率之外的软件质量风险,强调需将工具库视为首要软件 artifact。

Comments 11 pages, 4 figures; accepted at KDD 2026 Workshop on Agentic AI Evaluation and Trustworthiness

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14095 2026-07-07 cs.AI cs.CR 版本更新 57%

NEST: Nascent Encoded Steganographic Thoughts

NEST:新生编码隐写思想

Artem Karpov

专题命中 安全评测 :safety(abstract);分类 cs.AI

AI总结 探讨模型在无害文本中隐藏秘密推理的隐写思维链,通过分类系统评估34个模型的隐写能力极限,测量相关指标并与基线比较,发现前沿模型无法联合推理嵌入,编码能力已达标,强调持续评估隐写风险的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15476 2026-07-07 cs.CR cs.AI 版本更新 57%

SoK: Systematizing LLM Prompt Security: Taxonomies, Datasets, and Unified Evaluation of Attacks and Defenses

知识梳理:系统化大语言模型提示安全:分类法、数据集以及攻击与防御的统一评估

Hanbin Hong, Shuang Wu, Shuya Feng, Nima Naderloui, Shenao Yan, Jingyu Zhang, Ali Arastehfard, Heqing Huang, Yuan Hong

机构 * University of Connecticut(康涅狄格大学) University of Alabama at Birmingham(阿拉巴马大学伯明翰分校) Independent(独立研究者)

专题命中 安全评测 :jailbreak(abstract);分类 cs.AI

AI总结 研究大语言模型提示安全问题,提出相关分类法,形式化评估元数据,发布模块化平台,通过匹配评估揭示多种因素对安全结论有重大影响,支持可重复、成本感知且基于分类法的评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18133 2026-07-07 cs.CY 版本更新 57%

Aggregated Individual Reporting for Post-Deployment Evaluation

部署后评估的聚合个体报告

Jessica Dai, Inioluwa Deborah Raji, Benjamin Recht, Irene Y. Chen

专题命中 安全评测 :safety(abstract);分类 cs.CY

AI总结 针对部署后模型评估需求,提出聚合个体报告机制,依靠公众个体报告来评估系统,探讨个体经验在评估中的作用及实施流程等。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02519 2026-07-07 cs.CY 版本更新 57%

Deaf in AI: AI language technologies and the erosion of linguistic rights

人工智能中的聋人问题:人工智能语言技术与语言权利的侵蚀

Maartje De Meulder

专题命中 安全评测 :trustworthy(abstract);分类 cs.CY

AI总结 探讨人工智能语言技术、手语翻译和语言获取的相互作用,指出技术存在缺陷,批判将人工智能替代口译员的框架,呼吁聋人主导培养公平包容的人工智能系统。

Journal ref Language and Law / Linguagem e Direito, Vol. 12(1), 2025, pp. 100-121

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.08777 2026-07-07 stat.ML cs.LG 版本更新 57%

Distribution-free Deviation Bounds and The Role of Domain Knowledge in Learning via Model Selection with Cross-validation Risk Estimation

无分布偏差界以及领域知识在通过交叉验证风险估计进行模型选择学习中的作用

Diego Marcondes, Cláudia Peixoto

机构 * Mathematical Sciences Institute and France-Australia Mathematical Sciences and Interactions ANU-CNRS International Research Lab(数学科学研究所和法澳数学科学与互动ANU-CNRS国际研究实验室) Department of Applied Mathematics, Institute of Mathematics and Statistics, Universidade de São Paulo(应用数学系、数学与统计研究所、圣保罗大学)

专题命中 安全评测 :alignment(abstract);分类 cs.LG

AI总结 本文在经典统计学习理论中,构建通过交叉验证风险估计进行模型选择学习的通用无分布框架,建立基于VC维的偏差界,引入学习空间探讨候选模型结构对泛化的影响,通过案例和模拟研究展示其优势并提供模型选择指导。

Comments arXiv admin note: text overlap with arXiv:2109.03866

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02496 2026-07-03 cs.RO cs.LG 新提交 57%

Controllable Sim Agents with Behavior Latents

具有行为潜变量的可控模拟智能体

Juanwu Lu, Junyu Zhu, Ziran Wang

机构 * Purdue University(普渡大学) University of Tokyo(东京大学)

专题命中 安全评测 :safety(abstract);分类 cs.LG

AI总结 提出可控神经变分智能体(CNeVA),通过闭环共轭变分更新推断行为潜变量,结合修正流轨迹生成器,实现可解释轴上的可控模拟,在Waymo数据集上达到竞争性真实感并提供通道级可控性。

Comments 23 pages, 5 tables, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02494 2026-07-03 cs.CV cs.CL 新提交 57%

Towards Robustness against Typographic Attack with Training-free Concept Localization

基于训练无关的概念定位实现对抗印刷体攻击的鲁棒性

Bohan Liu, Wenqian Ye, Guangzhi Xiong, Zhenghao He, Sanchit Sinha, Aidong Zhang

机构 * University of Virginia(弗吉尼亚大学)

专题命中 安全评测 :safety(abstract);分类 cs.CL

AI总结 提出一种无需训练的可解释性方法,通过分析注意力头对词汇和语义的编码差异,定位并干预ViT中的词汇偏置电路,从而在不额外训练的情况下显著提升对印刷体攻击的鲁棒性。

Comments 15 pages main text, provisionally accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02466 2026-07-03 cs.RO cs.AI 新提交 57%

Learning to Move Before Learning to Do: Task-Agnostic pretraining for VLAs

先学移动再学做事:面向VLA的任务无关预训练

Junhao Shi, Siyin Wang, Xiaopeng Yu, Li Ji, Jingjing Gong, Xipeng Qiu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 提出任务无关预训练(TAP)框架,先通过自监督逆动力学从廉价无标签交互数据学习可迁移运动先验,再用少量专家数据将先验与语言对齐,显著降低VLA模型对专家演示的依赖。

Comments Accepted to ICML 2026, 21 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02230 2026-07-03 cs.CV cs.AI 新提交 57%

Efficient Waste Sorting for Circular Economy: A Confidence-guided comparison between One-Vs-All and One-Vs-Rest Classification Strategies with Human-in-the-Loop for Automated Waste Sorting

面向循环经济的高效废物分类:基于置信度的人机协同自动废物分类中一对多与一对一分类策略比较

Mohammed Fahad Ali, Dominique Briechle, Marit Briechle-Mathiszig, Tobias Geger, Andreas Rausch

机构 * Institute for Software and Systems Engineering(软件与系统工程研究所) Clausthal University of Technology(克莱斯特哈根技术大学)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 针对德国不同城市废物分类方案差异问题,比较OvA和OvR分类策略,通过置信度阈值筛选不确定样本进行人工复核,平衡误分类与人工标注成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01936 2026-07-03 cs.MA cs.AI 新提交 57%

CausalSteward: An Agentic Divide-Conquer-Combine Copilot for Causal Discovery

CausalSteward: 一种用于因果发现的智能分治-合并副驾驶

Nicholas Tagliapietra, Gian Lorenzo Marchioni, Moritz Willig, Juergen Luettin, Lavdim Halilaj, Kristian Kersting

专题命中 安全评测 :trustworthy(abstract);分类 cs.AI

AI总结 提出CausalSteward多智能体框架,通过分治策略将高维变量迭代划分并分别分析,融合先验知识与数据驱动方法,解决因果可识别性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01522 2026-07-03 eess.SY cs.AI cs.CE cs.SY 新提交 57%

Robust and Explainable 3D Mode Shape Recognition Using Region-Aware Graph Neural Networks

鲁棒且可解释的3D模态形状识别:基于区域感知图神经网络

Tong Duy Son, Marc Brughmans, Andrey Hense, Kohta Sugiura, Sebastian Ciceo, Paolo di Carlo, Theo Geluk

机构 * Siemens Digital Industries Software(西门子数字工业软件) KU Leuven(根特大学) Department of Mechanical Engineering(机械工程系)

专题命中 安全评测 :trustworthy(abstract);分类 cs.AI

AI总结 提出规范工程图表示与区域感知图学习框架,将异构有限元模型和实验测量转化为通用图,通过图注意力学习和区域感知池化实现跨车辆架构的鲁棒3D模态形状识别,并提供物理解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01278 2026-07-03 cs.LG 新提交 57%

Multilayer Q-Matrix-Embedded Neural Network for Cognitive Diagnosis (M-QCDNet): Structure-Aware Deep Learning Architecture for Psychometric Interpretability

多层Q矩阵嵌入的认知诊断神经网络(M-QCDNet):面向心理测量可解释性的结构感知深度学习架构

Yiyao Yang

专题命中 安全评测 :alignment(abstract);分类 cs.LG

AI总结 提出M-QCDNet,将Q矩阵作为结构先验嵌入神经网络,通过带L2惩罚的损失函数平衡预测性能与结构对齐,实现可解释的认知诊断。

Comments 15 pages, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27898 2026-07-03 cs.AI 版本更新 57%

A Unified Framework for the Evaluation of LLM Agentic Capabilities

LLM 代理能力评估的统一框架

Pengyu Zhu, Lijun Li, Yaxing Lyu, Qianxin Luo, Jingyi Yang, Yi Liu, Tingfeng Hui, Xinyu Yuan, Li Sun, Sen Su, Jing Shao

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Chongqing University of Posts and Telecommunications(重庆邮电大学) North China Electric Power University(华北电力大学)

专题命中 安全评测 :safety(abstract);分类 cs.AI

AI总结 提出一个统一框架,通过标准化配置、固定 ReAct 架构和离线设置,分离框架与环境效应,实现 LLM 代理能力的公平评估,并在 7 个基准、24 个领域、15 个模型上进行了大规模实证分析。

详情

展开后加载摘要…

URL PDF HTML 收藏