AgentCanary: A Security Evaluation Framework for Autonomous AI Agents in Real Executable Environments
AgentCanary:真实可执行环境中自主AI智能体的安全评估框架
专题命中 安全评测 :safety(abstract)
AI总结 提出AgentCanary框架,通过正交风险分类、高保真执行环境和轨迹多维度评估,解决现有安全评估中风险覆盖碎片化、环境静态低保真及指标单一粗粒度的问题。
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
AgentCanary:真实可执行环境中自主AI智能体的安全评估框架
专题命中 安全评测 :safety(abstract)
AI总结 提出AgentCanary框架,通过正交风险分类、高保真执行环境和轨迹多维度评估,解决现有安全评估中风险覆盖碎片化、环境静态低保真及指标单一粗粒度的问题。
DB-3DME:从数据集到基准测试,实现与人类对齐的自动3D网格评估
机构 * University of California, Berkeley(加州大学伯克利分校) ; Roblox Corporation(Roblox公司)
专题命中 安全评测 :alignment(abstract)
AI总结 提出DB-3DME数据集与基准,包含2619个合成3D网格及其人类评分,通过微调视觉编码器优化VLM评估性能,显著超越现有模型。
Comments CVPR 2026 workshop paper. 10 pages, 3 figures, 6 tables. Dataset available at GitHub and Hugging Face
HDSL:一种用于结构化3D室内场景生成和基于LLM智能体局部编辑的层次化领域特定语言
机构 * SIGS, Tsinghua University(清华大学深圳国际研究生院) ; Nankai University(南开大学) ; University of Arizona(亚利桑那大学) ; Zhejiang University(浙江大学) ; ETH Zurich(苏黎世联邦理工学院)
专题命中 安全评测 :alignment(abstract)
AI总结 提出HDSL语言,以树结构表示室内场景,结合LLM智能体生成、多模态检索和力导向布局优化,实现结构化场景生成与局部编辑,显著提升对象覆盖率和编辑效率。
可穿戴单导联心电图通过超声报告监督检测细粒度结构性心脏病
专题命中 安全评测 :alignment(abstract)
AI总结 提出AnyECG-Echo框架,利用单导联心电图与超声报告对比预训练,在外部队列中检测13种细粒度结构性心脏病亚型,实现高AUROC并具备双轴可解释性。
卡车-无人机协同配送网络的系统级规划与协调
机构 * School of Electrical Engineering and Computer Science at the University of Ottawa(渥太华大学电气工程与计算机科学学院)
专题命中 安全评测 :alignment(abstract)
AI总结 针对城市最后一英里配送,提出分层规划与协调框架,通过任务编排与智能体同步,实现卡车-无人机协同配送,相比纯卡车模式,总配送时间减少42.4%,能耗降低44.2%。
Comments 6 pages, 4 figures, Accepted to 2026 IEEE HPSR on Network Architectures and Intelligence for Smart Mobility and Autonomous Systems (TRAVERSAL)
从人类驾驶中学习:一种用于自动驾驶的人机协同在线行为克隆框架
机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(西安交通大学人工智能与机器人研究所人机混合增强智能国家重点实验室)
专题命中 安全评测 :safety(abstract)
AI总结 提出人机协同在线行为克隆框架HiL-OBC,通过人类干预初始化策略、贝叶斯潜在行为建模和在线更新,结合大模型感知与人类驾驶智能,在CARLA基准上显著提升驾驶性能。
一石三鸟:面向多VLM选择、自适应与集成的自适应最优传输
机构 * Xi’an Jiaotong University(西安交通大学) ; Yunnan Normal University(云南师范大学) ; Xidian University(西安电子科技大学) ; Kunming University of Science and Technology(昆明理工大学)
专题命中 安全评测 :trustworthy(abstract)
AI总结 提出无训练框架OSTB,通过自适应最优传输估计共识样本-类别结构,同时解决多VLM的模型选择、目标域自适应和预测集成问题。
HAVE:用于弥合安全数字孪生中上下文现实差距的主机主动验证引擎
专题命中 安全评测 :safety(abstract)
AI总结 提出HAVE引擎,通过安全约束主机代理进行最大似然估计,测量经验妥协概率,利用Wilson区间置信权重和贝叶斯混合规则修正CVSS评分导致的上下文现实差距,实验显示在误报和漏报场景中分别降低38.2%和提升132.4%的到达概率。
Comments This work has been submitted to the IEEE for possible publication