arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 9434 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 安全评测 9434 篇

2601.01116 2026-01-07 stat.ME q-bio.QM 50%

Beyond P-Values: Importing Quantitative Finance's Risk and Regret Metrics for AI in Learning Health Systems

超越P值:将定量金融的风险和遗憾度量引入AI在学习健康系统中的应用

Richik Chakraborty

专题命中 安全评测 :safety(abstract)

AI总结 本文提出将定量金融的风险和遗憾度量引入AI在学习健康系统中的应用,以改进对持续学习系统中证据和安全性的评估。

Comments Manuscript: 12 pages, 3 mathematical boxes, 1 figure, 1 table, 26 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02304 2026-01-06 cs.DB 50%

Octopus: A Lightweight Entity-Aware System for Multi-Table Data Discovery and Cell-Level Retrieval

Octopus: 一种轻量级的实体感知多表数据发现与单元格级检索系统

Wen-Zhi Li, Sainyam Galhotra

专题命中 安全评测 :alignment(abstract)

AI总结 Octopus是一种无需训练的轻量级系统,通过细粒度实体识别和直接扫描表内容,实现多表数据发现和单元格级值检索,提高准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09592 2026-01-06 cs.SE 50%

What Does Explainable AI Mean in Practice? Evaluative Requirements from a Longitudinal Clinical Case Study

在实践中可解释人工智能意味着什么?来自长期临床案例研究的评估要求

Tor Sporsem, Stine Rasdal Finserås, Lars Adde, Inga Strümke

专题命中 安全评测 :trustworthy(abstract)

AI总结 本文通过长期临床案例研究,探讨了在专家领域中构建可信AI系统所需的评估需求,发现医生更信任能与自身评估对比的简单预测图。

Comments Accepted to ICSE SEIP 2026 in Rio de Janeiro, 12-18 April

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10048 2026-01-06 cs.HC 50%

Between Knowledge and Care: Evaluating Generative AI-Based IUI in Type 2 Diabetes Management Through Patient and Physician Perspectives

在知识与关怀之间:通过患者和医师视角评估生成式AI在2型糖尿病管理中的IUI

Yibo Meng, Ruiqi Chen, Bingyi Liu, Yan Guan, Xiaolan Ding

专题命中 安全评测 :safety(abstract)

AI总结 本文通过患者和医师视角评估生成式AI在2型糖尿病管理中的应用,揭示其在安全性、情境判断和责任边界方面的不足,提出需智能界面调解AI输出以支持长期护理中的信任与责任。

Comments In Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00839 2026-01-06 cs.CV 50%

Unified Review and Benchmark of Deep Segmentation Architectures for Cardiac Ultrasound on CAMUS

针对心脏超声的深度分割架构的统一回顾与基准测试:CAMUS

Zahid Ullah, Muhammad Hilal, Eunsoo Lee, Dragan Pamucar, Jihie Kim

机构 * Department of Computer Science Artificial Intelligence, Dongguk University, Seoul 04620, Republic of Korea Department of Semiconductor System Engineering, Sejong University, Seoul, 05006, Republic of Korea Department of Operations Research Statistics, Faculty of Organizational Sciences, University of Belgrade, Belgrade, Serbia Department of Industrial Engineering \& Management, Yuan Ze University, Taoyuan City 320315, Taiwan Department of Applied Mathematical Science, College of Science Technology, Korea University, Sejong 30019, Republic of Korea

专题命中 安全评测 :alignment(abstract)

AI总结 本文通过统一基准测试评估了三种心脏超声分割架构的性能,提出标准化预处理方法,并展望了自监督和多模态标注技术的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00535 2026-01-05 cs.CV 50%

FreeText: Training-Free Text Rendering in Diffusion Transformers via Attention Localization and Spectral Glyph Injection

FreeText: 通过注意力定位和频谱字形注入实现免训练的文本渲染

Ruiqiang Zhang, Hengyi Wang, Chang Liu, Guanjie Wang, Zehua Ma, Weiming Zhang

机构 * Anhui Province Key Laboratory of Digital Security, University of Science and Technology of China(安徽省数字安全重点实验室,中国科学技术大学)

专题命中 安全评测 :alignment(abstract)

AI总结 FreeText通过注意力定位和频谱字形注入技术,无需训练即可提升文本渲染的准确性和美学质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24260 2026-01-05 cs.CV 50%

Physically-Grounded Manifold Projection Model for Generalizable Metal Artifact Reduction in Dental CBCT

基于物理的流形投影模型用于通用金属伪影减少在牙科CBCT

Zhi Li, Yaqi Wang, Bingtao Ma, Yifan Zhang, Huiyu Zhou, Shuai Wang

机构 * School of Cyberspace, Hangzhou Dianzi University(电子科技大学信息学院) Innovation Center for Electronic Design Automation Technology, Hangzhou Dianzi University(电子科技大学电子设计自动化创新中心) Hangzhou Geriatric Stomatology Hospital, Hangzhou Dental Hospital Group(杭州老年口腔医院,杭州口腔医院集团) School of Computing and Mathematical Sciences, University of Leicester(莱斯特大学计算与数学科学学院)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出基于物理的流形投影模型,通过合成数据和临床数据实验,实现了更高效且可靠的牙科CBCT中金属伪影减少。

Comments This manuscript has been submitted to Medical Image Analysis for peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24925 2026-01-01 cs.CR 50%

Towards Provably Secure Generative AI: Reliable Consensus Sampling

迈向可证明安全的生成AI:可靠的共识采样

Yu Cui, Hang Fu, Sicheng Pan, Zhuoyu Sun, Yifei Liu, Yuhong Nie, Bo Ran, Baohan Huang, Xufeng Zhang, Haibin Zhang, Cong Zuo, Licheng Wang

专题命中 安全评测 :safety(abstract)

AI总结 本文提出可靠的共识采样(RCS)算法,通过追踪接受概率提升生成AI的鲁棒性和效用,同时保持可控风险阈值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24321 2026-01-01 cs.CV cs.RO 50%

UniAct: Unified Motion Generation and Action Streaming for Humanoid Robots

UniAct:面向人形机器人的统一动作生成与动作流

Nan Jiang, Zimo He, Wanhe Yu, Lexi Pang, Yunhao Li, Hongjie Li, Jieming Cui, Yuhan Li, Yizhou Wang, Yixin Zhu, Siyuan Huang

机构 * Institute for AI, Peking University(人工智能研究院,北京大学) Beijing Institute for General Artificial Intelligence (BIGAI)(北京通用人工智能研究院) School of Psychological and Cognitive Sciences, Peking University(心理学与认知科学学院,北京大学) School of Computer Science, Peking University(计算机科学学院,北京大学) Yuanpei College, Peking University(元培学院,北京大学) School of Foreign Languages, Peking University(外语学院,北京大学) School of EECS, Peking University(电子工程与科学学院,北京大学) Huazhong University of Science and Technology(华中科技大学) State Key Lab of General AI(通用人工智能国家重点实验室) Nat’l Eng. Research Center of Visual Technology(视觉技术国家工程研究中心) Beijing Key Laboratory of Behavior and Mental Health, Peking University(北京行为与心理健康重点实验室,北京大学) Embodied Intelligence Lab, PKU-Wuhan Institute for Artificial Intelligence(具身智能实验室,北京大学-武汉人工智能研究院)

专题命中 安全评测 :alignment(abstract)

AI总结 UniAct通过统一感知与控制框架,实现人形机器人在多模态指令下的高效动作生成与实时执行,提升零样本跟踪成功率19%。

Comments Project page: https://jnnan.github.io/uniact/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21684 2026-01-01 cs.CV 50%

SlideChain: Semantic Provenance for Lecture Understanding via Blockchain Registration

SlideChain: 通过区块链注册实现讲座理解的语义溯源

Md Motaleb Hossen Manik, Md Zabirul Islam, Ge Wang

机构 * Department of Computer Science Rensselaer Polytechnic Institute(计算机科学系罗切斯特理工学院) Department of Biomedical Engineering Rensselaer Polytechnic Institute(生物医学工程系罗切斯特理工学院)

专题命中 安全评测 :trustworthy(abstract)

AI总结 SlideChain通过区块链注册实现讲座理解的语义溯源,提供可验证的完整性与持久基准,解决多模态教育内容的可复现性和审计性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23033 2025-12-30 cs.SE cs.CV 50%

Interpretable Gallbladder Ultrasound Diagnosis: A Lightweight Web-Mobile Software Platform with Real-Time XAI

可解释的胆囊超声诊断:一种轻量级的网页-移动软件平台与实时XAI

Fuyad Hasan Bhoyan, Prashanta Sarker, Parsia Noor Ethila, Md. Emon Hossain, Md Kaviul Hossain, Md Humaion Kabir Mehedi

机构 * University of Liberal Arts Bangladesh(乌拉尔大学 Bangladesh) BRAC University(BRAC大学)

专题命中 安全评测 :trustworthy(abstract)

AI总结 本研究提出了一种轻量级网页-移动软件平台,利用混合深度学习模型MobResTaNet实现胆囊疾病的实时可解释诊断,准确率达99.85%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21964 2025-12-29 cs.CV 50%

Perceive and Calibrate: Analyzing and Enhancing Robustness of Medical Multi-Modal Large Language Models

感知与校准:分析和增强医疗多模态大语言模型的鲁棒性

Dunyuan XU, Xikai Yang, Yaoqian Li, Juzheng Miao, Jinpeng Li, Pheng-Ann Heng

机构 * Department of Computer Science and Engineering, CUHK, Hong Kong, China(计算机科学与工程系,CUHK,香港,中国) Institute of Medical Intelligence and XR, CUHK, Hong Kong, China(医学智能与XR研究所,CUHK,香港,中国)

专题命中 安全评测 :safety(abstract)

AI总结 本文提出IMC框架,通过感知和校准原则提升医疗多模态大语言模型的鲁棒性,针对视觉和文本模态分别设计PDC和SMS进行噪声校正。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21616 2025-12-29 cs.CV 50%

TAMEing Long Contexts in Personalization: Towards Training-Free and State-Aware MLLM Personalized Assistant

在个性化中延长上下文:迈向无训练和状态感知的MLLM个性化助手

Rongpei Hong, Jian Lang, Ting Zhong, Yong Wang, Fan Zhou

机构 * University of Electronic Science and Technology of China(电子科技大学) Aiwen Technology Co., Ltd.(Aiwen科技有限公司) Intelligent Digital Media Technology Key Laboratory of Sichuan Province(四川省智能数字媒体技术重点实验室)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出TAME框架,通过双记忆和RA2G范式实现无训练、状态感知的MLLM个性化,提升长上下文对话能力。

Comments Accepted by KDD 2026 research track. Code and data are available at https://github.com/ronpay/TAME

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02622 2025-12-25 cs.CV 50%

RULER-Bench: Probing Rule-based Reasoning Abilities of Next-level Video Generation Models for Vision Foundation Intelligence

RULER-Bench: 探索下一代视频生成模型的基于规则的推理能力以实现视觉基础智能

Xuming He, Zehao Fan, Hengjia Li, Fan Zhuo, Hankun Xu, Senlin Cheng, Di Weng, Haifeng Liu, Can Ye, Boxi Wu

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团)

专题命中 安全评测 :alignment(abstract)

AI总结 RULER-Bench通过评估视频生成模型的基于规则的推理能力,揭示了其在时间一致性等指标上的不足,为提升视频生成模型的推理能力提供新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20561 2025-12-24 cs.CV 50%

FlashVLM: Text-Guided Visual Token Selection for Large Multimodal Models

FlashVLM: 大规模多模态模型中的文本引导视觉令牌选择

Kaitong Cai, Jusheng Zhang, Jing Yang, Yijia Fan, Pengtao Xie, Jian Wang, Keze Wang

机构 * Sun Yat-sen University(中山大学) University of California, San Diego(加州大学圣地亚哥分校) Snap Inc.(Snap公司)

专题命中 安全评测 :alignment(abstract)

AI总结 FlashVLM通过文本引导的视觉令牌选择,实现了高效压缩和高准确率,在大规模多模态模型中表现出色。

Comments Under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20501 2025-12-24 cs.CV 50%

Bridging Modalities and Transferring Knowledge: Enhanced Multimodal Understanding and Recognition

弥合模态与知识转移:增强多模态理解和识别

Gorjan Radevski

机构 * University of Bristol(布里斯托大学) University of Würzburg(乌尔姆大学) Processing Speech and Images (PSI)(语音与图像处理组)

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出多模态对齐、翻译、融合和转移方法,提升复杂输入的理解与识别能力,涵盖空间语言、医学文本、知识图谱和动作识别等多个领域。

Comments Ph.D. manuscript; Supervisors/Mentors: Marie-Francine Moens and Tinne Tuytelaars

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20184 2025-12-24 cs.DC 50%

Reaching Agreement Among Reasoning LLM Agents

使推理LLM代理达成一致

Chaoyi Ruan, Yiliang Wang, Ziji Shi, Jialin Li

专题命中 安全评测 :safety(abstract)

AI总结 Aegean通过引入基于共识的协议,为多代理推理提供正式模型,有效减少延迟并保持答案质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11649 2025-12-24 cs.SI 50%

Illusions of Intimacy: How Emotional Dynamics Shape Human-AI Relationships

亲密的幻觉:情感动态如何塑造人与人工智能的关系

Minh Duc Chu, Patrick Gerard, Kshitij Pawar, Charles Bickham, Kristina Lerman

专题命中 安全评测 :safety(abstract)

AI总结 本文研究了人与人工智能关系中情感动态的形成过程,通过分析用户与聊天机器人的对话数据,揭示了AI如何通过模仿用户情绪来增强亲密感,并提出了对社交聊天机器人设计和监管的建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21540 2025-12-22 cs.HC 50%

Designing an LLM-Based Behavioral Activation Chatbot for Young People with Depression: Insights from an Evaluation with Artificial Users and Clinical Experts

设计一个基于LLM的行为激活聊天机器人以帮助有抑郁症的青少年:基于人工用户和临床专家评估的见解

Florian Onur Kuhlmeier, Leon Hanschmann, Melina Rabe, Stefan Luettke, Eva-Lotta Brakemeier, Alexander Maedche

专题命中 安全评测 :safety(abstract)

AI总结 本文设计了一个基于LLM的行为激活聊天机器人,通过人工用户和临床专家评估,验证了其在抑郁症干预中的保真度和安全性,同时指出临床推理能力仍需改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22685 2025-12-22 cs.RO 50%

Deadlock-Free Hybrid RL-MAPF Framework for Zero-Shot Multi-Robot Navigation

无死锁的混合式RL-MAPF框架用于零样本多机器人导航

Haoyi Wang, Licheng Luo, Yiannis Kantaros, Bruno Sinopoli, Mingyu Cai

机构 * Department of Mechanical Engineering University of California Riverside CA USA(加州大学河滨分校机械工程系) Department of Electrical and Systems Engineering Washington University in St. Louis MO USA(华盛顿大学圣路易斯分校电气与系统工程系)

专题命中 安全评测 :safety(abstract)

AI总结 本文提出一种无死锁的混合RL-MAPF框架,通过整合反应性RL导航与按需MAPF干预,实现零样本多机器人导航的鲁棒性能。

Comments 18 pages (including appendix), 3 figures. Project page (videos, animations, additional resources): https://wanghaoyi518.github.io/rl-mapf-project-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01185 2025-12-19 cs.CR 50%

DefenSee: Dissecting Threat from Sight and Text -- A Multi-View Defensive Pipeline for Multi-modal Jailbreaks

DefenSee:从视觉和文本中解构威胁——一种多视图防御管道用于多模态对抗突破

Zihao Wang, Kar Wai Fok, Vrizlynn L. L. Thing

专题命中 安全评测 :jailbreak(abstract)

AI总结 DefenSee通过图像变体转录和跨模态一致性检查,提供一种多模态防御方法,有效降低多模态对抗攻击的成功率,提升模型鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15818 2025-12-19 cs.CR 50%

Unveiling the Attribute Misbinding Threat in Identity-Preserving Models

揭示身份保持模型中的属性绑定威胁

Junming Fu, Jishen Zeng, Yi Jiang, Peiyu Zhuang, Baoying Chen, Siyu Lu, Jianquan Yang

专题命中 安全评测 :safety(abstract)

AI总结 本文提出属性绑定攻击,揭示身份保持模型生成不安全内容的风险,并通过Misbinding Prompt评估集和ABSS指标评估模型的安全性与真实性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05788 2025-12-18 eess.SY cs.SY 50%

Task-Specific Trust Evaluation for Multi-Hop Collaborator Selection via GNN-Aided Distributed Agentic AI

基于图神经网络的多跳协作者选择任务特定信任评估

Botao Zhu, Xianbin Wang, Dusit Niyato

专题命中 安全评测 :trustworthy(abstract)

AI总结 本文提出基于图神经网络的分布式代理人工智能框架,用于多跳协作者选择中的任务特定信任评估,通过整合设备可信度评估结果,实现隐私保护的任务路径规划。

Journal ref IEEE Journal on Selected Areas in Communications, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15148 2025-12-18 cs.SE 50%

Aligning Academia with Industry: An Empirical Study of Industrial Needs and Academic Capabilities in AI-Driven Software Engineering

将学术与产业对齐:一项关于工业需求和学术能力的AI驱动软件工程实证研究

Hang Yu, Yuzhou Lai, Li Zhang, Xiaoli Lian, Fang Liu, Yanrui Dong, Ting Zhang, Zhi Jin, David Lo

专题命中 安全评测 :alignment(abstract)

AI总结 本文通过分析学术研究与工业需求的差距,揭示AI驱动软件工程中的关键挑战,旨在引导未来研究更贴近实际应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14755 2025-12-18 cs.CV 50%

SkyCap: Bitemporal VHR Optical-SAR Quartets for Amplitude Change Detection and Foundation-Model Evaluation

SkyCap:双时间维高分辨率光学-合成孔径雷达四元组用于幅度变化检测和基础模型评估

Paul Weinmann, Ferdinand Schenck, Martin Šiklar

机构 * LiveEO GmbH(LiveEO公司)

专题命中 安全评测 :alignment(abstract)

AI总结 SkyCap通过光学-雷达数据集和标签转移,首次评估了高分辨率SAR幅度变化检测中的基础模型性能。

Comments 8 pages, 0 figures. Accepted at Advances in Representation Learning for Earth Observation (REO) at EurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14499 2025-12-17 cs.CV 50%

Native Intelligence Emerges from Large-Scale Clinical Practice: A Retinal Foundation Model with Deployment Efficiency

原生智能源自大规模临床实践:一种具有部署效率的视网膜基础模型

Jia Guo, Jiawei Du, Shengzhu Yang, Shuai Lu, Wenquan Cheng, Kaiwen Zhang, Yihua Sun, Chuhong Yang, Weihang Zhang, Fang Chen, Yilan Wu, Lie Ju, Guochen Ning, Longfei Ma, Huiping Yao, Jinyuan Wang, Peilun Shi, Yukun Zhou, Jie Xu, Pearse A. Keane, Hanruo Liu, Hongen Liao, Ningli Wang, Huiqi Li

机构 * School of Biomedical Engineering, Tsinghua Medicine, Tsinghua University(生物医学工程学院,清华大学医学部,清华大学) School of Information and Electronics, Beijing Institute of Technology(信息与电子学院,北京理工大学) Beijing Key Laboratory of Intelligent Diagnosis Technology and Equipment for Optic Nerve-Related Eye Diseases(北京智能诊断技术与设备重点实验室) School of Medical Technology, Beijing Institute of Technology(医学技术学院,北京理工大学) Beijing Tongren Hospital, Capital Medical University(北京同仁医院,首都医科大学) School of Biomedical Engineering, Shanghai Jiaotong University(生物医学工程学院,上海交通大学) Beijing Visual Science and Translational Eye Research Institute (BERI), Beijing Tsinghua Changgung Hospital Eye Center, School of Clinical Medicine, Tsinghua Medicine, Tsinghua University Institute of Ophthalmology(北京视觉科学与转化眼研所(BERI),北京清华长庚医院眼科中心,临床医学学院,清华大学医学部,清华大学眼科学院)

专题命中 安全评测 :alignment(abstract)

AI总结 ReVision通过直接从真实临床数据中学习,实现了在低资源环境下高效部署的视网膜基础模型,无需额外标注即可在多种医学任务中取得优异性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11065 2025-12-17 cs.HC 50%

Immutable Explainability: Fuzzy Logic and Blockchain for Verifiable Affective AI

不可变的可解释性:模糊逻辑与区块链用于可验证的情感人工智能

Marcelo Fransoy, Alejandro Hossian, Hernán Merlino

专题命中 安全评测 :trustworthy(abstract)

AI总结 本文提出不可变可解释性架构,结合模糊逻辑与区块链,实现情感AI的透明决策和可信审计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13977 2025-12-17 cs.CV 50%

XAI-Driven Diagnosis of Generalization Failure in State-Space Cerebrovascular Segmentation Models: A Case Study on Domain Shift Between RSNA and TopCoW Datasets

基于XAI的州空间脑血管分割模型泛化失败诊断:在RSNA与TopCoW数据集域偏移案例研究

Youssef Abuzeid, Shimaa El-Bana, Ahmad Al-Kabbany

机构 * Department of Electronics and Electrical Communications Engineering(电子与电气通信工程系) Cairo University(开罗大学) Multimedia Interaction and Communication Lab(多媒体交互与通信实验室) Arab Academy for Science and Technology(阿拉伯科学与技术学院) Wearables, Biosensing, and Biosignal Processing Research lab(可穿戴设备、生物传感与生物信号处理研究实验室)

专题命中 安全评测 :trustworthy(abstract)

AI总结 本文提出基于XAI的两阶段方法,诊断州空间模型在脑血管分割中的泛化失败原因,揭示模型因关注机制失效而学习虚假相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13262 2025-12-16 cs.RO cs.CV 50%

Post-Training and Test-Time Scaling of Generative Agent Behavior Models for Interactive Autonomous Driving

生成代理行为模型在交互式自动驾驶中的训练和测试时间缩放

Hyunki Seong, Jeong-Kyun Lee, Heesoo Myeong, Yongho Shin, Hyun-Mook Cho, Duck Hoon Kim, Pranav Desai, Monu Surana

专题命中 安全评测 :safety(abstract)

AI总结 本文提出GRBO和Warm-K两种方法,用于提升交互式自动驾驶中生成代理行为模型的训练和测试时间性能,提高安全性和鲁棒性。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19253 2025-12-16 cs.IR 50%

DeepResearchGym: A Free, Transparent, and Reproducible Evaluation Sandbox for Deep Research

DeepResearchGym: 一个免费、透明且可复现的深度研究评估沙盒

João Coelho, Jingjie Ning, Jingyuan He, Kangrui Mao, Abhijay Paladugu, Pranav Setlur, Jiahe Jin, Jamie Callan, João Magalhães, Bruno Martins, Chenyan Xiong

专题命中 安全评测 :alignment(abstract)

AI总结 DeepResearchGym提供了一个免费、透明且可复现的深度研究评估沙盒,结合可复现的搜索API和严谨的评估协议,用于评估深度研究系统性能,展示其在成本效益训练中的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏