MCP Safety Audit: LLMs with the Model Context Protocol Allow Major Security Exploits
专题命中 安全评测 :safety(title,abstract);分类 cs.AI、cs.LG
Comments 27 pages, 21 figures, and 2 Tables. Cleans up the TeX source
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全评测 :safety(title,abstract);分类 cs.AI、cs.LG
Comments 27 pages, 21 figures, and 2 Tables. Cleans up the TeX source
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.AI
Comments 30 pages, 11 figures
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.AI
Comments 18 pages, 3 figures. Accepted for the ESWC 2025 Resource Track
专题命中 安全评测 :trustworthy(title);safety(abstract);分类 cs.AI、cs.LG
Comments 15 pages, 8 figures
专题命中 安全评测 :safety(title,abstract);分类 cs.AI、cs.LG
Comments 10 pages, 7 figures
专题命中 安全评测 :alignment(title,abstract);分类 cs.AI、cs.LG
Comments Accepted by SenSys'25
专题命中 安全评测 :safety(title,abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :safety(title,abstract);分类 cs.AI、cs.LG
Comments 16 pages, 10 figures, accepted by the 103rd Transportation Research Board (TRB) Annual Meeting, accepted and published by Transportation Research Record: Journal of the Transportation Research Board
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.LG
Comments Accepted by CVPR 2025
专题命中 安全评测 :alignment(title,abstract);分类 cs.AI、cs.LG
Comments Accepted at ICLR 2025 (Oral)
专题命中 安全评测 :trustworthy(title,abstract);分类 cs.CL、cs.AI
Comments 18 pages, code released at https://github.com/chenllliang/MMEvalPro, Homepage at https://mmevalpro.github.io/
专题命中 安全评测 :safety(title,abstract);分类 cs.CL、cs.CY
Comments AAAI 2025 Workshop on AI for Social Impact: Bridging Innovations in Finance, Social Media, and Crime Prevention
专题命中 安全评测 :safety(title,abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :safety(title);alignment(abstract);分类 cs.AI、cs.CY
Comments 27 pages, Part of MIT Open Learning AI and Open Education Initiative Series, published Jan 2025 https://aiopeneducation.pubpub.org/pub/i36sncz8/release/3?readingCollection=06969c6d
专题命中 安全评测 :safety(title,abstract);分类 cs.CL、cs.AI
Comments Advancing Artificial Intelligence through Theory of Mind Workshop, AAAI 2025
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.AI
Journal ref NeurIPS 2024
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.LG
Comments 9 pages (+ references and appendix)
专题命中 安全评测 :trustworthy(title,abstract);分类 cs.AI、cs.CY
Comments 8 pages, 10 tables, and 1 figure. Accepted at the International Telecommunication Union (ITU) Kaleidoscope 2024
Journal ref 2024 ITU Kaleidoscope: Innovation and Digital Transformation for a Sustainable World (ITU K), New Delhi, India, 2024, pp. 1-8
专题命中 安全评测 :alignment(title,abstract);分类 cs.AI、cs.LG
Comments 10 pages, 2 figures. To be published in ISBI 2025
专题命中 安全评测 :safety(title,abstract);分类 cs.AI、cs.LG
Comments 8 pages (IEEE double column format), 7 figures, 2 tables
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.LG
专题命中 安全评测 :safety(title,abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.AI
Comments BayLing 2's online demo: http://nlp.ict.ac.cn/bayling/demo. BayLing 2's code and models: https://github.com/ictnlp/BayLing
专题命中 安全评测 :trustworthy(title,abstract);分类 cs.CL、cs.AI
Comments 24 pages, 4 figures
专题命中 安全评测 :safety(title);alignment(abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :safety(title,abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.CY
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.AI
Journal ref 2024 Neurips
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.AI
Comments NeurlPS 2024, Camera ready