Cross-Platform Evaluation of Large Language Model Safety in Pediatric Consultations: Evolution of Adversarial Robustness and the Scale Paradox
跨平台评估大语言模型在儿科咨询中的安全性:对抗鲁棒性的演变与规模悖论
专题命中 医学数据与评测 :medical AI(abstract)
AI总结 本研究评估了不同模型和平台在家长焦虑驱动下的LLM安全性,发现较小模型在对抗性压力下表现更优,且安全性与模型架构相关,而非规模。
Journal ref npj Digit. Med. (2026)