Evaluating Large Language Models for Time Series Anomaly Detection in Aerospace Software
评估大型语言模型在航空航天软件时间序列异常检测中的应用
专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)
AI总结 本文提出ATSADBench基准,评估大型语言模型在航空航天软件时间序列异常检测中的性能,发现其在单变量任务表现良好,但多变量任务效果欠佳,且RAG策略可能加剧假警报问题。
Comments This paper has been accepted by ASE 2025