AttacKG+:Boosting Attack Knowledge Graph Construction with Large Language Models
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
Comments 20 pages, 5 figures
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
Comments 20 pages, 5 figures
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
Comments arXiv admin note: text overlap with arXiv:2307.03109 by other authors
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
Comments NAACL 2024 Findings paper (Camera-Ready Version)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
专题命中 评测与基准 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
Comments Paper accepted to NAACL 2024 (Findings)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
Comments 20 pages, 13 figures
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)
Comments Accepted by WWW 2024
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
Comments To be published in TACL (pre-MIT Press publication version)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
Comments Preprint, 26 pages, 10 figures, 5 tables; Added FreshEval
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)
专题命中 评测与基准 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)
Comments Eval4NLP 2023 shared task winner on both Small and Large model Track for Summarization
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);small language model(abstract)
Comments EMNLP2023
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);pretraining(abstract)
Comments 20 pages, 8 figures
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
Comments EMNLP 2023 Findings
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
Comments IJCNLP-AACL 2023
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
Comments Work in progress
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);small language model(abstract)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
Comments Benchmark website: http://coai.cs.tsinghua.edu.cn/leaderboard/ ; SafetyPrompts repo: https://github.com/thu-coai/Safety-Prompts
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
Comments 11 pages, 3 figures
代理大语言模型:综述
机构 * Leiden University Leiden Netherlands ; Leiden University \& AI Lab, Pegasystems Leiden Netherlands ; Leiden University ; Leiden University \& AI Lab, Pegasystems
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract,comments);分类 cs.CL、cs.AI、cs.LG
AI总结 本文综述了代理大语言模型的研究现状,探讨了其在医疗诊断、物流和金融分析等领域的应用,并提出通过推理、行动和交互提升大语言模型能力的未来研究方向。
Comments Website: https://askeplaat.github.io/agentic-llm-survey-site/
Journal ref JAIR volume 84, article 29, December 2025
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
Comments GitHub repository: https://github.com/xiyuanzh/awesome-llm-time-series
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract,comments);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to NeurIPS 2023, 24 pages. Datasets and Benchmarks Track. Added the first Mandarin and code-switching (zh-cn and en-us) results from the LLM-based generative ASR error correction to Table 8 on Page 21
智能体安全:LLM驱动渗透测试的工具、失效模式与设计法则体系化研究
机构 * Ahsanullah University of Science and Technology(阿赫桑乌拉科技大学) ; BRAC University(BRAC大学) ; North South University(北南大学) ; Missouri State University(密苏里州立大学) ; Multimedia University(多媒体大学) ; American International University-Bangladesh(孟加拉国美国国际大学)
专题命中 评测与基准 :LLM(title,title_cn);分类 cs.CL、cs.AI
AI总结 该研究对LLM驱动渗透测试的智能体安全相关工具、失效模式等体系化,推导定量规律与设计法则,实现Inspectra平台验证。
超越基准:基于拟人化与生命周期导向路线图的大语言模型评估
机构 * Department of Networks, China Mobile Communications Group Co.,Ltd.(中国移动通信集团有限公司网络部) ; Xidian University(西安电子科技大学) ; Oklahoma State University(俄克拉荷马州立大学) ; Shanghai Jiao Tong University(上海交通大学)
专题命中 评测与基准 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 本研究针对LLM基准分数与实际效用脱节问题,建立诊断本体并提出含IQ、PQ、EQ、VQ的拟人化评估框架,分析200余个基准后为LLM开发提供战略指引。
Comments Preprint. Under Review
PromptResponse:优化大语言模型编码任务的提示词
机构 * Humboldt-Universität zu Berlin(柏林洪堡大学) ; HU Berlin(柏林洪堡大学)
专题命中 评测与基准 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 本研究提出PromptResponse,通过对HumanEval数据集的5种变体让GPT-4o执行8200次编码任务,发现统一格式(尤其JSON)可提升代码效率与稳定性,LLM调优提示词会降低性能,还发布了相关数据集与评估流程。
Comments 22 pages, 7 figures, 10 listings