VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)
机构 * Academia Sinica(中国科学院) ; National Chengchi University(中正大学)
专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)
Comments Accepted to IEEE ICCE-TW 2025
机构 * Autolab, Westlake University(自动化实验室,西lake大学) ; Zhejiang University(浙江大学)
专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)
Comments CoRL 2025
机构 * Rochester Institute of Technology(罗切斯特技术学院) ; Gonzaga University(戈兹加大学)
专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
机构 * ZERON Shanghai, China(上海零点科技有限公司)
专题命中 评测与基准 :language model(title,abstract);LLM(abstract);large language model(abstract)
Comments 2nd place in CVPR 2024 End-to-End Driving at Scale Challenge
机构 * Stanford University(斯坦福大学) ; University of California, Santa Cruz(加州大学圣克ruz分校) ; Hitachi America, Ltd.(日立美国有限公司)
专题命中 评测与基准 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI
机构 * TALN Group, Universitat Pompeu Fabra(庞培法华大学TALN小组) ; Institute of Computer Science, Polish Academy of Sciences(波兰科学院计算机科学研究所)
专题命中 评测与基准 :language model(title,abstract);large language model(abstract);分类 cs.CL
Comments Presented at EMNLP 2025
机构 * Department of Radiology University of California(放射科系 加州大学)
专题命中 评测与基准 :foundation model(title,abstract);分类 cs.AI、cs.LG
Journal ref In Proceedings of the ICLR 2024 Workshop on Learning from Time Series for Health (2024). Retrieved from https://openreview.net/forum?id=O6T38rRiFp
专题命中 评测与基准 :foundation model(title,abstract);分类 cs.AI
机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University, China(清华大学深圳国际研究生院) ; Ping An Technology (Shenzhen) Co., Ltd., Shenzhen, China(平安科技(深圳)有限公司) ; Peng Cheng Laboratory, Shenzhen, China(鹏城实验室)
专题命中 评测与基准 :prompting(title,abstract);分类 cs.LG
Comments Accepted by the 49th IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2024)
机构 * MIT(麻省理工学院)
专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
Comments 6 pages, 2 figures, submitted to CIDR'26
机构 * Duke University(杜克大学)
专题命中 评测与基准 :language model(title,abstract)
Comments The paper has been accepted to the 2025 IEEE Conference on Virtual Reality and 3D User Interfaces (IEEE VR), and selected for publication in the 2025 IEEE Transactions on Visualization and Computer Graphics (TVCG) special issue
机构 * University of Tübingen & Tübingen AI Center, Germany(图宾根大学及图宾根人工智能中心) ; EPFL, Switzerland(瑞士联邦理工学院)
专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG
专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract)
Comments 37 pages
机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) ; The Hong Kong University of Science and Technology(香港科技大学) ; Tsinghua University(清华大学) ; Ant Group(蚂蚁集团) ; Alibaba Group(阿里巴巴集团)
专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
机构 * Bilkent University, Turkey(巴伊肯大学)
专题命中 评测与基准 :prompting(title);分类 cs.AI
Comments Accepted to ASE2025
专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL
机构 * Nara Institute of Science and Technology (NAIST)(奈良科学技术研究所) ; University of Colombo School of Computing (UCSC)(科伦坡大学计算学院) ; Informatics Institute of Technology (IIT)(信息技术研究所)
专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL
Comments 19 pages, 11 figures
机构 * Keio University(庆应大学) ; NVIDIA(英伟达)
专题命中 评测与基准 :large language model(abstract);language model(abstract)
Comments Accepted to ICCV Workshop 2025
专题命中 评测与基准 :large language model(abstract);language model(abstract)
Comments Work under review in NeurIPS 2025 with the title "Are we using Motion in Referring Segmentation? A Motion-Centric Evaluation"
专题命中 评测与基准 :large language model(abstract);language model(abstract)
专题命中 评测与基准 :large language model(abstract);language model(abstract)
Comments 10 pages, 3 figures, ICLR 2025 Workshop Advances in Financial AI
机构 * Computer Science, University of Massachusetts, Boston, MA, USA(计算机科学,马萨诸塞大学,波士顿,马萨诸塞州,美国) ; School of Medicine, University of North Carolina, Chapel Hill, NC, USA(医学院,北卡罗来纳大学,夏洛特,北卡罗来纳州,美国)
专题命中 评测与基准 :LLM(abstract);分类 cs.CL、cs.AI
Comments IEEE Global Communications Conference (GlobeCom) 2025
机构 * Hong Kong Polytechnic University(香港理工大学) ; AI Group, WeBank Co., Ltd(WeBank公司人工智能部)
专题命中 评测与基准 :LLM(abstract);分类 cs.CL
Comments Accepted by EMNLP 2025 Main Conference. Homepage: https://github.com/mengze-hong/QualBench
专题命中 评测与基准 :LLM(abstract)
专题命中 评测与基准 :language model(abstract)
Comments Accepted by ACMMM2025
专题命中 评测与基准 :language model(abstract)