GUARD: Role-playing to Generate Natural-language Jailbreakings to Test Guideline Adherence of Large Language Models
Haibo Jin, Ruoxi Chen, Peiyan Zhang, Andy Zhou, Haohan Wang
机构
*
School of Information Sciences University of Illinois at Urbana-Champaign(信息科学学院伊利诺伊大学厄巴纳-香槟分校)
;
Independent Researcher, Starc Institute(Starc研究所独立研究者)
;
Computer Science and Engineering HKUST(HKUST计算机科学与工程学院)
;
Computer Science Lapis Labs University of Illinois Urbana-Champaign(计算机科学Lapis Labs伊利诺伊大学厄巴纳-香槟分校)
;
School of Information Sciences University of Illinois Urbana-Champaign(信息科学学院伊利诺伊大学厄巴纳-香槟分校)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG
Measuring what Matters: Construct Validity in Large Language Model Benchmarks
Andrew M. Bean, Ryan Othniel Kearns, Angelika Romanou, Franziska Sofia Hafner, Harry Mayne, Jan Batzner, Negar Foroutan, Chris Schmitz, Karolina Korgul, Hunar Batra, Oishi Deb, Emma Beharry, Cornelius Emde, Thomas Foster, Anna Gausen, María Grandury, Simeng Han, Valentin Hofmann, Lujain Ibrahim, Hazel Kim, Hannah Rose Kirk, Fangru Lin, Gabrielle Kaili-May Liu, Lennart Luettgau, Jabez Magomere, Jonathan Rystrøm, Anna Sotnikova, Yushi Yang, Yilun Zhao, Adel Bibi, Antoine Bosselut, Ronald Clark, Arman Cohan, Jakob Foerster, Yarin Gal, Scott A. Hale, Inioluwa Deborah Raji, Christopher Summerfield, Philip H. S. Torr, Cozmin Ududec, Luc Rocher, Adam Mahdi
机构
*
University of Oxford(牛津大学)
;
EPFL(苏黎世联邦理工学院)
;
Weizenbaum Institute Berlin(柏林Weizenbaum研究所)
;
Technical University Munich(慕尼黑技术大学)
;
Centre for Digital Governance, Hertie School(赫尔姆霍兹学院数字治理中心)
;
Stanford University(斯坦福大学)
;
UK AI Security Institute(英国人工智能安全研究所)
;
SomosNLP
;
Universdad Politécnica de Madrid(马德里理工大学)
;
Yale University(耶鲁大学)
;
Allen Institute for AI(人工智能研究所)
;
University of Washington(华盛顿大学)
;
Meedan
;
UC Berkeley(加州大学伯克利分校)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI
Comments39th Conference on Neural Information Processing Systems (NeurIPS 2025) Track on Datasets and Benchmarks
Activation-Informed Merging of Large Language Models
Amin Heyrani Nobari, Kaveh Alim, Ali ArjomandBigdeli, Akash Srivastava, Faez Ahmed, Navid Azizan
机构
*
Massachusetts Institute of Technology(麻省理工学院)
;
Stony Brook University(石溪大学)
;
MIT-IBM Watson AI Lab & Red Hat AI Innovation(MIT-IBM Watson AI实验室及Red Hat AI创新)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
;
Hangzhou Institute for Advanced Study, UCAS(杭州高等研究院)
专题命中
效率与部署
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG
PPG-Distill: Efficient Photoplethysmography Signals Analysis via Foundation Model Distillation
Juntong Ni, Saurabh Kataria, Shengpu Tang, Carl Yang, Xiao Hu, Wei Jin
机构
*
Department of Computer Science, Emory University(计算机科学系,埃默里大学)
;
Nell Hodgson Woodruff School of Nursing, Emory University(Nell Hodgson Woodruff护理学院,埃默里大学)
机构
*
Tsinghua Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院,清华大学,深圳,中国)
;
Pengcheng Laboratory, Shenzhen, China(鹏城实验室,深圳,中国)
;
Shenyang Institute of Automation, Chinese Academy of Sciences, Shenyang, China(沈阳自动化研究所,中国科学院,沈阳,中国)
;
Chongqing Institute of Green and Intelligent Technology, Chinese Academy of Sciences, Chongqing, China(重庆绿色智能技术研究所,中国科学院,重庆,中国)
;
Pazhou Laboratory (Huangpu), Guangzhou, China(琶洲实验室(黄埔),广州,中国)
专题命中
效率与部署
:foundation model(title,abstract)
Commentsaccepted by T-PAMI
Journal refIEEE Transactions on Pattern Analysis and Machine Intelligence, 2025
When retrieval outperforms generation: Dense evidence retrieval for scalable fake news detection
Alamgir Munir Qazi, John P. McCrae, Jamal Abdul Nasir
机构
*
School of Computer Science, University of Galway, Ireland(Galway大学计算机科学学院)
;
Research Ireland Insight Centre and ADAPT Centre, University of Galway, Ireland(Galway大学爱尔兰研究洞察中心和ADAPT研究中心)
专题命中
效率与部署
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL
Journal refProceedings of the 5th Conference on Language, Data and Knowledge, pages 255-265, Naples, Italy. Unior Press, September 2025
LiveStar: Live Streaming Assistant for Real-World Online Video Understanding
Zhenyu Yang, Kairui Zhang, Yuhang Hu, Bing Wang, Shengsheng Qian, Bin Wen, Fan Yang, Tingting Gao, Weiming Dong, Changsheng Xu
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
ShanghaiTech University(上海科技大学)
;
Kuaishou Technology(快手科技)
;
Peng Cheng Laboratory(鹏城实验室)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.AI
Yu Bai, Yukai Miao, Dawei Wang, Li Chen, Fei Long, Rundi Zhai, Dan Li, Yanyu Ren, Tianfeng Liu, Hongtao Xie, Ce Yang, Xuhui Cai
机构
*
Zhongguancun Laboratory(中关村实验室)
;
Tsinghua University(清华大学)
;
China Mobile Communications Group Co., Ltd.(中国移动通信集团有限公司)
;
Beijing University of Posts and Telecommunications(北京邮电大学)