机构
*
University of California San Diego(加州大学圣地亚哥分校)
;
ShanghaiTech University(上海科技大学)
;
Kempner Institute, Harvard University(哈佛大学凯普勒研究所)
;
Shanghai Jiao Tong University(上海交通大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Massachusetts Institute of Technology(麻省理工学院)
专题命中
其他LLM
:large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
Modeling the Attack: Detecting AI-Generated Text by Quantifying Adversarial Perturbations
Lekkala Sai Teja, Annepaka Yadagiri, Sangam Sai Anish, Siva Gopala Krishna Nuthakki, Partha Pakray
机构
*
Computer Science \& Engineering National Institute of Technology Silchar, India lekkalad\ ug\
;
Computer Science \& Engineering National Institute of Technology Silchar, India annepaka22\
;
Computer Science \& Engineering National Institute of Technology Silchar, India sangams\ ug\
;
Computer Science \& Engineering BML Munjal University Haryana, India
;
Computer Science \& Engineering National Institute of Technology Silchar, India
专题命中
其他LLM
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
On the $O(\frac{\sqrt{d}}{K^{1/4}})$ Convergence Rate of AdamW Measured by $\ell_1$ Norm
Huan Li, Yiming Dong, Zhouchen Lin
机构
*
Institute of Robotics and Automatic Information Systems, College of Artificial Intelligence, Nankai University, Tianjin, China(机器人与自动信息系统研究所,人工智能学院,南开大学,天津,中国)
;
National Key Lab of General AI, School of Intelligence Science and Technology, Peking University, Beijing, China(通用人工智能国家重点实验室,智能科学与技术学院,北京大学,北京,中国)
专题命中
其他LLM
:large language model(abstract);language model(abstract);分类 cs.LG
CommentsV2: NeurIPSCamera-Ready. V3: expand upon the conference version by incorporating the analysis of NAdamW
Did Translation Models Get More Robust Without Anyone Even Noticing?
Ben Peters, André F. T. Martins
机构
*
Instituto de Telecomunicações(电信研究所)
;
Instituto Superior Técnico(技术高等学院)
;
Universidade de Lisboa(里斯本大学)
;
ELLIS Unit Lisbon (LUMLIS)(里斯本ELLIS单位(LUMLIS))
;
Unbabel
专题命中
其他LLM
:large language model(abstract);language model(abstract);分类 cs.CL