arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

作者

Yejin Choi

Natural Language Processing

共收录 365
2406.04770 2024-10-08 cs.CL cs.AI

WildBench: Benchmarking LLMs with Challenging Tasks from Real Users in the Wild

Bill Yuchen Lin, Yuntian Deng, Khyathi Chandu, Faeze Brahman, Abhilasha Ravichander, Valentina Pyatkin, Nouha Dziri, Ronan Le Bras, Yejin Choi

Comments Link: https://hf.co/spaces/allenai/WildBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07087 2024-10-07 cs.CL cs.LG

CopyBench: Measuring Literal and Non-Literal Reproduction of Copyright-Protected Text in Language Model Generation

Tong Chen, Akari Asai, Niloofar Mireshghallah, Sewon Min, James Grimmelmann, Yejin Choi, Hannaneh Hajishirzi, Luke Zettlemoyer, Pang Wei Koh

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07237 2024-10-07 cs.CL cs.AI

In Search of the Long-Tail: Systematic Generation of Long-Tail Inferential Knowledge via Logical Rule Guided Search

Huihan Li, Yuting Ning, Zeyi Liao, Siyuan Wang, Xiang Lorraine Li, Ximing Lu, Wenting Zhao, Faeze Brahman, Yejin Choi, Xiang Ren

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19472 2024-09-19 cs.CL cs.AI cs.LG

PlaSma: Making Small Language Models Better Procedural Knowledge Models for (Counterfactual) Planning

Faeze Brahman, Chandra Bhagavatula, Valentina Pyatkin, Jena D. Hwang, Xiang Lorraine Li, Hirona J. Arai, Soumya Sanyal, Keisuke Sakaguchi, Xiang Ren, Yejin Choi

Comments ICLR 2024 version , 31 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07841 2024-09-17 cs.CL

Do Membership Inference Attacks Work on Large Language Models?

Michael Duan, Anshuman Suri, Niloofar Mireshghallah, Sewon Min, Weijia Shi, Luke Zettlemoyer, Yulia Tsvetkov, Yejin Choi, David Evans, Hannaneh Hajishirzi

Comments Accepted at Conference on Language Modeling (COLM), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14791 2024-09-11 cs.CY cs.AI

Particip-AI: A Democratic Surveying Framework for Anticipating Future AI Use Cases, Harms and Benefits

Jimin Mun, Liwei Jiang, Jenny Liang, Inyoung Cheong, Nicole DeCario, Yejin Choi, Tadayoshi Kohno, Maarten Sap

Comments AIES 2024, 34 pages, 4 figures, 23 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03753 2024-09-10 cs.CL cs.AI cs.HC cs.IR cs.LG

WildVis: Open Source Visualizer for Million-Scale Chat Logs in the Wild

Yuntian Deng, Wenting Zhao, Jack Hessel, Xiang Ren, Claire Cardie, Yejin Choi

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09932 2024-09-09 cs.LG cs.AI cs.CL cs.CY

Foundational Challenges in Assuring Alignment and Safety of Large Language Models

Usman Anwar, Abulhair Saparov, Javier Rando, Daniel Paleka, Miles Turpin, Peter Hase, Ekdeep Singh Lubana, Erik Jenner, Stephen Casper, Oliver Sourbut, Benjamin L. Edelman, Zhaowei Zhang, Mario Günther, Anton Korinek, Jose Hernandez-Orallo, Lewis Hammond, Eric Bigelow, Alexander Pan, Lauro Langosco, Tomasz Korbak, Heidi Zhang, Ruiqi Zhong, Seán Ó hÉigeartaigh, Gabriel Recchia, Giulio Corsi, Alan Chan, Markus Anderljung, Lilian Edwards, Aleksandar Petrov, Christian Schroeder de Witt, Sumeet Ramesh Motwan, Yoshua Bengio, Danqi Chen, Philip H. S. Torr, Samuel Albanie, Tegan Maharaj, Jakob Foerster, Florian Tramer, He He, Atoosa Kasirzadeh, Yejin Choi, David Krueger

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15666 2024-08-29 cs.CL

StyleRemix: Interpretable Authorship Obfuscation via Distillation and Perturbation of Style Elements

Jillian Fisher, Skyler Hallinan, Ximing Lu, Mitchell Gordon, Zaid Harchaoui, Yejin Choi

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13654 2024-08-27 cs.CL

Symbolic Working Memory Enhances Language Models for Complex Rule Application

Siyuan Wang, Zhongyu Wei, Yejin Choi, Xiang Ren

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08565 2024-08-26 cs.CL

Tuning Language Models by Proxy

Alisa Liu, Xiaochuang Han, Yizhong Wang, Yulia Tsvetkov, Yejin Choi, Noah A. Smith

Comments COLM 2024 camera-ready, code available at https://github.com/alisawuffles/proxy-tuning

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05070 2024-08-22 cs.AI cs.CL cs.IR

A Roadmap to Pluralistic Alignment

Taylor Sorensen, Jared Moore, Jillian Fisher, Mitchell Gordon, Niloofar Mireshghallah, Christopher Michael Rytting, Andre Ye, Liwei Jiang, Ximing Lu, Nouha Dziri, Tim Althoff, Yejin Choi

Comments ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10199 2024-08-21 cs.CL cs.AI

CULTURE-GEN: Revealing Global Cultural Perception in Language Models through Natural Language Prompting

Huihan Li, Liwei Jiang, Jena D. Hwang, Hyunwoo Kim, Sebastin Santy, Taylor Sorensen, Bill Yuchen Lin, Nouha Dziri, Xiang Ren, Yejin Choi

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13780 2024-08-21 cs.CL cs.AI

Information-Theoretic Distillation for Reference-less Summarization

Jaehun Jung, Ximing Lu, Liwei Jiang, Faeze Brahman, Peter West, Pang Wei Koh, Yejin Choi

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16635 2024-08-21 cs.CL cs.AI cs.LG

Impossible Distillation: from Low-Quality Model to High-Quality Dataset & Model for Summarization and Paraphrasing

Jaehun Jung, Peter West, Liwei Jiang, Faeze Brahman, Ximing Lu, Jillian Fisher, Taylor Sorensen, Yejin Choi

Comments NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18370 2024-07-29 cs.LG cs.CL

Trust or Escalate: LLM Judges with Provable Guarantees for Human Agreement

Jaehun Jung, Faeze Brahman, Yejin Choi

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17468 2024-07-25 cs.CL cs.AI

WildHallucinations: Evaluating Long-form Factuality in LLMs with Real-World Entity Queries

Wenting Zhao, Tanya Goyal, Yu Ying Chiu, Liwei Jiang, Benjamin Newman, Abhilasha Ravichander, Khyathi Chandu, Ronan Le Bras, Claire Cardie, Yuntian Deng, Yejin Choi

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11438 2024-07-23 cs.CL

Trust No Bot: Discovering Personal Disclosures in Human-LLM Conversations in the Wild

Niloofar Mireshghallah, Maria Antoniak, Yash More, Yejin Choi, Golnoosh Farnadi

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.05657 2024-07-11 cs.AI cs.CL cs.LG

Agent Lumos: Unified and Modular Training for Open-Source Language Agents

Da Yin, Faeze Brahman, Abhilasha Ravichander, Khyathi Chandu, Kai-Wei Chang, Yejin Choi, Bill Yuchen Lin

Comments Accepted to ACL 2024 Main Conference; Camera Ready. Project website: https://allenai.github.io/lumos/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01942 2024-07-03 cs.AI cs.CL cs.CV

Certainly Uncertain: A Benchmark and Metric for Multimodal Epistemic and Aleatoric Awareness

Khyathi Raghavi Chandu, Linjie Li, Anas Awadalla, Ximing Lu, Jae Sung Park, Jack Hessel, Lijuan Wang, Yejin Choi

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11324 2024-07-03 cs.CL cs.AI cs.LG

Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting

Melanie Sclar, Yejin Choi, Yulia Tsvetkov, Alane Suhr

Comments ICLR 2024 Camera Ready version. With respect to the original submission, we added text generation experiments, plots of entire accuracy distributions for each task + stdev computations, and prompt length correlation with spread analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00369 2024-07-02 cs.CL

How to Train Your Fact Verifier: Knowledge Transfer with Multimodal Open Models

Jaeyoung Lee, Ximing Lu, Jack Hessel, Faeze Brahman, Youngjae Yu, Yonatan Bisk, Yejin Choi, Saadia Gabriel

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.17884 2024-07-02 cs.AI cs.CL cs.CR

Can LLMs Keep a Secret? Testing Privacy Implications of Language Models via Contextual Integrity Theory

Niloofar Mireshghallah, Hyunwoo Kim, Xuhui Zhou, Yulia Tsvetkov, Maarten Sap, Reza Shokri, Yejin Choi

Comments 2024 ICLR Spotlight. The dataset and code can be found at https://confaide.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18510 2024-06-27 cs.CL

WildTeaming at Scale: From In-the-Wild Jailbreaks to (Adversarially) Safer Language Models

Liwei Jiang, Kavel Rao, Seungju Han, Allyson Ettinger, Faeze Brahman, Sachin Kumar, Niloofar Mireshghallah, Ximing Lu, Maarten Sap, Yejin Choi, Nouha Dziri

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11442 2024-06-24 cs.CL

Can LLMs Reason with Rules? Logic Scaffolding for Stress-Testing and Improving LLMs

Siyuan Wang, Zhongyu Wei, Yejin Choi, Xiang Ren

Comments Accepted as a long paper to ACL 2024 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11069 2024-06-18 cs.CV cs.AI cs.CL

WildVision: Evaluating Vision-Language Models in the Wild with Human Preferences

Yujie Lu, Dongfu Jiang, Wenhu Chen, William Yang Wang, Yejin Choi, Bill Yuchen Lin

Comments link: https://hf.co/spaces/WildVision/vision-arena

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15610 2024-06-14 cs.CL

Selective "Selective Prediction": Reducing Unnecessary Abstention in Vision-Language Reasoning

Tejas Srinivasan, Jack Hessel, Tanmay Gupta, Bill Yuchen Lin, Yejin Choi, Jesse Thomason, Khyathi Raghavi Chandu

Comments Accepted to ACL Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17647 2024-06-12 cs.CV cs.AI cs.CL

Text as Images: Can Multimodal Large Language Models Follow Printed Instructions in Pixels?

Xiujun Li, Yujie Lu, Zhe Gan, Jianfeng Gao, William Yang Wang, Yejin Choi

Comments Github: https://github.com/VIM-Bench/VIM_TOOL, Model and Data: https://huggingface.co/VIM-Bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13787 2024-06-11 cs.LG

RewardBench: Evaluating Reward Models for Language Modeling

Nathan Lambert, Valentina Pyatkin, Jacob Morrison, LJ Miranda, Bill Yuchen Lin, Khyathi Chandu, Nouha Dziri, Sachin Kumar, Tom Zick, Yejin Choi, Noah A. Smith, Hannaneh Hajishirzi

Comments 44 pages, 19 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14838 2024-05-24 cs.CL cs.AI cs.LG

From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step

Yuntian Deng, Yejin Choi, Stuart Shieber

详情

展开后加载摘要…

URL PDF HTML 收藏