arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

作者

Yejin Choi

Natural Language Processing

至 收录 365
2503.13423 2025-08-28 cs.CL cs.LG

SuperBPE: Space Travel for Language Models

Alisa Liu, Jonathan Hayase, Valentin Hofmann, Sewoong Oh, Noah A. Smith, Yejin Choi

机构 * University of Washington(华盛顿大学) NVIDIA(英伟达) Allen Institute for AI(人工智能研究院)

Comments COLM 2025 camera-ready

URL PDF HTML 收藏
2508.17580 2025-08-26 cs.CL cs.AI cs.LG

UQ: Assessing Language Models on Unsolved Questions

Fan Nie, Ken Ziyu Liu, Zihao Wang, Rui Sun, Wei Liu, Weijia Shi, Huaxiu Yao, Linjun Zhang, Andrew Y. Ng, James Zou, Sanmi Koyejo, Yejin Choi, Percy Liang, Niklas Muennighoff

Comments FN, KZL, and NM are project co-leads and contributed equally. Project website: https://uq.stanford.edu

URL PDF HTML 收藏
2508.17079 2025-08-26 cs.IR cs.AI

Zero-shot Multimodal Document Retrieval via Cross-modal Question Generation

Yejin Choi, Jaewoo Park, Janghan Yoon, Saejin Kim, Jaehyun Jeon, Youngjae Yu

机构 * Yonsei University(延世大学) Seoul National University(首尔国立大学)

URL PDF HTML 收藏
2504.13203 2025-08-26 cs.CR cs.AI cs.CL cs.LG cs.MA

X-Teaming: Multi-Turn Jailbreaks and Defenses with Adaptive Multi-Agents

Salman Rahman, Liwei Jiang, James Shiffer, Genglin Liu, Sheriff Issaka, Md Rizwan Parvez, Hamid Palangi, Kai-Wei Chang, Yejin Choi, Saadia Gabriel

URL PDF HTML 收藏
2502.11881 2025-08-11 cs.AI cs.CL

Hypothesis-Driven Theory-of-Mind Reasoning for Large Language Models

Hyunwoo Kim, Melanie Sclar, Tan Zhi-Xuan, Lance Ying, Sydney Levine, Yang Liu, Joshua B. Tenenbaum, Yejin Choi

机构 * NVIDIA(NVIDIA公司) University of Washington(华盛顿大学) MIT(麻省理工学院) Harvard University(哈佛大学) Amazon(亚马逊公司) Stanford University(斯坦福大学)

Comments COLM 2025. For code and data, see https://hyunw.kim/thought-tracing

URL PDF HTML 收藏
2508.03613 2025-08-06 cs.LG cs.AI

Goedel-Prover-V2: Scaling Formal Theorem Proving with Scaffolded Data Synthesis and Self-Correction

Yong Lin, Shange Tang, Bohan Lyu, Ziran Yang, Jui-Hui Chung, Haoyu Zhao, Lai Jiang, Yihan Geng, Jiawei Ge, Jingruo Sun, Jiayun Wu, Jiri Gesi, Ximing Lu, David Acuna, Kaiyu Yang, Hongzhou Lin, Yejin Choi, Danqi Chen, Sanjeev Arora, Chi Jin

Comments 24 pages, 10 figures, 4 tables

URL PDF HTML 收藏
2508.02748 2025-08-06 cs.CY

Advancing Science- and Evidence-based AI Policy

Rishi Bommasani, Sanjeev Arora, Jennifer Chayes, Yejin Choi, Mariano-Florentino Cuéllar, Li Fei-Fei, Daniel E. Ho, Dan Jurafsky, Sanmi Koyejo, Hima Lakkaraju, Arvind Narayanan, Alondra Nelson, Emma Pierson, Joelle Pineau, Scott Singer, Gaël Varoquaux, Suresh Venkatasubramanian, Ion Stoica, Percy Liang, Dawn Song

Comments This is the author's version of the work. It is posted here by permission of the AAAS for personal use, not for redistribution. The definitive version was published in Science on July 31, 2025

URL PDF HTML 收藏
2507.08224 2025-07-22 cs.RO

Making VLMs More Robot-Friendly: Self-Critical Distillation of Low-Level Procedural Reasoning

Chan Young Park, Jillian Fisher, Marius Memmel, Dipika Khullar, Seoho Yun, Abhishek Gupta, Yejin Choi

Comments Code Available: https://github.com/chan0park/SelfReVision

URL PDF HTML 收藏
2507.12507 2025-07-18 cs.LG cs.AI cs.CL

Scaling Up RL: Unlocking Diverse Reasoning in LLMs via Prolonged Training

Mingjie Liu, Shizhe Diao, Jian Hu, Ximing Lu, Xin Dong, Hao Zhang, Alexander Bukharin, Shaokun Zhang, Jiaqi Zeng, Makesh Narsimhan Sreedhar, Gerald Shen, David Mosallanezhad, Di Zhang, Jonas Yang, June Yang, Oleksii Kuchaiev, Guilin Liu, Zhiding Yu, Pavlo Molchanov, Yejin Choi, Jan Kautz, Yi Dong

机构 * NVIDIA

Comments 14 pages, 7 figures

URL PDF HTML 收藏
2502.01100 2025-07-16 cs.AI cs.CL cs.LG

ZebraLogic: On the Scaling Limits of LLMs for Logical Reasoning

Bill Yuchen Lin, Ronan Le Bras, Kyle Richardson, Ashish Sabharwal, Radha Poovendran, Peter Clark, Yejin Choi

机构 * Allen Institute for AI(艾伦人工智能研究所) University of Washington(华盛顿大学) Stanford University(斯坦福大学)

Comments Accepted to ICML 2025

URL PDF HTML 收藏
2507.08371 2025-07-14 cs.CL

The Curious Case of Factuality Finetuning: Models' Internal Beliefs Can Improve Factuality

Benjamin Newman, Abhilasha Ravichander, Jaehun Jung, Rui Xin, Hamish Ivison, Yegor Kuznetsov, Pang Wei Koh, Yejin Choi

机构 * University of Washington(华盛顿大学) Stanford University(斯坦福大学)

Comments 29 pages, 4 figures, 16 tables

URL PDF HTML 收藏
2504.07096 2025-07-09 cs.CL

OLMoTrace: Tracing Language Model Outputs Back to Trillions of Training Tokens

Jiacheng Liu, Taylor Blanton, Yanai Elazar, Sewon Min, YenSung Chen, Arnavi Chheda-Kothary, Huy Tran, Byron Bischoff, Eric Marsh, Michael Schmitz, Cassidy Trier, Aaron Sarnat, Jenna James, Jon Borchardt, Bailey Kuehl, Evie Cheng, Karen Farley, Sruthi Sreeram, Taira Anderson, David Albright, Carissa Schoenick, Luca Soldaini, Dirk Groeneveld, Rock Yuren Pang, Pang Wei Koh, Noah A. Smith, Sophie Lebrecht, Yejin Choi, Hannaneh Hajishirzi, Ali Farhadi, Jesse Dodge

机构 * Allen Institute for AI(艾伦人工智能研究所) University of Washington(华盛顿大学) UC Berkeley(伯克利加州大学) Stanford University(斯坦福大学)

Comments ACL 2025 demo track

URL PDF HTML 收藏
2506.08927 2025-06-11 cs.CV cs.AI cs.CL

Socratic-MCTS: Test-Time Visual Reasoning by Asking the Right Questions

David Acuna, Ximing Lu, Jaehun Jung, Hyunwoo Kim, Amlan Kar, Sanja Fidler, Yejin Choi

机构 * NVIDIA University of Washington(华盛顿大学) University of Toronto(多伦多大学)

URL PDF HTML 收藏
2506.07643 2025-06-10 cs.CV

Synthetic Visual Genome

Jae Sung Park, Zixian Ma, Linjie Li, Chenhao Zheng, Cheng-Yu Hsieh, Ximing Lu, Khyathi Chandu, Quan Kong, Norimasa Kobori, Ali Farhadi, Yejin Choi, Ranjay Krishna

机构 * University of Washington(华盛顿大学) Allen Institute for Artificial Intelligence(人工智能艾伦研究所) Stanford University(斯坦福大学) Woven by Toyota(丰田编织)

Comments CVPR 2025

URL PDF HTML 收藏
2506.06020 2025-06-09 cs.CL cs.AI

When to Trust Context: Self-Reflective Debates for Context Reliability

Zeqi Zhou, Fang Wu, Shayan Talaei, Haokai Zhao, Cheng Meixin, Tinson Xu, Amin Saberi, Yejin Choi

机构 * Brown University(布朗大学) Stanford University(斯坦福大学) University of New South Wales(新南威尔士大学) Xi’an University of Electronic Science and Technology(西安电子科技大学) University of Chicago(芝加哥大学)

URL PDF HTML 收藏
2506.04633 2025-06-06 cs.CV

Unfolding Spatial Cognition: Evaluating Multimodal Models on Visual Simulations

Linjie Li, Mahtab Bigverdi, Jiawei Gu, Zixian Ma, Yinuo Yang, Ziang Li, Yejin Choi, Ranjay Krishna

机构 * University of Washington(华盛顿大学) Sun Yat-sen University(中山大学) Stanford University(斯坦福大学)

Comments STARE is available at https://github.com/STARE-bench/STARE

URL PDF HTML 收藏
2506.04178 2025-06-06 cs.LG

OpenThoughts: Data Recipes for Reasoning Models

Etash Guha, Ryan Marten, Sedrick Keh, Negin Raoof, Georgios Smyrnis, Hritik Bansal, Marianna Nezhurina, Jean Mercat, Trung Vu, Zayne Sprague, Ashima Suvarna, Benjamin Feuer, Liangyu Chen, Zaid Khan, Eric Frankel, Sachin Grover, Caroline Choi, Niklas Muennighoff, Shiye Su, Wanjia Zhao, John Yang, Shreyas Pimpalgaonkar, Kartik Sharma, Charlie Cheng-Jie Ji, Yichuan Deng, Sarah Pratt, Vivek Ramanujan, Jon Saad-Falcon, Jeffrey Li, Achal Dave, Alon Albalak, Kushal Arora, Blake Wulfe, Chinmay Hegde, Greg Durrett, Sewoong Oh, Mohit Bansal, Saadia Gabriel, Aditya Grover, Kai-Wei Chang, Vaishaal Shankar, Aaron Gokaslan, Mike A. Merrill, Tatsunori Hashimoto, Yejin Choi, Jenia Jitsev, Reinhard Heckel, Maheswaran Sathiamoorthy, Alexandros G. Dimakis, Ludwig Schmidt

Comments https://www.openthoughts.ai/blog/ot3. arXiv admin note: text overlap with arXiv:2505.23754 by other authors

URL PDF HTML 收藏
2503.05728 2025-06-04 cs.CY cs.AI

Political Neutrality in AI Is Impossible- But Here Is How to Approximate It

Jillian Fisher, Ruth E. Appel, Chan Young Park, Yujin Potter, Liwei Jiang, Taylor Sorensen, Shangbin Feng, Yulia Tsvetkov, Margaret E. Roberts, Jennifer Pan, Dawn Song, Yejin Choi

Comments Code: https://github.com/jfisher52/Approximation_Political_Neutrality

URL PDF HTML 收藏
2410.02677 2025-06-04 cs.CL cs.AI cs.LG

CulturalBench: A Robust, Diverse, and Challenging Cultural Benchmark by Human-AI CulturalTeaming

Yu Ying Chiu, Liwei Jiang, Bill Yuchen Lin, Chan Young Park, Shuyue Stella Li, Sahithya Ravi, Mehar Bhatia, Maria Antoniak, Yulia Tsvetkov, Vered Shwartz, Yejin Choi

机构 * University of Washington(华盛顿大学) University of British Columbia(不列颠哥伦比亚大学) Vector Institute for AI(人工智能向量研究所) McGill University(麦吉尔大学) University of Copenhagen(哥本哈根大学) Stanford University(斯坦福大学)

Comments ACL 2025 Main, 39 pages, 16 figures. arXiv admin note: text overlap with arXiv:2404.06664

URL PDF HTML 收藏
2410.11163 2025-06-03 cs.CL

Model Swarms: Collaborative Search to Adapt LLM Experts via Swarm Intelligence

Shangbin Feng, Zifeng Wang, Yike Wang, Sayna Ebrahimi, Hamid Palangi, Lesly Miculicich, Achin Kulshrestha, Nathalie Rauschmayr, Yejin Choi, Yulia Tsvetkov, Chen-Yu Lee, Tomas Pfister

Comments ICML 2025

URL PDF HTML 收藏
2410.03868 2025-06-03 cs.CL

Can Language Models Reason about Individualistic Human Values and Preferences?

Liwei Jiang, Taylor Sorensen, Sydney Levine, Yejin Choi

机构 * University of Washington(华盛顿大学) Google DeepMind(谷歌DeepMind) Stanford University(斯坦福大学) Allen Institute for Artificial Intelligence(人工智能研究院)

Comments Camera Ready at ACL Main 2025

URL PDF HTML 收藏
2505.24864 2025-06-02 cs.CL cs.AI

ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models

Mingjie Liu, Shizhe Diao, Ximing Lu, Jian Hu, Xin Dong, Yejin Choi, Jan Kautz, Yi Dong

机构 * NVIDIA

Comments 26 pages, 17 figures

URL PDF HTML 收藏
2410.16665 2025-05-29 cs.CL cs.CY

SafetyAnalyst: Interpretable, Transparent, and Steerable Safety Moderation for AI Behavior

Jing-Jing Li, Valentina Pyatkin, Max Kleiman-Weiner, Liwei Jiang, Nouha Dziri, Anne G. E. Collins, Jana Schaich Borg, Maarten Sap, Yejin Choi, Sydney Levine

Comments Accepted to ICML 2025

URL PDF HTML 收藏
2407.02273 2025-05-29 cs.CL

Language Model Alignment in Multilingual Trolley Problems

Zhijing Jin, Max Kleiman-Weiner, Giorgio Piatti, Sydney Levine, Jiarui Liu, Fernando Gonzalez, Francesco Ortu, András Strausz, Mrinmaya Sachan, Rada Mihalcea, Yejin Choi, Bernhard Schölkopf

机构 * Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) ETH Zürich(苏黎世联邦理工学院) University of Toronto(多伦多大学) University of Washington(华盛顿大学) Allen Institute for AI (AI2)(人工智能研究所) Carnegie Mellon University(卡内基梅隆大学) University of Trieste(特里斯坦大学) University of Michigan(密歇根大学)

Comments ICLR 2025 Spotlight, Best Paper @ NeurIPS 2024 Workshop on Pluralistic Alignment

URL PDF HTML 收藏
2504.20073 2025-05-27 cs.LG cs.AI cs.CL

RAGEN: Understanding Self-Evolution in LLM Agents via Multi-Turn Reinforcement Learning

Zihan Wang, Kangrui Wang, Qineng Wang, Pingyue Zhang, Linjie Li, Zhengyuan Yang, Xing Jin, Kefan Yu, Minh Nhat Nguyen, Licheng Liu, Eli Gottlieb, Yiping Lu, Kyunghyun Cho, Jiajun Wu, Li Fei-Fei, Lijuan Wang, Yejin Choi, Manling Li

机构 * Northwestern University(西北大学) University of Washington(华盛顿大学) Stanford University(斯坦福大学) Microsoft(微软) New York University(纽约大学) University of British Columbia(不列颠哥伦比亚大学) Singapore Management University(新加坡国立管理学院)

URL PDF HTML 收藏
2411.00204 2025-05-27 cs.CL

RESTOR: Knowledge Recovery in Machine Unlearning

Keivan Rezaei, Khyathi Chandu, Soheil Feizi, Yejin Choi, Faeze Brahman, Abhilasha Ravichander

机构 * University of Maryland(马里兰大学) Mistral AI Stanford University(斯坦福大学) Allen Institute for AI(人工智能研究院) University of Washington(华盛顿大学)

Comments Accepted to TMLR 2025

URL PDF HTML 收藏
2505.14633 2025-05-21 cs.CL cs.AI cs.CY cs.HC cs.LG

Will AI Tell Lies to Save Sick Children? Litmus-Testing AI Values Prioritization with AIRiskDilemmas

Yu Ying Chiu, Zhilin Wang, Sharan Maiya, Yejin Choi, Kyle Fish, Sydney Levine, Evan Hubinger

机构 * University of Washington(华盛顿大学) NVIDIA(NVIDIA公司) Cambridge(剑桥) Stanford(斯坦福大学) MIT(麻省理工学院) Harvard(哈佛大学) Anthropic(Anthropic公司)

Comments 34 pages, 11 figures, see associated data at https://huggingface.co/datasets/kellycyy/AIRiskDilemmas and code at https://github.com/kellycyy/LitmusValues

URL PDF HTML 收藏
2110.08420 2025-04-29 cs.CL cs.AI cs.LG

Understanding Dataset Difficulty with $\mathcal{V}$-Usable Information

Kawin Ethayarajh, Yejin Choi, Swabha Swayamdipta

Comments ICML 2022 (Outstanding Paper)

URL PDF HTML 收藏
2504.15362 2025-04-23 cs.CV cs.CL cs.LG

LongPerceptualThoughts: Distilling System-2 Reasoning for System-1 Perception

Yuan-Hong Liao, Sven Elflein, Liu He, Laura Leal-Taixé, Yejin Choi, Sanja Fidler, David Acuna

Comments 24 pages, 10 figures, in submission. Project page: https://andrewliao11.github.io/LongPerceptualThoughts

URL PDF HTML 收藏
2504.12691 2025-04-18 cs.CL

Why and How LLMs Hallucinate: Connecting the Dots with Subsequence Associations

Yiyou Sun, Yu Gai, Lijie Chen, Abhilasha Ravichander, Yejin Choi, Dawn Song

URL PDF HTML 收藏