arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 1755 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 幻觉与事实性 1755 篇

2311.04921 2023-11-10 cs.CL cs.AI 62%

Successor Features for Efficient Multisubject Controlled Text Generation

Meng Cao, Mehdi Fatemi, Jackie Chi Kit Cheung, Samira Shabanian

专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.02271 2023-11-10 cs.CL cs.AI 62%

FaMeSumm: Investigating and Improving Faithfulness of Medical Summarization

Nan Zhang, Yusen Zhang, Wu Guo, Prasenjit Mitra, Rui Zhang

专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL、cs.AI

Comments Main Conference of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.05161 2023-10-31 cs.LG cs.AI 62%

What is Flagged in Uncertainty Quantification? Latent Density Models for Uncertainty Categorization

Hao Sun, Boris van Breugel, Jonathan Crabbe, Nabeel Seedat, Mihaela van der Schaar

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11227 2023-10-18 cs.CL cs.AI 62%

RealBehavior: A Framework for Faithfully Characterizing Foundation Models' Human-like Behavior Mechanisms

Enyu Zhou, Rui Zheng, Zhiheng Xi, Songyang Gao, Xiaoran Fan, Zichu Fei, Jingting Ye, Tao Gui, Qi Zhang, Xuanjing Huang

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

Comments Accepted to Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.00398 2023-10-02 cs.CV cs.AI cs.LG 62%

ProbVLM: Probabilistic Adapter for Frozen Vision-Language Models

Uddeshya Upadhyay, Shyamgopal Karthik, Massimiliano Mancini, Zeynep Akata

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.AI、cs.LG

Comments ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12674 2023-08-25 cs.CL cs.AI 62%

Improving Translation Faithfulness of Large Language Models via Augmenting Instructions

Yijie Chen, Yijin Liu, Fandong Meng, Yufeng Chen, Jinan Xu, Jie Zhou

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

Comments Our code and datasets are released in Github: https://github.com/pppa2019/swie_overmiss_llm4mt

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.14891 2023-07-25 cs.LG cs.AI 62%

Broken Neural Scaling Laws

Ethan Caballero, Kshitij Gupta, Irina Rish, David Krueger

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.AI、cs.LG

Comments Published as a conference paper at International Conference on Learning Representations (ICLR) 2023

Journal ref International Conference on Learning Representations (ICLR), 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.06513 2023-07-14 cs.AI cs.LG 62%

Leveraging Contextual Counterfactuals Toward Belief Calibration

Qiuyi, Zhang, Michael S. Lee, Sherol Chen

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.AI、cs.LG

Comments ICML (International Conference on Machine Learning) Workshop on Counterfactuals in Minds and Machines, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.05118 2023-07-06 cs.LG cs.AI 62%

Beyond In-Domain Scenarios: Robust Density-Aware Calibration

Christian Tomani, Futa Waseda, Yuesong Shen, Daniel Cremers

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI、cs.LG

Comments In Proceedings of the International Conference on Machine Learning (ICML), 2023. Code available at https://github.com/futakw/DensityAwareCalibration

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.01229 2023-06-02 cs.CL cs.AI 62%

Almanac: Retrieval-Augmented Language Models for Clinical Medicine

Cyril Zakka, Akash Chaurasia, Rohan Shad, Alex R. Dalal, Jennifer L. Kim, Michael Moor, Kevin Alexander, Euan Ashley, Jack Boyd, Kathleen Boyd, Karen Hirsch, Curt Langlotz, Joanna Nelson, William Hiesinger

专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06708 2023-04-14 cs.CV cs.AI cs.CL 62%

Verbs in Action: Improving verb understanding in video-language models

Liliane Momeni, Mathilde Caron, Arsha Nagrani, Andrew Zisserman, Cordelia Schmid

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.05736 2023-04-13 cs.LG cs.AI stat.AP 62%

Communicating Uncertainty in Machine Learning Explanations: A Visualization Analytics Approach for Predictive Process Monitoring

Nijat Mehdiyev, Maxim Majlatow, Peter Fettke

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.12872 2023-03-24 cs.HC cs.AI cs.LG 62%

Human Uncertainty in Concept-Based AI Systems

Katherine M. Collins, Matthew Barker, Mateo Espinosa Zarlenga, Naveen Raman, Umang Bhatt, Mateja Jamnik, Ilia Sucholutsky, Adrian Weller, Krishnamurthy Dvijotham

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.02628 2023-02-07 cs.LG cs.AI 62%

Trust, but Verify: Using Self-Supervised Probing to Improve Trustworthiness

Ailin Deng, Shen Li, Miao Xiong, Zhirui Chen, Bryan Hooi

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.AI、cs.LG

Comments European Conference on Computer Vision 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.06009 2023-01-18 cs.CL cs.AI 62%

Rationalizing Predictions by Adversarial Information Calibration

Lei Sha, Oana-Maria Camburu, Thomas Lukasiewicz

专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL、cs.AI

Comments arXiv admin note: substantial text overlap with arXiv:2012.08884

Journal ref Artificial Intelligence, Volume 315, February 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.01425 2022-12-06 cs.CL cs.AI 62%

Unveiling the Black Box of PLMs with Semantic Anchors: Towards Interpretable Neural Semantic Parsing

Lunyiu Nie, Jiuding Sun, Yanlin Wang, Lun Du, Lei Hou, Juanzi Li, Shi Han, Dongmei Zhang, Jidong Zhai

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL、cs.AI

Comments AAAI 2023 Main Track Long Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.03041 2022-11-08 cs.CL cs.AI 62%

Calibration Meets Explanation: A Simple and Effective Approach for Model Confidence Estimates

Dongfang Li, Baotian Hu, Qingcai Chen

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.04260 2022-10-19 cs.LG cs.AI cs.CV 62%

Provably Robust Detection of Out-of-distribution Data (almost) for free

Alexander Meinke, Julian Bitterwolf, Matthias Hein

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.04714 2022-10-17 cs.CL cs.LG stat.ML 62%

Uncertainty Quantification with Pre-trained Language Models: A Large-Scale Empirical Analysis

Yuxin Xiao, Paul Pu Liang, Umang Bhatt, Willie Neiswanger, Ruslan Salakhutdinov, Louis-Philippe Morency

专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL、cs.LG

Comments Accepted by EMNLP 2022 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.11724 2022-09-21 cs.LG cs.AI cs.SI 62%

Explainable Misinformation Detection Across Multiple Social Media Platforms

Gargi Joshi, Ananya Srivastava, Bhargav Yagnik, Mohammed Hasan, Zainuddin Saiyed, Lubna A Gabralla, Ajith Abraham, Rahee Walambe, Ketan Kotecha

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.AI、cs.LG

Comments 28 pages,4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.11097 2022-06-29 cs.RO cs.AI cs.LG 62%

UMBRELLA: Uncertainty-Aware Model-Based Offline Reinforcement Learning Leveraging Planning

Christopher Diehl, Timo Sievernich, Martin Krüger, Frank Hoffmann, Torsten Bertram

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI、cs.LG

Comments Best Paper Award @ Advances in Neural Information Processing Systems - Machine Learning for Autonomous Driving Workshop (NeurIPS 2021 ML4AD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2107.09546 2022-06-10 cs.LG cs.CY 62%

Responsible and Regulatory Conform Machine Learning for Medicine: A Survey of Challenges and Solutions

Eike Petersen, Yannik Potdevin, Esfandiar Mohammadi, Stephan Zidowitz, Sabrina Breyer, Dirk Nowotka, Sandra Henn, Ludwig Pechmann, Martin Leucker, Philipp Rostalski, Christian Herzog

专题命中 幻觉与事实性 :safety(abstract);分类 cs.CY、cs.LG

Journal ref IEEE Access, Vol. 10, pp. 58375-58418, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.04837 2022-03-10 eess.AS cs.CL cs.CY 62%

'Beach' to 'Bitch': Inadvertent Unsafe Transcription of Kids' Content on YouTube

Krithika Ramesh, Ashiqur R. KhudaBukhsh, Sumeet Kumar

专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL、cs.CY

Comments This paper got accepted at AAAI 2022, AI for Social Impact track

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.02173 2022-03-04 cs.RO cs.AI cs.CV cs.LG cs.MA 62%

Multi-Agent Variational Occlusion Inference Using People as Sensors

Masha Itkina, Ye-Ji Mun, Katherine Driggs-Campbell, Mykel J. Kochenderfer

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI、cs.LG

Comments 12 pages, 9 figures, International Conference on Robotics and Automation (ICRA) 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.08239 2022-02-11 cs.CL cs.AI 62%

LaMDA: Language Models for Dialog Applications

Romal Thoppilan, Daniel De Freitas, Jamie Hall, Noam Shazeer, Apoorv Kulshreshtha, Heng-Tze Cheng, Alicia Jin, Taylor Bos, Leslie Baker, Yu Du, YaGuang Li, Hongrae Lee, Huaixiu Steven Zheng, Amin Ghafouri, Marcelo Menegali, Yanping Huang, Maxim Krikun, Dmitry Lepikhin, James Qin, Dehao Chen, Yuanzhong Xu, Zhifeng Chen, Adam Roberts, Maarten Bosma, Vincent Zhao, Yanqi Zhou, Chung-Ching Chang, Igor Krivokon, Will Rusch, Marc Pickett, Pranesh Srinivasan, Laichee Man, Kathleen Meier-Hellstern, Meredith Ringel Morris, Tulsee Doshi, Renelito Delos Santos, Toju Duke, Johnny Soraker, Ben Zevenbergen, Vinodkumar Prabhakaran, Mark Diaz, Ben Hutchinson, Kristen Olson, Alejandra Molina, Erin Hoffman-John, Josh Lee, Lora Aroyo, Ravi Rajakumar, Alena Butryna, Matthew Lamm, Viktoriya Kuzmina, Joe Fenton, Aaron Cohen, Rachel Bernstein, Ray Kurzweil, Blaise Aguera-Arcas, Claire Cui, Marian Croak, Ed Chi, Quoc Le

专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2011.07586 2021-05-05 cs.CY cs.HC cs.LG 62%

Uncertainty as a Form of Transparency: Measuring, Communicating, and Using Uncertainty

Umang Bhatt, Javier Antorán, Yunfeng Zhang, Q. Vera Liao, Prasanna Sattigeri, Riccardo Fogliato, Gabrielle Gauthier Melançon, Ranganath Krishnan, Jason Stanley, Omesh Tickoo, Lama Nachman, Rumi Chunara, Madhulika Srikumar, Adrian Weller, Alice Xiang

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CY、cs.LG

Comments AAAI/ACM Conference on Artificial Intelligence, Ethics, and Society (AIES) 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.10715 2021-04-23 cs.LG cs.AI 62%

Uncertainty-Aware Boosted Ensembling in Multi-Modal Settings

Utkarsh Sarawgi, Rishab Khincha, Wazeer Zulfikar, Satrajit Ghosh, Pattie Maes

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI、cs.LG

Comments Accepted at IJCNN 2021, to appear in IEEE proceedings. Equal contributions from US, RK and WZ

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.03613 2021-04-09 cs.LG cs.AI stat.AP 62%

Uncertainty-aware Remaining Useful Life predictor

Luca Biggio, Alexander Wieland, Manuel Arias Chao, Iason Kastanis, Olga Fink

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2002.07650 2021-02-12 stat.ML cs.AI cs.LG 62%

Uncertainty Estimation in Autoregressive Structured Prediction

Andrey Malinin, Mark Gales

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.06523 2020-12-14 cs.CV cs.AI cs.LG 62%

Dependency Decomposition and a Reject Option for Explainable Models

Jan Kronenberger, Anselm Haselhoff

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI、cs.LG

Comments Accepted at CVPR 2019 Workshop "DThree19: Dependable Deep Detectors"

详情

展开后加载摘要…

URL PDF HTML 收藏