arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 1756 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 幻觉与事实性 1756 篇

2310.19208 2024-03-14 cs.CL 57%

LitCab: Lightweight Language Model Calibration over Short- and Long-form Responses

Xin Liu, Muhammad Khalifa, Lu Wang

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL

Comments accepted to ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.06148 2024-03-12 cs.LG 57%

NetGPT: A Native-AI Network Architecture Beyond Provisioning Personalized Generative Services

Yuxuan Chen, Rongpeng Li, Zhifeng Zhao, Chenghui Peng, Jianjun Wu, Ekram Hossain, Honggang Zhang

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04670 2024-03-08 cs.LG 57%

End-to-end Conditional Robust Optimization

Abhilash Chenreddy, Erick Delage

专题命中 幻觉与事实性 :safety(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12688 2024-03-08 cs.LG stat.ML 57%

On the Out-of-Distribution Coverage of Combining Split Conformal Prediction and Bayesian Deep Learning

Paul Scemama, Ariel Kapusta

专题命中 幻觉与事实性 :safety(abstract);分类 cs.LG

Comments 26 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03558 2024-03-07 cs.CL 57%

Benchmarking Hallucination in Large Language Models based on Unanswerable Math Word Problem

Yuhong Sun, Zhangyue Yin, Qipeng Guo, Jiawen Wu, Xipeng Qiu, Hui Zhao

专题命中 幻觉与事实性 :RLHF(abstract);分类 cs.CL

Comments 11 pages, 8 figures, accepted by LREC-Coling 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16211 2024-02-27 cs.CL 57%

HypoTermQA: Hypothetical Terms Dataset for Benchmarking Hallucination Tendency of LLMs

Cem Uluoglakci, Tugba Taskaya Temizel

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.CL

Comments EACL SRW 2024 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13188 2024-02-21 cs.CL 57%

Question Calibration and Multi-Hop Modeling for Temporal Question Answering

Chao Xue, Di Liang, Pengfei Wang, Jing Zhang

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL

Comments Accepted by AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07049 2024-02-13 cs.AI 57%

A Factor Graph Model of Trust for a Collaborative Multi-Agent System

Behzad Akbari, Mingfeng Yuan, Hao Wang, Haibin Zhu, Jinjun Shan

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06937 2024-02-13 cs.LG cs.CV 57%

Assessing Uncertainty Estimation Methods for 3D Image Segmentation under Distribution Shifts

Masoumeh Javanbakhat, Md Tasnimul Hasan, Cristoph Lippert

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06625 2024-02-12 cs.CL 57%

Understanding the Effects of Iterative Prompting on Truthfulness

Satyapriya Krishna, Chirag Agarwal, Himabindu Lakkaraju

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12509 2024-01-25 cs.SI cs.LG 57%

Digital cloning of online social networks for language-sensitive agent-based modeling of misinformation spread

Prateek Puri, Gabriel Hassler, Anton Shenk, Sai Katragadda

专题命中 幻觉与事实性 :red teaming(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.03205 2024-01-09 cs.CL 57%

The Dawn After the Dark: An Empirical Study on Factuality Hallucination in Large Language Models

Junyi Li, Jie Chen, Ruiyang Ren, Xiaoxue Cheng, Wayne Xin Zhao, Jian-Yun Nie, Ji-Rong Wen

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL

Comments 24 pages, 8 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.10975 2024-01-05 cs.LG cs.SY eess.SY 57%

Improved uncertainty quantification for neural networks with Bayesian last layer

Felix Fiedler, Sergio Lucia

专题命中 幻觉与事实性 :safety(abstract);分类 cs.LG

Comments This work has been published at IEEE Access with Digital Object Identifier 10.1109/ACCESS.2023.3329685 under a Creative Commons Attribution 4.0 License

Journal ref IEEE Access, vol. 11, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10057 2023-12-19 cs.CY cs.HC 57%

Generative AI in Writing Research Papers: A New Type of Algorithmic Bias and Uncertainty in Scholarly Work

Rishab Jain, Aditya Jain

专题命中 幻觉与事实性 :red teaming(abstract);分类 cs.CY

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08586 2023-12-15 cs.LG cs.CV stat.ML 57%

Estimating calibration error under label shift without labels

Teodora Popordanoska, Gorjan Radevski, Tinne Tuytelaars, Matthew B. Blaschko

专题命中 幻觉与事实性 :alignment(abstract);分类 cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15716 2023-11-28 cs.CL cs.HC cs.IR 57%

Justifiable Artificial Intelligence: Engineering Large Language Models for Legal Applications

Sabine Wehnert

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13374 2023-11-23 cs.LG 57%

An Empirical Study of Uncertainty Estimation Techniques for Detecting Drift in Data Streams

Anton Winter, Nicolas Jourdan, Tristan Wirth, Volker Knauthe, Arjan Kuijper

专题命中 幻觉与事实性 :safety(abstract);分类 cs.LG

Comments NeurIPS 2023: Workshop on Distribution Shifts

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11262 2023-11-21 cs.LG physics.comp-ph 57%

Uncertainty quantification for noisy inputs-outputs in physics-informed neural networks and neural operators

Zongren Zou, Xuhui Meng, George Em Karniadakis

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.05417 2023-11-17 cs.LG cs.RO 57%

Predicting the Position Uncertainty at the Time of Closest Approach with Diffusion Models

Marta Guimarães, Cláudia Soares, Chiara Manfletti

专题命中 幻觉与事实性 :safety(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09145 2023-11-16 cs.LG stat.ML 57%

Model Agnostic Explainable Selective Regression via Uncertainty Estimation

Andrea Pugnana, Carlos Mougan, Dan Saattrup Nielsen

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14332 2023-11-16 cs.CL 57%

Evaluating and Modeling Attribution for Cross-Lingual Question Answering

Benjamin Muller, John Wieting, Jonathan H. Clark, Tom Kwiatkowski, Sebastian Ruder, Livio Baldini Soares, Roee Aharoni, Jonathan Herzig, Xinyi Wang

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL

Comments Published as a long paper at EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.02243 2023-11-07 cs.LG 57%

Equal Opportunity of Coverage in Fair Regression

Fangxin Wang, Lu Cheng, Ruocheng Guo, Kay Liu, Philip S. Yu

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.LG

Comments Accepted to NeurIPS 2023 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01106 2023-11-03 cs.LG 57%

In Defense of Softmax Parametrization for Calibrated and Consistent Learning to Defer

Yuzhou Cao, Hussein Mozannar, Lei Feng, Hongxin Wei, Bo An

专题命中 幻觉与事实性 :safety(abstract);分类 cs.LG

Comments NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19626 2023-10-31 cs.AI 57%

Transformation vs Tradition: Artificial General Intelligence (AGI) for Arts and Humanities

Zhengliang Liu, Yiwei Li, Qian Cao, Junwen Chen, Tianze Yang, Zihao Wu, John Hale, John Gibbs, Khaled Rasheed, Ninghao Liu, Gengchen Mai, Tianming Liu

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13544 2023-10-23 cs.CL cs.HC 57%

A Diachronic Perspective on User Trust in AI under Uncertainty

Shehzaad Dhuliawala, Vilém Zouhar, Mennatallah El-Assady, Mrinmaya Sachan

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL

Comments EMNLP 2023, 14 pages (8+6)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08027 2023-10-13 cs.CL cs.CV 57%

Exploring Large Language Models for Multi-Modal Out-of-Distribution Detection

Yi Dai, Hao Lang, Kaisheng Zeng, Fei Huang, Yongbin Li

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.CL

Comments EMNLP2023 Findings Long Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.16436 2023-09-29 cs.AI cs.LO 57%

Neuro Symbolic Reasoning for Planning: Counterexample Guided Inductive Synthesis using Large Language Models and Satisfiability Solving

Sumit Kumar Jha, Susmit Jha, Patrick Lincoln, Nathaniel D. Bastian, Alvaro Velasquez, Rickard Ewetz, Sandeep Neema

专题命中 幻觉与事实性 :safety(abstract);分类 cs.AI

Comments 25 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.15231 2023-08-30 cs.CL cs.HC 57%

Multi-party Goal Tracking with LLMs: Comparing Pre-training, Fine-tuning, and Prompt Engineering

Angus Addlesee, Weronika Sieińska, Nancie Gunson, Daniel Hernández Garcia, Christian Dondrup, Oliver Lemon

专题命中 幻觉与事实性 :safety(abstract);分类 cs.CL

Comments Accepted and will appear in the Proceedings of SIGdial 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.15141 2023-08-30 eess.IV cs.CV cs.LG 57%

Uncertainty Aware Training to Improve Deep Learning Model Calibration for Classification of Cardiac MR Images

Tareen Dawood, Chen Chen, Baldeep S. Sidhua, Bram Ruijsink, Justin Goulda, Bradley Porter, Mark K. Elliott, Vishal Mehta, Christopher A. Rinaldi, Esther Puyol-Anton, Reza Razavi, Andrew P. King

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14846 2023-08-30 cs.HC cs.AI cs.RO 57%

Trust in Construction AI-Powered Collaborative Robots: A Qualitative Empirical Analysis

Newsha Emaminejad, Reza Akhavian, Ph. D

专题命中 幻觉与事实性 :trustworthy(abstract);分类 cs.AI

Comments 2023 ASCE International Conference on Computing in Civil Engineering (I3CE)

详情

展开后加载摘要…

URL PDF HTML 收藏