arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Transactions on Machine Learning Research · 期刊 · Machine Learning

2025-12-30 至 2025-12-30 共收录 3
2406.04654 2025-12-30 eess.IV cs.LG

Image and Video Quality Assessment using Prompt-Guided Latent Diffusion Models for Cross-Dataset Generalization

基于提示引导的潜在扩散模型的图像和视频质量评估用于跨数据集泛化

Shankhanil Mitra, Diptanu De, Shika Rao, Rajiv Soundararajan

机构 * Samsung Research Institute(三星研究机构) Qualcomm(高通) New York University(纽约大学) Indian Institute of Science(印度科学研究院)

AI总结 本文提出基于提示引导的潜在扩散模型,通过学习跨注意力图和时间质量调节器,实现图像和视频质量评估的跨数据集泛化。

Comments Accepted to Transactions on Machine Learning Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14925 2025-12-30 cs.LG

A Survey of Reinforcement Learning from Human Feedback

从人类反馈强化学习的综述

Timo Kaufmann, Paul Weng, Viktor Bengs, Eyke Hüllermeier

机构 * LMU Munich(慕尼黑大学) MCML Munich(慕尼黑马克斯·普朗克研究所) DFKI(德国人工智能研究中心)

AI总结 本文综述了从人类反馈强化学习的基本原理、核心方法及在多个领域中的应用与贡献。

Comments Published version (TMLR): https://openreview.net/pdf?id=f7OkIurx4b

Journal ref Transactions on Machine Learning Research, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14937 2025-12-30 cs.CL cs.CR

Operationalizing a Threat Model for Red-Teaming Large Language Models (LLMs)

为大规模语言模型(LLMs)的红队测试构建威胁模型

Apurv Verma, Satyapriya Krishna, Sebastian Gehrmann, Madhavan Seshadri, Anu Pradhan, Tom Ault, Leslie Barrett, David Rabinowitz, John Doucette, NhatHai Phan

AI总结 本文提出了一种针对大规模语言模型的威胁模型,并系统化地总结了红队攻击的分类、防御方法及实践策略,以提升LLM系统的安全性和鲁棒性。

Comments Transactions of Machine Learning Research (TMLR)

Journal ref Transactions on Machine Learning Research, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏