arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-15 至 2025-12-15 共收录 31 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 31 篇

2512.09772 2025-12-15 cs.CL 92%

DeepSeek's WEIRD Behavior: The cultural alignment of Large Language Models and the effects of prompt language and cultural prompting

DeepSeek的WEIRD行为:大型语言模型的文化契合与提示语言和文化提示的影响

James Luther, Donald Brown

机构 * School of Data Science University of Virginia(数据科学学院 芝加哥大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL

AI总结 研究探讨了大型语言模型在不同文化提示下的对齐行为,发现DeepSeek-V3和GPT-5在美文化下表现突出,而GPT-4在英文化下更接近中国,文化提示可调整这种对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11215 2025-12-15 cs.CV 88%

SmokeBench: Evaluating Multimodal Large Language Models for Wildfire Smoke Detection

SmokeBench: 评估多模态大语言模型用于野火烟雾检测

Tianye Qi, Weihao Li, Nick Barnes

机构 * Australian National University(澳大利亚国立大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

AI总结 SmokeBench评估多模态大语言模型在野火烟雾检测中的性能,发现模型在烟雾定位方面存在显著局限,尤其在早期阶段。

Comments Accepted to WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11412 2025-12-15 cs.CE cs.AI cs.CL cs.LG q-bio.BM 82%

Task-Specific Sparse Feature Masks for Molecular Toxicity Prediction with Chemical Language Models

针对分子毒性预测的特定任务稀疏特征掩码与化学语言模型

Kwun Sy Lee, Jiawei Chen, Fuk Sheng Ford Chung, Tianyu Zhao, Zhenyuan Chen, Debby D. Wang

机构 * School of Science and Technology(科学与技术学院) Hong Kong Metropolitan University(香港 Metropolitan 大学) Faculty of Engineering(工程学院) Hong Kong Polytechnic University(香港理工大学)

专题命中 评测与基准 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种多任务学习框架,通过稀疏注意力机制提升化学分子毒性预测的准确性和可解释性。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.21047 2025-12-15 cs.AI cs.CL cs.LG 80%

Grammar-Aligned Decoding

语法对齐解码

Kanghee Park, Jiayu Wang, Taylor Berg-Kirkpatrick, Nadia Polikarpova, Loris D'Antoni

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) University of California San Diego(加州大学圣地亚哥分校)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出语法对齐解码(GAD)方法,通过适应性采样与近似期望未来(ASAp)算法,提升语法约束下生成输出的质量和概率匹配度。

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11437 2025-12-15 cs.CL 79%

CLINIC: Evaluating Multilingual Trustworthiness in Language Models for Healthcare

CLINIC:评估语言模型在医疗领域的多语言可信度

Akash Ghosh, Srivarshinee Sridhar, Raghav Kaushik Ravi, Muhsin Muhsin, Sriparna Saha, Chirag Agarwal

机构 * Indian Institute of Technology Patna(印度理工学院帕纳布分校) IGIMS, Patna(帕纳布IGIMS) University of Virginia(弗吉尼亚大学)

专题命中 评测与基准 :language model(title,abstract);分类 cs.CL

AI总结 CLINIC提出一个多语言基准,评估语言模型在医疗领域的可信度,揭示其在事实准确性、公平性和隐私保护方面的不足。

Comments 49 pages, 31 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10734 2025-12-15 cs.CL cs.AI 79%

Textual Data Bias Detection and Mitigation -- An Extensible Pipeline with Experimental Evaluation

文本数据偏差检测与缓解——一个可扩展的流程及其实验评估

Rebekka Görge, Sujan Sai Gannamaneni, Tabea Naeven, Hammam Abdelwahab, Héctor Allende-Cid, Armin B. Cremers, Lennard Helmer, Michael Mock, Anna Schmitz, Songkai Xue, Elif Yildirir, Maximilian Poretschkin, Stefan Wrobel

机构 * organization= Fraunhofer Institute for Intelligent Analysis organization= Trustworthiness Theory, Technology \& Engineering Lab, Huawei Technologies Co., Ltd , country= China organization= Lamarr Institute for Machine Learning organization= B-IT Emeritus Research Group AI Foundations, University of Bonn , country= Germany

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种可扩展的数据偏见检测与缓解流程,通过四个组件减少文本数据中的表示偏见和刻板印象,并通过实验评估展示其对模型偏见减少的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11039 2025-12-15 cs.SD 78%

Listening Between the Frames: Bridging Temporal Gaps in Large Audio-Language Models

在帧之间倾听:在大型音频-语言模型中弥合时间缺口

Hualei Wang, Yiming Li, Shuo Ma, Hong Liu, Xiangdong Wang

专题命中 评测与基准 :language model(title,abstract)

AI总结 TimeAudio通过引入时间标记和绝对时间编码,提升大型音频-语言模型在时间定位和长音频理解上的能力,有效解决时间戳表示、架构和数据限制问题。

Comments Accepted by The Fortieth AAAI Conference on Artificial Intelligence (AAAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12306 2025-12-15 cs.AI cs.CY 77%

UpBench: A Dynamically Evolving Real-World Labor-Market Agentic Benchmark Framework Built for Human-Centric AI

UpBench: 一个动态演化的现实劳动力市场代理基准框架,专为以人为本的AI设计

Darvin Yi, Teng Liu, Mattie Terzolo, Lance Hasson, Ayan Sinha, Pablo Mendes, Andrew Rabinovich

机构 * Upwork

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 UpBench是一个动态演化的现实劳动力市场代理基准框架,通过真实工作和财务结果评估AI与人类协作的能力,推动人机协作的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13572 2025-12-15 cs.DB cs.AI cs.IR 77%

Q${}^2$Forge: Minting Competency Questions and SPARQL Queries for Question-Answering Over Knowledge Graphs

Q²Forge:生成知识图谱的胜任问题和SPARQL查询用于问答

Yousouf Taghzouti, Franck Michel, Tao Jiang, Louis-Félix Nothias, Fabien Gandon

机构 * Univ. Côte d'Azur(普罗旺斯大学) Inria(法国国家科学研究中心) ICN(信息与通信网络研究所) I3S(信息科学与系统研究所) CNRS(法国国家科学研究中心)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Q²Forge通过生成知识图谱的胜任问题和对应的SPARQL查询,解决非专家用户生成高质量查询的挑战,提供开放源代码的模块化解决方案。

Journal ref Knowledge Capture Conference 2025 (K-CAP '25), December 10--12, 2025, Dayton, OH, USA, Dec 2025, Dayton, OH, United States

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06490 2025-12-15 eess.AS cs.AI cs.MM cs.SD eess.SP 77%

Recent Advances in Discrete Speech Tokens: A Review

最近离散语音标记的进展:综述

Yiwei Guo, Zhihan Li, Hankun Wang, Bohan Li, Chongtian Shao, Hanglei Zhang, Chenpeng Du, Xie Chen, Shujie Liu, Kai Yu

机构 * MoE Key Lab of Artificial Intelligence, Jiangsu Key Lab of Language Computing(MoE人工智能关键实验室、江苏语言计算重点实验室;X-LANCE实验室、计算机科学与工程系、上海交通大学) X-LANCE Lab, Department of Computer Science and Engineering, Shanghai Jiao Tong University

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文综述了离散语音标记的最新进展,分析了声音标记和语义标记的分类、方法及挑战,为未来研究提供方向。

Comments 26 pages, 8 figures, 3 tables. Accepted to IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11689 2025-12-15 cs.MA 76%

Evaluating Cooperative Resilience in Multiagent Systems: A Comparison Between Humans and LLMs

评估多智能体系统中的合作韧性:人类与大语言模型的比较

Manuela Chacon-Chamorro, Juan Sebastián Pinzón, Rubén Manrique, Luis Felipe Giraldo, Nicanor Quijano

专题命中 评测与基准 :LLM(abstract,comments);large language model(abstract);language model(abstract)

AI总结 本文通过比较人类与LLM在合作韧性中的表现,发现人类通过交流能有效提升合作韧性,而LLM在无交流时表现低于人类。

Comments Supplementary material in https://github.com/mavivi95/resilience_humans_vs_LLM/blob/main/Supplementary_File.pdf

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11398 2025-12-15 cs.SE cs.MA 75%

AutoFSM: A Multi-agent Framework for FSM Code Generation with IR and SystemC-Based Testing

AutoFSM:一种基于IR和SystemC的多智能体FSM代码生成框架

Qiuming Luo, Yanming Lei, Kunzhong Wu, Yixuan Cao, Chengjian Liu

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 AutoFSM通过引入结构化中间表示和SystemC建模,提升了FSM代码生成的可靠性与可扩展性,实验表明其在测试基准中表现优于现有框架。

Comments This version corrects a typo in the section title ("Intruction" -> "Introduction") that appears in the published version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10971 2025-12-15 q-fin.CP cs.CE 75%

AI-Trader: Benchmarking Autonomous Agents in Real-Time Financial Markets

AI-Trader: 评估实时金融市场中的自主代理

Tianyu Fan, Yuhao Yang, Yangqin Jiang, Yifei Zhang, Yuxuan Chen, Chao Huang

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 AI-Trader通过实时评估LLM在金融市场的表现,揭示了自主代理在风险控制和流动性中的关键局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11110 2025-12-15 cs.CL cs.AI 73%

FIBER: A Multilingual Evaluation Resource for Factual Inference Bias

FIBER:一个多语言事实推理偏差评估资源

Evren Ayberk Munis, Deniz Yılmaz, Arianna Muti, Çağrı Toraman

机构 * Politecnico di Torino(托斯卡纳理工学院) Middle East Technical University(中东技术大学) Bocconi University(博科尼大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 FIBER是一个多语言事实推理偏差评估资源,用于评估大型语言模型在单实体和多实体问题上的事实知识准确性及语言相关偏见。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11588 2025-12-15 cs.AI 70%

AI Benchmark Democratization and Carpentry

AI基准民主化与木工

Gregor von Laszewski, Wesley Brewer, Jeyan Thiyagalingam, Juri Papay, Armstrong Foundjem, Piotr Luszczek, Murali Emani, Shirley V. Moore, Vijay Janapa Reddi, Matthew D. Sinclair, Sebastian Lobentanzer, Sujata Goswami, Benjamin Hawks, Marco Colombo, Nhan Tran, Christine R. Kirkpatrick, Abdulkareem Alsudais, Gregg Barrett, Tianhao Li, Kirsten Morehouse, Shivaram Venkataraman, Rutwik Jain, Kartik Mathur, Victor Lu, Tejinder Singh, Khojasteh Z. Mirza, Kongtao Chen, Sasidhar Kunapuli, Gavin Farrell, Renato Umeton, Geoffrey C. Fox

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出动态、适应性AI基准框架,强调通过教育和技术创新实现基准民主化,以提升AI评估的透明性和实用性。

Comments 43 pages, 2 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11315 2025-12-15 cs.LG 70%

Benchmarking the Generality of Vision-Language-Action Models

对视觉-语言-动作模型通用性的基准测试

Pranav Guruprasad, Sudipta Chowdhury, Harsh Sikka, Mridul Sharma, Helen Lu, Sean Rivera, Aryan Khurana, Hangliang Ren, Yangyue Wang

机构 * Manifold Research Metarch AI Georgia Tech(佐治亚理工学院) Tufts University(塔夫茨大学) Northeastern University(东北大学) Birla Institute of Technology and Science, Pilani(比拉理工学院,帕利尼) Institute for Research and Innovation in Intelligent Systems (IRIIS)(智能系统研究与创新研究所)

专题命中 评测与基准 :language model(abstract);foundation model(abstract);分类 cs.LG

AI总结 本文提出MultiNet v1.0基准,评估视觉-语言-动作模型在六个基础能力领域的跨领域泛化能力,发现现有模型在未见领域和模态转移时表现显著退化。

Comments 23 pages, 7 figures, and 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11296 2025-12-15 cs.CV cs.AI cs.HC 70%

Few-Shot VLM-Based G-Code and HMI Verification in CNC Machining

少样本基于视觉语言模型的CNC加工G代码和人机界面验证

Yasaman Hashem Pour, Nazanin Mahjourian, Vinh Nguyen

机构 * Department of Mechanical and Aerospace Engineering, Michigan Technological University(机械与航空航天工程系,密歇根技术大学)

专题命中 评测与基准 :language model(abstract);prompting(abstract);分类 cs.AI

AI总结 本文提出基于视觉语言模型的少样本方法,用于验证CNC加工中G代码与人机界面的错误和安全状态。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11510 2025-12-15 cs.CV 67%

Reconstruction as a Bridge for Event-Based Visual Question Answering

重建作为事件驱动视觉问答的桥梁

Hanyue Lou, Jiayi Zhou, Yang Zhang, Boyu Li, Yi Wang, Guangnan Ye, Boxin Shi

机构 * Peking University(北京大学) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) Fudan University(复旦大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract)

AI总结 本文提出基于重建的框架,通过FRT和ART方法提升事件驱动视觉问答性能,并引入EvQA基准验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11414 2025-12-15 physics.soc-ph 67%

An Artificial Intelligence Framework for Conflict Mapping and Resolution for Sustainability of Systems

用于系统可持续性的冲突映射与解决的人工智能框架

Apala Chakrabarti

专题命中 评测与基准 :large language model(abstract);language model(abstract)

AI总结 本文提出CONFARM框架,通过人工智能技术实现系统可持续性的冲突映射与解决,提升早期决策支持和跨领域可持续性评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11245 2025-12-15 cs.HC 67%

Breast-Rehab: A Postoperative Breast Cancer Rehabilitation Training Assessment System Based on Human Action Recognition

Breast-Rehab: 一种基于人体动作识别的术后乳腺癌康复训练评估系统

Zikang Chen, Tan Xie, Qinchuan Wang, Heming Zheng, Xudong Lu

专题命中 评测与基准 :large language model(abstract);language model(abstract)

AI总结 Breast-Rehab通过结合人体动作识别与RAG框架,提供低成本的居家乳腺癌术后上肢康复训练评估系统,提升患者康复依从性。

Comments has been accepted by CHIP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10257 2025-12-15 cs.HC 67%

Reject or Not?: A Benchmark for Voice Assistant Query Rejection in Smart Home Scenario and an Improved Method Based on LLMs

拒绝或不?:智能家庭场景下的语音助手查询拒绝基准及基于LLM的改进方法

Huichao Men, Yizhen Hu, Yingyang He, Yu Gao, Xiaofeng Mou, Yi Xu

专题命中 评测与基准 :large language model(abstract);language model(abstract)

AI总结 本文提出面向智能家庭场景的语音助手查询拒绝基准及基于LLM的改进方法,通过构建多模态数据集和三级协作架构提升拒绝准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11350 2025-12-15 cs.CV cs.AI 57%

Surveillance Video-Based Traffic Accident Detection Using Transformer Architecture

基于监控视频的交通事故检测使用变换器架构

Tanu Singh, Pranamesh Chakraborty, Long T. Truong

机构 * Department of Civil Engineering, Indian Institute of Technology Kanpur(印度理工学院坎浦尔分校土木工程系) School of Computing, Engineering and Mathematical Sciences, La Trobe University(拉特罗布大学计算科学与工程数学科学学院)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

AI总结 本文提出基于变换器架构的交通事故检测模型,利用预提取的空间视频特征和运动线索,通过卷积与变换器结合提升检测准确率至88.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11323 2025-12-15 cs.AI 57%

CAPTURE: A Benchmark and Evaluation for LVLMs in CAPTCHA Resolving

CAPTURE:一个用于LVLM在CAPTCHA解决中的基准和评估

Jianyi Zhang, Ziyin Zhou, Xu Ji, Shizhao Liu, Zhangchi Zhao

机构 * Beijing Electric Science and Technology Institute(北京电子科技研究所)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

AI总结 CAPTURE是一个专为LVLM设计的CAPTCHA基准,涵盖4种主要类型和25种子类型,旨在全面评估LVLM在解决CAPTCHA任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09142 2025-12-15 cs.AI 57%

SDialog: A Python Toolkit for End-to-End Agent Building, User Simulation, Dialog Generation, and Evaluation

SDialog:一个用于端到端代理构建、用户模拟、对话生成和评估的Python工具包

Sergio Burdisso, Séverin Baroudi, Yanis Labrak, David Grunert, Pawel Cyrta, Yiyang Chen, Srikanth Madikeri, Esaú Villatoro-Tello, Thomas Schaaf, Ricard Marxer, Petr Motlicek

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

AI总结 SDialog是一个开源Python工具包,提供端到端的对话代理构建、用户模拟、对话生成和评估功能,结合机理可解释性工具和综合评估方法,帮助研究人员更系统地研究对话系统。

Comments We have an old version of the paper at arXiv:2506.10622, we will update this old version instead (even though the authors and the title have changed since this first old version)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11147 2025-12-15 cs.CR cs.AI 57%

MiniScope: A Least Privilege Framework for Authorizing Tool Calling Agents

MiniScope: 一种基于最小特权原则的工具调用代理授权框架

Jinhao Zhu, Kevin Tseng, Gil Vernik, Xiao Huang, Shishir G. Patil, Vivian Fang, Raluca Ada Popa

机构 * University of California, Berkeley(加州大学伯克利分校) IBM Research(IBM研究院)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI

AI总结 MiniScope通过重建权限层次结构和移动式权限模型,实现最小特权原则,以平衡安全性和易用性,同时在权限最小化和成本控制方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10968 2025-12-15 cs.CL cs.SD eess.AS 57%

Benchmarking Automatic Speech Recognition Models for African Languages

对非洲语言自动语音识别模型的基准测试

Alvin Nahabwe, Sulaiman Kagumire, Denis Musinguzi, Bruno Beijuka, Jonah Mubuuke Kyagaba, Peter Nabende, Andrew Katumba, Joyce Nakatumba-Nabende

机构 * Makerere University Centre for Artificial Intelligence(Makerere大学人工智能中心) Marconi Lab(Marconi实验室) Department of Information Systems(信息系统系) Department of Electrical Engineering(电气工程系) Department of Computer Science(计算机科学系)

专题命中 评测与基准 :language model(abstract);分类 cs.CL

AI总结 本研究对四种最先进的ASR模型在13种非洲语言上进行基准测试,揭示不同模型在不同资源条件下的表现差异及优化策略。

Comments 19 pages, 8 figures, Deep Learning Indiba, Proceedings of Machine Learning Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10470 2025-12-15 cs.CL 57%

Statistical Analysis of Sentence Structures through ASCII, Lexical Alignment and PCA

通过ASCII、词性对齐和PCA进行句子结构的统计分析

Abhijeet Sahdev

机构 * New Jersey Institute of Technology(新泽西理工学院)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

AI总结 本研究通过ASCII、词性对齐和PCA分析句子结构的平衡,提出一种资源高效的统计方法,用于评估文本平衡并补充传统语法工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11749 2025-12-15 cs.CV 50%

SVG-T2I: Scaling Up Text-to-Image Latent Diffusion Model Without Variational Autoencoder

SVG-T2I: 在视觉基础模型表示空间中扩展文本到图像的潜在扩散模型而不使用变分自编码器

Minglei Shi, Haolin Wang, Borui Zhang, Wenzhao Zheng, Bohan Zeng, Ziyang Yuan, Xiaoshi Wu, Yuanxing Zhang, Huan Yang, Xintao Wang, Pengfei Wan, Kun Gai, Jie Zhou, Jiwen Lu

机构 * Department of Automation, Tsinghua University(自动化系,清华大学) Kling Team, Kuaishou Technology(快手技术团队)

专题命中 评测与基准 :foundation model(abstract)

AI总结 SVG-T2I通过在视觉基础模型表示空间中直接进行文本到图像生成,实现了高质量的图像合成并验证了VFM在生成任务中的能力。

Comments Code Repository: https://github.com/KlingTeam/SVG-T2I; Model Weights: https://huggingface.co/KlingTeam/SVG-T2I

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11557 2025-12-15 cs.CV 50%

3DTeethSAM: Taming SAM2 for 3D Teeth Segmentation

3DTeethSAM:对SAM2进行调整以实现3D牙齿分割

Zhiguo Lu, Jianwen Lou, Mingjun Ma, Hairong Jin, Youyi Zheng, Kun Zhou

专题命中 评测与基准 :foundation model(abstract)

AI总结 3DTeethSAM通过调整SAM2模型,结合提示嵌入生成器、掩码细化器和分类器,实现了高精度的3D牙齿分割,并在基准测试中取得91.90%的IoU表现。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11330 2025-12-15 cs.CV 50%

Noise Matters: Optimizing Matching Noise for Diffusion Classifiers

噪声至关重要:优化扩散分类器的匹配噪声

Yanghao Wang, Long Chen

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 评测与基准 :language model(abstract)

AI总结 本文提出NoOp方法,通过频率匹配和空间匹配原则优化扩散分类器的噪声,以提升分类稳定性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏