arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11714 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11714 篇

2604.20511 2026-04-23 cs.LG cs.AI cs.CL cs.CV cs.CY 75%

CHASM: Unveiling Covert Advertisements on Chinese Social Media

CHASM:揭示中国社交媒体上的隐蔽广告

Jingyi Zheng, Tianyi Hu, Yule Liu, Zhen Sun, Zongmin Zhang, Zifan Peng, Wenhan Dong, Xinlei He

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出CHASM数据集,用于评估多模态大语言模型在检测社交媒体隐蔽广告的能力,揭示当前模型在识别隐蔽广告中的不足及改进方向。

Comments NeuIPS 2025 (Datasets and Benchmarks Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07129 2026-04-21 cs.CL cs.AI cs.LG 75%

LoRA on the Go: Instance-level Dynamic LoRA Selection and Merging

LoRA on the Go:实例级动态LoRA选择与合并

Seungeon Lee, Soumi Das, Manish Gupta, Krishna P. Gummadi

机构 * MPI-SWS(马克斯·普朗克研究所-斯图加特研究所) Microsoft, India(微软公司,印度)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 LoRA on the Go通过实例级动态选择和合并适配器,在无需额外训练的情况下提升多任务性能,实验证明其在多个NLP基准和数据集上表现优异。

Comments Accepted as a main conference paper in ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05920 2026-04-21 cs.CV 75%

High-Resolution Visual Reasoning via Multi-Turn Grounding-Based Reinforcement Learning

通过多轮基于定位的强化学习实现高分辨率视觉推理

Xinyu Huang, Yuhao Dong, Weiwei Tian, Bo Li, Rui Feng, Ziwei Liu

机构 * Fudan University(复旦大学) S-Lab, Nanyang Technological University(南洋理工大学S实验室)

专题命中 指令微调 :SFT(abstract,abstract_cn);post-training(abstract)

AI总结 本文提出MGPO框架,通过多轮对话机制使LMMs在无需额外标注的情况下提升视觉定位能力,实验表明其在MME-Realworld和V*Bench任务中表现优异。

Comments Accepted by ACL(Findings) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00772 2026-04-21 cs.LG cs.AI cs.CL 75%

LIFT the Veil for the Truth: Principal Weights Emerge after Rank Reduction for Reasoning-Focused Supervised Fine-Tuning

揭开真相的面纱:秩减少后主权重的浮现使以推理为导向的监督微调得以提升

Zihang Liu, Tianyu Pang, Oleg Balabanov, Chaoqun Yang, Tianjin Huang, Lu Yin, Yaoqing Yang, Shiwei Liu

机构 * University of California, Berkeley, CA, USA(加州大学伯克利分校) International Computer Science Institute, CA, USA(国际计算机科学研究所) Lawrence Berkeley National Laboratory, CA, USA(伯克利国家实验室) Dartmouth College, NH, USA(达特茅斯学院) University of Exeter, Exeter, UK(埃克塞特大学) University of Oxford, Oxford, UK(牛津大学) University of Surrey, Guildford, UK(萨里大学) Tsinghua University, China(清华大学) Eindhoven University of Technology, the Netherlands(埃因霍温理工大学)

专题命中 指令微调 :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出LIFT方法,通过秩减少后选取主权重进行微调,提升推理能力,同时保持内存效率,优于全微调和LoRA。

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03038 2026-04-20 cs.LG cs.AI cs.CL 75%

Automatic Combination of Sample Selection Strategies for Few-Shot Learning

少样本学习中样本选择策略的自动组合

Branislav Pecher, Ivan Srba, Maria Bielikova, Joaquin Vanschoren

机构 * Faculty of Information Technology, Brno University of Technology(布拉格技术学院,布拉格技术大学) Kempelen Institute of Intelligent Technologies(智能技术研究所) Eindhoven University of Technology(埃因霍温技术大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出ACSESS方法,通过结合多种样本选择策略提升少样本学习性能,实验显示组合策略优于单一策略,且在小数据集上效果更佳。

Comments Accepted to the Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04377 2026-04-20 cs.CL cs.AI cs.LG 75%

Disco-RAG: Discourse-Aware Retrieval-Augmented Generation

Disco-RAG: 语篇意识的检索增强生成

Dongqi Liu, Hang Ding, Qiming Feng, Xurong Xie, Zhucun Xue, Chengjie Wang, Jian Li, Jiangning Zhang, Yabiao Wang

机构 * Saarland University(萨尔兰大学) Shanghai Jiaotong University(上海交通大学) Fudan University(复旦大学) Zhejiang University(浙江大学) Tencent YouTu Lab(腾讯优图实验室)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Discourse-aware RAG框架通过构建篇章内结构树和跨篇章修辞图,提升知识整合能力,在问答和长文档摘要任务中取得最佳效果。

Comments ACL 2026 Main & Long Conference Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03897 2026-04-17 cs.RO cs.AI cs.CL cs.HC cs.LG 75%

IROSA: Interactive Robot Skill Adaptation using Natural Language

IROSA: 基于自然语言的交互机器人技能适应

Markus Knauer, Samuel Bustamante, Thomas Eiband, Alin Albu-Schäffer, Freek Stulp, João Silvério

机构 * German Aerospace Center (DLR), Institute of Robotics and Mechatronics (RMC)(德国航空航天中心(DLR)机器人与机电研究所) School of Computation, Information and Technology (CIT), Technical University of Munich (TUM)(计算、信息与技术学院(CIT),慕尼黑技术大学)

专题命中 指令微调 :language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出IROSA框架,利用预训练大语言模型实现开放词汇技能适应,通过工具架构在语言模型与机器人硬件间保持抽象层,无需微调即可通过自然语言指令调整机器人技能。

Comments Accepted IEEE Robotics and Automation Letters (RA-L) journal, 8 pages, 5 figures, 3 tables, 1 listing. Code available: https://github.com/DLR-RM/IROSA

Journal ref IEEE Robotics and Automation Letters (RA-L), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20913 2026-04-16 cs.CV 75%

LongVideo-R1: Smart Navigation for Low-cost Long Video Understanding

LongVideo-R1: 低成本长视频理解的智能导航

Jihao Qiu, Lingxi Xie, Xinyue Huo, Qi Tian, Qixiang Ye

机构 * University of Chinese Academy of Sciences(中国科学院大学) Huawei Consumer Business Group(华为消费者业务集团)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract)

AI总结 本文提出LongVideo-R1,一种基于多模态大语言模型的智能导航系统,通过高效视频上下文导航减少冗余搜索,提升长视频理解的效率与准确性。

Comments 17 pages, 9 figures, 8 tables, accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15195 2026-04-08 cs.CR cs.AI cs.CL cs.LG 75%

Weight space Detection of Backdoors in LoRA Adapters

LoRA适配器中后门的权重空间检测

David Puertolas Merenciano, Ekaterina Vasyagina, Kevin Zhu, Javier Ferrando, Maheep Chaudhary

机构 * Algoverse AI Research Independent(独立研究者)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出一种无需运行模型即可检测LoRA适配器后门的方法,通过分析权重矩阵的谱统计特征,利用逻辑回归分类器在三种模型家族上实现100%准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03240 2026-04-07 cs.LG cs.AI cs.CL 75%

Scaling DPPs for RAG: Density Meets Diversity

在RAG中扩展DPPs:密度与多样性

Xun Sun, Baiheng Xie, Li Huang, Qiang Gao

机构 * Southwestern University of Finance and Economics(西南财经大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出ScalDPP,通过轻量级P-Adapter整合DPPs,实现RAG中密度与多样性的联合优化,通过DML损失确保互补证据链的优先级,实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17586 2026-04-06 cs.DB 75%

DeepEye-SQL: A Software-Engineering-Inspired Text-to-SQL Framework

DeepEye-SQL: 一种受软件工程启发的文本到SQL框架

Boyan Li, Chong Chen, Zhujun Xue, Yinan Mei, Yuyu Luo

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 DeepEye-SQL通过结构化协作提升文本到SQL的可靠性,采用软件开发生命周期指导,实现73.5%的BIRD-Dev准确率和89.8%的Spider-Test表现,优于现有方法。

Comments SIGMOD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01694 2026-04-03 cs.LG cs.AI cs.CL 75%

MiCA Learns More Knowledge Than LoRA and Full Fine-Tuning

MiCA 学习比 LoRA 和全微调更多知识

Sten Rüdiger, Sebastian Raschka

机构 * Independent Researcher(独立研究员) RAIR Lab(RAIR实验室)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 MiCA 通过适应模型表示中未充分利用的子空间,在优化训练超参数下实现知识获取提升5.9倍,参数足迹比 LoRA 小6-60%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17094 2026-04-01 cs.LG cs.AI cs.CL 75%

The Mouth is Not the Brain: Bridging Energy-Based World Models and Language Generation

嘴巴不是大脑:连接基于能量的世界模型与语言生成

Junichiro Niimi

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出'嘴巴不是大脑'原则,通过基于能量的世界模型与语言模型分离,展示在消费者评论领域中,世界模型能提升生成质量与可控性,为语言能力与世界理解分离提供实证支持。

Comments ICLR 2026 The 2nd Workshop on World Models: Understanding, Modelling, and Scaling

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26032 2026-03-30 cs.CR 75%

Protecting User Prompts Via Character-Level Differential Privacy

通过字符级差分隐私保护用户提示

Shashie Dilhara Batan Arachchige, Hassan Jameel Asghar, Benjamin Zi Hao Zhao, Dinusha Vatsalan, Dali Kaafar

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出一种基于差分隐私的字符级扰动方法,用于保护用户提示中的敏感信息,通过远程LLM恢复非敏感词并完成下游任务,实验显示其在隐私与效用之间取得良好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25118 2026-03-27 cs.CV 75%

AnyDoc: Enhancing Document Generation via Large-Scale HTML/CSS Data Synthesis and Height-Aware Reinforcement Optimization

AnyDoc:通过大规模HTML/CSS数据合成和高度感知强化优化提升文档生成

Jiawei Lin, Wanrong Zhu, Vlad I Morariu, Christopher Tensmeyer

机构 * Xi’an Jiaotong University(西安交通大学) Adobe Research(Adobe研究院)

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract)

AI总结 AnyDoc通过大规模HTML/CSS数据合成和高度感知强化优化,实现多文档生成任务,包含265206个样本,覆盖111类和32种风格,提升文档生成性能。

Comments CVPR 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11864 2026-03-27 cs.CR 75%

NeuroStrike: Neuron-Level Attacks on Aligned LLMs

NeuroStrike:对对齐大语言模型的神经层面攻击

Lichao Wu, Sasha Behrouzi, Mohamadreza Rostami, Maximilian Thang, Stjepan Picek, Ahmad-Reza Sadeghi

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 NeuroStrike通过利用对齐技术引入的稀疏安全神经元漏洞,提出了一种通用攻击框架,实现了对多种大语言模型的高效攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24204 2026-03-26 cs.IR 75%

SumRank: Aligning Summarization Models for Long-Document Listwise Reranking

SumRank:对长文档列表级重排序进行总结化对齐

Jincheng Feng, Wenhan Liu, Zhicheng Dou

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract)

AI总结 本文提出SumRank模型,通过压缩长文档为简洁的排序对齐摘要,提升列表级重排序的效率与效果,实验显示其在多个基准数据集上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22446 2026-03-25 cs.CL cs.AI cs.LG 75%

Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs

稀疏但关键:RLVR微调中LLMs分布偏移的token级分析

Haoming Meng, Kexin Huang, Shaohang Wei, Chiyu Ma, Shuo Yang, Xue Wang, Guoyin Wang, Bolin Ding, Jingren Zhou

机构 * Alibaba Group(阿里巴巴集团)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究通过token级分析揭示RLVR微调中分布偏移的机制,发现微调导致稀疏且针对性强的token分布变化,通过交叉采样实验验证了少量token决策对性能提升的关键作用。

Comments Published as a conference paper at the International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21418 2026-03-24 cs.CL cs.AI cs.LG 75%

Efficient Fine-Tuning Methods for Portuguese Question Answering: A Comparative Study of PEFT on BERTimbau and Exploratory Evaluation of Generative LLMs

葡萄牙问答任务中高效的微调方法:对BERTimbau的PEFT系统评估及生成LLMs的探索性评估

Mariela M. Nina, Caio Veloso Costa, Lilian Berton, Didier A. Vega-Oliveros

机构 * Institute of Science and Technology(科学技术研究院) Federal University of São Paulo (UNIFESP)(圣保罗联邦大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文比较了PEFT在BERTimbau上的表现,并探索了生成式LLMs在葡萄牙问答任务中的效果,发现PEFT方法在计算成本上更高效,适合可持续发展。

Comments 10 pages, 2 figures, PROPOR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21818 2026-03-19 cs.CV 75%

SkyReels-V4: Multi-modal Video-Audio Generation, Inpainting and Editing model

SkyReels-V4:多模态视频-音频生成、修复和编辑模型

Guibin Chen, Dixuan Lin, Jiangping Yang, Youqiang Zhang, Zhengcong Fei, Debang Li, Sheng Chen, Chaofeng Ao, Nuo Pang, Yiming Wang, Yikun Dou, Zheng Chen, Mingyuan Fan, Tuanhui Li, Mingshan Chang, Hao Zhang, Xiaopeng Sun, Jingtao Xu, Yuqiang Xie, Jiahua Wang, Zhiheng Xu, Weiming Xiong, Yuzhe Jin, Baoxuan Gu, Binjie Mao, Yunjie Yu, Jujie He, Yuhao Feng, Shiwen Tu, Chaojie Wang, Rui Yan, Wei Shen, Jingchen Wu, Peng Zhao, Xuanyue Zhong, Zhuangzhuang Liu, Kaifei Wang, Fuxiang Zhang, Weikai Xu, Wenyan Liu, Binglu Zhang, Yu Shen, Tianhui Xiong, Bin Peng, Liang Zeng, Xuchen Song, Haoxiang Guo, Peiyu Wang, Max W. Y. Lam, Chien-Hung Liu, Yahui Zhou

机构 * Skywork AI

专题命中 指令微调 :large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 SkyReels-V4是一款多模态视频基础模型,支持视频音频生成、修复和编辑,采用双流多模态扩散变换器架构,结合文本编码器实现多模态指令处理,支持高分辨率、长时长视频生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16063 2026-03-18 cs.CV 75%

ViT-AdaLA: Adapting Vision Transformers with Linear Attention

ViT-AdaLA:基于线性注意力的视觉变换器适应

Yifan Li, Seunghyun Yoon, Viet Dac Lai, Franck Dernoncourt, Jason Kuen, Yu Kong, Trung Bui

机构 * Adobe Research(Adobe研究院) Michigan State University, East Lansing, MI, USA.(密歇根州立大学,东兰辛,MI,美国)

专题命中 指令微调 :large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 本文提出ViT-AdaLA框架,通过注意力对齐、特征对齐和监督微调三阶段,有效将视觉基础模型的先验知识迁移至线性注意力ViT,提升长序列处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14336 2026-03-17 cs.CV 75%

UAVBench and UAVIT-1M: Benchmarking and Enhancing MLLMs for Low-Altitude UAV Vision-Language Understanding

UAVBench 和 UAVIT-1M:用于低空无人机视觉-语言理解的LLM基准测试与增强

Yang Zhan, Yuan Yuan

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract)

AI总结 本文提出UAVBench和UAVIT-1M,用于评估和提升LLM在低空无人机视觉-语言任务中的能力,通过大规模数据集和基准测试揭示开源LLM在低空视觉内容生成上的不足,并通过微调提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19001 2026-03-17 eess.AS cs.SD 75%

HD-PPT: Hierarchical Decoding of Content- and Prompt-Preference Tokens for Instruction-based TTS

HD-PPT: 基于内容和提示偏好令牌的分层解码用于基于指令的语音合成

Sihang Nie, Xiaofen Xing, Jingyuan Xing, Baiji Liu, Xiangmin Xu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出HD-PPT框架,通过分层解码策略提升指令遵循性和语音自然度,实现更精细的语音合成控制。

Comments 5 pages, 2 figures, 3 tables; Accepted to ICASSP2026(Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10862 2026-03-16 cs.CL cs.AI cs.CR cs.CY cs.LG 75%

Superficial Safety Alignment Hypothesis

表面安全对齐假说

Jianwei Li, Jung-Eun Kim

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出表面安全对齐假说,认为安全对齐通过让模型选择正确推理方向来实现,识别出四种关键组件以建立安全防护。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09740 2026-03-11 cs.RO cs.CV 75%

Let's Reward Step-by-Step: Step-Aware Contrastive Alignment for Vision-Language Navigation in Continuous Environments

逐步奖励:面向连续环境的视觉语言导航中的步骤感知对比对齐

Haoyuan Li, Rui Liu, Hehe Fan, Yi Yang

机构 * College of Computer Science and Technology, Zhejiang University, Hangzhou, China(浙江大学计算机科学与技术学院,杭州,中国)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract)

AI总结 本文提出SACA框架,通过步骤感知对比对齐提升连续环境中视觉语言导航的性能,解决传统方法在错误恢复和训练稳定性方面的不足。

Comments 28 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09312 2026-03-11 cs.CV 75%

IntroSVG: Learning from Rendering Feedback for Text-to-SVG Generation via an Introspective Generator-Critic Framework

IntroSVG: 通过反思生成器-批评者框架从渲染反馈中学习以实现文本到SVG生成

Feiyu Wang, Jiayuan Yang, Zhiyuan Zhao, Da Zhang, Bingyu Li, Peng Liu, Junyu Gao

机构 * Fudan University(复旦大学) TeleAI Northwestern Polytechnical University(西北工业大学) University of Science and Technology of China(中国科学技术大学)

专题命中 指令微调 :language model(abstract);SFT(abstract);preference optimization(abstract)

AI总结 IntroSVG通过反思生成器-批评者框架,结合监督微调和直接偏好优化,实现文本到SVG生成的高质量输出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02795 2026-03-09 cs.CV 75%

VSearcher: Long-Horizon Multimodal Search Agent via Reinforcement Learning

VSearcher:通过强化学习实现长周期多模态搜索代理

Ruiyang Zhang, Qianguo Sun, Chao Song, Yiyan Qi, Zhedong Zheng

机构 * University of Macau(澳门大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract)

AI总结 VSearcher通过强化学习实现多模态搜索代理,提升长周期多轮工具使用能力,在多模态网络搜索任务中表现优异。

Comments 23 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03230 2026-03-04 cs.LG cs.AI cs.CL math.OC 75%

DiaBlo: Diagonal Blocks Are Sufficient For Finetuning

DiaBlo: 对角块足以用于微调

Selcuk Gurses, Aozhong Zhang, Yanxia Deng, Xun Dong, Xin Li, Naigang Wang, Penghang Yin, Zi Yang

机构 * University at Albany, SUNY(纽约州立大学阿尔巴尼分校) IBM T. J. Watson Research Center(IBM 汤普逊·杰·沃森研究中心)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 DiaBlo是一种仅更新模型权重矩阵对角块的参数高效微调方法,通过消除低秩矩阵乘积需求,实现稳定收敛和高效训练。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01565 2026-03-03 eess.AS cs.SD 75%

Investigating Group Relative Policy Optimization for Diffusion Transformer based Text-to-Audio Generation

探究基于扩散变压器的文本到音频生成中的群体相对策略优化

Yi Gu, Yanqing Liu, Chen Yang, Sheng Zhao

机构 * Tsinghua University(清华大学) Microsoft(微软)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文基于扩散变压器架构,利用群体相对策略优化提升文本到音频生成的保真度和提示遵循性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04281 2026-03-03 cs.CY cs.CR 75%

Prompt Injection Vulnerability of Consensus Generating Applications in Digital Democracy

共识生成应用在数字民主中的提示注入漏洞

Jairo Gudiño-Rosero, Clément Contet, Umberto Grandi, César A. Hidalgo

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 研究揭示了共识生成LLMs在数字民主中的提示注入漏洞,并提出鲁棒性方法以减少方向性失败。

Comments 33 pages, 11 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏