arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11714 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11714 篇

2507.10986 2026-01-19 cs.LG 77%

StellarF: A Physics-Informed LoRA Framework for Stellar Flare Forecasting with Historical & Statistical Data

StellarF:一种结合物理知识的LoRA框架,用于利用历史和统计数据进行恒星耀斑预测

Tianyu Su, Zhiqiang Zou, Qingyu Lu, Feng Zhang, Ali Luo, Xiao Kong, Min Li

机构 * School of Computer Science, Nanjing University of Posts and Telecommunications(南京邮电大学计算机科学学院) Jiangsu Key Laboratory of Big Data Security and Intelligent Processing(江苏大数据安全与智能处理重点实验室) University of Chinese Academy of Sciences(中国科学院大学) CAS Key Laboratory of Optical Astronomy, National Astronomical Observatories(中国科学院国家天文台光学天文重点实验室) School of Astronomy and Space Science, University of Chinese Academy of Sciences(中国科学院大学天文与空间科学学院)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 StellarF通过结合物理知识和LoRA框架,利用历史和统计数据提升恒星耀斑预测的准确性与物理可解释性。

Comments 12 pages, 8 figures (5 main, 3 appendix), 7 tables (2 main, 5 appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10043 2026-01-16 q-fin.CP cs.LG 77%

Instruction Finetuning LLaMA-3-8B Model Using LoRA for Financial Named Entity Recognition

使用LoRA对LLaMA-3-8B模型进行指令微调以实现金融命名实体识别

Zhiming Lian

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.LG

AI总结 本文通过结合指令微调和LoRA技术,提升LLaMA-3-8B模型在金融命名实体识别任务中的性能,取得微F1得分为0.894。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09185 2026-01-15 cs.CL 77%

OrthoGeoLoRA: Geometric Parameter-Efficient Fine-Tuning for Structured Social Science Concept Retrieval on theWeb

OrthoGeoLoRA:用于Web上结构化社会科学概念检索的几何参数高效微调

Zeqiang Wang, Xinyue Wu, Chenxi Li, Zixi Chen, Nishanth Sastry, Jon Johnson, Suparna De

机构 * University of Surrey(萨里大学) Washington State University(华盛顿州立大学) University of Oxford(牛津大学) New York University Shanghai(纽约大学上海分校) University College London(伦敦大学学院)

专题命中 指令微调 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL

AI总结 OrthoGeoLoRA通过几何约束改进低秩适应,实现更高效的参数微调,提升社会科学概念检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07185 2026-01-13 cs.CR cs.AI 77%

Defenses Against Prompt Attacks Learn Surface Heuristics

对抗提示攻击的防御学习表面启发式

Shawn Li, Chenxiao Yu, Zhiyu Ni, Hao Li, Charith Peris, Chaowei Xiao, Yue Zhao

机构 * University of Southern California(南加州大学) University of California, Berkeley(加州大学伯克利分校) Washington University in St. Louis(圣路易斯华盛顿大学) Amazon(亚马逊公司) Johns Hopkins University(约翰霍普金斯大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究了对抗提示攻击防御中表面启发式的问题,发现现有方法易受表面模式影响,提出受控数据集和系统评估以揭示监督微调的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06851 2026-01-13 cs.AI 77%

A Brain-like Synergistic Core in LLMs Drives Behaviour and Learning

类脑协同核心在大语言模型中驱动行为与学习

Pedro Urbina-Rodriguez, Zafeirios Fountas, Fernando E. Rosas, Jun Wang, Andrea I. Luppi, Haitham Bou-Ammar, Murray Shanahan, Pedro A. M. Mediano

机构 * Department of Computing Imperial College London(帝国理工学院计算机系) Huawei Noah’s Ark Lab(华为诺亚实验室) AI Centre Department of Computer Science University College London(伦敦大学学院人工智能中心) Department of Informatics University of Sussex(Sussex大学信息学院) Centre for Complexity Science and Center for Psychedelic Research Department of Brain Science Imperial College London(帝国理工学院复杂科学中心和迷幻研究中心) Department of Psychiatry and Centre for Eudaimonia and Human Flourishing University of Oxford(牛津大学精神病学系和幸福与人类繁荣中心) Division of Information Engineering and St John’s College University of Cambridge(剑桥大学信息工程系和圣约翰学院) Montreal Neurological Institute McGill University(麦吉尔大学蒙特利尔神经科学研究所) Division of Psychology and Language Sciences University College London(伦敦大学学院心理学与语言科学系)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究发现大语言模型中自发形成的协同核心与人脑相似,通过学习产生,影响行为与学习性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19455 2026-01-09 cs.CL 77%

SiamGPT: Quality-First Fine-Tuning for Stable Thai Text Generation

SiamGPT:面向稳定泰语文本生成的质量优先微调

Thittipat Pairatsuppawat, Abhibhu Tachaapornchai, Paweekorn Kusolsomboon, Chutikan Chaiwong, Thodsaporn Chay-intr, Kobkrit Viriyayudhakorn, Nongnuch Ketui, Aslan B. Wong

机构 * iApp Technology Co., Ltd.(iApp技术有限公司) Intelligent Informatics and Service Innovation Research Center, Thailand(智能信息与服务创新研究中心,泰国) Rajamangala University of Technology Lanna Nan, Thailand(拉玛安高校技术大学兰纳纳分校,泰国) National Electronics and Computer Technology Center (NECTEC)(国家电子与计算机技术中心) Artificial Intelligence Association of Thailand (AIAT)(泰国人工智能协会)

专题命中 指令微调 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL

AI总结 SiamGPT通过质量优先策略提升泰语生成稳定性,实现指令遵循和多轮对话能力的增强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10509 2026-01-09 cs.LG 77%

From Actions to Words: Towards Abstractive-Textual Policy Summarization in RL

从动作到词语:迈向强化学习中基于抽象文本的策略摘要

Sahar Admoni, Assaf Hallak, Yftah Ziser, Omer Ben-Porat, Ofra Amir

机构 * Nvidia Research(英伟达研究)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 SySLLM通过将策略解释转化为语言生成问题,利用大型语言模型生成连贯的摘要,以解释复杂强化学习行为。

Comments In Proceedings of AAMAS 2026 (The 25th International Conference on Autonomous Agents and Multi-Agent Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04714 2026-01-09 cs.AI 77%

ThinkDrive: Chain-of-Thought Guided Progressive Reinforcement Learning Fine-Tuning for Autonomous Driving

ThinkDrive: 基于链式推理的渐进强化学习微调框架用于自动驾驶

Chang Zhao, Zheming Yang, Yunqing Hu, Qi Guo, Zijian Wang, Pengcheng Li, Wen Ji

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

AI总结 ThinkDrive通过结合显式推理与难度感知的自适应策略优化,提升了自动驾驶中的决策透明度和泛化能力,实验显示其在多个指标上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02983 2026-01-07 cs.SD cs.AI 77%

Interpretable All-Type Audio Deepfake Detection with Audio LLMs via Frequency-Time Reinforcement Learning

通过频率-时间强化学习实现可解释的多类型音频深度伪造检测

Yuankun Xie, Xiaoxuan Guo, Jiayi Zhou, Tao Wang, Jian Liu, Ruibo Fu, Xiaopeng Wang, Haonan Cheng, Long Ye

机构 * Communication University of China(中国通信大学) Machine Intelligence, Ant Group(蚂蚁集团机器智能部) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

AI总结 本文提出FT-GRPO方法,通过频率-时间强化学习实现多类型音频深度伪造检测的可解释性与高性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02128 2026-01-06 cs.CL eess.AS 77%

Towards Multi-Level Transcript Segmentation: LoRA Fine-Tuning for Table-of-Contents Generation

迈向多级转录分割:LoRA微调用于目录生成

Steffen Freisinger, Philipp Seeberger, Thomas Ranzenberger, Tobias Bocklet, Korbinian Riedhammer

机构 * Technische Hochschule Nürnberg(纽伦堡技术大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

AI总结 本文提出基于LoRA微调的多级转录分割方法,通过整合语音停顿特征,提升主题和子主题边界识别的准确性。

Comments Published in Proceedings of Interspeech 2025. Please cite the proceedings version (DOI: 10.21437/Interspeech.2025-2792)

Journal ref Proceedings of Interspeech 2025, pp. 276-280

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24615 2026-01-01 cs.AI 77%

Youtu-Agent: Scaling Agent Productivity with Automated Generation and Hybrid Policy Optimization

Youtu-Agent:通过自动化生成和混合策略优化提升代理生产力

Yuchen Shi, Yuzheng Cai, Siqi Cai, Zihan Xu, Lichao Chen, Yulei Qin, Zhijian Zhou, Xiang Fei, Chaofan Qiu, Xiaoyu Tan, Gang Li, Zongyi Li, Haojia Lin, Guocan Cai, Yong Mao, Yunsheng Wu, Ke Li, Xing Sun

机构 * Youtu-Agent Team(优图代理团队)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Youtu-Agent通过自动化生成和混合策略优化提升LLM代理的生产力和性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24271 2026-01-01 cs.CV cs.AI 77%

Taming Hallucinations: Boosting MLLMs' Video Understanding via Counterfactual Video Generation

驯服幻觉:通过反事实视频生成提升MLLMs的视频理解

Zhe Huang, Hao Wen, Aiming Hao, Bingze Song, Meiqi Wu, Jiahong Wu, Xiangxiang Chu, Sheng Lu, Haoqian Wang

机构 * Tsinghua University(清华大学) Beihang University(北航) AMAP, Alibaba Group(阿里妈妈实验室,阿里巴巴集团)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

AI总结 通过反事实视频生成和对比训练,提升MLLMs对视频的理解能力并减少幻觉。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04903 2026-01-01 cs.CL 77%

ACE-RL: Adaptive Constraint-Enhanced Reward for Long-form Generation Reinforcement Learning

ACE-RL:自适应约束增强的长形式生成强化学习

Jianghao Chen, Wei Sun, Qixiang Yin, Zhixing Tan, Jiajun Zhang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Zhongguancun Academy, Beijing, China(中关村学院,北京,中国) Tsinghua University(清华大学) Wuhan AI Research(武汉人工智能研究所)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

AI总结 ACE-RL通过自适应约束增强的强化学习方法,提升长形式生成任务的训练效果,实验显示在WritingBench上优于现有基线模型。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21218 2025-12-30 cs.CL 77%

Can Finetuing LLMs on Small Human Samples Increase Heterogeneity, Alignment, and Belief-Action Coherence?

能否通过在小样本人类数据上微调LLM增加异质性、对齐性和信念-行为一致性?

Steven Wang, Kyle Hunt, Shaojie Tang, Kenneth Joseph

机构 * Department of Management Science and Systems, University at Buffalo(管理科学与系统系,布法罗大学) Department of Computer Science and Engineering, University at Buffalo(计算机科学与工程系,布法罗大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究探讨通过微调LLM在小样本人类数据上是否能提高模拟结果的异质性、对齐性和信念-行为一致性,发现虽有提升但无法完全替代人类数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20140 2025-12-24 cs.AI 77%

Enhancing Zero-Shot Time Series Forecasting in Off-the-Shelf LLMs via Noise Injection

通过噪声注入增强现成大语言模型在零样本时间序列预测中的性能

Xingyou Yin, Ceyao Zhang, Min Hu, Kai Chen

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出通过在时间序列数据分词前注入噪声,提升现成大语言模型在零样本时间序列预测中的性能。

Comments 9 pages,3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20062 2025-12-24 cs.CR cs.AI 77%

On the Effectiveness of Instruction-Tuning Local LLMs for Identifying Software Vulnerabilities

关于指令微调本地LLM在识别软件漏洞中的有效性

Sangryu Park, Gihyuk Ko, Homook Cho

机构 * KAIST Cyber Security Research Center(韩国科学技术院网络安全研究中心)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出通过指令微调本地LLM来提升软件漏洞识别效果,替代依赖API的大型模型,实现更高效、安全的漏洞管理。

Comments The 9th International Conference on Mobile Internet Security (MobiSec 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19297 2025-12-23 cs.CR cs.AI 77%

Causal-Guided Detoxify Backdoor Attack of Open-Weight LoRA Models

因果引导的LoRA开放权重后门攻击

Linzhi Chen, Yang Sun, Hongru Wei, Yuqi Chen

机构 * Independent Researcher(独立研究者)

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI

AI总结 本研究提出CBA框架,通过因果引导和覆盖引导技术,实现对LoRA开放权重模型的高效隐蔽后门攻击,减少假触发率并提升鲁棒性。

Comments NDSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10713 2025-12-23 cs.SE cs.AI 77%

PACIFIC: a framework for generating benchmarks to check Precise Automatically Checked Instruction Following In Code

PACIFIC:用于检查精确自动指令遵循的代码基准生成框架

Itay Dreyfuss, Antonio Abu Nassar, Samuel Ackerman, Axel Ben David, Eitan Farchi, Rami Katan, Orna Raz, Marcel Zalmanovici

机构 * IBM Research(IBM研究)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PACIFIC框架通过生成具有明确预期输出的基准,评估LLM在代码指令遵循和dry运行能力上的表现,提供了一种抗污染且可扩展的评估方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18686 2025-12-22 cs.LG 77%

Hierarchical Multimodal LLMs with Semantic Space Alignment for Enhanced Time Series Classification

具有语义空间对齐的层次多模态大语言模型用于增强的时间序列分类

Xiaoyu Tao, Tingyue Pan, Mingyue Cheng, Yucong Luo, Qi Liu, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 HiTime通过层次多模态大语言模型和语义空间对齐,提升时间序列分类的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11930 2025-12-16 cs.CY cs.AI 77%

Evolutionary Reinforcement Learning based AI tutor for Socratic Interdisciplinary Instruction

基于进化强化学习的AI导师用于苏格拉底跨学科教学

Mei Jiang, Haihai Shen, Zhuo Luo, Bingdong Li, Wenjing Hong, Ke Tang, Aimin Zhou

机构 * East China Normal University(华东师范大学) Shenzhen University(深圳大学) Southern University of Science and Technology(南方科技大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

AI总结 本文提出ERL4SIIP框架,通过动态学生模拟器、分层奖励机制和LoRA-Division优化策略,解决苏格拉底跨学科教学中的认知建模、奖励稀疏性和策略多样性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24379 2025-12-15 cs.CV cs.AI 77%

Any2Caption:Interpreting Any Condition to Caption for Controllable Video Generation

Any2Caption:任何条件到字幕以实现可控视频生成

Shengqiong Wu, Weicai Ye, Jiahao Wang, Quande Liu, Xintao Wang, Pengfei Wan, Di Zhang, Kun Gai, Shuicheng Yan, Hao Fei, Tat-Seng Chua

机构 * Kuaishou Technology(快手科技) National University of Singapore(新加坡国立大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.AI

AI总结 Any2Caption通过多模态大语言模型实现任何条件到字幕的可控视频生成,提升视频生成的可控性和质量。

Comments Project Page: https://sqwu.top/Any2Cap/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10545 2025-12-12 cs.CL 77%

XDoGE: Multilingual Data Reweighting to Enhance Language Inclusivity in LLMs

XDoGE: 多语言数据重新加权以增强大语言模型中的语言包容性

Iñaki Lacunza, José Javier Saiz, Alexander Shvets, Aitor Gonzalez-Agirre, Marta Villegas

机构 * Language Technologies Lab(语言技术实验室) Barcelona Supercomputing Center(巴塞罗那超级计算中心)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 XDoGE通过多语言数据重新加权提升大语言模型的语言包容性,优化语言分布并改进模型性能。

Comments Accepted and presented at the LLMs4All workshop at the IEEE BigData 2025 Conference, Macau - December 8-11, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09006 2025-12-11 cs.SE cs.AI cs.CR 77%

Llama-based source code vulnerability detection: Prompt engineering vs Fine tuning

基于Llama的源代码漏洞检测:提示工程与微调

Dyna Soumhane Ouchebara, Stéphane Dupont

机构 * University of Mons(蒙斯大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

AI总结 本研究探讨了基于Llama模型的源代码漏洞检测方法,比较了提示工程与微调技术的效果,提出双微调方法并评估其性能。

Comments 20 pages, Accepted at ESORICS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03746 2025-12-04 cs.CV cs.CL 77%

Thinking with Programming Vision: Towards a Unified View for Thinking with Images

通过编程视觉思考:迈向图像思考的统一视角

Zirun Guo, Minjie Hong, Feng Zhang, Kai Jia, Tao Jin

机构 * Zhejiang University(浙江大学) ByteDance BandAI(字节跳动BandAI)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

AI总结 CodeVision提出一种灵活的代码作为工具框架,通过两阶段训练提升模型对图像变化和多工具推理的鲁棒性,实验显示显著提升性能并促进新兴能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17636 2025-12-03 cs.CV cs.AI 77%

Aligning Diffusion Models with Noise-Conditioned Perception

对扩散模型进行噪声条件感知对齐

Alexander Gambashidze, Anton Kulikov, Yuriy Sosnin, Ilya Makarov

机构 * Artificial Intelligence Research Institute (AIRI)(人工智能研究 institute(AIRI)) Skolkovo Institute of Science and Technology(斯克尔科沃科学与技术研究所) HSE University(俄罗斯高等经济学院) Research Center for Trusted Artificial Intelligence, ISP RAS(可信人工智能研究中心,信息与通信技术研究院) ISP RAS(信息与通信技术研究院)

专题命中 指令微调 :language model(abstract);SFT(abstract);preference optimization(abstract);分类 cs.AI

AI总结 本研究提出在扩散模型的U-Net嵌入空间中使用感知目标,以提升人类偏好对齐的效率和质量,并减少计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02358 2025-12-03 cs.AI 77%

Beyond Playtesting: A Generative Multi-Agent Simulation System for Massively Multiplayer Online Games

超越试玩:一种生成式多智能体仿真系统用于大规模多人在线游戏

Ran Zhang, Kun Ouyang, Tiancheng Ma, Yida Yang, Dong Fang

机构 * independent researcher(独立研究者)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

AI总结 本文提出了一种基于生成式多智能体仿真的系统,利用大型语言模型优化大规模多人在线游戏的数值设计,提升玩家体验并提高优化效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00670 2025-12-02 cs.AI 77%

EDIT: Early Diffusion Inference Termination for dLLMs Based on Dynamics of Training Gradients

EDIT:基于训练梯度动态的早期扩散推理终止用于dLLMs

He-Yen Hsieh, Hong Wang, H. T. Kung

机构 * CISPA Harvard University(哈佛大学) Intel Corporation(英特尔公司)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

AI总结 EDIT通过利用训练梯度动态,在保持准确性的同时减少dLLM推理步骤,提升效率。

Comments 22 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21698 2025-12-01 cs.MM cs.AI 77%

TIP and Polish: Text-Image-Prototype Guided Multi-Modal Generation via Commonality-Discrepancy Modeling and Refinement

TIP和Polish:通过共同性-差异性建模与细化的文本-图像-原型引导的多模态生成

Zhiyong Ma, Jiahao Chen, Qingyuan Chuai, Zhengping Li

专题命中 指令微调 :LLM(abstract);language model(abstract);SFT(abstract);分类 cs.AI

AI总结 TIPPo通过共同性-差异性建模与细化,提升多模态生成的主题一致性和风格一致性。

Comments Submitted to ICASSP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17927 2025-11-25 cs.CV cs.AI 77%

PA-FAS: Towards Interpretable and Generalizable Multimodal Face Anti-Spoofing via Path-Augmented Reinforcement Learning

PA-FAS: 向可解释和通用的多模态人脸反伪装迈进:通过路径增强强化学习

Yingjie Ma, Xun Lin, Yong Xu, Weicheng Xie, Zitong Yu

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

AI总结 PA-FAS通过路径增强强化学习提升多模态人脸反伪装的可解释性和泛化能力。

Comments Accepted by AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03138 2025-11-18 cs.AI 77%

DeepKnown-Guard: A Proprietary Model-Based Safety Response Framework for AI Agents

Qi Li, Jianjun Xu, Pingtao Wei, Jiu Li, Peiqiang Zhao, Jiwei Shi, Xuan Zhang, Yanhui Yang, Xiaodong Hui, Peng Xu, Wenqin Shao

机构 * Beijing Caizhi Tech(北京彩智科技)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏