arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12193 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12193 篇

2603.11501 2026-03-17 cs.LG cs.AI cs.CR 79%

KEPo: Knowledge Evolution Poison on Graph-based Retrieval-Augmented Generation

KEPo:基于图的检索增强生成中的知识演化毒化

Qizhi Chen, Chao Qi, Yihong Huang, Muquan Li, Rongzheng Wang, Dongyang Zhang, Ke Qin, Shuang Liang

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出KEPo攻击方法,针对图检索增强生成系统,通过演化知识路径注入毒化信息,提升攻击效果,实验显示其在单目标和多目标攻击中均表现优异。

Comments Accepted in the ACM Web Conference 2026 (WWW 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13461 2026-03-17 cs.CR cs.AI cs.LG 79%

Purifying Generative LLMs from Backdoors without Prior Knowledge or Clean Reference

从后门中净化生成式大语言模型而不依赖先验知识或干净参考

Jianwei Li, Jung-Eun Kim

机构 * Department of Computer Science(计算机科学系)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种无需先验知识或干净参考的生成式大语言模型净化框架,通过分析后门关联在MLP层中的冗余编码,设计免疫启发的消除方法,通过合成后门变体和对比清洁版本,发现共享的后门签名,从而净化模型以抵御多种后门攻击。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07766 2026-03-10 cs.CL cs.AI 79%

QuadAI at SemEval-2026 Task 3: Ensemble Learning of Hybrid RoBERTa and LLMs for Dimensional Aspect-Based Sentiment Analysis

QuadAI在SemEval-2026任务3中的表现:混合RoBERTa与LLMs的集成学习用于维度方面基于情感分析

A. J. W. de Vink, Filippos Karolos Ventirozos, Natalia Amat-Lefort, Lifeng Han

机构 * LIACS, Leiden University, NL(莱顿大学LIACS研究中心) Manchester Metropolitan University(曼彻斯特 Metropolitan 大学) Leiden University Medical Center(莱顿大学医学中心)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 QuadAI通过集成混合RoBERTa与LLMs的方法,在SemEval-2026任务3中实现了维度方面基于情感分析的高性能表现。

Comments SemEval System Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04548 2026-03-06 cs.CL cs.AI 79%

Identifying Good and Bad Neurons for Task-Level Controllable LLMs

识别用于任务级可控大语言模型的好神经元和坏神经元

Wenjie Li, Guansong Pang, Hezhe Qiao, Debin Gao, David Lo

机构 * Singapore Management University(新加坡管理大学) ShanghaiTech University(上海科技大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 NeuronLLM通过对比学习识别任务级可控大语言模型中的好神经元和坏神经元,以提升任务表现和理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01824 2026-03-03 cs.CL cs.LG 79%

OpenAutoNLU: Open Source AutoML Library for NLU

OpenAutoNLU: 开源自然语言理解自动机器学习库

Grigory Arshinov, Aleksandr Boriskin, Sergey Senichev, Ayaz Zaripov, Daria Galimzianova, Daniil Karpov, Leonid Sanochkin

机构 * MWS AI ITMO University(ITMO大学) MBZUAI

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 OpenAutoNLU是一个开源的自动机器学习库,提供自然语言理解任务的文本分类和命名实体识别功能,通过数据感知的训练制度选择和低代码API实现高效自动化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05085 2026-02-26 cs.CL cs.AI cs.IR 79%

Multi-Head RAG: Solving Multi-Aspect Problems with LLMs

多头RAG:利用LLMs解决多方面问题

Maciej Besta, Ales Kubicek, Robert Gerstenberger, Marcin Chrapek, Roman Niggli, Patrik Okanovic, Yi Zhu, Patrick Iff, Michal Podstawski, Lucas Weitzendorf, Mingyuan Chi, Joanna Gajda, Piotr Nyczyk, Jürgen Müller, Hubert Niewiadomski, Torsten Hoefler

机构 * Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系) IDEAS Research Institute(IDEAS研究 institute) NASK National Research Institute(国家研究 institute)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 多头RAG通过利用Transformer多头注意力机制提升多方面查询的检索准确性,实现更高的检索成功率和下游生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17483 2026-02-20 cs.HC cs.AI cs.CL cs.CY 79%

What Do LLMs Associate with Your Name? A Human-Centered Black-Box Audit of Personal Data

LLMs与你的名字关联什么?对个人数据的人本黑盒审计

Dimitri Staufer, Kirsten Morehouse

机构 * Columbia University(哥伦比亚大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究通过LMP2工具审计LLMs对个人数据的关联,发现模型能准确生成用户特征,引发对数据隐私权在LLMs中的适用性讨论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15322 2026-02-18 cs.LG cs.AI 79%

On Surprising Effectiveness of Masking Updates in Adaptive Optimizers

自适应优化器中掩码更新的意外有效性

Taejong Joo, Wenhan Xia, Cheolmin Kim, Ming Zhang, Eugene Ie

机构 * Northwestern University(西北大学) Google(谷歌)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 Magma通过动量对齐梯度掩码提升自适应优化器性能,显著降低大型语言模型的困惑度。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00187 2026-02-17 cs.CL cs.CR cs.LG 79%

Steering Dialogue Dynamics for Robustness against Multi-turn Jailbreaking Attacks

引导对话动态以对抗多轮劫持攻击

Hanjiang Hu, Alexander Robey, Changliu Liu

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本研究提出基于安全控制理论的神经屏障函数,通过状态空间建模和安全预测器,有效防御多轮劫持攻击,提升对话安全性与实用性。

Comments TMLR, 31 pages, 11 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18008 2026-02-17 cs.HC cs.AI cs.CL 79%

Through the Lens of Human-Human Collaboration: A Configurable Research Platform for Exploring Human-Agent Collaboration

通过人类-人类协作的视角:一个可配置的研究平台,用于探索人类-智能体协作

Bingsheng Yao, Jiaju Chen, Chaoran Chen, April Wang, Toby Jia-jun Li, Dakuo Wang

机构 * Northeastern University(东北大学) Rice University(里士满大学) University of Notre Dame(诺特难大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一个可配置的研究平台,用于探索人类与大语言模型代理之间的协作,通过三个案例研究验证了平台在人机协作研究中的有效性。

Comments Accepted at CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02872 2026-02-16 cs.CL cs.LG 79%

Highlight & Summarize: RAG without the jailbreaks

突出与总结:无需劫持的RAG

Giovanni Cherubin, Andrew Paverd

机构 * Microsoft Security Response Center(微软安全响应中心)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 H&S通过设计防止LLM劫持,采用分阶段处理方式,确保生成模型不接触用户问题,提升问答任务的准确性和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12546 2026-02-16 eess.AS cs.AI cs.CL cs.SD 79%

Decoder-only Conformer with Modality-aware Sparse Mixtures of Experts for ASR

仅解码器的Conformer结合模态感知的稀疏专家混合

Jaeyoung Lee, Masato Mimura

机构 * NTT, Inc., Japan(日本NTT公司)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种仅解码器的Conformer模型,通过模态感知的稀疏混合专家实现更高效的ASR,减少了参数使用并提升了识别准确率。

Comments Accepted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12305 2026-02-16 cs.LG cs.AI cs.DC cs.MA cs.SE 79%

OptiML: An End-to-End Framework for Program Synthesis and CUDA Kernel Optimization

OptiML:一种端到端的程序合成与CUDA内核优化框架

Arijit Bhattacharjee, Heng Ping, Son Vu Le, Paul Bogdan, Nesreen K. Ahmed, Ali Jannesari

机构 * Iowa State University, Ames, Iowa, USA(爱荷华州立大学) Cisco AI Research, San Jose, California, USA(思科人工智能研究) University of Southern California, Los Angeles, California, USA(南加州大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 OptiML通过端到端框架将自然语言意图或输入代码转化为高性能CUDA内核,结合搜索与验证技术实现优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22208 2026-02-05 cs.CL cs.CV cs.LG 79%

Open-Source Multimodal Moxin Models with Moxin-VLM and Moxin-VLA

开源多模态Moxin模型:Moxin-VLM和Moxin-VLA

Pu Zhao, Arash Akbari, Xuan Shen, Zhenglun Kong, Yixin Shen, Sung-En Chang, Timothy Rupprecht, Lei Lu, Enfu Nan, Changdi Yang, Yumei He, Weiyan Shi, Xingchen Xu, Yu Huang, Wei Jiang, Wei Wang, Yue Chen, Yong He, Yanzhi Wang

机构 * Northeastern University(东北大学) Harvard University(哈佛大学) Cornell University(康奈尔大学) Tulane University(路易斯安那州立大学) University of Washington(华盛顿大学) Futurewei(未来通信) AIBAO LLC

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出开源多模态Moxin模型,通过Moxin-VLM、Moxin-VLA和Moxin-Chinese三种变体,提升视觉-语言、视觉-语言-动作及中文任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03468 2026-02-04 cs.AI cs.LG 79%

IntentRL: Training Proactive User-intent Agents for Open-ended Deep Research via Reinforcement Learning

IntentRL: 通过强化学习训练主动的用户意图代理以进行开放性深度研究

Haohao Luo, Zexi Li, Yuexiang Xie, Wenhao Zhang, Yaliang Li, Ying Shen

机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 IntentRL通过强化学习训练主动用户意图代理,提升开放性深度研究的意图识别与任务性能。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23361 2026-02-03 cs.SE cs.CL cs.LG 79%

SWE-Exp: Experience-Driven Software Issue Resolution

SWE-Exp:基于经验的软件问题解决

Silin Chen, Shaoxin Lin, Yuling Shi, Heng Lian, Xiaodong Gu, Longfei Yun, Dong Chen, Lin Cao, Jiyang Liu, Nu Xia, Qianxiang Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei(华为) Xidian University(西安电子科技大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 SWE-Exp通过提炼历史经验实现软件问题解决的持续学习,显著提升修复效率。

Comments Our code and data are available at https://github.com/YerbaPage/SWE-Exp

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00597 2026-02-03 cs.CL cs.AI 79%

Hermes the Polyglot: A Unified Framework to Enhance Expressiveness for Multimodal Interlingual Subtitling

赫мес:一种增强多模态跨语言字幕表达力的统一框架

Chaoqun Cui, Shijing Wang, Liangbin Huang, Qingqing Gu, Zhaolong Huang, Xiao Zeng, Wenji Mao

机构 * MAIS, Institute of Automation, Chinese Academy of Sciences Beijing China School of AI, University of\ Academy of Sciences Beijing China Beijing Jiaotong University Beijing China Geely AI lab Ningbo Zhejiang China MAIS, Institute of Automation, Chinese Academy of Sciences School of AI, University of\ Academy of Sciences Beijing Jiaotong University Geely AI lab

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 赫мес通过整合说话人分离、术语识别和表达力增强模块,提升了多模态跨语言字幕的表达力和连贯性,实现了最先进的字幕生成性能。

Comments Accepted to The Web Conference (WWW) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04347 2026-02-03 cs.CL cs.AI 79%

SCALM: Detecting Bad Practices in Smart Contracts Through LLMs

SCALM:通过LLMs检测智能合约中的不良实践

Zongwei Li, Xiaoqi Li, Wenkai Li, Xin Wang

机构 * Zongwei Li, Xiaoqi Li, Wenkai Li, Xin Wang(作者)

专题命中 其他LLM :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 SCALM通过结合Step-Back提示和RAG技术,有效检测智能合约中的不良实践,优于现有工具。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20731 2026-01-29 cs.CL cs.AI cs.CY 79%

QueerGen: How LLMs Reflect Societal Norms on Gender and Sexuality in Sentence Completion Tasks

QueerGen:LLMs在句子完成任务中如何反映性别和性取向的社会规范

Mae Sosto, Delfina Sol Martinez Pandiani, Laura Hollink

机构 * Centrum Wiskunde & Informatica(荷兰数学与信息学中心) Universiteit van Amsterdam(阿姆斯特丹大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 QueerGen研究LLMs在句子完成任务中对性别和性取向的社会规范反映,揭示模型在不同主体类别中的偏见表现及影响因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18255 2026-01-27 cs.LG cs.AI 79%

Beyond Retention: Orchestrating Structural Safety and Plasticity in Continual Learning for LLMs

超越保留:在连续学习中协调结构安全与可塑性

Fei Meng

机构 * Yangtze Delta Region Institute of Tsinghua University(清华大学 Yangtze Delta 区研究所)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出OSW方法,通过正交子空间唤醒协调连续学习中的结构安全与可塑性,有效保留脆弱任务能力并维持新任务学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14798 2026-01-22 cs.LG cs.CL cs.CY 79%

Reflecting in the Reflection: Integrating a Socratic Questioning Framework into Automated AI-Based Question Generation

反思中的反思:将苏格拉底质疑框架整合到基于自动的AI问题生成中

Ondřej Holub, Essi Ryymin, Rodrigo Alves

机构 * Czech Technical University in Prague(捷克技术大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出一种基于苏格拉底质疑框架的双代理模型,通过多轮对话生成高质量反思问题,提升教学效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07690 2026-01-22 cs.CL cs.AI 79%

LoSemB: Logic-Guided Semantic Bridging for Inductive Tool Retrieval

LoSemB:基于逻辑的语义桥接用于归纳工具检索

Luyao Zhuang, Qinggang Zhang, Huachi Zhou, Yujing Zhang, Xiao Huang

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 LoSemB通过逻辑引导的语义桥接框架,在无需重新训练的情况下实现高效归纳工具检索,缓解分布偏移和相似度检索的脆弱性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10726 2026-01-19 cs.AI cs.CL 79%

Building AI Agents to Improve Job Referral Requests to Strangers

构建AI代理以提高对陌生人的求职推荐请求

Ross Chu, Yuting Huang

机构 * UC Berkeley(加州大学伯克利分校)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出利用AI代理增强求职推荐请求的撰写效果,通过检索增强生成技术提升较弱请求的成功率,同时保持较强请求的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05579 2026-01-12 cs.DB cs.AI cs.CL cs.SE 79%

RISE: Rule-Driven SQL Dialect Translation via Query Reduction

RISE: 通过查询简化实现规则驱动的SQL方言翻译

Xudong Xie, Yuwei Zhang, Wensheng Dou, Yu Gao, Ziyu Cui, Jiansen Song, Rui Yang, Jun Wei

机构 * Institute of Software at CAS, China(中国科学院软件研究所)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 RISE通过查询简化技术,利用LLM实现高效准确的SQL方言翻译,显著提升翻译准确率。

Comments Accepted by ICSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19614 2026-01-08 cs.CL cs.AI 79%

LFD: Layer Fused Decoding to Exploit External Knowledge in Retrieval-Augmented Generation

LFD: 层融合解码以利用外部知识进行检索增强生成

Yang Sun, Zhiyong Xie, Lixin Zou, Dan Luo, Min Tang, Xiangyu Zhao, Yunwei Zhao, Xixun Lin, Yanxiong Lu, Chenliang Li

机构 * Key Laboratory of Aerospace Information Security and Trusted Computing, Ministry of Education, School of Cyber Science and Engineering, Wuhan University(航空信息安全与可信计算重点实验室,教育部,武汉大学计算机科学与工程学院) Lehigh University(莱斯大学) Monash University(墨尔本大学) City University of Hong Kong(香港城市大学) CNCERT/CC(国家互联网应急中心) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Search Team, WeChat, Tencent Inc.(微信搜索团队,腾讯公司)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 LFD通过层融合解码策略,利用中层表示与最终层解码输出结合,提升RAG系统在检索外部事实性知识上的效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23676 2025-12-30 cs.AI cs.CL cs.CV 79%

Web World Models

Jichen Feng, Yifan Zhang, Chenggong Zhang, Yifu Lu, Shilong Liu, Mengdi Wang

机构 * Princeton University(普林斯顿大学) University of California(加州大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);language agent(abstract);分类 cs.CL、cs.AI

Comments Project Page: https://github.com/Princeton-AI2-Lab/Web-World-Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14715 2025-12-18 cs.LG cs.AI 79%

How a Bit Becomes a Story: Semantic Steering via Differentiable Fault Injection

一位比特如何成为故事:通过可微分故障注入实现语义引导

Zafaryab Haider, Md Hafizur Rahman, Shane Moeykens, Vijay Devabhaktuni, Prabuddha Chakraborty

机构 * University of Maine(缅因大学) Illinois State University(伊利诺伊州立大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 通过可微分故障注入分析,研究比特级扰动对生成模型语义的影响,揭示低级变化如何引导高层语义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12885 2025-12-16 cs.CV cs.AI cs.CL cs.IR cs.RO 79%

SignRAG: A Retrieval-Augmented System for Scalable Zero-Shot Road Sign Recognition

SignRAG:一种用于可扩展零样本道路标志识别的检索增强系统

Minghao Zhu, Zhihao Zhang, Anmol Sidhu, Keith Redmill

机构 * Computer Engineering The Ohio State University(计算机工程 俄亥俄州立大学) Applied Research Transportation Research Center Inc.(应用研究 交通运输研究中心公司) Computer Engineering The Ohio State University Columbus, Ohio, USA(计算机工程 俄亥俄州立大学 哥伦布俄亥俄州) Applied Research Transportation Research Center Inc. East Liberty, Ohio, USA(应用研究 交通运输研究中心公司 埃斯特利比 俄亥俄州)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 SignRAG通过检索增强生成范式实现可扩展的零样本道路标志识别,结合视觉语言模型和大型语言模型,实现高准确率的标志识别。

Comments Submitted to IV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01335 2025-12-02 cs.CR cs.AI cs.CL 79%

EmoRAG: Evaluating RAG Robustness to Symbolic Perturbations

EmoRAG:评估RAG对符号扰动的鲁棒性

Xinyun Zhou, Xinfeng Li, Yinan Peng, Ming Xu, Xuanwang Zhang, Miao Yu, Yidong Wang, Xiaojun Jia, Kun Wang, Qingsong Wen, XiaoFeng Wang, Wei Dong

机构 * ZJU Hangzhou China(浙江大学杭州校区) NTU Singapore(南洋理工大学) Hengxin Tech. Singapore(新加坡恒心科技) NUS Singapore(国立新加坡大学) NJU Nanjing China(南京大学) PKU Beijing China(北京大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 EmoRAG研究揭示RAG系统对细微表情符号扰动的鲁棒性问题,发现单个表情符号可导致检索严重误导,并提出针对性防御措施。

Comments Accepted to ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07338 2025-12-02 cs.AI cs.LG 79%

DeepPersona: A Generative Engine for Scaling Deep Synthetic Personas

DeepPersona: 一个用于扩展深度合成人设的生成引擎

Zhen Wang, Yufan Zhou, Zhongyan Luo, Lyumanshan Ye, Adam Wood, Man Yao, Saab Mansour, Luoshang Pan

机构 * UCSD(加州大学圣地亚哥分校) KU Leuven(鲁汶大学) SJTU(上海交通大学) University of Michigan(密歇根大学) Denison University(德尼森大学) Amazon(亚马逊) Meta

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 DeepPersona通过双阶段分类学引导方法生成深度合成人设,提升LLM个性化和人类模拟的准确性与多样性。

Comments add an author[Update], 12 pages, 5 figures, accepted at LAW 2025 Workshop (NeurIPS 2025) Project page: https://deeppersona-ai.github.io/

Journal ref LAW 2025 Workshop, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏