arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2602.04935 2026-06-10 cs.SE cs.AI 版本更新 70%

ASA: Backbone-Training-Free Representation Engineering for Tool-Calling Agents

ASA:无需骨干训练的工具调用智能体表示工程

Youjin Wang, Run Zhou, Yingjie Ma, Rong Fu, Jiani Liang, Shuaishuai Cao, Min Huang, Tao Fang, Liangming Pan

机构 * Renmin University of China(中国人民大学) University of Macau(澳门大学) Central South University(中南大学) Jiangxi Normal University(江西师范大学) Macau Millennium College(澳门 millennium 学院) Peking University(北京大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对大语言模型在工具调用中的惰性代理问题,提出一种无需训练、推理时激活干预的方法ASA,通过路由条件混合引导向量和探针引导门控,显著提升工具使用F1并降低误报率。

Comments The manuscript consists of 24 pages formatted in the ACL style. Youjin Wang, Run Zhou, and Yingjie Ma contributed equally to this work. Tao Fang and Liangming Pan are the co-corresponding authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08726 2026-06-10 cs.CL 版本更新 70%

Standard Language Ideology in AI-Generated Language

AI生成语言中的标准语言意识形态

Genevieve Smith, Eve Fleisig, Ishita Rustagi, Xavier Yin

机构 * Stanford University(斯坦福大学) UC Berkeley(加州大学伯克利分校)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出一个分类法,揭示大型语言模型如何强化标准语言意识形态,导致语言变体的边缘化,并讨论其社会影响及应对建议。

Comments To appear in the 2026 ACM Conference on Fairness, Accountability, and Transparency (FAccT '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08806 2026-06-09 cs.SE cs.AI 新提交 70%

Governance Controls for AI-Generated Test Artifacts in Autonomous Software Testing

自主软件测试中AI生成测试工件的治理控制

Dimple Bajaj, Deepak Khetan

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出治理感知自主测试框架(GATF),通过治理验证、可解释性分析、风险评估、合规监控和审计治理,将AI生成测试工件的治理风险降低89.6%,准确率达94.3%。

Comments 21 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06342 2026-06-05 stat.ML cs.LG 70%

Symmetric Divergence and Normalized Similarity: A Unified Topological Framework for Representation Analysis

对称散度与归一化相似性:表示分析的统一拓扑框架

Yan Wang, Tianyang Hu

机构 * School of Data Science, The Chinese University of Hong Kong, Shenzhen(数据科学学院,香港中文大学(深圳))

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 提出对称表示拓扑散度(SRTD)和归一化拓扑相似性(NTS),分别解决现有拓扑散度的非对称性和无界性问题,实现细粒度结构诊断与跨场景标准化评估。

Comments Accepted by TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16311 2026-06-05 stat.ML cs.LG stat.ME 70%

Generator-Mediated Bandits: Thompson Sampling for GenAI-Powered Adaptive Interventions

生成器介导的老虎机:面向生成式人工智能的自适应干预的汤普森采样

Marc Brooks, Gabriel Durham, Kihyuk Hong, Ambuj Tewari

机构 * Department of Statistics, University of Michigan, Ann Arbor, MI (USA)(密歇根大学统计学系,安阿伯,MI (美国))

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出了一种生成器介导的老虎机算法(GAMBITTS),用于解决生成式人工智能(GenAI)驱动的自适应干预问题。该算法通过建模治疗和奖励生成过程,利用观察到的治疗信息加速策略学习,并在模拟研究中优于传统算法。

Comments 39 pages, 12 figures

Journal ref Advances in Neural Information Processing Systems 38 (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04612 2026-06-04 cs.CL 70%

Hybrid Adversarial Defence for Natural Language Understanding Tasks

混合对抗防御用于自然语言理解任务

Manar Abouzaid, Yang Wang, Chenghua Lin, Stuart E. Middleton

机构 * School of Electronics and Computer Science, University of Southampton, UK(南安普顿大学电子与计算机科学学院) Department of Computer Science, University of Manchester, UK(曼彻斯特大学计算机科学系)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出一种结合熵、不确定性和几何特征的混合防御框架,在多个自然语言理解数据集上同时提升了干净任务性能和对抗鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03799 2026-06-04 cs.CL cs.SY eess.SY 70%

Enhancing Hallucination Detection through Noise Injection

通过噪声注入增强幻觉检测

Litian Liu, Reza Pourreza, Sunny Panchal, Apratim Bhattacharyya, Yubing Jian, Yao Qin, Roland Memisevic

机构 * Qualcomm AI Research(高通人工智能研究)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出一种基于贝叶斯模型不确定性的无训练噪声注入方法,通过扰动模型参数或隐藏单元激活来改进采样过程,显著提升大语言模型幻觉检测性能。

Comments ICLR 2026 main conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17064 2026-06-04 cs.AI 70%

BRAINCELL-AID: An Agentic AI Created Brain Cell Type Resource for Community Annotation

BRAINCELL-AID:用于社区注释的由AI代理创建的脑细胞类型资源

Rongbin Li, Wenbo Chen, Zhao Li, Rodrigo Munoz-Castaneda, Jinbo Li, Neha S. Maurya, Arnav Solanki, Huan He, Hanwen Xing, Meaghan Ramlakhan, Zachary Wise, Nelson Johansen, Zhuhao Wu, Hua Xu, Michael Hawrylycz, W. Jim Zheng

机构 * McWilliams School of Biomedical Informatics, University of Texas Health Science Center at Houston(德克萨斯大学健康科学中心休斯顿分校麦克威廉斯生物医学信息学学院) Appel Alzheimer’s Disease Research Institute, Feil Family Brain and Mind Research Institute, Weill Cornell Medicine(艾伯神经变性病研究机构、费尔家庭脑与心灵研究机构、韦尔·科恩医学中心) Department of Biomedical Informatics and Data Science, School of Medicine, Yale University(耶鲁大学医学院生物医学信息学与数据科学系) Allen Institute for Brain Science(艾伦脑科学研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出一种多智能体AI系统BRAINCELL-AID,结合检索增强生成和自由文本描述与本体标签,实现对单细胞RNA测序数据中基因集注释的准确性和鲁棒性提升,并应用于小鼠脑细胞图谱的注释。

Comments 23 pages, 6 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03486 2026-06-03 cs.CR cs.AI 70%

NeuroArmor: Safe-Variant-Guided Representation Consistency for Selective Re-Anchoring in Jailbreak Defense

NeuroArmor:基于安全变体引导的表示一致性实现越狱防御中的选择性重新锚定

Zhongyang Lin, Ziran Zhao, Feifei Zhai, Pengyuan Liu

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出NeuroArmor白盒运行时防御方法,通过为每个提示构建安全变体作为局部安全参考,在隐藏状态空间进行一致性检查并路由异常,有效降低恶意攻击成功率同时保持低误报率。

Comments 16 pages, 4 figures, 17 tables. Submitted to ACL ARR

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03179 2026-06-03 cs.CL 70%

HyperPatch: Sequential Knowledge Editing Under n-ary Structural Drift

HyperPatch: n元结构漂移下的顺序知识编辑

Yu-Kai Chan, Wen-Sheng Lien, Dong-Ting Yao, Bo-Kai Ruan, Kwan-Yeung Lin, Hong-Han Shuai, Meng-Fen Chiang

机构 * National Yang Ming Chiao Tung University

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对非平稳环境中n元事件顺序更新引发的结构漂移问题,提出HyperPatch框架,通过超图流形上的稳定性建模,实现参数保留的知识编辑,在MQuAKE-CF和MQuAKE-T基准上分别取得96.24%和21.06%的跳步准确率相对提升。

Comments Accepted to Proceedings of the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01471 2026-06-03 cs.IR cs.LG 70%

Reconstructing Content with Collaborative Attention for Universal Multimodal Representation Learning

通过协同注意力重建内容以提升多模态嵌入质量

Jiahan Chen, Da Li, Hengran Zhang, Yinqiong Cai, Lixin Su, Jiafeng Guo, Daiting Shi, Dawei Yin, Keping Bi

机构 * State Key Laboratory of AI Safety(人工智能安全国家重点实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Baidu Inc.(百度公司)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出CoCoA预训练范式,通过重构注意力流和基于EOS的重建任务,利用协同注意力优化多模态嵌入,使模型将输入语义压缩到<EOS>令牌中,从而提升嵌入质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10322 2026-06-03 cs.CL 70%

Evaluating the Reversal Curse in Model Editing

评估模型编辑中的逆转诅咒

Hao-Xiang Xu, Jun-Yu Ma, Zhen-Hua Ling, Quan Liu, Cong Liu, Jia-Chen Gu

机构 * National Engineering Research Center of Speech and Language Information Processing(语音与语言信息处理国家级工程研究中心) University of Science and Technology of China(中国科学技术大学) iFLYTEK Research(iFLYTEK研究院) University of California, Los Angeles(美国加州大学洛杉矶分校)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文研究双向语言模型编辑,提出反向泛化指标并构建BAKE基准,发现多数编辑方法在反向评估中存在系统性缺陷,并分析逆转诅咒的成因及缓解策略。

Comments Accepted by TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01610 2026-06-02 cs.AI 70%

Revisiting Ripple Effects in Knowledge Editing through Pressure-Aware Joint Neighborhood Optimization

重新审视知识编辑中的涟漪效应:通过压力感知联合邻域优化

Haoben Huang, Shuxin Liu, Ou Wu, Di Gao

机构 * Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(杭州高等研究院,中国科学院大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对大语言模型单次编辑引发的涟漪效应,提出联合邻域优化框架,通过压力感知协调和语义预执行门控联合优化可编辑侧与保留侧的耦合压力,在RippleEdits上传播与保留指标提升至少7.0%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01053 2026-06-02 cs.AI 70%

AnyEdit++: Adaptive Long-Form Knowledge Editing via Bayesian Surprise

AnyEdit++: 基于贝叶斯惊讶的自适应长文本知识编辑

Bowen Tian, Caixue He, Jiemin Wu, Jingying Wang, Wenshuo Chen, Zexi Li, Yutao Yue

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出AnyEdit++框架,通过基于贝叶斯惊讶的自适应分割机制Bayes-Chunk,实现结构感知的长文本知识编辑,在数学推理、代码生成和叙事任务上优于现有方法。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01033 2026-06-02 cs.AI 70%

TriLens: Per-Layer Logit-Lens Entropy for White-Box Hallucination Detection

TriLens: 基于逐层Logit-Lens熵的白盒幻觉检测

Bohan Yang, Yijun Gong, Zhi Zhang, Ge Zhang, Wenpeng Xing, Meng Han

机构 * Binjiang Institute of Zhejiang University(浙江大学滨海学院) Beijing Normal-Hong Kong Baptist University(北京师范大学-香港 Baptist大学) Zhejiang University(浙江大学) GenTel.io Great Bay University(Great Bay大学)

专题命中 知识编辑与模型理解 :LLM(abstract_cn);language model(abstract);分类 cs.AI

AI总结 提出TriLens方法,通过在每个Transformer层读取多头自注意力、前馈网络和残差流的logit-lens输出熵,构建紧凑的3L维轨迹,有效检测大语言模型幻觉。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06841 2026-06-02 cs.AI 70%

From Features to Actions: Explainability in Traditional and Agentic AI Systems

从特征到行动:传统与智能体AI系统中的可解释性

Sindhuja Chaduvula, Jessee Ho, Kina Kim, Aravind Narayanan, Ahmed Y. Radwan, Mahshid Alinoori, Muskan Garg, Dhanesh Ramachandram, Shaina Raza

机构 * Vector Institute for Artificial Intelligence(向量人工智能研究所) Independent Researcher(独立研究者) Mayo Clinic(梅奥诊所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文比较了基于归因的解释与基于轨迹的诊断在静态和智能体设置中的效果,发现归因方法无法可靠诊断智能体轨迹中的执行级故障,而轨迹级可解释性更能定位行为故障。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00742 2026-06-02 cs.CL 70%

CURP: Codebook-based Continuous User Representation for Personalized Generation with LLMs

CURP: 基于码本的连续用户表示用于大语言模型的个性化生成

Liang Wang, Xinyi Mou, Xiaoyou Liu, Xuanjing Huang, Zhongyu Wei

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Shanghai Innovation Institute(上海创新研究院) School of Computer Science, Fudan University(复旦大学计算机科学学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出CURP框架,通过双向用户编码器和离散原型码本提取多维用户特征,实现少量可训练参数的即插即用个性化生成,在变体生成任务上优于强基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31561 2026-06-01 cs.CL 70%

What Am I Missing? Question-Answering as Hidden State Probing

我遗漏了什么?将问答作为隐藏状态探测

Chu Fei Luo, Samuel Dahan, Xiaodan Zhu

机构 * Department of Electrical and Computer Engineering & Ingenuity Labs, Queen’s University(电子与计算机工程系及Ingenuity实验室,女王大学) Conflict Analytics Lab, Queen’s University(冲突分析实验室,女王大学) Cornell Law School(康奈尔法学院) Vector Institute for AI(人工智能向量研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出将问答作为推理时干预手段,通过学生-教师框架探测隐藏状态,发现提问前的隐藏状态可预测最终正确性,并设计门控策略优化提问时机。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31497 2026-06-01 cs.LG stat.ML 70%

Assign and Add: A Mechanistic Study of Compositional Arithmetic

Assign and Add: 组合算术的机制研究

Brady Exoo, Alberto Bietti, John Sous

机构 * Yale University(耶鲁大学) Flatiron Institute(Flatiron研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 通过变量赋值和模加法任务,研究Transformer中组合泛化的机制,发现模型利用同一模加法模块处理直接和间接输入,并揭示了三阶段学习动态。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28990 2026-05-29 cs.LG 70%

Learning Robust and Task-Invariant Functional Representation from fMRI through Siamese Self-Supervised Learning

通过孪生自监督学习从fMRI中学习鲁棒且任务不变的功能表示

Jiyao Wang, Peiyu Duan, Nicha C. Dvornek, Lawrence H. Staib, Denis Sukhodolsky, Pamela Ventola, James S. Duncan

机构 * organization= Department of Biomedical Engineering , addressline= Yale University , city= New Haven , state= CT , country= USA organization= Radiology \& Biomedical Imaging , addressline= Yale School of Medicine , city= New Haven , state= CT , country= USA organization= Electrical Engineering , addressline= Yale University , city= New Haven , state= CT , country= USA organization= Child Study Center , addressline= Yale School of Medicine , city= New Haven , state= CT , country= USA

专题命中 知识编辑与模型理解 :foundation model(abstract);pretraining(abstract);分类 cs.LG

AI总结 提出轻量级自监督框架BrainSimSiam,利用正样本对学习鲁棒且通用的fMRI表示,在多个下游任务中超越全监督基线,接近大规模模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02116 2026-05-29 cs.LG 70%

Statistical Consistency and Generalization of Contrastive Representation Learning

对比表示学习的统计一致性与泛化性

Yuanfan Li, Xiyuan Wei, Tianbao Yang, Yiming Ying

机构 * University of Sydney Texas A\&M University

专题命中 知识编辑与模型理解 :language model(abstract);foundation model(abstract);分类 cs.LG

AI总结 本文提出统一的统计学习理论,证明对比损失与最优排序统计一致,并推导出随负样本数增加而改善的泛化界,解释了大负样本集的经验优势。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28388 2026-05-28 cs.AI 70%

Mechanistically Interpreting the Role of Sample Difficulty in RLVR for LLMs

机制性解释样本难度在RLVR中对大语言模型的作用

Yue Cheng, Jiajun Zhang, Xiaohui Gao, Weiwei Xing, Zheng Wang, Zhanxing Zhu

机构 * Beijing Jiaotong University(北京交通大学) AntGroup(蚂蚁集团) Northwestern Polytechnical University(西北工业大学) University of Leeds(利兹大学) University of Southampton(南安普顿大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过难度维度和单样本分析,发现样本难度对RLVR有非单调影响,中等难度问题提供最稳定的推理改进,并基于此提出难度自适应策略。

Comments 30 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27993 2026-05-28 cs.CL 70%

Rethinking Visual Neglect: Steering via Context-Preference for MLLM Hallucination Mitigation

重新思考视觉忽视:通过上下文偏好引导缓解MLLM幻觉

Jingwen Wu, Xijun Zhang, Ge Song

机构 * School of Computer and Electronic Information, Nanjing Normal University(计算机与电子信息学院,南京师范大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对多模态大语言模型的物体幻觉问题,提出无需训练的上下文偏好激活引导框架(CAS),通过提取上下文偏好向量并在中间早期MLP层注入符号残差来控制信息依赖,有效缓解幻觉且不增加解码延迟。

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27954 2026-05-28 cs.LG 70%

Cyclical Entropy Eruption: Entropy Dynamics in Agent Reinforcement Learning

循环熵爆发:智能体强化学习中的熵动力学

Wendi Li, Shawn Im, Sharon Li

机构 * Department of Computer Sciences, University of Wisconsin–Madison(威斯康星大学麦迪逊分校计算机科学系)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文发现智能体强化学习训练中存在循环熵爆发现象,并提出了SEAL辅助损失函数来稳定训练、提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27706 2026-05-28 cs.CL cs.IR 70%

Chain-based Adaptive Reconfiguration Over Lattices for Hallucination Reduction

基于格点链式自适应重配置以减少幻觉

Joan Vendrell Gallart, Solmaz Kia, Russell Bent, Michael Grosskopf

机构 * Department of Mechanical and Aerospace University of California Irvine(机械与航空航天系加州大学伊文斯顿分校) Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出CAROL框架,通过定义语义不确定性度量并在文本序列格点上构建串子模目标,将幻觉缓解转化为马尔可夫链接受-拒绝过程,实现测试时幻觉减少。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22553 2026-05-28 stat.ML cs.LG 70%

Linear Causal Representation Learning by Topological Ordering, Pruning, and Disentanglement

通过拓扑排序、剪枝和解缠的线性因果表示学习

Hao Chen, Lin Liu, Yu Guang Wang

机构 * School of Mathematical Sciences, Shanghai Jiao Tong University, Shanghai, China(上海交通大学数学科学学院) Institute of Natural Sciences, MOE--LSC(教育部-上海交大联合实验室) SJTU--Yale Joint Center for Biostatistics(上海交大-耶鲁大学生物统计联合中心) Data Science, Shanghai Jiao Tong University, Shanghai, China(上海交通大学数据科学) Bio--X Institutes, Shanghai Jiao Tong University, Shanghai, China(上海交通大学Bio-X研究院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出一种在更弱假设下通过拓扑排序、剪枝和解缠恢复线性因果表示的新算法,并通过合成实验和大语言模型可解释性分析验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27296 2026-05-27 cs.CL 70%

Probing Cultural Awareness in LLMs: A Case Study of Cross-Culture Aesthetic Stylistics

探究大型语言模型的文化意识:跨文化美学文体学案例研究

Jiashuo Wang, Fenggang Yu, Jian Wang, Chak Tou Leong, Xiaoyu Shen, Chunpu Xu, Jiawen Duan, Wenjie Li, Johan F. Hoorn

机构 * Department of Computing, Hong Kong Polytechnic University(香港理工大学计算机系) Institute of Digital Twin, Eastern Institute of Technology, Ningbo(宁波东部技术研究所数字孪生研究所) Department of Language Science and Technology, Hong Kong Polytechnic University(香港理工大学语言科学与技术系) School of Design, Hong Kong Polytechnic University(香港理工大学设计学院) Research Institute for Quantum Technology, Hong Kong Polytechnic University(香港理工大学量子技术研究所) Department of Communication Science, Vrije Universiteit Amsterdam(阿姆斯特丹自由大学传播科学系)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 通过构建C4STYLI基准(包含香港和中国大陆的高度风格化翻译电影片名和广告标语),评估大型语言模型在跨文化美学文体识别和生成方面的能力,发现模型依赖表层语言信息而非风格结构,对香港特定风格结构敏感度有限。

Comments IJCAI 2026 Human-Centred AI track

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25377 2026-05-26 cs.CV cs.AI 70%

Adversarial Orthogonal Disentanglement for LVLM Hallucination Mitigation

对抗正交解缠用于LVLM幻觉缓解

Ruoxi Cheng, Haoxuan Ma, Zhengfei Hai, Yiyan Huang, Ranjie Duan, Tianle Zhang, Xu Yang, Ziyi Ye, Xingjun Ma

机构 * Fudan University(复旦大学) Tencent(腾讯) Nanjing University(南京大学) Southeast University(东南大学) Great Bay University(大坝大学) TeleAI, China Telecom(TeleAI,中国电信)

专题命中 知识编辑与模型理解 :language model(abstract);instruction tuning(abstract);分类 cs.AI

AI总结 提出对抗正交解缠(AOD)框架,通过最小最大目标学习幻觉相关方向,并利用双前向对比解码策略,在不需额外训练的情况下缓解大型视觉语言模型(LVLM)的幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24077 2026-05-26 eess.SP cs.LG 70%

LWM-CDE: A Representation Space for Wireless Data Reasoning and Transferability

LWM-CDE:无线数据推理与可迁移性的表示空间

Sadjad Alikhani, Akshay Malhotra, Shahab Hamidi-Rad, Ahmed Alkhateeb

机构 * School of Electrical, Computer and Energy Engineering, Arizona State University(电气、计算机与能源工程学院,亚利桑那州立大学) InterDigital, Inc.(InterDigital公司)

专题命中 知识编辑与模型理解 :foundation model(abstract);pretraining(abstract);分类 cs.LG

AI总结 提出基于预训练无线基础模型特征空间的数据集相似性框架LWM-CDE,通过对比学习和几何形状损失微调数据集嵌入,构建距离可靠指示可迁移性的结构化流形,在无线基准测试中比现有指标更高效且与经验迁移性能相关性更强。

Comments The model and relevant scripts are available on the WILab Hugging Face page: https://huggingface.co/wi-lab

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18979 2026-05-26 cs.LG 70%

Dynamic Optimization and Safety Indicator Injection for Jailbreaking Text-to-Image Models with Multimodal Safety Filters

动态优化与安全指示注入:针对多模态安全过滤器的文本到图像模型越狱方法

Zixuan Chen, Hao Lin, Ke Xu, Xinghao Jiang, Tanfeng Sun

机构 * Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 提出OptJail框架,通过动态提示优化与自适应安全指示注入,绕过文本和图像过滤器,实现高成功率越狱,并揭示多模态防御的系统性漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏