arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-02-10 至 2026-02-10 共收录 109 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 安全评测 42 篇

2602.08342 2026-02-10 cs.CV cs.AI 57%

UrbanGraphEmbeddings: Learning and Evaluating Spatially Grounded Multimodal Embeddings for Urban Science

UrbanGraphEmbeddings: 学习和评估空间导向的多模态嵌入用于城市科学

Jie Zhang, Xingtong Yu, Yuan Fang, Rudi Stouffs, Zdravko Trivic

机构 * National University of Singapore Department of Architecture Singapore The Chinese University of Hong Kong Dept of Systems Eng. \& Eng. Mgmt. China Singapore Management University School of Computing \& Info. Systems Singapore National University of Singapore Department of Architecture The Chinese University of Hong Kong Singapore Management University

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 本文提出UGE框架,通过空间导向的多模态嵌入提升城市理解任务性能,实验显示在图像检索和地理位置排名上取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08339 2026-02-10 cs.AI cs.CV 57%

CoTZero: Annotation-Free Human-Like Vision Reasoning via Hierarchical Synthetic CoT

CoTZero:通过分层合成CoT实现无标注的人类级视觉推理

Chengyi Du, Yazhe Niu, Dazhong Shen, Luxin Xu

机构 * University of Electronic Science and Technology of China(电子科技大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Chinese University of Hong Kong MMLab(香港中文大学 MMLab) The College of Computer Science and Technology(计算机科学与技术学院) Nanjing University of Aeronautics and Astronautics(南京航空航天大学)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 CoTZero通过双阶段数据合成和认知对齐训练,实现无标注的人类级视觉推理,提升模型的层次推理和泛化能力。

Comments 16 pages 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08121 2026-02-10 cs.AI 57%

Initial Risk Probing and Feasibility Testing of Glow: a Generative AI-Powered Dialectical Behavior Therapy Skills Coach for Substance Use Recovery and HIV Prevention

Glow的初始风险探测与可行性测试:一种生成式人工智能驱动的辩证行为疗法技能教练,用于物质使用康复和HIV预防

Liying Wang, Madison Lee, Yunzhang Jiang, Steven Chen, Kewei Sha, Yunhe Feng, Frank Wong, Lisa Hightow-Weidman, Weichao Yuwen

专题命中 安全评测 :safety(abstract);分类 cs.AI

AI总结 Glow是一种生成式人工智能驱动的辩证行为疗法技能教练,旨在通过风险探测和可行性测试评估其在物质使用康复和HIV预防中的安全性与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10238 2026-02-10 cs.AI 57%

The Achilles' Heel of LLMs: How Altering a Handful of Neurons Can Cripple Language Abilities

大语言模型的致命弱点:改变少量神经元即可摧毁语言能力

Zixuan Qin, Qingchen Yu, Kunlin Lyu, Zhaoxin Fan, Yifan Sun

机构 * Center for Applied Statistics, School of Statistics, Renmin University of China(中国人民大学统计学院应用统计中心) Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(未来区块链与隐私计算北京先进创新中心) School of Artificial Intelligence, Beihang University(北航人工智能学院)

专题命中 安全评测 :safety(abstract);分类 cs.AI

AI总结 研究发现大语言模型中存在关键神经元集,破坏这些神经元可导致模型崩溃,揭示了模型鲁棒性和可解释性的重要问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11472 2026-02-10 cs.CV cs.LG 57%

Toward Inherently Robust VLMs Against Visual Perception Attacks

朝向对抗视觉感知攻击的固有鲁棒性VLMs

Pedram MohajerAnsari, Amir Salarpour, Michael Kühr, Siyu Huang, Mohammad Hamad, Sebastian Steinhorst, Habeeb Olufowobi, Bing Li, Mert D. Pesé

机构 * Clemson University(克莱姆森大学) Technical Universität München(慕尼黑技术大学) University of Texas at Arlington(德克萨斯大学阿灵顿分校)

专题命中 安全评测 :safety(abstract);分类 cs.LG

AI总结 本文提出V2LMs,通过固有鲁棒性提升自动驾驶车辆感知对视觉攻击的抗性,实验显示其在对抗攻击下表现优于传统DNNs。

Comments Accepted to the 2026 IEEE Intelligent Vehicles Symposium (IV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00765 2026-02-10 cs.AI 57%

HouseTS: A Large-Scale, Multimodal Spatiotemporal U.S. Housing Dataset and Benchmark

HouseTS:一个大规模、多模态的美国住房时空数据集和基准

Shengkun Wang, Yanshen Sun, Fanglan Chen, Linhan Wang, Naren Ramakrishnan, Chang-Tien Lu, Yinlin Chen

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 HouseTS是一个大规模多模态美国住房时空数据集,用于提供长期房价预测的基准,涵盖超过6000个邮政编码的月度数据,并支持多种模型的评估与可解释性分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07978 2026-02-10 cs.CL 57%

Cross-Linguistic Persona-Driven Data Synthesis for Robust Multimodal Cognitive Decline Detection

跨语言人格驱动的数据合成用于鲁棒多模态认知衰退检测

Rui Feng, Zhiyao Luo, Liuyu Wu, Wei Wang, Yuting Song, Yong Liu, Kok Pin Ng, Jianqing Li, Xingyao Wang

机构 * Engineering Research Center of Intelligent Theranostics Technology and Instruments, Ministry of Education, School of Biomedical Engineering and Informatics, Nanjing Medical University(智能诊疗技术与仪器工程研究中心、教育部、生物医学工程与信息学院、南京医科大学) Institute of Biomedical Engineering, University of Oxford(生物医学工程研究所、牛津大学) Institute of High Performance Computing, Agency for Science, Technology and Research (A*STAR)(高性能计算研究所、科技研究局(A*STAR)) Department of Neurology, National Neuroscience Institute, Singapore, 308433, Singapore(神经病学部、新加坡国家神经科学研究所) Duke-NUS Medical School, Singapore, 169857, Singapore(新加坡国立大学医学院)

专题命中 安全评测 :trustworthy(abstract);分类 cs.CL

AI总结 SynCog通过跨语言人格驱动数据合成与推理链微调,提升多模态模型在认知衰退检测中的诊断性能和跨语言泛化能力。

Comments 18 pages, 7 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07814 2026-02-10 cs.CV cs.AI 57%

How well are open sourced AI-generated image detection models out-of-the-box: A comprehensive benchmark study

开源生成图像检测模型的即插即用性能如何:一项全面的基准研究

Simiao Ren, Yuchen Zhou, Xingyu Shen, Kidus Zewde, Tommy Duong, George Huang, Hatsanai, Tiangratanakul, Tsang, Ng, En Wei, Jiayu Xue

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 本文评估了16种最新图像检测模型的即插即用性能,发现无统一最佳模型,训练数据对齐影响显著,现代生成器性能优异,揭示了跨数据集泛化中的系统性故障模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07706 2026-02-10 cs.LG 57%

Dense Feature Learning via Linear Structure Preservation in Medical Data

通过线性结构保持实现密集特征学习:医学数据

Yuanyun Zhang, Mingxuan Zhang, Siyuan Li, Zihan Wang, Haoran Chen, Wenbo Zhou, Shi Li

机构 * Independent Researcher(独立研究者) The Chinese University of Hong Kong(香港中文大学) Columbia University(哥伦比亚大学)

专题命中 安全评测 :alignment(abstract);分类 cs.LG

AI总结 本文提出密集特征学习方法,通过线性结构保持提升医学数据表示的稳定性与可解释性,实现更优的下游性能。

Comments ICLR Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07662 2026-02-10 cs.AI 57%

ONTrust: A Reference Ontology of Trust

ONTrust:信任的参考本体

Glenda Amaral, Tiago Prince Sales, Riccardo Baratella, Daniele Porello, Renata Guizzardi, Giancarlo Guizzardi

机构 * Semantics, Cybersecurity \& Services, University of Twente, The Netherlands Business Information Systems, University of Twente, The Netherlands DAFIST, University of Genoa, Italy

专题命中 安全评测 :trustworthy(abstract);分类 cs.AI

AI总结 ONTrust通过构建信任参考本体,提供信任概念的本体学基础,支持信息建模、自动推理和语义互操作性,应用于信任管理、AI设计等领域。

Comments 46 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07652 2026-02-10 cs.CR cs.AI 57%

Agent-Fence: Mapping Security Vulnerabilities Across Deep Research Agents

Agent-Fence: 在深度研究代理中映射安全漏洞

Sai Puppala, Ismail Hossain, Md Jahangir Alam, Yoonpyo Lee, Jay Yoo, Tanzim Ahad, Syed Bahauddin Alam, Sajedul Talukder

机构 * Computer Science Department, Southern Illinois University(索尔坦大学计算机科学系) Computer Science Department, University of Texas(德克萨斯大学计算机科学系) Hanyang University(翰阳大学) The Grainger College of Engineering, Nuclear, Plasma & Radiological Engineering, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校格雷格尔工程学院)

专题命中 安全评测 :safety(abstract);分类 cs.AI

AI总结 Agent-Fence通过定义14种信任边界攻击类别,评估深度代理的安全性,发现高风险类别如Denial-of-Wallet和Authorization Confusion,揭示代理在持久交互中的安全漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22978 2026-02-10 cs.CL 57%

ShoppingComp: Are LLMs Really Ready for Your Shopping Cart?

ShoppingComp: LLMs 是否真的准备好为您的购物车服务?

Huaixiao Tou, Ying Zeng, Yuemeng Li, Cong Ma, Muzhi Li, Minghao Li, Weijie Yuan, He Zhang, Kai Jia

机构 * ByteDance(字节跳动)

专题命中 安全评测 :safety(abstract);分类 cs.CL

AI总结 ShoppingComp通过现实世界基准揭示LLM在购物代理任务中的局限性,强调其在信息定位、多约束验证和风险决策方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16813 2026-02-10 cs.CL 57%

Cognitive Linguistic Identity Fusion Score (CLIFS): A Scalable Cognition-Informed Approach to Quantifying Identity Fusion from Text

认知语言身份融合评分(CLIFS):一种可扩展的认知导向方法,用于从文本中量化身份融合

Devin R. Wright, Jisun An, Yong-Yeol Ahn

机构 * Center for Complex Networks and Systems Research, Luddy School of Informatics, Computing, and Engineering, Indiana University Bloomington(复杂网络与系统研究中心,信息学、计算与工程学院,印第安纳大学布卢明顿分校) Cognitive Science Program, Indiana University Bloomington(认知科学项目,印第安纳大学布卢明顿分校) School of Data Science, University of Virginia(数据科学学院,弗吉尼亚大学) CulturePulse, Inc.(CulturePulse公司)

专题命中 安全评测 :alignment(abstract);分类 cs.CL

AI总结 CLIFS通过整合认知语言学与大语言模型,提供一种自动化方法来量化文本中的身份融合,有效提升暴力风险评估的准确性。

Comments Authors' accepted manuscript (postprint; camera-ready). To appear in the Proceedings of EMNLP 2025. Pagination/footer layout may differ from the Version of Record

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07014 2026-02-10 cs.CV cs.AI 57%

Vectra: A New Metric, Dataset, and Model for Visual Quality Assessment in E-Commerce In-Image Machine Translation

Vectra: 一种新的度量标准、数据集和模型用于电子商务图像中的图像翻译视觉质量评估

Qingyu Wu, Yuxuan Han, Haijun Li, Zhao Xu, Jianshan Zhao, Xu Jin, Longyue Wang, Weihua Luo

机构 * Alibaba International Digital Commerce Group(阿里巴巴国际数字商业集团)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 Vectra提出了一种无参考、基于大语言模型的视觉质量评估框架,通过多维度量系统、数据集和模型提升电子商务图像翻译的视觉质量评估效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06998 2026-02-10 cs.CY 57%

Tokenizations for Austronesian Language Models: study on languages in Indonesia Archipelago

印尼群岛语言模型的分词:对印尼群岛地区语言的研究

Andhika Bernard Lumbantobing, Hokky Situngkir

专题命中 安全评测 :alignment(abstract);分类 cs.CY

AI总结 本研究提出基于音节的分词方法,用于印尼群岛地区语言,通过音节分割和传统印尼文字原则,提升多语言LLM的语音和形态模式保留能力。

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11840 2026-02-10 cs.AI cs.LO cs.SE 57%

Imandra CodeLogician: Neuro-Symbolic Reasoning for Precise Analysis of Software Logic

Imandra CodeLogician: 用于软件逻辑精确分析的神经符号推理

Hongyu Lin, Samer Abdallah, Makar Valentinov, Paul Brennan, Elijah Kagan, Christoph M. Wintersteiger, Denis Ignatovich, Grant Passmore

专题命中 安全评测 :safety(abstract);分类 cs.AI

AI总结 Imandra CodeLogician通过神经符号推理提升软件逻辑分析的精确性,结合形式方法与LLM,实现更严谨的程序验证与分析。

Comments 52 pages, 23 figures. Includes a new benchmark dataset (code-logic-bench) and evaluation of neurosymbolic reasoning for software analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08588 2026-02-10 cs.DB 50%

MMTS-BENCH: A Comprehensive Benchmark for Time Series Understanding and Reasoning

MMTS-BENCH: 一个全面的时间序列理解和推理基准

Yao Yin, Zhenyu Xiao, Musheng Li, Yiwen Liu, Sutong Nan, Yiting He, Ruiqi Wang, Zhenwei Zhang, Qingmin Liao, Yuantao Gu

专题命中 安全评测 :alignment(abstract)

AI总结 MMTS-BENCH通过多模态基准评估大语言模型在时间序列理解与推理中的表现,揭示了TS-LLMs在跨领域泛化和多模态整合方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08421 2026-02-10 cs.RO 50%

Decentralized Intent-Based Multi-Robot Task Planner with LLM Oracles on Hyperledger Fabric

基于Hyperledger Fabric的去中心化意图多机器人任务规划器与LLM预言机

Farhad Keramat, Salma Salimi, Tomi Westerlund

专题命中 安全评测 :trustworthy(abstract)

AI总结 本文提出基于Hyperledger Fabric的去中心化多机器人任务规划器,结合LLM预言机与新聚合方法,实现意图分解与多机器人协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08298 2026-02-10 cs.RO 50%

Benchmarking Autonomous Vehicles: A Driver Foundation Model Framework

自动驾驶性能评估:一种驾驶员基础模型框架

Yuxin Zhang, Cheng Wang, Hubert P. H. Shum

机构 * National Key Laboratory of Automotive Chassis Integration and Bionics, Jilin University(汽车底盘集成与仿生国家重点实验室,吉林大学) Department of Computer Science, Durham University(杜伦大学计算机科学系) School of Engineering and Physical Sciences, Heriot-Watt University(赫瑞斯泰大学工程与物理科学学院) DRIVEResearch

专题命中 安全评测 :safety(abstract)

AI总结 本文提出一种驾驶员基础模型框架,用于全面评估自动驾驶车辆的性能,旨在解决安全、舒适和能源经济性等挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08263 2026-02-10 cs.SE 50%

Specification Vibing for Automated Program Repair

基于规范的自动化程序修复

Taohong Zhu, Lucas C. Cordeiro, Mustafa A. Mustafa, Youcheng Sun

专题命中 安全评测 :alignment(abstract)

AI总结 VibeRepair通过行为规范修复替代传统代码编辑,提升自动化程序修复的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06305 2026-02-10 cs.HC 50%

Reimagining Legal Fact Verification with GenAI: Toward Effective Human-AI Collaboration

重新构想法律事实验证与生成式AI:迈向有效的人类-人工智能协作

Sirui Han, Yuyao Zhang, Yidan Huang, Xueyan Li, Chengzhong Liu, Yike Guo

专题命中 安全评测 :trustworthy(abstract)

AI总结 本文通过调研律师对生成式AI的态度,探讨了如何设计可信赖的AI系统以支持法律事实验证,强调在效率与专业判断间平衡,并维护伦理和法律问责。

Comments Accepted by CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06884 2026-02-10 eess.SP cs.NI 50%

Memory-Augmented Generative AI for Real-time Wireless Prediction in Dynamic Industrial Environments

记忆增强型生成AI用于动态工业环境中实时无线预测

Rahul Gulia, Amlan Ganguly, Michael E. Kuhl, Ehsan Rashedi, Clark Hochgraf

专题命中 安全评测 :alignment(abstract)

AI总结 Evo-WISVA通过记忆增强生成AI实现动态工业环境中的实时无线预测,显著降低重建误差并提升泛化能力。

Comments Found a fundamental error (data leakage) in cross-validation setup affecting both papers. This issue compromises the model training and results, making performance claims unreliable and potentially misleading. We request withdrawal of current versions (v1) to prevent the dissemination of incorrect scientific findings. Corrected versions will be submitted later

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15301 2026-02-10 cs.SE 50%

aiXcoder-7B-v2: Training LLMs to Fully Utilize the Long Context in Repository-level Code Completion

aiXcoder-7B-v2: 训练 LLMs 完全利用仓库级代码补全中的长上下文

Jia Li, Hao Zhu, Huanyu Liu, Xianjie Shi, He Zong, Yihong Dong, Kechi Zhang, Siyuan Jiang, Zhi Jin, Ge Li

专题命中 安全评测 :alignment(abstract)

AI总结 aiXcoder-7B-v2通过COLA方法提升仓库级代码补全的长上下文利用能力

Comments Camera-ready version for ASE2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07275 2026-02-10 cs.NE 50%

Evolving LLM-Derived Control Policies for Residential EV Charging and Vehicle-to-Grid Energy Optimization

进化LLM衍生的控制策略用于住宅电动车充电和车辆到电网能源优化

Vishesh Purnananda, Benjamin John Wruck, Mingyu Guo

专题命中 安全评测 :safety(abstract)

AI总结 本研究利用LLM驱动的进化计算生成透明且可检查的电动车充电控制策略,通过混合提示策略实现118%的利润提升,发现复杂行为如前瞻性套利。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04333 2026-02-10 cs.CV cs.RO 50%

RAP: 3D Rasterization Augmented End-to-End Planning

RAP: 3D 像素化增强端到端规划

Lan Feng, Yang Gao, Eloi Zablocki, Quanyi Li, Wuyang Li, Sichao Liu, Matthieu Cord, Alexandre Alahi

机构 * EPFL(苏黎世联邦理工学院) Sorbonne Université(索邦大学)

专题命中 安全评测 :alignment(abstract)

AI总结 RAP通过3D像素化增强端到端规划,利用轻量级像素化和特征对齐实现可扩展的数据增强,提升闭环鲁棒性和长尾泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. AI治理与伦理 3 篇

2602.08145 2026-02-10 cs.LG cs.AI cs.CL cs.CV cs.CY 77%

Reliable and Responsible Foundation Models: A Comprehensive Survey

可靠且负责任的基础模型:全面综述

Xinyu Yang, Junlin Han, Rishi Bommasani, Jinqi Luo, Wenjie Qu, Wangchunshu Zhou, Adel Bibi, Xiyao Wang, Jaehong Yoon, Elias Stengel-Eskin, Shengbang Tong, Lingfeng Shen, Rafael Rafailov, Runjia Li, Zhaoyang Wang, Yiyang Zhou, Chenhang Cui, Yu Wang, Wenhao Zheng, Huichi Zhou, Jindong Gu, Zhaorun Chen, Peng Xia, Tony Lee, Thomas Zollo, Vikash Sehwag, Jixuan Leng, Jiuhai Chen, Yuxin Wen, Huan Zhang, Zhun Deng, Linjun Zhang, Pavel Izmailov, Pang Wei Koh, Yulia Tsvetkov, Andrew Wilson, Jiaheng Zhang, James Zou, Cihang Xie, Hao Wang, Philip Torr, Julian McAuley, David Alvarez-Melis, Florian Tramèr, Kaidi Xu, Suman Jana, Chris Callison-Burch, Rene Vidal, Filippos Kokkinos, Mohit Bansal, Beidi Chen, Huaxiu Yao

专题命中 AI治理与伦理 :alignment(abstract);trustworthy(abstract);分类 cs.CL、cs.AI、cs.CY

AI总结 本文综述了基础模型的可靠和负责任发展,探讨了偏见、安全、不确定性等关键问题,并提出了未来研究方向。

Comments TMLR camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07799 2026-02-10 cs.LG cs.AI 62%

Fairness Aware Reward Optimization

公平感知的奖励优化

Ching Lam Choi, Vighnesh Subramaniam, Phillip Isola, Antonio Torralba, Stefanie Jegelka

机构 * CSAIL, Department of EECS, Massachusetts Institute of Technology(计算机科学与人工智能实验室,电气工程与计算机科学系,麻省理工学院) School of CIT, MCML, MDSI, Technical University of Munich(信息科技学院,MCML,MDSI,慕尼黑技术大学)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 Faro通过在处理过程中训练奖励模型,实现公平性、准确性与校准性的平衡,减少偏见并提升模型质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07312 2026-02-10 cs.HC 50%

Navigating Algorithmic Opacity: Folk Theories and User Agency in Semi-Autonomous Vehicles

穿越算法隐匿性:半自动驾驶车辆中用户自主性的folk理论

Yehuda Perry, Tawfiq Ammari

专题命中 AI治理与伦理 :safety(abstract)

AI总结 研究探讨了半自动驾驶车辆司机如何通过folk理论理解算法行为,揭示了司机在算法治理中的被动地位,并提出参与式算法治理框架以提升透明度和用户参与度。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 其他安全 21 篇

2602.07540 2026-02-10 cs.CV cs.LG 79%

LLM-Guided Diagnostic Evidence Alignment for Medical Vision-Language Pretraining under Limited Pairing

基于LLM的诊断证据对齐用于有限配对情况下的医学视觉-语言预训练

Huimin Yan, Liang Bai, Xian Yang, Long Chen

机构 * Institute of Intelligent Information Processing, Shanxi University(山西大学智能信息处理研究所) Alliance Manchester Business School, The University of Manchester(曼彻斯特大学阿利安斯商学院) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系)

专题命中 其他安全 :alignment(title,abstract);分类 cs.LG

AI总结 本文提出LLM引导的诊断证据对齐方法,旨在解决有限配对数据下医学视觉-语言预训练的诊断表示学习问题,通过提取关键诊断证据提升跨模态对齐效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12215 2026-02-10 cs.CL 79%

GMSA: Enhancing Context Compression via Group Merging and Layer Semantic Alignment

GMSA:通过组合并和层语义对齐增强上下文压缩

Jiwei Tang, Zhicheng Zhang, Shunlong Wu, Jingheng Ye, Lichen Bai, Zitai Wang, Tingwei Lu, Lin Hai, Yiming Zhao, Hai-Tao Zheng, Hong-Gee Kim

机构 * Tsinghua University(清华大学) Pengcheng Laboratory(鹏城实验室) Seoul National University(首尔国立大学) Sun Yat-sen University(中山大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 GMSA通过组合并和层语义对齐技术,提升长上下文场景下的上下文压缩效率,实现更高效的模型压缩与下游任务性能提升。

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏