Safety Cost of Steering Vectors Is Separable and Reducible
引导向量的安全代价是可分离且可降低的
专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.CL、cs.LG
AI总结 本研究针对引导向量破坏LLM安全机制的问题,通过识别并移除其安全退化分量,提出带约束的原始对偶优化方法,可在保留引导效果的同时大幅降低安全退化。
Comments COLM 2026
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
引导向量的安全代价是可分离且可降低的
专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.CL、cs.LG
AI总结 本研究针对引导向量破坏LLM安全机制的问题,通过识别并移除其安全退化分量,提出带约束的原始对偶优化方法,可在保留引导效果的同时大幅降低安全退化。
Comments COLM 2026
通过轨迹投毒对自进化技能实施仅查询式后门攻击
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 本研究针对自进化技能系统提出仅查询式轨迹后门攻击TBA,通过构造查询诱导生成带后门技能,实验证实其可可靠植入条件后门且效果优于直接注入。
TeachUp:借助反思性支持帮助新手教师从课堂视频中学习教学策略
专题命中 其他LLM :LLM(summary_cn,abstract)
AI总结 TeachUp借助LLM驱动的流程检测课堂视频中的9种教学策略,为新手教师提供反思支持,经实验验证可提升其学习参与度与策略应用表现。
Comments 16 pages, 6 figures, and 4 tables. To appear in the Proceedings of the 39th Annual ACM Symposium on User Interface Software and Technology (UIST '26)
Scout:基于数据相似度的可扩展文档提取工具
专题命中 其他LLM :LLM(summary_cn,abstract)
AI总结 Scout是一款基于文档相似度的可扩展文档提取工具,通过生成优化规则集实现高性价比数据提取,在多个真实数据集上达到与前沿LLM相当的准确率,成本大幅降低且优于同类基于程序的方法。
Gemini 3 检测手动测试用例中自然语言测试异味的实证研究
专题命中 其他LLM :large language model(abstract);language model(abstract);small language model(abstract);SLM(abstract_cn)
AI总结 研究使用 Gemini-3-Pro-Preview 通过整体测试用例分析策略检测手动测试用例中的七种测试异味,相比小型语言模型性能更优,并发现平均每步近一个异味。
政客、骗子与顺从的工人:层级博弈中大语言模型智能体的涌现行为
机构 * Soongsil University(崇实大学) ; GISMA University(GISMA大学)
专题命中 其他LLM :LLM(title,abstract_cn);分类 cs.AI
AI总结 该研究通过层级博弈实验测试6种大语言模型智能体,发现其在不同制度下会涌现出撒谎、私下交易等类似人类的治理失效行为,且模型家族会影响领导层更迭。
实现前的承诺:无分类器引导何时在掩码扩散语言模型中变得不必要
专题命中 其他LLM :language model(title,abstract);分类 cs.CL
AI总结 该研究探究掩码扩散语言模型解码中无分类器引导(CFG)的必要性,定义承诺 horizon τ*,发现固定提示的交叉验证 horizon 时,其表现不劣于全程CFG,还可优化并行度与失败轨迹恢复效果。
语言模型处理差异论元标记中的类型学对齐差异
机构 * University of Washington(华盛顿大学)
专题命中 其他LLM :language model(title,abstract);分类 cs.CL
AI总结 通过控制合成语料训练GPT-2模型,发现模型在标记方向(自然标记方向)上表现出类人偏好,但在论元角色偏好(宾语vs主语)上未复现人类语言的强烈宾语偏好。
Comments 16 pages, 8 figures, 7 tables. To appear at CoNLL 2026
Journal ref Proceedings of the 30th Conference on Computational Natural Language Learning (CoNLL 2026), pp. 268-283, San Diego, California, USA, Association for Computational Linguistics, 2026
视觉-语言模型中的源模态监控
机构 * Department of Computer Science, Brown University(布朗大学计算机科学系)
专题命中 其他LLM :language model(title,abstract);分类 cs.CL
AI总结 研究探讨了多模态模型追踪并沟通信息来源的能力,分析了语法与语义信号在绑定提示词与输入组件中的作用,发现语义信号在模态分布差异大时更占主导。
Comments Accepted at COLM 2026. All resources will be available at https://github.com/ethahtz/source-modality-monitoring
用基础模型检测Python重构实现中的行为变化
专题命中 其他LLM :foundation model(title,abstract)
AI总结 本研究提出基于基础模型Oracle的方法,通过分析git风格差异检测Python重构的行为变化,在Rope上评估发现13个bug,12个被接受,凸显需提升Python重构工具鲁棒性。
Comments Accepted at Brazilian Symposium on Software Engineering (SBES) 2026
VOICE:一种融合原位单细胞基因表达直接预测与基于检索预测的视觉-组学基础模型
机构 * University of Michigan(密歇根大学) ; Weill Cornell Medicine(威尔康奈尔医学院)
专题命中 其他LLM :foundation model(title,abstract)
AI总结 该研究提出多模态基础模型 VOICE,通过对比学习对齐 H&E 形态与单细胞表达嵌入,融合直接回归与参考检索分支,泛化性良好且在七项指标上优于现有方法,可从 H&E 图像预测单细胞基因表达。
理论引导的欺骗检测:基于检索增强生成(RAG)的人工智能探索
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究基于欺骗理论开发7个RAG模型,对比4个大语言模型与基线模型的欺骗判断,发现RAG模型反应偏差更低但准确率无显著差异,理论引导AI判断当前参数下不可靠,优化后或有潜力。
从语音到交互:鸡尾酒会场景下多模态系统的分析
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL
AI总结 本研究分析了CHiME-9 MCoRec任务中不同多模态系统解决鸡尾酒会场景的策略,发现最优系统实现57%相对错误减少,且高语音重叠并非性能差异的主要原因。
Comments Accepted at ICMI 2026
多用户冲突中的权威预期效应
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI
AI总结 该研究在Claude、Gemini、GPT、Grok四个LLMs上开展三类实验,发现社会权威信号可重构模型判断,提出并表征了具有参考依赖、证据重新解释、方向敏感性特性的权威预期效应。
提示注入的剖析:用于结构化分析的组件模型
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI
AI总结 本文提出七个组件的提示注入结构化分析模型,统一相关分类法,结合实例与CTI模式,助力标记、分析提示注入攻击。
NeuroPilot:一种用于神经影像处理、质量控制与管理的智能体驱动智能流程
机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI
AI总结 该研究提出NeuroPilot多智能体系统,整合神经影像处理、质控与管理流程,在17个超12.3万受试者的队列中验证,将传统2-3个月的工作压缩至一周,提升了可扩展性与效率。
Comments 21 pages, 6 figures
SG-WAM:面向世界-动作模型的文本 grounded 与空间感知语义引导
机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) ; Ola Dimensions(奥拉维度公司)
专题命中 其他LLM :language model(abstract,abstract_cn)
AI总结 针对现有世界-动作模型(WAM)存在的视频与指令语义不对齐问题,提出基于视觉-语言模型(VLM)的SG-WAM语义引导方法,通过注入文本接地且空间感知的语义前瞻,提升了WAM的指令遵循与操纵精度,经仿真和真实实验验证有效。
基于结构化API分析的Rust库泛型感知模糊测试目标生成
专题命中 其他LLM :LLM(abstract,abstract_cn)
AI总结 该研究针对Rust库模糊测试中现有工具约束处理不足导致覆盖率低的问题,提出GRAFT方法,通过结构化API分析生成可编译模糊目标,在13个Rust crate上的API覆盖率和编译成功率均优于现有工具。
用于结合文本信息的图像聚类的深度模态共享自表达学习
专题命中 其他LLM :language model(abstract,abstract_cn)
AI总结 提出DeepMORSE方法,通过模态共享自表达模型学习结合文本信息的图像聚类,在6个基准数据集上聚类性能提升超3%,且所学表示可迁移至下游任务。
面向汽车基于模型的系统工程的有状态多智能体大语言模型,用于跨视图接口对齐
专题命中 其他LLM :large language model(abstract);language model(abstract)
AI总结 针对LLMs在汽车MBSE中引发的架构漂移问题,提出有状态多智能体验证流水线,在ADAS场景中实现97%实体可追溯性等指标,证明对抗性审核可让LLMs可靠生成零错误MBSE架构。
带有情感的翻译:在翻译技术中中心化译者视角
专题命中 其他LLM :large language model(abstract);language model(abstract)
AI总结 研究通过访谈19名跨11种语言和11个领域的专业译者,探讨译者在使用翻译技术时的视角、经验与担忧,强调需开发以译者需求为导向的翻译技术,而非取代人类翻译。
Comments AIES 2026, 14 pages, 2 tables
体积惩罚法用于模拟旋转固体周围的流体流动,结合多参考系和滑动网格
专题命中 其他LLM :SLM(abstract,abstract_cn)
AI总结 本研究提出一种结合多参考系和滑动网格的体积惩罚法,用于模拟旋转固体周围的流体流动,并通过实验验证其有效性。
先验通过抑制持续存在:词汇覆盖的斯特鲁普范式
机构 * The University of Hong Kong(香港大学)
专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.LG
AI总结 通过斯特鲁普范式实验,发现语言模型中的词汇先验在局部规则覆盖后仍持续存在,并通过激活修补定位到源位置三元组,揭示了先验是干扰起源和覆盖痕迹的共同通道。
通过注意力集中进行偏好重定向:对计算机使用代理的一种攻击
机构 * Tübingen AI Center, University of Tübingen(图宾根大学图宾根人工智能中心)
专题命中 其他LLM :foundation model(abstract);分类 cs.LG;language model(journal_ref)
AI总结 本文提出PRAC攻击,通过重定向模型注意力操纵CUA选择过程,揭示了视觉模态的漏洞,威胁到基于开放权重模型的CUA安全。
Journal ref Conference on Language Modeling (COLM) 2026
CAVE:面向视频时序定位的能力感知视觉边界证据对齐
机构 * AMAP, Alibaba Group(阿里巴巴集团AMAP)
专题命中 其他LLM :language model(abstract);分类 cs.CL
AI总结 针对视频时序定位中视觉证据与时间戳错位的问题,提出CAVE方法,通过边界证据奖励、轻量级热身及性能感知门控,在公开基准上验证了有效性。
诱饵图像增强针对编码越狱的字幕介导防御
专题命中 其他LLM :language model(abstract);分类 cs.AI
AI总结 该研究发现附加诱饵图像可降低VLMs的编码越狱攻击成功率,通过编码输入检测器门控附加诱饵,可在保留安全增益的同时控制良性弃权率,该效应在多模型、多场景下可复现。
Comments There is bug in algorithm implementation
RoboSeg:基于单眼在手相机的机器人操作的在线部件级语义重建
机构 * School of Mechanical Engineering and Automation, Beihang University(北京航空航天大学机械工程及自动化学院)
专题命中 其他LLM :language model(abstract)
AI总结 RoboSeg是无需CAD模型的部件级语义重建系统,结合VLM、TSDF融合与SAM3,实现机器人操作的部件语义索引,在24次物理试验中21次完成综合任务。
融合UI结构与语义的面向特征的应用屏幕检索与聚类
专题命中 其他LLM :language model(abstract)
AI总结 该研究针对UI编程中代码与图形表示的抽象鸿沟,提出多模态神经符号嵌入技术FRAME,在三项基准测试中提升了屏幕检索与聚类的性能,可增强自动化UI设计与测试工具。
Comments 12 pages, 8 figures, 6 tables. Accepted at the 42nd IEEE International Conference on Software Maintenance and Evolution (ICSME 2026), Benevento, Italy
AI能否编写合规代码?以及在多大程度上能?评估Claude Fable 5、Claude Opus 4.8和Claude Opus 5在四个用例中的SOC 2合规性
专题命中 其他LLM :language model(abstract)
AI总结 该研究评估Claude Fable 5、Claude Opus 4.8和Claude Opus 5在四个用例中的SOC 2合规性,发现添加一句SOC 2语句可大幅提升合规率,模式匹配评分器不可靠需替换为语义检查。
用于上行非正交传输的语义辅助迭代解码
专题命中 其他LLM :language model(abstract)
AI总结 本文提出语义辅助迭代解码(Sem-IR)方案,结合ByT5语言模型与物理层迭代,在8dB时较无语义反馈的NOMA将块错误率降低一个数量级,性能优于TDMA。
Comments 6 pages, 7 figures, 1 table