Trajectory-Guided Forget-Recover Network for Continual LLM Unlearning
用于持续大语言模型遗忘的轨迹引导遗忘-恢复网络
专题命中 其他LLM :LLM(title);分类 cs.AI、cs.LG
AI总结 针对持续大语言模型遗忘的两大挑战,提出TFR-Net,通过跟踪通道级风险抑制持久目标相关通道、恢复休眠通道,在四个数据集上取得更优的遗忘效果与保留性能权衡。
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
用于持续大语言模型遗忘的轨迹引导遗忘-恢复网络
专题命中 其他LLM :LLM(title);分类 cs.AI、cs.LG
AI总结 针对持续大语言模型遗忘的两大挑战,提出TFR-Net,通过跟踪通道级风险抑制持久目标相关通道、恢复休眠通道,在四个数据集上取得更优的遗忘效果与保留性能权衡。
APPROVE:结合大型语言模型的面向视觉端用户的机器人编程
专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)
AI总结 APPROVE是一种结合LLMs的多模态端用户机器人编程框架,通过Blockly可视化程序并支持用户确认、修改或拒绝,还可存储复用已确认功能,解决了现有系统透明度不足、意图对齐差、复用有限的问题,提升了用户信任与编程灵活性。
Comments Accepted for publication in Procedia CIRP, Proceedings of the 20th CIRP Conference on Intelligent Computation in Manufacturing Engineering (ICME 2026)
具有增强对抗样本迁移性的视角不变攻击
机构 * The Hong Kong Polytechnic University(香港理工大学)
专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)
AI总结 针对对抗样本跨模型迁移性带来的安全威胁,提出视角不变攻击(PIA)及其扩展PIA-Mix,通过多自由度顶点采样策略提升对抗样本迁移性,实验显示其性能优于当前最优基于迁移的攻击方法。
Journal ref IEEE Transactions on Information Forensics and Security, vol. 21, pp. 6818-6831, 2026
AlphaSeek:面向多源金融数据的轨迹级自迭代因子挖掘框架
专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)
AI总结 针对现有量化因子挖掘方法的缺陷,提出AlphaSeek框架,整合自动化方向发现等技术,在CSI300上取得优异策略性能,且因子具跨市场迁移性。
估算AI使用产生的温室气体排放:企业级测量框架
专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)
AI总结 针对企业AI排放核算缺乏公认方法的问题,提出标准化企业级AI排放核算框架,以支撑减排目标设定与脱碳决策。
Baikal:面向数据湖深度研究的结构化搜索框架
专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG
AI总结 Baikal是面向数据湖深度研究的结构化搜索框架,通过聚类证据为语义区域并自适应搜索,在HybridQA和TAT-QA数据湖上较基线方法提升报告得分28%和36%,展现了结构化语义探索的价值。
从图形用户界面测试到对话交互:特定应用语音助手的新视角
专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)
AI总结 研究针对移动平台语音助手与应用行为契合度低的问题,提出由语言模型驱动、利用图形用户界面测试代码自动开发特定应用语音助手的方法,经安卓原型验证,可复用测试代码实现语音助手合成并指明相关研究方向。
利用多模态大语言模型探索程序流程图在代码生成中的潜力
专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)
AI总结 研究利用多模态大语言模型探索程序流程图对代码生成的潜力,通过从示例代码生成流程图并与问题陈述一起提供给模型进行代码生成实验,发现结合流程图可提升性能,不同细节程度的流程图效果有差异,还比较了与少样本学习的效果。
通过安全感知工具描述减轻MCP服务器中的污点式漏洞
专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)
AI总结 研究MCP服务器污点式漏洞,提出SPELLSMITH,通过分析服务器高风险能力,结合工具描述等识别潜在风险,利用协议属性和大语言模型自我反思能力迭代优化输出,有效减轻污点式漏洞利用。
基于梯度的任意语音识别模型的语音到文本对齐:从连接主义时间分类到语音大语言模型
机构 * Machine Learning and Human Language Technology Group, RWTH Aachen University(机器学习与人类语言技术组,亚琛工业大学) ; AppTek GmbH(AppTek公司)
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 研究基于梯度的任意可微语音识别模型的语音到文本对齐方法,通过对教师强制令牌对数概率取梯度并解码,无需训练、改模型及对齐头,适用于各模型家族,在多模型上评估,结果显示该方法能产生可用对齐,有优有劣。
数学中的技术转向
专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)
AI总结 探讨交互式定理证明器、自动定理证明器和大语言模型等技术对数学实践的影响,包括对数学知识创造与共享、社会层面如协作和信任关系的改变,以及引发的关于形式化本质和人机认知劳动分工等问题。
探测而非提示:用于多元RAG中元数据过滤的隐藏状态探测器
机构 * National University of Kyiv-Mohyla Academy(基辅莫希拉学院国家大学)
专题命中 其他LLM :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 研究改进多跳问答检索,用基于小型开源语言模型隐藏状态训练的确定性探测器取代专有提取器,探测器在准确率上有优势且输出空间固定,介绍了使其工作的设计选择及低成本输出方式。
智能体技能下游适配的实证研究
专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)
AI总结 研究大语言模型智能体技能下游适配,分析六个技能库的1126个适配实例,构建含46种模式的分类法,揭示重用悖论,发现适配相互依赖及近五分之一适配引入安全敏感内容,为改进技能设计等提供启示。
Comments 10 pages, 3 figures, 13 tables
AI伴侣社区中的拟人化:年龄、性别与情感相关性
专题命中 其他LLM :large language model(abstract);language model(abstract);prompting(abstract)
AI总结 本研究利用Reddit数据,分析AI伴侣社区中用户年龄、性别与拟人化倾向及情感表达的关系,发现成年人和女性更易拟人化,积极情感与拟人化正相关,且这些关系在成年人中更强。
协作与AI支持的需求获取:一项实证研究
专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)
AI总结 通过混合方法控制实验,比较四种需求获取方法,发现结合协作与AI支持的方法产出质量最高,且被认为更清晰易执行。
卡通字幕中的混合智能:评估AI作为创意写作伙伴
专题命中 其他LLM :large language model(abstract);language model(abstract);prompting(abstract)
AI总结 研究通过GPT-4o为IEEE计算机杂志卡通生成字幕,评估AI在幽默创作中的表现,发现AI能提供创意但需人类把控,建议作为辅助工具。
Comments 12 pages, 8 Figures, Accepted to AI Magazine
使用多模态语言模型对TikTok上的有害内容暴露情况进行审计:一项跨国、按年龄分层的研究
机构 * Politecnico di Milano(米兰理工大学)
专题命中 其他LLM :language model(title);分类 cs.CL
AI总结 本研究使用多模态大语言模型Gemini 2.5 Flash,在法、意、瑞三国对TikTok开展跨国年龄分层审计,发现关键词搜索会大幅提升有害内容占比,意国各年龄组有害内容占比最高,平台安全过滤器低估了明确有害内容。
Comments 20 pages, 16 figures, 14 tables. Accepted to Findings of EMNLP 2026
从实体提及到语气:基于大语言模型的媒体偏见分析流水线
机构 * University of Tirana(地拉那大学)
专题命中 其他LLM :LLM(title);分类 cs.CL
AI总结 该研究提出一种基于大语言模型的媒体偏见分析流水线,对8358篇阿尔巴尼亚新闻文章开展实验,验证了其在偏见分析中的有效性,适用于手动验证数据集或专用语言工具有限的场景。
用于发现重要数学猜想的大语言模型框架:AI对下一个黎曼猜想的探索
专题命中 其他LLM :LLM(title);分类 cs.AI
AI总结 该研究提出一种三阶段大语言模型框架,用于系统发现重要数学猜想,经实验验证其在20个候选猜想上的形式化检查表现稳定,无重复问题。
Comments 25pages, 1 figure
语言模型中的隐藏API:从分叉未来中发现可复用的因果接口
机构 * Nanyang Technological University(南洋理工大学) ; Southern University of Science and Technology(南方科技大学) ; Tianjin University(天津大学) ; Sun Yat-sen University(中山大学) ; Carnegie Mellon University(卡内基梅隆大学) ; Georgia Institute of Technology(佐治亚理工学院) ; The Hong Kong Polytechnic University(香港理工大学) ; Shenzhen University(深圳大学) ; Tsinghua University(清华大学) ; The Hong Kong University of Science and Technology(香港科技大学)
专题命中 其他LLM :language model(title);分类 cs.AI
AI总结 本研究从分叉未来采样后续操作以比较语言模型隐藏状态,发现共享接口在多模型评估中表现最优,支持测试操作库中存在可复用因果接口。
ZUNA1.1:一种更灵活的用于去噪和超分辨率的脑电图(EEG)基础模型
机构 * Zyphra
专题命中 其他LLM :foundation model(title);分类 cs.LG
AI总结 研究推出3.8亿参数的EEG基础模型ZUNA1.1,其灵活性远超原模型ZUNA1,在EEG去噪与重建任务中性能达标且显著优于MNE包的球形样条插值,已以Apache 2.0许可开源发布。
拒绝编码的图书管理员:大语言模型代码生成中依赖模型的身份设定
机构 * Bluebear Security(蓝熊安全公司)
专题命中 其他LLM :LLM(title);分类 cs.CL
AI总结 研究在可控条件下评估不同人物角色对代码生成的影响,测试了四种提示条件、两个模型等,发现角色影响因模型而异,如Claude Opus上图书管理员角色降低正确性,结果表明角色是依赖模型的行为策略偏差,还发布了相关数据和文档。
Comments 17 pages, 3 tables, no figures. Ancillary files include raw completions, derived scores, analysis scripts, persona texts, and preregistration
大语言模型生成器-调节器博弈的变分框架
机构 * Department of Electrical and Computer Engineering, Tandon School of Engineering, New York University, Brooklyn, NY, USA(电气工程系,工程学院,纽约大学,布鲁克林,纽约,美国)
专题命中 其他LLM :LLM(title);分类 cs.AI
AI总结 提出一个变分框架,将语言生成建模为熵正则化吉布斯分布,将调节建模为最优判别器,通过鞍点问题平衡效用、熵、调节一致性和有限长度可检测性,并通过审查过滤和钓鱼防御案例验证。
MaskWAM:统一掩码提示与预测的世界-动作模型
机构 * The Hong Kong University of Science and Technology(香港科技大学) ; Tencent Robotics X(腾讯机器人X实验室) ; Tsinghua University(清华大学)
专题命中 其他LLM :prompting(title);分类 cs.LG
AI总结 提出MaskWAM,通过统一掩码输入与预测的混合Transformer架构,解决世界-动作模型的空间瓶颈,提升策略泛化能力,在LIBERO等任务上显著优于基线。
一种用于缓解医疗查询中患者上下文歧义的知识引导智能体框架
专题命中 其他LLM :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI
AI总结 该研究提出知识引导智能体框架,通过解析医疗查询、构建假设、识别缺失上下文并提问,缓解患者上下文歧义,在诊断检索和饮食安全分类任务中显著提升了多种语言模型的性能。
Comments 48 pages, 3 figures, 6 tables, journal
对话式AI能否弱化“我们与他们”的界限?共同、双重及分离身份框架对支持移民的群体间帮助的影响
专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI
AI总结 该研究通过与GPT-4o开展五轮对话的预先注册实验,发现强调共同或双重身份的AI对话可弱化群体间界限,提升行动意愿,且效应在各调节变量中基本一致。
查询时机在大型语言模型(LLMs)与人类之间产生相反的位置偏差
机构 * Princeton University(普林斯顿大学)
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究探究查询时机对LLMs和人类位置偏差的影响,发现二者存在差异,且新LLMs的位置偏差比前代更显著。
Comments Entropic Award (Top 3 Paper), ICBINB @ ICLR 2026
超越特征袋:稀疏自编码器中的集合级不稳定性
机构 * Heidelberg University(海德堡大学)
专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL、cs.LG
AI总结 该研究以稀疏自编码器(SAE)隐集合重叠度为相似度度量,发现SAE特征不通过简单特征袋语义组合,其激活集合与人类概念判断存在显著不匹配。
理论引导的欺骗检测:基于检索增强生成(RAG)的人工智能探索
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究基于欺骗理论开发7个RAG模型,对比4个大语言模型与基线模型的欺骗判断,发现RAG模型反应偏差更低但准确率无显著差异,理论引导AI判断当前参数下不可靠,优化后或有潜力。
基因型触发器:通过生成抗菌肽模型中宿主特定后门暴露药物基因组学盲区
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究提出基因型触发器后门攻击,操控抗菌肽生成模型使其针对特定HLA等位基因携带者生成高免疫原性风险肽,同时保留抗菌效力与低毒性,以暴露药物基因组学盲区。