arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-09 至 2026-01-09 共收录 12 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12 篇

2601.04261 2026-01-09 cs.CR 89%

Inhibitory Attacks on Backdoor-based Fingerprinting for Large Language Models

针对大语言模型后门式指纹识别的抑制攻击

Hang Fu, Wanli Peng, Yinghan Zhou, Jiaxuan Wu, Juan Wen, Yiming Xue

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出两种新型攻击方法,针对大语言模型后门式指纹识别的鲁棒性进行评估,有效抑制指纹响应并提升系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04620 2026-01-09 cs.AI 85%

AgentDevel: Reframing Self-Evolving LLM Agents as Release Engineering

AgentDevel: 将自演化大语言模型代理重新定义为发布工程

Di Zhang

机构 * Fudan University(复旦大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 AgentDevel将LLM代理改进重新定义为发布工程,通过无实现偏见的批评者、可执行诊断和翻转中心门控,实现稳定改进和可审计的发布流程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04889 2026-01-09 cs.CL 81%

Faithful Summarisation under Disagreement via Belief-Level Aggregation

通过信念层面聚合实现分歧下的忠实总结

Favour Yahdii Aghaebe, Tanefa Apekey, Elizabeth Williams, Nafise Sadat Moosavi

机构 * University of Sheffield, UK(谢菲尔德大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出一种通过信念层面聚合实现分歧意识的总结方法,结合结构化信念集和大语言模型生成,提升观点密集场景下的摘要忠实性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05241 2026-01-09 cs.CV cs.AI cs.RO 79%

RoboVIP: Multi-View Video Generation with Visual Identity Prompting Augments Robot Manipulation

RoboVIP: 多视角视频生成与视觉身份提示增强机器人操作

Boyang Wang, Haoran Zhang, Shujie Zhang, Jinkun Hao, Mingda Jia, Qi Lv, Yucheng Mao, Zhaoyang Lyu, Jia Zeng, Xudong Xu, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) University of Michigan(密歇根大学)

专题命中 其他LLM :prompting(title,abstract);分类 cs.AI

AI总结 RoboVIP通过引入视觉身份提示和可扩展的视觉身份池,提升机器人操控数据的质量与多样性,从而增强视觉语言-动作和视觉-运动政策模型的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04388 2026-01-09 cs.AI 79%

LLM-Guided Lifecycle-Aware Clustering of Multi-Turn Customer Support Conversations

基于大语言模型的生命周期感知多轮客户支持对话聚类

Priyaranjan Pattnayak, Sanchari Chowdhuri, Amit Agarwal, Hitesh Laxmichand Patel

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文提出基于大语言模型的生命周期感知多轮客户支持对话聚类方法,通过动态细化聚类提升聚类质量,实现高效实时分析。

Comments Accepted in AACL 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15490 2026-01-09 cs.CL 70%

Collaborative Problem-Solving in an Optimization Game

优化游戏中的协作问题解决

Isidora Jeknic, Alex Duchnowski, Alexander Koller

机构 * Saarland University(萨尔兰大学)

专题命中 其他LLM :LLM(abstract);prompting(abstract);分类 cs.CL

AI总结 本文提出了一种新的对话游戏,通过协作解决双人旅行商问题,结合大语言模型与符号机制,实现了在自我对战中45%的最优解率,并展示了与人类用户协作和泛化能力。

Comments 23 pages, 16 figures

Journal ref Proceedings of the 26th Annual Meeting of the Special Interest Group on Discourse and Dialogue (2025) 780-799

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04525 2026-01-09 cs.CL 70%

GRACE: Reinforcement Learning for Grounded Response and Abstention under Contextual Evidence

GRACE:基于上下文证据的强化学习用于 grounded 响应和回避

Yibo Zhao, Jiapeng Zhu, Zichen Ding, Xiang Li

机构 * School of Data Science and Engineering, East China Normal University(数据科学与工程学院,东华大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 GRACE通过强化学习框架整合证据基础和可靠回避,解决检索增强生成中的准确性和回避性问题,实现高准确率与低标注成本的平衡。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04251 2026-01-09 cs.SI cs.AI cs.HC 70%

Using Grok to Avoid Personal Attacks While Correcting Misinformation on X

利用Grok避免人身攻击以纠正X平台上的虚假信息

Kevin Matthe Caramancion

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究发现,使用Grok纠正X平台上的虚假信息可显著减少人身攻击,表明AI中介可能改善公共争议的社会互动

Comments 5 pages, 2 columns, 2 tables, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04518 2026-01-09 cs.AI cs.LG 62%

Integrating Distribution Matching into Semi-Supervised Contrastive Learning for Labeled and Unlabeled Data

将分布匹配整合到半监督对比学习中以处理标记和未标记数据

Shogo Nakayama, Masahiro Okuda

机构 * Doshisha University(大阪大学)

专题命中 其他LLM :prompting(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过整合分布匹配技术,提升半监督对比学习中伪标签的利用效率,以提高图像分类性能。

Comments ITC-CSCC accepted

Journal ref 2025 International Technical Conference on Circuits/Systems, Computers, and Communications (ITC-CSCC), Seoul, Korea, Republic of, 2025, pp. 1-5,

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04270 2026-01-09 cs.LG 57%

Predictable Gradient Manifolds in Deep Learning: Temporal Path-Length and Intrinsic Rank as a Complexity Regime

深度学习中的可预测梯度流形:时间路径长度与内在秩作为复杂性制度

Anherutowa Calvo

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 本文提出通过时间路径长度和内在秩来表征深度学习优化的低复杂度时间制度,为优化动态提供新视角。

Comments 12 Pages. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17144 2026-01-09 cs.DB cs.AI 57%

Metasql: A Generate-then-Rank Framework for Natural Language to SQL Translation

Metasql: 一种自然语言到SQL翻译的生成后排序框架

Yuankai Fan, Zhenying He, Tonghui Ren, Can Huang, Yinan Jing, Kai Zhang, X. Sean Wang

机构 * School of Computer Science, Fudan University, Shanghai, China(计算机科学学院,复旦大学,上海,中国)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 Metasql通过引入查询元数据和学习排序算法,提升自然语言到SQL翻译的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04964 2026-01-09 physics.optics 50%

Nonlinear virtual lens for programmable and multispectral infrared upconversion imaging

非线性虚拟透镜用于可编程和多光谱红外上转换成像

Ze Zheng, Olga Sergaeva, Davide Rocco, Yuchen Zhang, Guoquan Zhang, Mohsen Rahmani, Costantino De Angelis, Lei Xu

专题命中 其他LLM :SLM(abstract)

AI总结 本研究提出了一种非线性虚拟透镜,实现可编程和多光谱红外上转换成像,通过可调带宽和聚焦功能提升红外成像性能。

Comments 19 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏