arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-13 至 2026-01-13 共收录 16 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 16 篇

2601.06424 2026-01-13 cs.CL 89%

Can a Unimodal Language Agent Provide Preferences to Tune a Multimodal Vision-Language Model?

单模语言代理能否为调整多模态视觉-语言模型提供偏好?

Sazia Tabasum Mim, Jack Morris, Manish Dhakal, Yanming Xiu, Maria Gorlatova, Yi Ding

机构 * Georgia State University(佐治亚州立大学) Duke University(杜克大学)

专题命中 其他LLM :language model(title,abstract);language agent(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出通过单模语言代理提供偏好反馈,提升多模态视觉-语言模型的描述能力,实验显示在准确率上提升13%,且人类偏好匹配率达64.6%。

Comments Accepted to IJCNLP-AACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06092 2026-01-13 cs.CY cs.AI 89%

Islamic Chatbots in the Age of Large Language Models

大型语言模型时代下的伊斯兰聊天机器人

Muhammad Aurangzeb Ahmad

机构 * Department of Computer Science & Software Engineering University of Washington Bothell(计算机科学与软件工程系华盛顿大学Bothell分校)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文探讨了大型语言模型驱动的伊斯兰聊天机器人对宗教实践的影响,分析了其在知识获取民主化与权威侵蚀之间的矛盾,并提出负责任设计的建议。

Comments Muslim in ML Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07347 2026-01-13 cs.CL 88%

DiffER: Diffusion Entity-Relation Modeling for Reversal Curse in Diffusion Large Language Models

DiffER: 用于扩散大语言模型中反转诅咒的扩散实体-关系建模

Shaokai He, Kaiwen Wei, Xinyi Zeng, Xiang Chen, Xue Yang, Zhenyang Li, Jiang Zhong, Yu Tian

机构 * Chongqing University(重庆大学) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Hong Kong University of Science and Technology(香港理工大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 DiffER通过实体感知训练和平衡数据构建,解决扩散大语言模型中的反转诅咒问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12195 2026-01-13 cs.CL 85%

Browse and Concentrate: Comprehending Multimodal Content via prior-LLM Context Fusion

浏览与聚焦:通过先验LLM上下文融合理解多模态内容

Ziyue Wang, Chi Chen, Yiqi Zhu, Fuwen Luo, Peng Li, Ming Yan, Ji Zhang, Fei Huang, Maosong Sun, Yang Liu

机构 * Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University, Beijing, China(计算机科学与技术系,人工智能研究院,清华大学,北京,中国) Institute for AI Industry Research (AIR), Tsinghua University, Beijing, China(人工智能产业研究院(AIR),清华大学,北京,中国) Institute of Intelligent Computing, Alibaba Group(智能计算研究院,阿里巴巴集团) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室,上海,中国) Jiangsu Collaborative Innovation Center for Language Competence, Jiangsu, China(江苏省语言能力协同创新中心,江苏,中国)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出浏览与聚焦两阶段范式,通过融合先验LLM上下文提升多模态内容理解,显著提升多图像场景的性能。

Comments 17 pages, 5 figures

Journal ref ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15862 2026-01-13 cs.MA cs.CL 79%

The Subtle Art of Defection: Understanding Uncooperative Behaviors in LLM based Multi-Agent Systems

缺陷的微妙艺术:理解基于大语言模型的多智能体系统中的不合作行为

Devang Kulshreshtha, Wanyu Du, Raghav Jain, Srikanth Doss, Hang Su, Sandesh Swamy, Yanjun Qi

机构 * AWS AI Labs(AWS人工智能实验室) UC San Diego(大学圣地亚哥)

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL

AI总结 本文提出了一种用于分析基于大语言模型的多智能体系统中不合作行为的框架,通过实验发现不合作行为会迅速导致系统崩溃,同时指出现有防御方法存在检测不足的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19212 2026-01-13 cs.RO 78%

Scaffolding Dexterous Manipulation with Vision-Language Models

利用视觉-语言模型实现灵巧操作的支架

Vincent de Bakker, Joey Hejna, Tyler Ga Wei Lum, Onur Celik, Aleksandar Taranovic, Denis Blessing, Gerhard Neumann, Jeannette Bohg, Dorsa Sadigh

专题命中 其他LLM :language model(title,abstract)

AI总结 利用视觉-语言模型生成任务相关轨迹,训练低层RL策略实现灵巧操作,无需人工演示或奖励。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07136 2026-01-13 cs.SE cs.AI 77%

A Large-Scale Study on the Development and Issues of Multi-Agent AI Systems

多智能体AI系统的发展与问题的大型研究

Daniel Liu, Krishna Upadhyay, Vinaik Chhetri, A. B. Siddique, Umar Farooq

机构 * Louisiana State University(路易斯安那州立大学) University of Kentucky(肯塔基大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过分析多智能体AI系统的开发和问题,揭示了生态系统的发展模式及维护挑战,强调了改进测试和文档的重要性。

Comments 8 pages, 8 figures, IEEE BigData Workshop on Software Engineering for Agentic AI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06910 2026-01-13 cs.SE 75%

PenForge: On-the-Fly Expert Agent Construction for Automated Penetration Testing

PenForge: 为自动化渗透测试的实时专家代理构建

Huihui Huang, Jieke Shi, Junkai Chen, Ting Zhang, Yikun Li, Chengran Yang, Eng Lieh Ouh, Lwin Khin Shar, David Lo

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 PenForge通过实时构建专家代理提升自动化渗透测试效果,实现零日设置中30%的利用成功率,比现有方法提高3倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06049 2026-01-13 cs.CY cs.AI 74%

The Violation State: Safety State Persistence in a Multimodal Language Model Interface

违规状态:多模态语言模型接口中的安全状态持续

Bentley DeVilling

专题命中 其他LLM :language model(title);分类 cs.AI

AI总结 研究发现多模态语言模型在面对版权拒绝后,会持续拒绝无关图像生成请求,揭示了会话级安全状态的持续性问题。

Comments 19 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06781 2026-01-13 cs.HC cs.AI cs.CV 70%

AutoTour: Automatic Photo Tour Guide with Smartphones and LLMs

AutoTour:基于智能手机和LLMs的自动照片导览系统

Huatao Xu, Zihe Liu, Zilin Zeng, Baichuan Li, Mo Li

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 AutoTour利用智能手机和LLMs自动为用户照片生成细粒度地标注释和描述,实现可扩展且上下文感知的交互式探索体验。

Comments 21

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06235 2026-01-13 cs.SD cs.AI cs.HC 70%

An Intelligent AI glasses System with Multi-Agent Architecture for Real-Time Voice Processing and Task Execution

基于多智能体架构的智能AI眼镜系统:用于实时语音处理与任务执行

Sheng-Kai Chen, Jyh-Horng Wu, Ching-Yao Lin, Yen-Ting Lin

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种基于多智能体架构的AI眼镜系统,实现实时语音处理与多语言任务执行。

Comments Published in NCS 2025 (Paper No. N0180)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09663 2026-01-13 cs.LG econ.EM math.ST stat.ML stat.TH 70%

Ordinary Least Squares as an Attention Mechanism

普通最小二乘法作为注意力机制

Philippe Goulet Coulombe

机构 * Université du Québec à Montréal(魁北克大学蒙特利尔分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 将普通最小二乘法解释为一种注意力机制,通过变换回归空间中的相似性方法,重新定义OLS的优化目标,连接注意力机制与时间序列计量经济学。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23035 2026-01-13 cs.CV 67%

Toward Stable Semi-Supervised Remote Sensing Segmentation via Co-Guidance and Co-Fusion

迈向稳定的半监督遥感分割:通过共引导与共混淆

Yi Zhou, Xuechao Zou, Shun Zhang, Kai Li, Shiying Wang, Jingming Chen, Congyan Lang, Tengfei Cao, Pin Tao, Yuanchun Shi

机构 * School of Computer Technology and Application, Qinghai University(青海大学计算机技术与应用学院) Intelligent Computing and Application Laboratory of Qinghai Province, Qinghai University(青海省智能计算与应用实验室,青海大学) Key Lab of Big Data & Artificial Intelligence in Transportation (Ministry of Education), School of Computer Science & Technology, Beijing Jiaotong University(交通运输大数据与人工智能重点实验室(教育部),北京交通大学计算机科学与技术学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Key Laboratory of Pervasive Computing, Ministry of Education(教育部普适计算重点实验室)

专题命中 其他LLM :language model(abstract);foundation model(abstract)

AI总结 本文提出Co2S框架,通过融合视觉-语言模型和自监督模型的先验知识,解决半监督遥感分割中的伪标签漂移问题,提升分割精度。

Comments 12 pages, 5 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06087 2026-01-13 cs.CY 67%

The AI Roles Continuum: Blurring the Boundary Between Research and Engineering

人工智能角色连续体:模糊研究与工程之间的边界

Deepak Babu Piskala

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出人工智能角色连续体框架,指出研究与工程角色在能力上重叠,强调流动角色对提升组织效率和学习能力的重要性。

Comments Conceptual analysis and taxonomy grounded in public AI hiring data and organizational artifacts

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12216 2026-01-13 cs.SE cs.AI cs.CL 62%

Training Versatile Coding Agents in Synthetic Environments

在合成环境中训练多功能编码代理

Yiqi Zhu, Apurva Gandhi, Graham Neubig

机构 * Tsinghua University(清华大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

AI总结 SWE-Playground通过从头生成项目和任务,训练多功能编码代理,能够处理更广泛的编码任务并提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06443 2026-01-13 cs.CV 50%

How to Build Robust, Scalable Models for GSV-Based Indicators in Neighborhood Research

如何构建基于GSV指标的稳健、可扩展模型用于邻里研究

Xiaoya Tang, Xiaohe Yue, Heran Mane, Dapeng Li, Quynh Nguyen, Tolga Tasdizen

机构 * University of Utah(犹他大学) Scientific Computing and Imaging Institute(科学计算与成像研究所) University of Maryland(马里兰大学) National Institute of Nursing Research(护理研究国家研究所) National Institutes of Health(卫生研究院) University of Alabama(阿拉巴马大学) Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 其他LLM :foundation model(abstract)

AI总结 本文通过实证分析探讨如何为小规模数据集选择和调整基础模型,利用无监督训练提升对Google Street View图像的稳健、可扩展模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏