arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-22 至 2025-12-22 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 11 篇

2509.22818 2025-12-22 cs.AI cs.CY 89%

Can Large Language Models Develop Gambling Addiction?

大语言模型能否产生赌博成瘾?

Seungpil Lee, Donghyeon Shin, Yunjeong Lee, Sundong Kim

机构 * Department of AI Convergence, Gwangju Institute of Science and Technology(人工智能融合系,全州科学技术院)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本研究探讨大语言模型在老虎机实验中表现出赌博成瘾行为,揭示其决策机制与风险认知特征,指出模型行为受抽象决策特征控制而非单纯依赖训练数据。

Comments 26 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17669 2025-12-22 cs.CL 88%

Generating Completions for Broca's Aphasic Sentences Using Large Language Models

利用大语言模型生成布罗卡失语症患者句子的完成

Sijbren van Vaals, Yevgen Matusevych, Frank Tsiwah

机构 * Center for Language and Cognition Groningen, University of Groningen(格罗宁根大学语言与认知中心)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本研究利用大语言模型生成布罗卡失语症患者句子的完成,通过合成数据训练模型以提升其在语法规则缺失句子重建中的性能。

Comments in IEEE Journal of Biomedical and Health Informatics

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19041 2025-12-22 cs.CL cs.AI cs.CV cs.LG cs.MM 85%

LookAhead Tuning: Safer Language Models via Partial Answer Previews

LookAhead Tuning: 通过部分答案预览实现更安全的语言模型

Kangwei Liu, Mengru Wang, Yujie Luo, Lin Yuan, Mengshu Sun, Lei Liang, Zhiqiang Zhang, Jun Zhou, Bryan Hooi, Shumin Deng

机构 * Zhejiang University(浙江大学) Zhejiang University - Ant Group Joint Laboratory of Knowledge Graph(浙江大学-蚂蚁集团知识图谱联合实验室) Ant Group(蚂蚁集团) National University of Singapore(新加坡国立大学)

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 LookAhead Tuning通过预览部分答案前缀,有效保持语言模型在微调过程中的安全性,同时不损害下游任务的性能。

Comments WSDM 2026 short

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17224 2025-12-22 cs.CV 82%

Any-Optical-Model: A Universal Foundation Model for Optical Remote Sensing

Any-Optical-Model: 一种通用的光学遥感基础模型

Xuyang Li, Chenyu Li, Danfeng Hong

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract)

AI总结 Any-Optical-Model提出了一种通用的光学遥感基础模型,能够适应任意波段配置、传感器类型和分辨率尺度,通过多尺度自适应补丁嵌入和语义对齐机制实现光谱-空间关系建模,有效提升遥感任务的泛化能力和实际应用性能。

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01037 2025-12-22 cs.CL cs.AI 81%

When Safety Blocks Sense: Measuring Semantic Confusion in LLM Refusals

当安全阻止感知:测量大语言模型拒绝中的语义混淆

Riad Ahmed Anonto, Md Labid Al Nahiyan, Md Tanvir Hassan

机构 * Department of Computer Science and Engineering, Bangladesh University of Engineering and Technology (BUET)(计算机科学与工程系,孟加拉国工程与技术大学)

专题命中 预训练与数据 :LLM(title);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出语义混淆的概念及测量框架,通过ParaGuard语料库和三种模型无关指标,揭示大语言模型拒绝中的局部不一致问题,帮助开发者优化安全与准确性平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16248 2025-12-22 cs.CL cs.AI 79%

Sigma-MoE-Tiny Technical Report

Sigma-MoE-Tiny 技术报告

Qingguo Hu, Zhenghao Lin, Ziyue Yang, Yucheng Ding, Xiao Liu, Yuting Jiang, Ruizhe Wang, Tianyu Chen, Zhongxin Guo, Yifan Xiong, Rui Gao, Lei Qu, Jinsong Su, Peng Cheng, Yeyun Gong

机构 * Microsoft Research(微软研究院)

专题命中 预训练与数据 :language model(abstract);foundation model(abstract);post-training(abstract);分类 cs.CL、cs.AI

AI总结 Sigma-MoE-Tiny通过极端稀疏性实现高效参数利用,采用渐进稀疏化计划解决负载平衡问题,取得顶级性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07414 2025-12-22 cs.AI cs.CL cs.GT 73%

Language Self-Play For Data-Free Training

数据自由训练的语言自博弈

Jakub Grudzien Kuba, Mengting Gu, Qi Ma, Yuandong Tian, Vijai Mohan, Jason Chen

机构 * Meta Superintelligence Labs(Meta超智能实验室)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出语言自博弈方法,通过模型与自身博弈实现数据自由训练,提升指令遵循、数学和编码任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15431 2025-12-22 cs.CV 67%

Step-GUI Technical Report

Step-GUI 技术报告

Haolong Yan, Jia Wang, Xin Huang, Yeqing Shen, Ziyang Meng, Zhimin Fan, Kaijun Tan, Jin Gao, Lieyu Shi, Mi Yang, Shiliang Yang, Zhirui Wang, Brian Li, Kang An, Chenyang Li, Lei Lei, Mengmeng Duan, Danxun Liang, Guodong Liu, Hang Cheng, Hao Wu, Jie Dong, Junhao Huang, Mei Chen, Renjie Yu, Shunshan Li, Xu Zhou, Yiting Dai, Yineng Deng, Yingdan Liang, Zelin Chen, Wen Sun, Chengxu Yan, Chunqin Xu, Dong Li, Fengqiong Xiao, Guanghao Fan, Guopeng Li, Guozhen Peng, Hongbing Li, Hang Li, Hongming Chen, Jingjing Xie, Jianyong Li, Jingyang Zhang, Jiaju Ren, Jiayu Yuan, Jianpeng Yin, Kai Cao, Liang Zhao, Liguo Tan, Liying Shi, Mengqiang Ren, Min Xu, Manjiao Liu, Mao Luo, Mingxin Wan, Na Wang, Nan Wu, Ning Wang, Peiyao Ma, Qingzhou Zhang, Qiao Wang, Qinlin Zeng, Qiong Gao, Qiongyao Li, Shangwu Zhong, Shuli Gao, Shaofan Liu, Shisi Gao, Shuang Luo, Xingbin Liu, Xiaojia Liu, Xiaojie Hou, Xin Liu, Xuanti Feng, Xuedan Cai, Xuan Wen, Xianwei Zhu, Xin Liang, Xin Liu, Xin Zhou, Yifan Sui, Yingxiu Zhao, Yukang Shi, Yunfang Xu, Yuqing Zeng, Yixun Zhang, Zejia Weng, Zhonghao Yan, Zhiguo Huang, Zhuoyu Wang, Zihan Yan, Zheng Ge, Jing Li, Yibo Zhu, Binxing Jiao, Xiangyu Zhang, Daxin Jiang

机构 * GELab-Team(GELab团队)

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

AI总结 Step-GUI 是一种先进的 GUI 代理,通过自我进化训练管道和 GUI-MCP 协议,在保持高准确率的同时实现高效隐私保护的 GUI 自动化。

Comments 41 pages, 26 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15692 2025-12-22 cs.RO cs.AI cs.CV cs.LG 62%

mimic-video: Video-Action Models for Generalizable Robot Control Beyond VLAs

mimic-video: 用于超越VLAs的通用机器人控制的视频-动作模型

Jonas Pai, Liam Achenbach, Victoriano Montesinos, Benedek Forrai, Oier Mees, Elvis Nava

机构 * mimic robotics Microsoft Zurich(微软瑞士分公司) ETH Zurich(苏黎世联邦理工学院) ETH AI Center(苏黎世联邦理工学院人工智能中心) UC Berkeley(伯克利大学)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

AI总结 mimic-video通过结合预训练的视频模型和基于流匹配的动作解码器,实现了更有效的机器人控制,提升了样本效率和收敛速度。

Comments Revised Introduction, Related Work, and Appendix. Additional minor notational and grammatical fixes

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17178 2025-12-22 cs.CV cs.IR 50%

ABE-CLIP: Training-Free Attribute Binding Enhancement for Compositional Image-Text Matching

ABE-CLIP: 无训练属性绑定增强用于组合图像-文本匹配

Qi Zhang, Yuxu Chen, Lei Deng, Lili Shen

机构 * School of Mathematics, Sichuan University(四川大学数学学院)

专题命中 预训练与数据 :pretraining(abstract)

AI总结 ABE-CLIP通过语义细化和局部对齐策略提升CLIP模型的属性-物体绑定性能,无需额外训练。

Comments 10 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09116 2025-12-22 cs.CV 50%

Zero-shot Hierarchical Plant Segmentation via Foundation Segmentation Models and Text-to-image Attention

零shot分层植物分割:通过基础分割模型和文本到图像注意力

Junhao Xing, Ryohei Miyakawa, Yang Yang, Xinpeng Liu, Risa Shinoda, Hiroaki Santo, Yosuke Toda, Fumio Okura

机构 * The University of Osaka(大阪大学) Phytometrics Nagoya University(名古屋大学)

专题命中 预训练与数据 :language model(abstract)

AI总结 ZeroPlantSeg通过基础分割模型和文本到图像注意力实现零shot分层植物分割,有效提取植物个体,优于现有方法。

Comments WACV 2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏