arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-25 至 2025-12-25 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 6 篇

2512.21107 2025-12-25 cs.CL cs.AI cs.LG 89%

Semi-Supervised Learning for Large Language Models Safety and Content Moderation

大型语言模型安全性和内容审核的半监督学习

Eduard Stefan Dinuta, Iustin Sirbu, Traian Rebedea

机构 * National University of Science and Technology Politehnica Bucharest(波兰技术大学科学与技术国家大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出利用半监督学习提升大型语言模型的安全性,通过结合标记和未标记数据以及任务特定增强技术,提高安全分类器的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14368 2025-12-25 cs.CV cs.CL cs.LG 86%

O3SLM: Open Weight, Open Data, and Open Vocabulary Sketch-Language Model

O3SLM:开放权重、开放数据和开放词汇草图-语言模型

Rishi Gupta, Mukilan Karuppasamy, Shyam Marjit, Aditay Tripathi, Anirban Chakraborty

机构 * IISc(印度理工学院)

专题命中 预训练与数据 :language model(title,abstract);instruction tuning(abstract);pretraining(abstract);分类 cs.CL、cs.LG

AI总结 O3SLM通过构建大规模图像-草图-指令三元组数据集和训练模型,实现了对草图理解和推理的突破性进展。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21316 2025-12-25 econ.GN cs.AI cs.HC q-fin.EC 83%

Scaling Laws for Economic Productivity: Experimental Evidence in LLM-Assisted Consulting, Data Analyst, and Management Tasks

经济生产力的扩展定律:在LLM辅助咨询、数据分析师和管理任务中的实验证据

Ali Merali

专题命中 预训练与数据 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过实验发现,LLM训练计算量和算法进展可提升专业任务效率,非代理分析任务的生产力增益更大,预计未来十年美国生产力将提升约20%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21332 2025-12-25 cs.CL cs.AI 82%

C2LLM Technical Report: A New Frontier in Code Retrieval via Adaptive Cross-Attention Pooling

C2LLM技术报告:通过自适应跨注意力池化实现代码检索的新前沿

Jin Qin, Zihan Liao, Ziyin Zhang, Hang Yu, Peng Di, Rui Wang

机构 * Ant Group(蚂蚁集团) Shanghai Jiao Tong University(上海交通大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 C2LLM通过自适应跨注意力池化技术,实现更高效的代码检索,其模型在代码嵌入任务中取得新突破。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21028 2025-12-25 cs.SE 80%

Artificial or Just Artful? Do LLMs Bend the Rules in Programming?

人工还是艺术?LLMs在编程中是否会打破规则?

Oussama Ben Sghaier, Kevin Delcourt, Houari Sahraoui

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);prompting(abstract)

AI总结 本文研究了LLMs在不同提示条件下如何调整代码生成策略,发现测试可见性显著影响性能,测试驱动的细化成为主要适应策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09016 2025-12-25 cs.SD cs.AI eess.AS 57%

DiTSinger: Scaling Singing Voice Synthesis with Diffusion Transformer and Implicit Alignment

DiTSinger: 通过扩散变换器和隐式对齐扩展歌唱语音合成

Zongcai Du, Guilin Deng, Xiaofeng Guo, Xin Gao, Linke Li, Kaichang Cheng, Fubo Han, Siyu Yang, Peng Liu, Pan Zhong, Qiang Fu

机构 * Migu Music, China Mobile Communications Corporation, China(咪咕音乐,中国移动通信集团,中国)

专题命中 预训练与数据 :LLM(abstract);分类 cs.AI

AI总结 DiTSinger通过扩散变换器和隐式对齐机制实现高效且高保真的歌唱语音合成,解决了数据稀缺和模型扩展性问题。

Comments ICASSP26 under review. Demo page: https://nju-jet.github.io/DiTSinger

详情

展开后加载摘要…

URL PDF HTML 收藏