arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-19 至 2026-01-19 共收录 12 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12 篇

2601.10719 2026-01-19 cs.AI cs.CL 90%

Do You Trust Me? Cognitive-Affective Signatures of Trustworthiness in Large Language Models

你信任我吗?大型语言模型中信任worthiness的认知-情感特征

Gerard Yeo, Svetlana Churina, Kokil Jaidka

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI

AI总结 研究揭示大型语言模型通过认知-情感特征隐式编码信任worthiness,为构建可信AI系统提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10986 2026-01-19 cs.CL 88%

ZPD Detector: Data Selection via Capability-Difficulty Alignment for Large Language Models

ZPD检测器:基于能力-难度对齐的数据选择用于大语言模型

Bo Yang, Yunkui Chen, Lanfei Feng, Yu Zhang, Shijian Li

机构 * State Key Laboratory of Brain–Machine Intelligence(脑机智能国家重点实验室) College of Computer Science and Technology, Zhejiang University(计算机科学与技术学院,浙江大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 ZPD检测器通过能力-难度对齐动态选择高价值样本,提升大语言模型的数据利用效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12537 2026-01-19 cs.CL cs.AI eess.AS 86%

What Makes a Good Speech Tokenizer for LLM-Centric Speech Generation? A Systematic Study

什么使LLM为中心的语音生成中的良好语音分词器?系统研究

Xiaoran Fan, Zhichao Sun, Yangfan Gao, Jingfei Xiong, Hang Yan, Yifei Cao, Jiajun Sun, Shuo Li, Zhihao Zhang, Zhiheng Xi, Yuhao Zhou, Senjie Jin, Changhao Jiang, Junjie Ye, Ming Zhang, Rui Zheng, Zhenhua Han, Yunke Zhang, Demei Yan, Shaokang Dong, Tao Ji, Tao Gui

专题命中 预训练与数据 :LLM(title,abstract);language model(abstract);SLM(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了LLM为中心的语音生成中语音分词器设计的影响,通过引入多令牌预测和说话人感知生成,提升了语音生成的质量和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09105 2026-01-19 cs.AI cs.CL cs.CV 84%

AviationLMM: A Large Multimodal Foundation Model for Civil Aviation

AviationLMM:民用航空的大规模多模态基础模型

Wenbin Li, Jingling Wu, Xiaoyong Lin. Jing Chen, Cong Chen

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI

AI总结 AviationLMM旨在通过统一民用航空的异构数据流,提升航空安全与效率,推动可信且隐私保护的航空人工智能生态系统发展。

Comments Accepted by 2025 7th International Conference on Interdisciplinary Computer Science and Engineering (ICICSE 2025), Chongqing, China; 9 pages,1 figure,5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13137 2026-01-19 cs.AI 81%

Theorem Prover as a Judge for Synthetic Data Generation

定理推理解释器作为合成数据生成的裁判

Joshua Ong Jun Leang, Giwon Hong, Wenda Li, Shay B. Cohen

机构 * School of Informatics, The University of Edinburgh(信息学院,爱丁堡大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);RLHF(abstract)

AI总结 本研究提出TP-as-a-Judge和RLTPF方法,通过定理推理解释器提升LLM的合成数据生成与推理准确性。

Journal ref Proc. ACL 2025, pp. 29941-29977

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10804 2026-01-19 cs.CL 81%

BYOL: Bring Your Own Language Into LLMs

BYOL: 将你的语言带入大语言模型

Syed Waqas Zamir, Wassim Hamidouche, Boulbaba Ben Amor, Luana Marotti, Inbal Becker-Reshef, Juan Lavista Ferres

机构 * Microsoft AI for Good Research Lab(微软人工智能造福人类研究实验室)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 BYOL提出了一种统一框架,通过数据精炼、翻译介导等方法,提升低资源语言的LLM性能,并公开了相关模型和代码。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24992 2026-01-19 cs.CL eess.AS 74%

POWSM: A Phonetic Open Whisper-Style Speech Foundation Model

POWSM:一种基于语音的开放式耳语风格语音基础模型

Chin-Jou Li, Kalvin Chang, Shikhar Bharadwaj, Eunjung Yeo, Kwanghee Choi, Jian Zhu, David Mortensen, Shinji Watanabe

机构 * Carnegie Mellon University(卡内基梅隆大学) University of California, Berkeley(加州大学伯克利分校) University of Texas, Austin(德克萨斯大学奥斯汀分校) University of British Columbia(不列颠哥伦比亚大学)

专题命中 预训练与数据 :foundation model(title);分类 cs.CL

AI总结 POWSM是一种能够联合执行多种语音任务的统一框架,实现了音频、文本和音素之间的无缝转换,并在低资源条件下提升了语音处理性能。

Comments 18 pages, under review. Model available at https://huggingface.co/espnet/powsm

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10781 2026-01-19 cs.CV 67%

Future Optical Flow Prediction Improves Robot Control & Video Generation

未来光流预测改进机器人控制与视频生成

Kanchana Ranasinghe, Honglu Zhou, Yu Fang, Luyu Yang, Le Xue, Ran Xu, Caiming Xiong, Silvio Savarese, Michael S Ryoo, Juan Carlos Niebles

机构 * Salesforce AI Research(Salesforce AI研究院) Stony Brook University(石溪大学)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

AI总结 FOFPred通过统一的视觉-语言模型和扩散架构,实现高效的未来光流预测,提升机器人控制与视频生成的性能。

Comments Project Site (Code, Models, Demo): https://fofpred.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11006 2026-01-19 cs.LG 57%

Backdoor Attacks on Multi-modal Contrastive Learning

多模态对比学习中的后门攻击

Simi D Kuniyilh, Rita Machacy

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

AI总结 本文研究了多模态对比学习中的后门攻击问题,分析了攻击方法、威胁模型及防御措施,并探讨了该领域的发展挑战与未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19566 2026-01-19 cs.LG stat.ML 57%

ModHiFi: Identifying High Fidelity predictive components for Model Modification

ModHiFi:识别模型修改的高保真预测组件

Dhruva Kashyap, Chaitanya Murti, Pranav K Nayak, Tanay Narshana, Chiranjib Bhattacharyya

机构 * CSA, IISc(计算机科学与工程系,印度理工学院)

专题命中 预训练与数据 :language model(abstract);分类 cs.LG

AI总结 ModHiFi通过子集保真度度量,在无梯度和损失函数访问的情况下,实现模型剪枝和去学习的高效修改。

Comments NeurIPS 2025 (Spotlight). Our code is available at https://github.com/DhruvaKashyap/modhifi

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11866 2026-01-19 cs.CL 57%

Southern Newswires: A Large-Scale Study of Mid-Century Wire Content Beyond the Front Page

南方新闻电讯:关于20世纪中叶电讯内容的大型研究(超越首页内容)

Michael McRae

机构 * Trinity College Dublin(都柏林三一学院)

专题命中 预训练与数据 :LLM(abstract);分类 cs.CL

AI总结 本文通过构建1960-1975年间南方报纸的电讯语料库,研究20世纪中叶南方新闻报道的广泛内容及编辑差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20114 2026-01-19 cs.IR cs.AI cs.CV 57%

FiCo-ITR: bridging fine-grained and coarse-grained image-text retrieval for comparative performance analysis

FiCo-ITR:弥合细粒度与粗粒度图像-文本检索以进行性能比较分析

Mikel Williams-Lekuona, Georgina Cosma

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI

AI总结 FiCo-ITR通过标准化评估方法,对比细粒度与粗粒度图像-文本检索模型的性能与效率权衡,为模型选择和混合系统研究提供依据。

Comments Published at the International Journal of Multimedia Information Retrieval

详情

展开后加载摘要…

URL PDF HTML 收藏