arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-24 至 2025-12-24 共收录 7 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7 篇

2512.20162 2025-12-24 cs.AI 89%

Concept Generalization in Humans and Large Language Models: Insights from the Number Game

人类与大语言模型的概念泛化:来自数字游戏的洞察

Arghavan Bazigaran, Hansem Sohn

机构 * Department of Biomedical Engineering, Sungkyunkwan University, South Korea(生物医学工程系,全州大学,韩国)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 研究通过数字游戏对比人类与大语言模型在概念泛化上的差异,揭示人类灵活的推理策略与LLM依赖数学规则的本质区别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09349 2025-12-24 cs.CL 81%

DrVoice: Parallel Speech-Text Voice Conversation Model via Dual-Resolution Speech Representations

DrVoice:通过双分辨率语音表示实现平行语音-文本语音对话模型

Chao-Hong Tan, Qian Chen, Wen Wang, Chong Deng, Qinglin Zhang, Luyao Cheng, Hai Yu, Xin Zhang, Xiang Lv, Tianyu Zhao, Chong Zhang, Yukun Ma, Yafeng Chen, Hui Wang, Jiaqing Liu, Xiangang Li, Jieping Ye

机构 * Alibaba Group(阿里巴巴集团)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 DrVoice通过双分辨率语音表示实现语音与文本的平行生成,有效降低计算成本并提升语音基础模型性能。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17004 2025-12-24 cs.CV cs.CL 79%

Vision Language Models are Confused Tourists

视觉语言模型是困惑的游客

Patrick Amadeus Irawan, Ikhlasul Akmal Hanif, Muhammad Dehan Al Kautsar, Genta Indra Winata, Fajri Koto, Alham Fikri Aji

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL

AI总结 本研究提出ConfusedTourist,通过文化对抗鲁棒性测试揭示视觉语言模型在文化线索干扰下的稳定性问题,发现其在简单扰动下表现显著下降,凸显了多文化环境下模型鲁棒性的关键挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01564 2025-12-24 cs.CL 77%

Enhancing Uncertainty Estimation in LLMs with Expectation of Aggregated Internal Belief

通过聚合内部信念期望增强大语言模型的不确定性估计

Zeguan Xiao, Diyang Dou, Boya Xiong, Yun Chen, Guanhua Chen

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.CL

AI总结 本文提出EAGLE方法,通过聚合内部信念期望提升大语言模型的不确定性估计,改进校准性能。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19484 2025-12-24 econ.GN cs.CE q-fin.EC stat.ML 75%

Structured Event Representation and Stock Return Predictability

结构化事件表示与股票收益可预测性

Gang Li, Dandan Qiao, Mingxuan Zheng

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于结构化事件表示和注意力机制的深度学习模型,用于预测股票收益并提升其可预测性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19933 2025-12-24 cs.CL 70%

PRISM: A Personality-Driven Multi-Agent Framework for Social Media Simulation

PRISM: 一种基于个性的多智能体框架用于社交媒体模拟

Zhixiang Lu, Xueyuan Deng, Yiran Liu, Yulong Li, Qiang Yan, Imran Razzak, Jionglong Su

机构 * University of Liverpool(利物浦大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) University College London(伦敦大学学院) Xi'an Jiaotong-Liverpool University(西安交通大学-利物浦大学) Chinese Academy of Sciences(中国科学院) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 PRISM通过结合连续情绪演变与基于个性的决策过程,提供了一种更准确模拟社交媒体中个性驱动意见极化的框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20034 2025-12-24 cs.IR 67%

VSA:Visual-Structural Alignment for UI-to-Code

VSA:面向UI到代码的视觉-结构对齐

Xian Wu, Ming Zhang, Zhiyu Fang, Fei Li, Bin Wang, Yong Jiang, Hao Zhou

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

AI总结 VSA通过视觉-结构对齐提升UI到代码的模块化和一致性,生成类型安全的组件以提高软件工程效率。

详情

展开后加载摘要…

URL PDF HTML 收藏