arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-30 至 2025-12-30 共收录 20 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 20 篇

2512.22603 2025-12-30 cs.CL 89%

Structured Prompting and LLM Ensembling for Multimodal Conversational Aspect-based Sentiment Analysis

结构化提示与大语言模型集成用于多模态对话基于方面的情感分析

Zhiqiang Gao, Shihao Gao, Zixing Zhang, Yihao Guo, Hongyu Chen, Jing Han

机构 * Hunan University(湖南大学) University of Cambridge(剑桥大学)

专题命中 其他LLM :prompting(title,abstract);LLM(title);large language model(abstract);language model(abstract)

AI总结 本文提出结构化提示与大语言模型集成方法,用于多模态对话基于方面的情感分析,有效提升情感识别与翻转检测的准确性。

Journal ref ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03831 2025-12-30 cs.LG physics.atm-clus physics.chem-ph physics.comp-ph 88%

A large language model-type architecture for high-dimensional molecular potential energy surfaces

用于高维分子势能面的大型语言模型型架构

Xiao Zhu, Srinivasan S. Iyengar

机构 * Department of Chemistry, Department of Physics(化学系、物理系) the Indiana University Quantum Science(印第安纳大学量子科学) Engineering Center (IU-QSEC), Indiana University, 800 E. Kirkwood Ave, Bloomington, IN-47405(工程中心(IU-QSEC),印第安纳大学,800 E. Kirkwood Ave,布卢明顿,IN-47405)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本文提出了一种基于图神经网络的架构,用于高效计算高维分子势能面,实现了对186维势能面的高精度预测。

Comments 31 pages, 35 figures

Journal ref Phys. Rev. X, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23136 2025-12-30 cs.HC 87%

Understanding EFL Learners' Code-Switching and Teachers' Pedagogical Approaches in LLM-Supported Speaking Practice

理解外语学习者在LLM支持下的语用转换及教师教学方法

Junyeong Park, Jieun Han, Yeon Su Park, Youngbin Lee, Suin Kim, Juho Kim, Alice Oh, So-Yeon Ahn

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本研究探讨了LLM支持下EFL学习者语用转换的使用及教师教学策略,发现学习者通过语用转换表达文化情感,教师采用动态支架策略促进有意义学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05499 2025-12-30 cs.CR cs.AI cs.CL cs.SE 86%

Prompt Injection attack against LLM-integrated Applications

针对集成大语言模型应用的提示注入攻击

Yi Liu, Gelei Deng, Yuekang Li, Kailong Wang, Zihao Wang, Xiaofeng Wang, Tianwei Zhang, Yepang Liu, Haoyu Wang, Yan Zheng, Leo Yu Zhang, Yang Liu

机构 * Griffith University(格里菲斯大学) Nanyang Technological University(南洋理工大学) University of New South Wales(新南威尔士大学) Huazhong University of Science and Technology(华中科技大学) Indiana University at Bloomington(印第安纳大学布卢明顿分校) Southern University of Science and Technology(南方科技大学) Tianjin University(天津大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出HouYi技术,揭示LLM集成应用中提示注入攻击的潜在风险及缓解方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22625 2025-12-30 cs.AI cs.MA 85%

The Wisdom of Deliberating AI Crowds: Does Deliberation Improve LLM-Based Forecasting?

众智AI深思:深思是否能提升基于LLM的预测?

Paul Schneider, Amalie Schramm

机构 * PRIORB

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究探讨通过让LLM互相审查预测是否能提升其准确性,发现结构化深思在多样化模型中有效,但对同质模型无帮助。

Comments 13 pages, 2 figures, 5 tables, for source code and data see https://github.com/priorb-source/delib-ai-wisdom

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22790 2025-12-30 cs.HC 85%

ChatGraPhT: A Visual Conversation Interface for Multi-Path Reflection with Agentic LLM Support

ChatGraPhT: 多路径反思的视觉对话界面与代理LLM支持

Geoff Kimm, Linus Tan

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 ChatGraPhT通过可视化对话地图和代理LLM支持,提升复杂任务中的反思深度与灵活性。

Comments Early-stage research prototype; exploratory study

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22462 2025-12-30 cs.HC cs.CY 85%

Relational Mediators: LLM Chatbots as Boundary Objects in Psychotherapy

关系调解者:LLM聊天机器人作为心理治疗中的边界对象

Jiatao Quan, Ziyue Li, Tian Qi Zhu, Yuxuan Li, Baoying Wang, Wanda Pratt, Nan Gao

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出动态边界调解框架,旨在通过LLM聊天机器人调解心理治疗中的关系复杂性,解决边缘化用户在信任建立、身份教育和自我披露中的挑战。

Comments To be published in CSCW 2026, Issue 2 of PACMHCI, 35 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00256 2025-12-30 cs.SE 85%

LLM4FP: LLM-Based Program Generation for Triggering Floating-Point Inconsistencies Across Compilers

LLM4FP: 基于大型语言模型的程序生成以触发不同编译器间的浮点不一致

Yutong Wang, Cindy Rubio-González

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 LLM4FP通过生成浮点程序触发不同编译器间的不一致,提升数值不一致检测能力,揭示更多优化级别间的不匹配。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10321 2025-12-30 cs.LG cs.AI cs.CL cs.CR 85%

AdvPrefix: An Objective for Nuanced LLM Jailbreaks

AdvPrefix: 一种面向 nuanced LLM 模型 jailbreak 的目标

Sicheng Zhu, Brandon Amos, Yuandong Tian, Chuan Guo, Ivan Evtimov

机构 * University of Maryland, College Park(马里兰大学 College Park分校) FAIR, Meta(Meta的FAIR)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 AdvPrefix 提出了一种新的目标,通过结合高预填充攻击成功率和低负对数似然来选择模型依赖的前缀,以提升 jailbreak 攻击的精确性和有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23676 2025-12-30 cs.AI cs.CL cs.CV 79%

Web World Models

Jichen Feng, Yifan Zhang, Chenggong Zhang, Yifu Lu, Shilong Liu, Mengdi Wang

机构 * Princeton University(普林斯顿大学) University of California(加州大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);language agent(abstract);分类 cs.CL、cs.AI

Comments Project Page: https://github.com/Princeton-AI2-Lab/Web-World-Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11239 2025-12-30 cs.CV 78%

Cross-modal Prompting for Balanced Incomplete Multi-modal Emotion Recognition

跨模态提示用于平衡不完整多模态情绪识别

Wen-Jue He, Xiaofeng Zhu, Zheng Zhang

专题命中 其他LLM :prompting(title,abstract)

AI总结 本文提出跨模态提示方法,通过增强模态特定特征和动态加权提升多模态情绪识别的准确性和鲁棒性。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24408 2025-12-30 cs.CR cs.LG 77%

FuncPoison: Poisoning Function Library to Hijack Multi-agent Autonomous Driving Systems

FuncPoison:用于劫持多智能体自动驾驶系统的中毒函数库

Yuzhen Long, Songze Li

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 FuncPoison通过注入恶意工具篡改多智能体自动驾驶系统的函数库,导致决策错误和系统误导,揭示了该领域的重要安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22725 2025-12-30 cs.CL cs.CY 77%

Mitigating Social Desirability Bias in Random Silicon Sampling

在随机硅采样中缓解社会可取性偏差

Sashank Chapala, Maksym Mironov, Songgaojun Deng

机构 * Eindhoven University of Technology(埃因霍温理工大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究通过提示工程方法减轻LLM中的社会可取性偏差,提升硅样本与人类数据的一致性。

Comments 31 pages, 9 figures, and 24 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22903 2025-12-30 cs.LG cs.CL 73%

Debugging Tabular Log as Dynamic Graphs

基于动态图的表格日志调试

Chumeng Liang, Zhanyang Jin, Zahaib Akhtar, Mona Pereira, Haofei Yu, Jiaxuan You

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Amazon(亚马逊)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出GraphLogDebugger框架,利用动态图模型高效调试表格日志,优于大型语言模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22382 2025-12-30 cs.LG cs.AI stat.ML 73%

Completed Hyperparameter Transfer across Modules, Width, Depth, Batch and Duration

跨模块、宽度、深度、批大小和持续时间的超参数转移

Bruno Mlodozeniec, Pierre Ablin, Louis Béthune, Dan Busbridge, Michal Klein, Jason Ramapuram, Marco Cuturi

机构 * Apple(苹果公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种统一宽度、深度、批大小和持续时间缩放的参数化方法,实现了跨模块超参数的优化与转移,提升了大规模模型的训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23300 2025-12-30 cs.CL 70%

AI4Reading: Chinese Audiobook Interpretation System Based on Multi-Agent Collaboration

AI4Reading: 基于多智能体协作的中文有声书解读系统

Minjiang Huang, Jipeng Qiang, Yi Zhu, Chaowei Zhang, Xiangyu Zhao, Kui Yu

机构 * Yangzhou University(扬州大学) City University of Hong Kong(香港城市大学) Hefei University of Technology(合肥工业大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 AI4Reading通过多智能体协作,利用大语言模型和语音合成技术,生成更简洁准确的有声书解读内容。

Comments ACL 2025 demo

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09525 2025-12-30 cs.CV 67%

Learning Spatial Decay for Vision Transformers

学习空间衰减以用于视觉变换器

Yuxin Mao, Zhen Qin, Jinxing Zhou, Bin Fan, Jing Zhang, Yiran Zhong, Yuchao Dai

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出空间衰减变换器(SDT),通过引入上下文感知门控机制,学习动态数据依赖的空间衰减,提升视觉变换器在空间结构化任务中的性能。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01987 2025-12-30 cs.LG cs.AI cs.RO 62%

Forecasting in Offline Reinforcement Learning for Non-stationary Environments

非平稳环境下的离线强化学习预测

Suzan Ece Ada, Georg Martius, Emre Ugur, Erhan Oztop

机构 * Bogazici University(博科西大学) University of Tübingen(图宾根大学) Ozyegin University(奥祖根大学) Osaka University(大阪大学)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 非平稳环境下的离线强化学习预测框架FORL,通过结合条件扩散和零样本时间序列模型,提升智能体在非平稳环境中的鲁棒性与性能。

Comments The Thirty-Ninth Annual Conference on Neural Information Processing Systems, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22630 2025-12-30 cs.CL 57%

On the Role of Discreteness in Diffusion LLMs

扩散语言模型中离散性的作用

Ziqi Jin, Bin Wang, Xiang Lin, Lidong Bing, Aixin Sun

机构 * MiroMind AI Nanyang Technological University(南洋理工大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 本文探讨了扩散语言模型中离散性的重要性,指出现有方法在结构权衡上的不足,并提出了更符合文本结构的扩散过程改进方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11244 2025-12-30 cs.CL 57%

Iterative Multilingual Spectral Attribute Erasure

迭代多语言光谱属性擦除

Shun Shao, Yftah Ziser, Zheng Zhao, Yifu Qiu, Shay B. Cohen, Anna Korhonen

机构 * University of Cambridge(剑桥大学) University of Edinburgh(爱丁堡大学) NVIDIA Research(NVIDIA研究)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 IMSAE通过迭代SVD截断在多语言中减轻联合偏见子空间,优于传统单语言和跨语言去偏方法。

Comments Accepted to the main conference of EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏