arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-11 至 2026-02-11 共收录 16 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 16 篇

2602.09528 2026-02-11 cs.CV 88%

SchröMind: Mitigating Hallucinations in Multimodal Large Language Models via Solving the Schrödinger Bridge Problem

SchröMind: 通过求解薛定谔桥问题减轻多模态大语言模型中的幻觉

Ziqiang Shi, Rujie Liu, Shanshan Yu, Satoshi Munakata, Koichi Shirahata

机构 * Fujitsu Research \& Development Center Co.,LTD., Beijing, China Fujitsu Limited, Tokyo, Japan

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)

AI总结 SchröMind通过求解薛定谔桥问题,有效减轻多模态大语言模型中的幻觉问题,提升模型在医疗等高风险领域的应用能力。

Comments ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09362 2026-02-11 econ.GN cs.AI q-fin.EC 87%

Behavioral Economics of AI: LLM Biases and Corrections

人工智能行为经济学:大语言模型的偏见与修正

Pietro Bini, Lin William Cong, Xing Huang, Lawrence J. Jin

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文研究了大语言模型在经济决策中的偏见问题,通过实验发现模型在不同任务中表现出不同的行为模式,并提出通过提示使模型做出理性决策以减少偏见。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05819 2026-02-11 cs.HC 87%

Authorship Drift: How Self-Efficacy and Trust Evolve During LLM-Assisted Writing

作者漂移:在LLM辅助写作中自我效能与信任如何演变

Yeon Su Park, Nadia Azzahra Putri Arvi, Seoyoung Kim, Juho Kim

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究探讨了在LLM辅助写作中,自我效能和信任如何演变,并提出了支持人类与LLM协作中作者身份的设计建议。

Comments Conditionally accepted to CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09410 2026-02-11 cs.AR cs.AI 85%

Accelerating Post-Quantum Cryptography via LLM-Driven Hardware-Software Co-Design

通过LLM驱动的硬件软件协同设计加速后量子密码学

Yuchao Liao, Tosiron Adegbija, Roman Lysecky

机构 * Electrical \& Computer Engineering University of Arizona Tucson, AZ, USA

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出利用LLM驱动硬件软件协同设计加速PQC,通过FALCON方案实现内核执行时间提升2.6倍,同时优化资源利用与功耗。

Comments Accepted at the 27th International Symposium on Quality Electronic Design (ISQED 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09504 2026-02-11 q-fin.GN cs.AI 81%

Seeing the Goal, Missing the Truth: Human Accountability for AI Bias

看见目标,却错过真相:人类对AI偏见的责任

Sean Cao, Wei Jiang, Hui Xu

机构 * University of Maryland(马里兰大学) Robert H. Smith School of Business, University of Maryland, College Park(马里兰大学罗伯特·H·史密斯商学院) Emory University(埃默里大学) Lancaster University(兰卡斯特大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本研究发现,人类设定的目标会影响LLM的行为,导致生成有偏见的指标,但这种偏见并非算法问题,而是源于人类在设计中确保AI测量的统计有效性

Comments 17 pages, 3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22576 2026-02-11 cs.LG cs.CL 81%

EPO: Entropy-regularized Policy Optimization for LLM Agents Reinforcement Learning

EPO:基于LLM代理强化学习的熵正则化策略优化

Wujiang Xu, Wentian Zhao, Zhenting Wang, Yu-Jhe Li, Can Jin, Mingyu Jin, Kai Mei, Kun Wan, Dimitris N. Metaxas

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL、cs.LG

AI总结 EPO通过熵正则化策略优化解决多轮稀疏奖励环境下的探索-利用问题,提升LLM代理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09312 2026-02-11 cs.CL cs.AI cs.LG 80%

Don't Shoot The Breeze: Topic Continuity Model Using Nonlinear Naive Bayes With Attention

别射流风:使用非线性朴素贝叶斯与注意机制的主题连续性模型

Shu-Ting Pi, Pradeep Bagavan, Yejia Li, Disha, Qun Liu

机构 * Amazon(亚马逊)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种基于非线性朴素贝叶斯与注意力机制的主题连续性模型,用于评估对话响应与初始话题的一致性,有效处理长对话并提升可解释性。

Comments EMNLP 2024: Industry Track; 8 pages, 2 figures, 1 table

Journal ref Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing: Industry Track, pages 65-72

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09489 2026-02-11 cs.AI 79%

Computing Conditional Shapley Values Using Tabular Foundation Models

利用表格基础模型计算条件Shapley值

Lars Henry Berge Olsen, Dennis Christensen

机构 * Norwegian Computing Center(挪威计算中心) Norwegian Defence Research Establishment (FFI)(挪威国防研究机构(FFI))

专题命中 其他LLM :foundation model(title,abstract);分类 cs.AI

AI总结 本文利用TabPFN模型高效计算条件Shapley值,在模拟和真实数据上表现优异,运行效率高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16449 2026-02-11 cs.HC cs.AI cs.RO 77%

Affective and Conversational Predictors of Re-Engagement in Human-Robot Interactions -- A Student-Centered Study with A Humanoid Social Robot

情感与会话预测人类与机器人互动中重新参与的因素——一项以学生为中心的研究,使用人形社交机器人

Hangyeol Kang, Thiago Freitas dos Santos, Maher Ben Moussa, Nadia Magnenat-Thalmann

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究发现,机器人对话的有趣性和自然性是影响用户重新参与的主要因素,而非情感特征。

Comments 27 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09496 2026-02-11 cs.HC 75%

Jokeasy: Exploring Human-AI Collaboration in Thematic Joke Generation

Jokeasy:探索主题笑话生成中的人机协作

Yate Ge, Lin Tian, Chiqian Xu, Luyao Xu, Meiying Li, Yuanda Hu, Weiwei Guo

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 Jokeasy通过人机协作提升主题笑话生成,结合搜索功能与双角色LLM代理,优化创意流程与素材整合。

Comments Accepted at IASDR 2025. This is the author-accepted version. Correspondence to first author: geyate@gmail.com

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18340 2026-02-11 cs.LG 70%

Why Policy Gradient Algorithms Work for Undiscounted Total-Reward MDPs

为何策略梯度算法适用于未折扣总奖励MDP

Jongmin Lee, Ernest K. Ryu

机构 * Seoul National University, Department of Mathematical Sciences(首尔国立大学数学科学系) UCLA, Department of Mathematics(加州大学洛杉矶分校数学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文探讨了为何策略梯度算法在未折扣总奖励MDP中有效,通过状态分类和暂态访问度量的分析,解决了γ=1时的收敛问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15831 2026-02-11 cs.CV 67%

UniFit: Towards Universal Virtual Try-on with MLLM-Guided Semantic Alignment

UniFit: 向基于多模态大语言模型引导的语义对齐的通用虚拟试衣迈进

Wei Zhang, Yeying Jin, Xin Li, Yan Zhang, Xiaofeng Cong, Cong Wang, Fengcai Qiao, zhichao Lian

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 UniFit通过多模态大语言模型引导的语义对齐模块,解决虚拟试衣中语义差距和数据稀缺问题,实现通用且高性能的试衣框架。

Comments accepted to AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09225 2026-02-11 cs.LG 57%

Barycentric alignment for instance-level comparison of neural representations

实例层面神经表示的重心对齐

Shreya Saha, Zoe Wanying He, Meenakshi Khosla

机构 * Department of XXX, University of YYY, Location, Country(YYY大学XXX系) School of ZZZ, Institute of WWW, Location, Country(WWW研究所ZZZ学院) Department of Electrical and Computer Engineering, UCSD(UCSD电子与计算机工程系) Cognitive Science Department, UCSD(UCSD认知科学系) Department of Computer Science(计算机科学系)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 通过实例层面的神经表示重心对齐,揭示了跨视觉和语言模型的表示收敛与发散特性,并展示了人类对齐的跨模态比较能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09078 2026-02-11 cs.CR cs.AI cs.ET cs.NI 57%

Framework for Integrating Zero Trust in Cloud-Based Endpoint Security for Critical Infrastructure

云环境下的关键基础设施端点安全中零信任架构整合框架

Shyam Kumar Gajula

专题命中 其他LLM :prompting(abstract);分类 cs.AI

AI总结 本文提出一种云环境中关键基础设施端点安全的零信任架构整合框架,旨在提升合规性和持续保护能力。

Comments 12 pages

Journal ref International Journal of Cyber Security, Vol. 4, No. 1 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09521 2026-02-11 cs.CV 50%

Attention to details, logits to truth: visual-aware attention and logits enhancement to mitigate hallucinations in LVLMs

关注细节,logits到真相:视觉感知注意力与logits增强以减轻LVLMs中的幻觉

Jingyi Wang, Fei Li, Rujie Liu

专题命中 其他LLM :language model(abstract)

AI总结 本文提出一种无需训练的注意力干预算法,通过增强任务相关token的注意力和改进解码过程,有效减少LVLMs中的幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05603 2026-02-11 econ.EM 50%

Nonparametric Testability of Slutsky Symmetry

非参数检验的Slutsky对称性

Florian Gunsilius, Lonjezo Sithole

专题命中 其他LLM :prompting(abstract)

AI总结 本文提出非参数条件分位数限制,用于检验Slutsky对称性在存在个体异质性和内生性的情况下是否可检验,并扩展了非分离模型中部分效应的识别结果。

Comments Shortened paper to testability result, fixed small error in Lemma 2.1 and changed the notation substantially for better tractability

详情

展开后加载摘要…

URL PDF HTML 收藏