arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 762 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 762 篇

2607.18256 2026-07-22 cs.AI cs.LG 新提交 73%

PEARL: Solver-in-the-Loop Interactive Optimization Modeling from Natural Language

PEARL:基于自然语言的循环求解器交互式优化建模

Hongliang Lu, Zhong Li, Yuxuan Chen, Yuan Lan, Fan Zhang, Zaiwen Wen

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究旨在解决优化建模问题,提出PEARL系统,通过在循环中使用Python执行和数学编程求解器,学习优化策略,在多轮工具集成设置下提升求解率,在优化建模任务中表现优于强大基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17146 2026-07-21 cond-mat.dis-nn cs.CL cs.LG 新提交 73%

The Geometry of Semantic Space: A Continuous Geometric Framework for the Transformer Architecture

语义空间的几何:Transformer架构的连续几何框架

Zhihua Liang

机构 * INFN, Sezione di Cagliari(意大利国家核物理研究所,卡利亚里分部)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 该研究提出连续几何框架,将Transformer架构运算建模为积分 - 微分方程,从几何公理出发转化其核心组件。通过实验验证,此框架能为大语言模型的稳定性、上下文及优化动态提供预测性描述词汇。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14769 2026-07-17 cs.CL cs.AI cs.MA 新提交 73%

Dialogue Summarization with Emotion Dynamics Using Topic- and Participant-Centric Decomposition

使用以主题和参与者为中心的分解方法进行具有情感动态的对话摘要

Linyun Xiang, Mark Neerincx, Stephanie Tan

机构 * Delft University of Technology(代尔夫特理工大学)

专题命中 其他LLM :language model(abstract);small language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究针对对话摘要问题,提出基于改进分层智能体链方法的框架,从主题和参与者两个视角分解对话,结合自动推断情感生成摘要,并引入情感轨迹指标评估,实验表明其框架能生成含语义和情感内容的摘要,凸显方法有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11760 2026-07-14 cs.LG cs.CL 新提交 73%

From Expressivity to Sample Complexity: Narrow Teachers for Transformers via C-RASP

从表达能力到样本复杂度:通过C-RASP为Transformer构建窄教师模型

Michael Rizvi-Martel, Satwik Bhattamishra, Guillaume Rabusseau, Michael Hahn

机构 * Mila & Université de Montréal(米拉与蒙特利尔大学) University of Oxford(牛津大学) Saarland University(萨尔兰大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 研究Transformer的理论理解,通过提出手工权重等分析其表达能力。针对其可学习性研究少的问题,受损失景观分析启发,为用Transformer学习C-RASP结构提出初步样本复杂度界限。

Comments 9 pages total

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07891 2026-07-10 cs.CL cs.AI 新提交 73%

How Do I Know What to Say Next? Barenholtz's Autogenerative Theory as an Enrichment of Harrisean Integrationism

我如何知道接下来该说什么?巴伦霍尔茨的自生成理论对哈里斯整合主义的丰富

J. Mark Bishop, Stephen J. Cowley

机构 * Emeritus Goldsmiths, University of London(埃米蒂斯金士顿大学伦敦分校) Emeritus University of Southern Denmark(埃米蒂斯南部丹麦大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文探讨如何用伊兰·巴伦霍尔茨的自生成理论丰富罗伊·哈里斯的整合主义语言学,填补其在符号开放性机制、语言与非语言符号活动连续性及过去整合档案结构属性方面的解释空白,为相关从业者和研究者说明大语言模型统计结构的本质及局限。

Comments Submitted to Philosophy and Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06854 2026-07-09 cs.LG cs.AI cs.GT 新提交 73%

A Gold-Standard Study of What Makes a Lightweight Game-Playing Agent Strong

关于使轻量级博弈代理强大的因素的金标准研究

Nima Kelidari, Mohammadsaeed Haghi, Mahdi Salmani

机构 * University of Southern California(美国南加州大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究不完美信息纸牌游戏中使轻量级博弈代理强大的因素,构建专家代理作标准,经超百次运行确定有效因素,添加基线并应用于另一游戏,得出通用方法可训练有竞争力代理且无需专家训练。

Comments 9 pages, 5 figures, 3 tables. Code and models: https://github.com/Nikelroid/adversarial-coevolution

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05855 2026-07-08 cs.LG cs.AI 新提交 73%

Unsupervised Anomaly Detection of Information Operations Users via Behavioral and Language Patterns

通过行为和语言模式对信息操作用户进行无监督异常检测

Sishun Liu, Sajal Halder, Ke Deng, Yan Wang, Xiuzhen Zhang

机构 * RMIT University(皇家墨尔本理工大学) Macquarie University(麦考瑞大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 研究针对社交媒体网络信息操作检测难题,提出无监督方法TENSOR,利用多模态数据,通过训练时间点过程捕捉异常行为模式,并引入新证据函数调整输出,在五个真实数据集上表现优于基线。

Comments Accepted at ECML/PKDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01859 2026-07-03 cs.AI cs.CL 新提交 73%

Safety Targeted Embedding Exploit via Refinement

通过精炼的安全目标嵌入利用

Joshua Adrian Cahyono

机构 * Nanyang Technological University(南洋理工大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出STEER方法,通过梯度引导攻击识别并翻译关键词语到低资源语言,抑制大语言模型拒绝行为,在多个模型上实现高达96.7%的攻击成功率,揭示安全机制在多语言输入下的泛化缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24177 2026-06-24 cs.SE cs.AI cs.CL cs.MA 新提交 73%

Agon: An Autonomous Large-Scale Omnidisciplinary Research System Built on Prompt Economy

Agon:基于提示经济学的自主大规模全学科研究系统

Youran Sun, Xingyu Ren, Chugang Yi, Jiaxuan Guo, Kejia Zhang, Jianda Du, Haizhao Yang

机构 * University of Maryland, College Park(马里兰大学 College Park 分校) The Chinese University of Hong Kong(香港中文大学) Stanford University(斯坦福大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出Agon研究编排系统,通过提示经济学循环实现大规模自主研究,将可验证任务自动化,不可验证判断留给人类,并分类了系统失败类型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22550 2026-06-23 cs.CV cs.AI cs.CL cs.MM 新提交 73%

Training-Free Semantic Correction for Autoregressive Visual Models

自回归视觉模型的免训练语义校正

Junhao Chen, Chanyu Zhu, Zheqi Lv, Keting Yin, Shengyu Zhang

机构 * Zhejiang University(浙江大学) Shandong University(山东大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出Gazer框架,通过多模态大语言模型反馈在自回归视觉模型采样循环中进行语义诊断与校正,无需额外训练即可提升语义对齐和组合准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20600 2026-06-23 cs.AI cs.LG 新提交 73%

The New Associationism: Lessons from Deep Learning

新联想主义:来自深度学习的启示

Daniel Rothschild

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文论证现代AI的成功支持一种温和但真实的联想主义,认为监督学习作为统一、渐进、错误驱动的学习机制,在深度学习中广泛适用,并反驳了联想主义机制不足以解释人类认知能力的观点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18620 2026-06-18 cs.CL cs.AI 新提交 73%

BCL: Bayesian In-Context Learning Framework for Information Extraction

BCL:面向信息抽取的贝叶斯上下文学习框架

Haoliang Liu, Chengkun Cai, Xu Zhao, Han Zhu, Shizhou Huang, Xinglin Zhang, Tao Chen, Jenq-Neng Hwang, Zhang Huaping, Lei Li

机构 * HiThink Research(海天瑞声研究) University College London(伦敦大学学院) University of Edinburgh(爱丁堡大学) The Hong Kong University of Science and Technology(香港科技大学) East China Normal University(华东师范大学) Shanghai Medical Image Insights(上海医学影像洞察) University of Waterloo(滑铁卢大学) University of Washington(华盛顿大学) Beijing Institute of Technology(北京理工大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出BCL框架,利用贝叶斯更新和粒子滤波优化信息抽取中的上下文学习,在序列标注和关系分类任务上取得显著提升。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17519 2026-06-17 cs.CL cs.AI 新提交 73%

Scaling Enterprise Agent Routing: Degradation, Diagnosis, and Recovery

扩展企业智能体路由:退化、诊断与恢复

Kellen Gillespie, Robyn Perry

机构 * Superhuman, Inc.(Superhuman公司)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 研究企业助手工具库扩展时路由准确率下降问题,通过嵌入预选恢复F1分数10-17个百分点。

Comments 10 pages (6 main + 4 appendix), 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06523 2026-06-17 cs.AI cs.LG cs.LO cs.SE 新提交 73%

Lean4Agent: Formal Modeling and Verification for Agent Workflow and Trajectory

Lean4Agent:面向智能体工作流与轨迹的形式化建模与验证

Ruida Wang, Jerry Huang, Pengcheng Wang, Xuanqing Liu, Luyang Kong, Tong Zhang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Independent researcher(独立研究者)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出Lean4Agent框架,利用依赖类型形式语言Lean4对智能体工作流进行形式化建模与验证,通过FormalAgentLib库和LeanEvolve方法提升工作流可靠性,实验验证通过的工作流性能平均提升11.94%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12774 2026-06-12 eess.SY cs.AI cs.CL cs.SY 新提交 73%

Agentic MPC for Semantic Control System Resynthesis

用于语义控制系统再综合的智能体MPC

Yuya Miyaoka, Masaki Inoue

机构 * University of Tokyo(东京大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出智能体MPC框架,通过集成大语言模型智能体实现上下文感知的语义自适应控制综合,在自动驾驶场景中验证其根据个人偏好或社交情境(如避让应急车辆)调整控制的能力。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07600 2026-06-09 cs.LG cs.AI 新提交 73%

Reachability and asymptotics of Gaussian Transformer dynamics

高斯Transformer动力学的可达性与渐近性

Albert Alcalde, Zhengping Ji, Enrique Zuazua

机构 * Friedrich–Alexander University Erlangen–Nürnberg(弗里德里希-亚历山大大学埃尔朗根-纽伦堡) Research Council of Norway(挪威研究理事会)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 将Transformer数据传播建模为概率测度空间上的非线性控制系统,证明高斯分布在自注意力与仿射前馈层下保持高斯性,从而降维为双线性控制系统,并揭示与Riccati方程的联系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03598 2026-08-05 cs.SE 新提交 71%

From Bug Reports to Browser-Executable Procedures: An LLM-Driven Agent for Web GUI Bug Reproduction

从错误报告到浏览器可执行流程:一种大语言模型驱动的Web GUI错误复现智能体

Cunming Zhang, Yu Pei, Michail Papadakis

专题命中 其他LLM :LLM(title)

AI总结 本文提出ReBug智能体系统,通过分阶段驱动真实浏览器复现Web GUI错误,在667条真实报告上的评估显示其性能优于基线,可有效支持基于报告的浏览器错误复现。

Comments 13 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11472 2026-07-14 cs.CR 新提交 71%

LLM-Guided Program Evolution for Targeted Black-Box Attacks on Perceptual Hash Algorithms

用于对感知哈希算法进行有针对性的黑盒攻击的大语言模型引导的程序进化

A. Krylov, D. Rakhov, V. Veselova, D. Bolokhov, Oleg Y. Rogov

专题命中 其他LLM :LLM(title)

AI总结 研究针对感知哈希算法的黑盒攻击,提出基于GigaEvo和OpenEvolve的进化框架,通过综合分数评估攻击性能,实验表明该方法在减少查询次数、降低L2失真方面优于现有基线,揭示了相关漏洞并推动鲁棒方案开发。

Comments 15 pages, 2 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10598 2026-07-14 cs.CV 新提交 71%

Anomalous Frame Detection by Grouping Frame Similarities between Two Videos Computed by Vision-Language Model to Extract Expert Workers' Unique Actions

通过对视觉语言模型计算的两个视频之间的帧相似性进行分组来检测异常帧,以提取专家工人的独特动作

Ryo Sakai, Yongpeng Cao, Nobutaka Kimura

专题命中 其他LLM :language model(title)

AI总结 针对熟练维护工人减少的问题,提出通过比较两个视频帧相似性检测异常帧来提取专家独特动作的方法,在模拟实验中对特定动作类型提取率达66.9%,比传统技术提高50个百分点,有助于技能转移和劳动力发展。

Comments 11 pages, 6 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19549 2026-08-21 cs.CL cs.HC 新提交 70%

Generating Diverse Personas for User Simulators to Test Interview Dialogue Systems

为用户模拟器生成多样化角色以测试面试对话系统

Mikio Nakano, Kazunori Komatani, Hironori Takeuchi

机构 * C4A Research Institute, Inc.(C4A研究所) SANKEN, University of Osaka(大阪大学SANKEN研究所) Musashi University(武藏野大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对面试对话系统测试人力成本高的问题,提出用大语言模型自动生成带沟通风格人格特质的多样化角色的用户模拟器,实验显示其生成话语的变化性更大。

Comments Accepted for publication at SIGDIAL 2025, 19 pages, 18 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19083 2026-08-20 cs.HC cs.CL 新提交 70%

When Readability and Source Retention Diverge: An Evaluability Gap in AI Translation

当可读性与源保留产生分歧:AI翻译中的可评估性差距

Chenchen Mao, Hanjing Shi, Haiyan Jia, Emily Wegrzyn, Dominic DiFranzo

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 该研究针对AI翻译中可读性与源保留分歧导致的可评估性差距,通过TransLingo开展2×2对比实验,揭示了源文本条件与输出呈现方式对感知质量等的影响,明确了任务绩效信任与披露意愿的关联。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18482 2026-08-20 cs.AR cs.AI 新提交 70%

Coverage-Driven RTL Assertion Generation with Formal Exploration and Neuro-Symbolic Refinement

基于形式化探索与神经符号优化的覆盖率驱动RTL断言生成

Zhiyuan Yan, Ziyue Zheng, Hongce Zhang

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究提出NeuroAssertion框架,结合形式化迹生成、SyGuS与智能体启发优化,实现覆盖率驱动的RTL断言生成,断言数量与突变覆盖率均约为传统方法的2倍。

Comments Accepted at MLCAD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16686 2026-08-18 cs.HC cs.CL cs.RO 新提交 70%

Closing the Affective Loop: Multimodal Speaker-Listener Emotion-Dynamics-Aware Empathetic Social Robots

闭合情感循环:具情感动态感知的多模态说话人-听话人共情社交机器人

Zi Haur Pang, Casey Kennington, Tatsuya Kawahara

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本研究提出AffectLoop系统,在Misty II机器人上实现多模态情感动态感知的说话人-听话人共情交互,经试点研究验证可提升共情响应与用户满意度。

Comments This paper has been accepted for presentation at APSIPA ASC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16409 2026-08-18 cs.LG 新提交 70%

SoftModel: A Neural Model That Grows Its Own Topology -- Governed Structural Growth for Continual In-Service Learning

SoftModel:一种自行扩展拓扑的神经模型——面向持续服务中学习的受控结构增长

Zhoumin Xie

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 该研究提出了软模型(SoftModel),其结构可随非平稳数据流持续受控增长,在标准持续学习基准上保留了长任务序列的持续学习能力,为终身学习提供了新方案。

Comments 99 pages, 16 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14913 2026-08-18 cs.GT cs.AI cs.MA 新提交 70%

The Open-Strategy Dictator Game: Cooperation Under Mutual Transparency

开放策略独裁者博弈:相互透明下的合作

Michael Glass

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究提出开放策略独裁者博弈,借助大语言模型裁决互动,通过循环锦标赛分析发现条件合作策略占优,证明在智能体可互查决策程序的环境中条件合作具备进化稳健性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14697 2026-08-18 cs.AI 新提交 70%

Synchronized Logit Steering: Real-world Steganography

同步对数几率调控:面向真实场景的隐写术

Andrew Rufail, Aadi Dash, Onir Narahari, Ethan Mui, Mahi Gajare, Prakhar Tiwari, Shrija Makapothula, Nick Cui

机构 * Algoverse AI

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出同步对数几率调控(SLS),一种无需发送方与接收方共享相同提示上下文的确定性隐写方案,通过代理提示编码有效载荷,在多数据集上验证其低 KL 散度、高信息密度及强隐蔽性,实现实用隐蔽通信。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14035 2026-08-17 cs.AI 新提交 70%

Agent-Orchestration in Autonomous Chip Design

自主芯片设计中的智能体编排

Linyang Li

机构 * Nova Silicon(诺瓦硅公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究针对芯片设计领域,结合大型语言模型与工具使用智能体,提出将芯片设计超级智能建模为庞大AI组织的思路,探索适用于该复杂行业的AI类型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13674 2026-08-17 cs.CY cs.CL cs.SI 新提交 70%

Asymmetric Discourse Homogenization and Shared Language Technology: Evidence from Reddit

不对称话语同质化与共享语言技术:来自Reddit的证据

Fengming Liu

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文基于Reddit数据发现2022年末出现政治话语多元化趋势的不对称断裂,保守派用户话语多元化轨迹中断,进步派无类似变化,机制更可能是社区层面的话语趋同。

Comments 36 pages, 5 figures, 6 tables. Replication package available (code and instructions). Keywords: political discourse; semantic similarity; discourse homogenization; generative AI; computational text analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13589 2026-08-17 cs.HC cs.AI 新提交 70%

Context Aware AI Assistant and AR Interface for Lunar Extravehicular Activity (EVA) Procedural Guidance

面向月球舱外活动(EVA)程序指导的上下文感知AI助手与AR界面

Rodrigo Gallardo, Qilmeg Doudatcz, Ganit Goldstein, Ilkyaz Sarimehmetoglu, Sergio Mutis, Alexander Htet Kyaw, Anita Lin, Clara Emmerling, Berfin Ataman, Skylar Tibbits

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对月球EVA中宇航员注意力分散导致的信息适配难题,提出GAIN-AI系统,通过两层架构结合大语言模型与AR界面,在111个合成EVA场景中取得良好表现。

Comments 4 pages, 4 figures, 1 table. Accepted to ACM SIGGRAPH 2026 Conference Posters, July 19-23, 2026, Los Angeles, California, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12674 2026-08-14 cs.AI 新提交 70%

Lines and Ladders: A Context-Aware Multi-Agent Framework for Large-Scale Retail Price Taxonomy

Lines and Ladders:面向大规模零售价格分类的上下文感知多智能体框架

Ravi Teja Chunduri, Srikaran Reddy Boya, Deep Narayan Mishra, Ajay Kumar B, Karthik Kumaran, Pranay Kona

机构 * Walmart Global Tech(沃尔玛全球科技)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对大规模零售商品定价管理难题,提出上下文感知多智能体框架自动化构建Lines and Ladders价格分类,3智能体系统在Lines任务F1达0.83,在多品类数据上表现优异且已投入生产。

Comments 8 pages. Accepted in the Main Conference of IEEE ICMLA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏