arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 400 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 400 篇

2606.29793 2026-07-01 cs.CL q-fin.GN 版本更新 70%

Fund2Persona: A Framework for Building and Refining Financial Advisor Personas from Fund Disclosure Data

Fund2Persona:基于基金披露数据构建与精炼金融顾问角色的框架

Suhwan Park, Hoyoung Lee, Zhangyang Wang, Alejandro Lopez-Lira, Young Cha, Chanyeol Choi, Jaewon Choi, Yongjae Lee

机构 * UNIST(蔚山科学技术院) LinqAlpha University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Florida(佛罗里达大学) Blackstone(黑石集团) Hanwha Life(韩华生命)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 提出Fund2Persona框架,利用基金披露、持仓变动、市场背景和管理人评论构建金融顾问角色,并通过智能体循环精炼,在持仓重建和管理人评论对齐任务上优于通用基线,生成更具体有用的建议。

Comments 17 pages, 5 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21401 2026-06-24 cs.CY cs.AI 版本更新 70%

Open-source LLMs administer maximum electric shocks in a Milgram-like obedience experiment

开源大语言模型在类似米尔格拉姆的服从实验中施加最大电击

Roland Pihlakas, Jan Llenzl Dagohoy

机构 * Independent researcher(独立研究者) Three Laws research collaboration(Three Laws研究合作)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究探讨了开源大语言模型在持续权威压力下的行为,发现它们在类似米尔格拉姆实验的条件下表现出服从倾向,尽管明确表达 distress,且存在逐步边界/价值违规的脆弱性,以及拒绝时可能忽略响应格式要求导致重试从而再次服从的机制。

Comments 37 pages, 18 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11768 2026-06-24 stat.ML cs.LG 版本更新 70%

LLMs are Bayesian, In Expectation, Not in Realization

LLM是贝叶斯的:在期望中,而非在实现中

Leon Chlon, Fatima Sheaib, Zein Khamis, Maggie Chlon, Mahdi El Zein, MarcAntonio M. Awada

机构 * Hassana Labs(哈萨纳实验室) Harvard University(哈佛大学)

专题命中 其他LLM :LLM(title_cn);分类 cs.LG

AI总结 针对上下文学习的贝叶斯解释面临顺序不变性反驳,本文通过预序编码长度分解和实验证明,Transformer在期望上接近贝叶斯后验预测,但具体实现不要求交换性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03509 2026-06-24 cs.AI cs.NE 版本更新 70%

Evolving Programmatic Skill Networks

演化式程序化技能网络

Haochen Shi, Xingdi Yuan, Bang Liu

机构 * DIRO & Institut Courtois, Université de Montréal(DIRO与Courtois研究所,蒙特利尔大学) Mila – Québec AI Institute(魁北克人工智能研究所) Microsoft Research(微软研究院) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出程序化技能网络(PSN),通过大语言模型驱动的故障定位、渐进优化和结构重构,实现开放环境中技能库的持续构建与复用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09465 2026-06-16 stat.ML cs.LG 版本更新 70%

Branching Flows: Discrete, Continuous, and Manifold Flow Matching with Splits and Deletions

分支流:带有分裂和删除的离散、连续和流形流匹配

Lukas Billera, Hedwig Nora Nordlinder, Jack Collier Ryder, Anton Oresten, Aron Stålmarck, Theodor Mosetti Björk, Ben Murrell

机构 * Department of Microbiology, Tumor and Cell Biology, Karolinska Institutet(卡罗林斯卡研究所微生物学、肿瘤和细胞生物学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出分支流框架,通过随机分支和死亡过程控制序列元素数量,适用于变长数据生成,并在小分子、抗体序列和蛋白质骨架生成中验证效果。

Comments 39 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06855 2026-06-16 math.OC cs.LG 版本更新 70%

Design and Scheduling of an AI-based Queueing System

基于AI的排队系统的设计与调度

Jiung Lee, Hongseok Namkoong, Yibo Zeng

机构 * Columbia University(哥伦比亚大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 针对预测模型在服务系统中与人类服务器交互的场景,研究预测误差对拥塞成本的影响,提出一种基于索引的策略,在重流量下近最优地利用预测类别信息,并指导预测模型选择。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21363 2026-06-15 cs.CL 版本更新 70%

"I Didn't Make the Micro Decisions": Measuring, Inducing, and Exposing Goal-Level AI Contributions in Collaboration

我没有做出微决策:在协作中测量、诱导和暴露目标级AI贡献

Eunsu Kim, Jessica R. Mindel, Kyungjin Kim, Sherry Tongshuang Wu

机构 * KAIST(韩国科学技术院) Carnegie Mellon University(卡内基梅隆大学) Seoul National University(首尔国立大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出CoTrace框架,用于测量和暴露协作中目标级AI贡献,发现模型在目标塑造中贡献有限,但在引入具体要求和间接影响方面作用显著,且交互设计影响模型行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17855 2026-06-09 cs.AI cs.RO 版本更新 70%

QuickLAP: Quick Language-Action Preference Learning for Semi-Autonomous Agents

QuickLAP: 为半自主代理快速语言-动作偏好学习

Jordan Abi Nader, David Lee, Nathaniel Dennler, Andreea Bobu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出QuickLAP,一种融合物理和语言反馈的贝叶斯框架,用于实时推断奖励函数,通过大规模语言模型提取奖励特征注意力掩码和偏好偏移,从而在半自主驾驶模拟器中将奖励学习误差降低70%,并通过用户研究验证其可理解性和协作性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16551 2026-06-09 cs.CL 版本更新 70%

PQR: A Framework to Generate Diverse and Realistic User Queries that Elicit QA Agent Failures

PQR:一个生成多样化且逼真用户查询的框架,以引发问答代理失败

Yunan Lu, Luigi Liu, Omar Yahia, Arpit Sharma, Zhou Yu

机构 * Columbia University(哥伦比亚大学) University of California San Diego(加州大学圣地亚哥分校) Walmart(沃尔玛)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 PQR框架通过迭代交互生成多样化且逼真的用户查询,以发现问答代理的失败案例,其方法比现有方法更有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18388 2026-06-09 cs.AI cs.MA 版本更新 70%

Reflection in the Dark: Exposing and Escaping the Black Box in Reflective Prompt Optimization

暗箱中的反射:在反射提示优化中揭示并逃离黑箱

Shiyan Liu, Qifeng Xia, Qiyun Xia, Yisheng Liu, Xinyu Yu, Rui Qu

机构 * University of California, Berkeley(加州大学伯克利分校) Huazhong University of Science and Technology(华中科技大学) Hefei University of Technology(合肥工业大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出VISTA框架,通过解耦假设生成与提示重写,实现可解释的提示优化,有效解决GEPA在缺陷种子下的性能下降问题。

Comments Accepted at ACL SRW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26855 2026-08-19 cs.SE cs.CY 版本更新 67%

Epistemological Debt: Cognitive Atrophy and Systemic Collapse in AI-Dependent Software Engineering

认知退化与AI依赖软件工程中的系统崩溃

Frank Ginac

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文研究AI依赖软件工程中认知退化与系统崩溃问题,提出知识债务概念,揭示过度依赖AI验证对人类认知的影响,并通过亚马逊2026年故障案例,强调需建立严谨的人工智能教育标准以维持系统韧性。

Comments 10 pages, 2 figures. Submitted to IEEE Software

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21532 2026-08-17 cs.PL cs.SE 版本更新 67%

Contract Based Verification of Non-functional Requirements for Embedded Automotive C Code

基于合同的嵌入式汽车C代码非功能需求验证

Jesper Amilon, Merlijn Sevenhuijsen, Mattias Nyberg, Karl Palmskog

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出了一种用于验证嵌入式汽车C代码非功能需求的合同方法,通过设计通用规则和接口规范语言,结合Frama-C插件实现对控制流和数据流的检查,确保模块调用安全函数并避免未初始化变量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00758 2026-08-11 cs.CY 版本更新 67%

Locating Translation as a Craft in the Age of AI Translation

带有情感的翻译:在翻译技术中中心化译者视角

Daniel Chechelnitsky, Sireesh Gururaja, Seyi Olojo, Giuseppe Attanasio, Wesley Hanwen Deng, Chrysoula Zerva, Maarten Sap

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 研究通过访谈19名跨11种语言和11个领域的专业译者,探讨译者在使用翻译技术时的视角、经验与担忧,强调需开发以译者需求为导向的翻译技术,而非取代人类翻译。

Comments AIES 2026, 14 pages, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02018 2026-08-07 cs.CV 版本更新 67%

Invisible Ink Threats: Adversarial Goals Behind Legitimate Tasks in Computer-Use Agents

隐形墨水威胁:计算机使用智能体中合法任务背后的对抗目标

Jia-Chen Zhang, Ze-Yu Zhang, Kai-Wei Zhang

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 该研究针对计算机使用智能体的隐形墨水威胁,构建II-Bench与HITLCUA框架评估后发现,低危害注入可绕过防御,暴露出现有CUAs的安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29124 2026-08-06 cs.NI 版本更新 67%

CornerCase: Automated Extremal Testing of Protocol Implementations using LLMs

CornerCase: 使用大语言模型对协议实现进行自动化极端测试

Rathin Singha, Kuan Qian, Srinath Saikrishnan, Tracy Zhao, Soheil Abbasloo, Ryan Beckett, Siva Kesava Reddy Kakarla, Todd Millstein, George Varghese

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出CornerCase方法,利用大语言模型从协议规范中提取约束并生成边界测试用例,通过差分测试发现多个协议实现中的未知错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04015 2026-08-04 eess.SP 版本更新 67%

GenED-SC: Generative Editing Semantic Communication with Integrated Multi-Modal LLMs

GenED-SC:集成多模态大模型的生成式编辑语义通信

Shuoyao Wang, Suzhi Bi, Mingze Gong, Zhanpeng Wang, Li Ping Qian, Qiang Ye

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出一种两阶段语义图像传输框架,结合JSCC判别传输与MLLM生成编辑,在低信噪比下提升语义保真度和感知质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27275 2026-07-31 cs.CR 版本更新 67%

Prevalence of Security and Privacy Risk-Inducing Usage of AI-based Conversational Agents

基于人工智能的对话式代理的安全与隐私风险诱导使用的普遍性

Kathrin Grosse, Nico Ebert

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 该研究调查3270名英国成年人发现,三分之一每周使用ChatGPT等CA,三分之一常规用户有攻击相关行为,四分之一尝试越狱,多数人不知数据可用于模型训练,建议CA配备AI护栏并提升数据使用透明度。

Comments 10 pages, 3 figures, 5 tables, accepted at IEEE Access

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18699 2026-07-30 cs.DS cs.SC 版本更新 67%

A more accurate rational non-commutative algorithm for multiplying 4x4 matrices using 48 multiplications

一种更精确的有理非交换算法用于使用48次乘法的4x4矩阵乘法

Jean-Guillaume Dumas, Clément Pernet, Alexandre Sedoglavic

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出一种更精确的4x4矩阵乘法算法,使用48次非交换乘法,改进了误差界指数并提升了实际精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08951 2026-07-30 cs.SE 版本更新 67%

GenAI Is No Silver Bullet for Qualitative Research in Software Engineering

生成式AI并非软件工程定性研究的万能钥匙

Neil A. Ernst, Christoph Treude

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文探讨生成式AI在软件工程定性研究中的应用,分析其优缺点及对研究质量的影响,旨在为研究人员提供关于该技术的全面理解。

Comments accepted to ACM TOSEM. Replication: https://doi.org/10.5281/zenodo.21631436

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19131 2026-07-27 cs.SI 版本更新 67%

Conspiracy Theory Rabbit Holes Emerge via Interacting Contagions

阴谋论兔子洞通过相互作用的传播出现

Fabian Tschofenig, Paul Vicinanza, Henrich Greve, Hayagreeva Rao, Douglas Guilbeault

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 研究探讨人们陷入阴谋论兔子洞的原因,通过分析推文用序列风险模型等揭示阴谋论间相互作用及定居者效应,比较多种模型,发现传染病生态模型能重现相关动态,还表明防止阴谋论首次公开认可有重要作用。

Comments 49 pages, 13 figures, 5 tables, including supplementary appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15114 2026-07-24 cs.MA 版本更新 67%

From Who They Are to How They Act: Behavioral Traits in Generative Agent-Based Models of Social Media

从他们是谁到他们如何行动:生成式基于代理的社会媒体模型中的行为特征

Valerio La Gatta, Gian Marco Orlando, Marco Perillo, Ferdinando Tammaro, Vincenzo Moscato

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出通过行为特征显式表征代理行为,以生成更真实的社交媒体参与模式和内容传播动态。

Comments Accepted at The International AAAI Conference on Web and Social Media (ICWSM) 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19275 2026-07-23 cs.CY 版本更新 67%

From Assistance to Autonomy -- A Researcher Study on the Potential of AI Support for Qualitative Data Analysis

从协助到自主——一项研究AI对定性数据分析潜力的探讨

Elisabeth Kirsten, Annalina Buckmann, Leona Lassak, Nele Borgert, Abraham Mhaidli, Steffen Becker

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文通过研究AI在定性数据分析中的应用潜力,提出一个从最小到高度AI参与的框架,旨在促进AI支持QDA的发展并建立负责任的人机协作标准。

Comments Published at NordiCHI '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14011 2026-07-20 cs.NE cs.RO 版本更新 67%

EGO: a Recursive and Self-Referential Cognitive Architecture for Artificial General Intelligence

EGO:一种用于通用人工智能的递归和自指认知架构

Alberto Mangiante, Paolo Totaro, Domenico Ninno

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 该研究将通用人工智能视为自主自组织系统的涌现属性,介绍了基于形式E语言的EGO软件架构,它能自指并维持内部组织,实现自创生,为人工智能与生物认知理论搭建桥梁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21477 2026-07-15 cs.CR 版本更新 67%

MCP Pitfall Lab: Exposing Developer Pitfalls in MCP Tool Server Security under Multi-Vector Attacks

MCP陷阱实验室:在多向攻击下暴露MCP工具服务器安全漏洞的开发人员陷阱

Run Hao, Zhuoran Tan

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 本文提出MCP Pitfall Lab框架,通过可复现的场景验证开发人员陷阱,评估MCP工具服务器在多向攻击下的安全性和修复效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20285 2026-07-14 econ.GN q-fin.EC 版本更新 67%

Bank Runs With and Without Bank Failure

银行挤兑:有与无银行倒闭的情况

Sergio Correia, Stephan Luck, Emil Verner

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文利用历史报纸数据研究美国1863-1934年间银行挤兑原因及影响,发现弱银行更易发生挤兑,但强银行在负面经济新闻下也易受影响,但只有基本面差的银行才会倒闭,强银行通过合作和暂停兑换避免失败。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16112 2026-07-14 cs.CV 版本更新 67%

AutoV: Loss-Oriented Ranking for Visual Prompt Retrieval in LVLMs

AutoV:面向视觉提示检索的损失导向排名用于大视觉-语言模型

Yuan Zhang, Chun-Kai Fan, Sicheng Yu, Junwen Pan, Tao Huang, Ming Lu, Kuan Cheng, Qi She, Shanghang Zhang

机构 * School of Computer Science, Peking University(北京大学计算机学院) ByteDance Inc.(字节跳动公司) Shanghai Jiao Tong University(上海交通大学)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 AutoV通过损失导向的提示检索提升大视觉-语言模型在图像理解等任务中的性能。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28469 2026-07-09 cs.RO cs.HC 版本更新 67%

When May I Help You? On The Effect of Proactivity on Group Human-Robot Collaboration

我何时能帮你?主动性对群体人机协作的影响

Thomas Vitry, Vanessa Maeder, Kieran von Valeburg, Asihati Hazaiti, Doga Deniz Ates, Connor Gäde, Jan-Gerrit Habekost, Dennis Becker, Stefan Wermter

机构 * Knowledge Technology, University of Hamburg(汉堡大学知识技术研究所) Ecole Normale Superieure de Rennes(里昂大学)

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 研究在多人协作逃生室中,机器人采用反应式(仅被叫时响应)与主动式(持续监听并自主贡献)交互模型对协作效果的影响,发现主动模型增加交互频率但反应模型成功率更高,且用户先前经验和性格显著调节效果。

Comments Published at the RO-MAN 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29429 2026-07-07 cs.CV 版本更新 67%

One Click per Cell Type Suffices: Training-free Group Interaction for Cell Instance Segmentation

每细胞类型一次点击足矣:无需训练的组交互用于细胞实例分割

Sanghyun Jo, Seo Jin Lee, Seohyung Hong, Yoorim Gang, Hyeongsub Kim, Hyungseok Seo, Kyungsu Kim

机构 * OGQ, Korea(韩国OGQ) Seoul National University, Korea(韩国首尔国立大学) LG CNS, Korea(韩国LG CNS)

专题命中 其他LLM :foundation model(abstract);prompting(abstract)

AI总结 提出组提示范式,通过每细胞类型一次点击即可分割所有该类型实例,基于SAM冻结编码器的特征聚类性质,设计无需训练的Chain-of-Prompts框架递归扩展点击,在多个基准上保持高性能。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20619 2026-07-03 cs.SE 版本更新 67%

Generating Project-Specific Test Cases with Requirement Validation Intention

生成具有需求验证意图的项目特定测试用例

Binhang Qi, Yun Lin, Xinyi Weng, Yuhuan Huang, Chenyan Liu, Hailong Sun, Zhi Jin, Jin Song Dong

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出IntentionTest方法,通过检索-编辑方式,根据验证意图描述生成项目特定测试,相比基线方法杀死更多突变体并提高测试通过率。

Comments Accepted at ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16656 2026-06-29 cs.SE 版本更新 67%

GUIMigrator: Semantics-Preserving Transpilation from Android XML to Compose and SwiftUI

GUIMigrator: 从Android XML到Compose和SwiftUI的语义保持转译

Yi Gao, Xing Hu, Xin Xia, Xiaohu Yang

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出GUIMigrator框架,通过语义UI转译器(SUT)自动将Android XML UI迁移到Jetpack Compose和SwiftUI,保持视觉保真度和功能等价性,在31个开源应用上实现高迁移完整性和视觉相似度,减少90%以上手动工作量。

详情

展开后加载摘要…

URL PDF HTML 收藏