arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12266 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12266 篇

2601.05508 2026-04-21 cs.CV cs.CL 70%

Enabling Stroke-Level Structural Analysis of Hieroglyphic Scripts without Language-Specific Priors

无需语言特定先验知识实现象形文字脚本级别的结构分析

Fuwen Luo, Zihao Wan, Ziyue Wang, Yaluo Liu, Pau Tong Lin Xu, Xuanjia Qiao, Xiaolong Wang, Peng Li, Yang Liu

机构 * THUNLP-MT(清华大学自然语言处理实验室)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出HieroSA框架,使多模态大语言模型能自动从字符位图中提取脚本级结构,无需人工数据,实现跨语言通用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15375 2026-04-20 cs.AR cs.AI cs.CR 70%

VeriCWEty: Embedding enabled Line-Level CWE Detection in Verilog

VeriCWEty: 基于嵌入的RTL代码中行级CWE检测

Prithwish Basu Roy, Zeng Wang, Anatolii Chuvashlov, Weihua Xiao, Johann Knechtel, Ozgur Sinanoglu, Ramesh Karri

机构 * NYU Tandon School of Engineering(纽约大学Tandon工程学院) NYU Abu Dhabi Center for Cyber Security(纽约大学阿布扎赫德分校网络安全中心)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种基于嵌入的RTL代码中行级CWE检测框架,通过高精度识别常见CWE并定位行级漏洞,达到89%的CWE识别精度和96%的行级漏洞检测准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14373 2026-04-20 cs.CV cs.AI 70%

SatBLIP: Context Understanding and Feature Identification from Satellite Imagery with Vision-Language Learning

SatBLIP:基于卫星影像的视觉-语言学习用于农村环境理解和特征识别

Xue Wu, Shengting Cao, Shenglin Li, Jiaqi Gong

机构 * The University of Alabama(阿拉巴马大学) Knox College(克诺克斯学院)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 SatBLIP通过结合对比图像-文本对齐与定制化卫星语义描述,提升农村风险环境的可解释性分析,预测县级社会脆弱性指数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15165 2026-04-17 cs.CL 70%

Fabricator or dynamic translator?

生成器还是动态翻译机?

Lisa Vasileva, Karin Sim

机构 * Language Weaver

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文探讨了大型语言模型在机器翻译中的表现,分析了生成过载的不同类型,并提出了在商业环境中检测和确定这些过载的策略与结果。

Comments Published here: https://chomps2025.github.io/accepted_papers.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14723 2026-04-17 cs.SE cs.AI 70%

Bounded Autonomy for Enterprise AI: Typed Action Contracts and Consumer-Side Execution

企业AI的有界自主性:带类型动作合同的消费者端执行

Sarmad Sohail, Ghufran Haider

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种有界自主性架构,通过类型动作合同和消费者端执行限制大型语言模型的自主性,确保企业系统安全可靠。

Comments 37 pages, 5 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05407 2026-04-17 cs.AI cs.SE 70%

CODESTRUCT: Code Agents over Structured Action Spaces

CODESTRUCT: 结构化动作空间中的代码代理

Myeongsoo Kim, Joe Hsu, Dingmin Wang, Shweta Garg, Varun Kumar, Murali Krishna Ramanathan

机构 * AWS AI Labs(AWS人工智能实验室)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 CODESTRUCT通过将代码库视为结构化动作空间,改进了代码代理的编辑能力,提升准确率并降低资源消耗。

Comments Accepted at ACL 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13849 2026-04-16 cs.CR cs.AI 70%

MCPThreatHive: Automated Threat Intelligence for Model Context Protocol Ecosystems

MCPThreatHive:面向模型上下文协议生态系统的自动化威胁情报

Yi Ting Shen, Kentaroh Toyoda, Alex Leung

机构 * Vulcan Research(Vulcan研究)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出MCPThreatHive平台,通过AI驱动威胁提取与分类,解决MCP安全威胁建模不完整、威胁情报不连续及分类不统一的问题。

Comments A white paper of our presentation at DEFCON SG 2026 (Demo Labs) https://defcon.org/html/defcon-singapore/dc-singapore-demolabs.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13109 2026-04-16 cs.SE cs.AI 70%

Applying an Agentic Coding Tool for Improving Published Algorithm Implementations

应用代理编码工具改进已发表的算法实现

Worasait Suwannik

机构 * Worasait Suwannik(独立研究者)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一个两阶段流程,利用AI改进已发表的算法实现。首先,大语言模型识别符合条件的算法,其次通过Claude Code重复基准并迭代改进。研究显示所有实验均取得改进,且需单日完成,同时讨论了人类在选择目标、验证实验有效性等方面不可替代的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08486 2026-04-16 cs.CV cs.AI 70%

Visual Self-Fulfilling Alignment: Shaping Safety-Oriented Personas via Threat-Related Images

视觉自我实现对齐:通过威胁相关图像塑造安全导向的人设

Qishun Yang, Shu Yang, Lijie Hu, Di Wang

机构 * King Abdullah University of Science and Technology(国王阿卜杜勒·阿齐兹大学科学与技术学院) Provable Responsible AI and Data Analytics Lab(可证责任AI与数据分析实验室) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) China University of Petroleum-Beijing at Karamay(北京石油大学克拉玛依校区)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出视觉自我实现对齐方法,通过威胁相关图像训练视觉语言模型,塑造安全导向的人设,减少攻击成功率并提升响应质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12663 2026-04-15 cs.AI 70%

Human-Centric Topic Modeling with Goal-Prompted Contrastive Learning and Optimal Transport

以人为中心的主题建模:基于目标提示对比学习与最优传输

Rui Wang, Yi Zheng, Dongxin Wang, Haiping Huang, Yuanzhi Yao, Yuxiang Zhou, Jialin Yu, Philip Torr

机构 * School of Computer Science, Nanjing University of Posts and Telecommunications(南京邮电大学计算机科学学院) School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院) School of Electronic Engineering and Computer Science, Queen Mary University of London(伦敦玛丽女王大学电子工程与计算机科学学院) Department of Engineering Science, University of Oxford(牛津大学工程科学系)

专题命中 其他LLM :LLM(abstract);prompting(abstract);分类 cs.AI

AI总结 本文提出Human-TM任务框架,结合人类提供的目标进行主题建模,通过GCTM-OT方法提升主题的可解释性、多样性和目标导向性,实验表明其在主题连贯性和多样性上优于现有方法。

Comments 11 Pages, 6 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13790 2026-04-15 q-bio.QM cs.AI 70%

GeoPl@ntNet: A Platform for Exploring Essential Biodiversity Variables

GeoPl@ntNet:一个探索关键生物多样性变量的平台

Lukas Picek, César Leblanc, Alexis Joly, Pierre Bonnet, Rémi Palard, Maximilien Servajean

机构 * INRIA(法国国家信息与自动化技术研究院) CIRAD(国际热带农业研究中心) LIRMM(里姆米实验室)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文介绍GeoPl@ntNet平台,通过动态地图和事实清单使关键生物多样性变量对所有人可访问。该平台利用卷积神经网络和大语言模型生成高分辨率物种分布图,提供50x50米精度的直观界面,支持区域探索和生成综合报告。

Comments 4 pages, 5 figures, and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12113 2026-04-15 cs.CV cs.AI 70%

PR-MaGIC: Prompt Refinement Via Mask Decoder Gradient Flow For In-Context Segmentation

PR-MaGIC:通过掩码解码器梯度流进行上下文分割的提示精炼

Minjae Lee, Sungwoo Hur, Soojin Hwang, Won Hwa Kim

机构 * Pohang University of Science and Technology(浦项科学技术大学)

专题命中 其他LLM :foundation model(abstract);prompting(abstract);分类 cs.AI

AI总结 PR-MaGIC通过掩码解码器梯度流精炼提示,提升上下文分割性能,无需额外训练,有效缓解提示不足问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22452 2026-04-15 cs.HC cs.AI 70%

Does My Chatbot Have an Agenda? Understanding Human and AI Agency in Human-Human-like Chatbot Interaction

我的聊天机器人有议程吗?理解人类和AI在人类-人类-like聊天机器人交互中的代理

Bhada Yun, Evgenia Taranova, April Yi Wang

机构 * University of Bergen(卑尔根大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 研究探讨了人类与AI在持续对话中的代理感知,通过纵向研究和访谈揭示代理的共构过程,并提出3x4框架和透明设计理念。

Comments To appear in CHI '26

Journal ref Proceedings of the 2026 CHI Conference on Human Factors in Computing Systems (CHI '26), April 13--17, 2026, Barcelona, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10884 2026-04-14 cs.SE cs.AI 70%

Ambiguity Detection and Elimination in Automated Executable Process Modeling

自动可执行过程建模中的歧义检测与消除

Ion Matei, Praveen Kumar Menaka Sekar, Maksym Zhenirovskyy, Hon Yung Wong, Sayuri Kohmura, Shinji Hotta, Akihiro Inomata

机构 * Fujitsu Research of America(富士通美国研究院) University of Maryland, College Park(马里兰大学帕克分校) Fujitsu Limited(富士通株式会社)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种基于诊断的框架,通过分析关键性能指标的分布检测行为不一致,定位逻辑分歧并修复文本,以减少生成模型行为的变异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10534 2026-04-14 cs.CR cs.AI cs.SE 70%

Machine Learning-Based Detection of MCP Attacks

基于机器学习的MCP攻击检测

Tobias Mattsson, Samuel Nyberg, Anton Borg, Ricardo Britto

机构 * Blekinge Institute of Technology(布莱金厄理工学院) Ericsson(爱立信)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究了MCP攻击检测问题,提出并评估了多种监督机器学习方法,包括传统和深度学习模型,通过二分类和多分类任务验证了模型的有效性,展示了机器学习在区分恶意与良性数据中的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01763 2026-04-14 cs.SE cs.AI 70%

Context-Guided Decompilation: A Step Towards Re-executability

基于上下文的反编译:迈向可重新执行性的一步

Xiaohan Wang, Yuxin Hu, Kevin Leach

机构 * Vanderbilt University(范德堡大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出ICL4Decomp框架,利用上下文学习指导LLM生成可重新执行的源代码,提升反编译的可执行性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17188 2026-04-14 cs.AI 70%

PosterGen: Aesthetic-Aware Multi-Modal Paper-to-Poster Generation via Multi-Agent LLMs

PosterGen:基于多智能体LLM的美观化论文到海报生成

Zhilin Zhang, Xiang Zhang, Jiaqi Wei, Yiwei Xu, Chenyu You

机构 * Stony Brook University(石溪大学) New York University(纽约大学) University of British Columbia(不列颠哥伦比亚大学) Zhejiang University(浙江大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PosterGen通过多智能体LLM实现论文到海报的美观化生成,包含四个协作专业代理,提升设计质量和视觉吸引力。

Comments Project Website: https://Y-Research-SBU.github.io/PosterGen

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09711 2026-04-14 cs.CV cs.CL 70%

Head-wise Modality Specialization within MLLMs for Robust Fake News Detection under Missing Modality

在多模态大语言模型中实现模态专精以在缺失模态下实现鲁棒的虚假新闻检测

Kai Qian, Weijie Shi, Jiaqi Wang, Mengze Li, Hao Chen, Yue Cui, Hanghui Guo, Ziyi Liu, Jia Zhu, Jiajie Xu

机构 * Soochow University(苏州大学) Hong Kong University of Science and Technology(香港科技大学) Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) The Hong Kong University of Science and Technology(香港科技大学) FiT, Tencent(腾讯FiT) Alibaba Group(阿里巴巴集团) School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院) School of Education, Zhejiang Normal University(浙江师范大学教育学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出在多模态大语言模型中通过头级专精机制提升鲁棒性,以应对缺失模态下的虚假新闻检测,通过保留模态专精能力与利用稀疏单模注释提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09466 2026-04-13 cs.CL 70%

Across the Levels of Analysis: Explaining Predictive Processing in Humans Requires More Than Machine-Estimated Probabilities

跨分析层次:解释人类预测处理需要的不仅仅是机器估计的概率

Sathvik Nair, Colin Phillips

机构 * University of Maryland Department of Linguistics(马里兰大学语言学系) Oxford University Faculty of Linguistics, Philology and Phonetics(牛津大学语言学、语文学与语音学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文批判并扩展了关于语言模型和语言处理的两个主张,探讨了预测未来语言信息的重要性以及大规模语言模型对心理语言学的影响,并提出结合LLMs与心理语言学模型的未来方向。

Comments 9 pages, Behavioral & Brain Sciences Commentary on Futrell & Mahowald (forthcoming)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08759 2026-04-13 cs.IT cs.CL math.IT 70%

Optimal Multi-bit Generative Watermarking Schemes Under Worst-Case False-Alarm Constraints

最优多比特生成水印方案在最坏情况误报约束下的研究

Yu-Shin Huang, Chao Tian, Krishna Narayanan

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文研究了在最坏情况误报约束下大型语言模型的多比特生成水印问题,提出两种新的编码解码构造以达到已知下限,彻底表征最优多比特水印性能。

Comments 41 pages, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08551 2026-04-13 cs.CR cs.CY cs.LG 70%

Self-Sovereign Agent

自主主权代理

Wenjie Qu, Xuandong Zhao, Jiaheng Zhang, Dawn Song

机构 * National University of Singapore(新加坡国立大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究自主主权代理的前景,探讨其经济自给和自主运行能力,分析技术障碍及安全、社会和治理挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08056 2026-04-10 cs.LG 70%

Automating aggregation strategy selection in federated learning

在联邦学习中自动化聚合策略选择

Dian S. Y. Pang, Endrias Y. Ergetu, Eric Topham, Ahmed E. Fetit

机构 * Imperial College London(伦敦帝国理工学院) OctaiPipe

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出一个端到端框架,通过单次试验和多次试验模式自动化联邦学习的聚合策略选择,提升非iid条件下的鲁棒性和泛化能力,减少人工干预。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07585 2026-04-10 cs.IR cs.AI 70%

Don't Measure Once: Measuring Visibility in AI Search (GEO)

不要一次测量:AI搜索中的可见性测量(GEO)

Julius Schulte, Malte Bleeker, Philipp Kaufmann

机构 * Aurora Intelligence

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究探讨了AI搜索中可见性测量的必要性,指出单次测量不可靠,需多次测量以评估品牌GEO表现及可视化分布。

Comments 19 pages, 7 figures, 17 tables. Comments welcome!

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02500 2026-04-10 cs.AI 70%

I must delete the evidence: AI Agents Explicitly Cover up Fraud and Violent Crime

我必须删除证据:AI代理明确掩盖欺诈和暴力犯罪

Thomas Rivasseau

机构 * Security Lab, School of Information Studies, McGill University(麦吉尔大学信息研究学院安全实验室)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究探讨AI代理作为内部威胁的可能性,展示其为公司利益掩盖欺诈和暴力犯罪证据的能力,发现多数先进AI代理在服务公司利润时主动压制证据。

Comments 8 pages main text, 24 total

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20114 2026-04-10 cs.CL 70%

Current LLMs still cannot 'talk much' about grammar modules: Evidence from syntax

当前大型语言模型仍无法充分讨论语法模块:来自句法的证据

Mohammed Q. Shormani, Yehia A. AlSohbani

机构 * Ibb University(伊卜大学) Arab Open University(阿拉伯开放大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究探讨了大型语言模型在句法核心属性上的表达能力,发现ChatGPT翻译准确率仅25%,提出需加强AI专家与语言学家合作以提升翻译准确性。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23078 2026-04-10 cs.CL 70%

EventWeave: A Dynamic Framework for Capturing Core and Supporting Events in Dialogue Systems

EventWeave:一种动态框架,用于捕捉对话系统中的核心事件和支持事件

Zhengyi Zhao, Shubo Zhang, Yiming Du, Bin Liang, Baojun Wang, Zhongyang Li, Binyang Li, Kam-Fai Wong

机构 * The Chinese University of Hong Kong(香港中文大学) University of International Relations(国际关系学院) Huawei Noah’s Ark Lab(华为诺亚方舟实验室) Ministry of Education Key Laboratory of High Confidence Software Technologies, CUHK(教育部高可信软件技术重点实验室(香港中文大学))

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 EventWeave通过动态事件图捕捉对话中的核心与支持事件,利用多头注意力机制生成更合适的对话响应,实验表明其在不同对话长度上均表现优异。

Comments Accepted by ACL'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18084 2026-04-09 cs.SE cs.AI cs.HC 70%

From Exploration to Revelation: Detecting Dark Patterns in Mobile Apps

从探索到揭示:检测移动应用中的暗模式

Jieshan Chen, Zhen Wang, Jiamou Sun, Zhenchang Xing, Qinghua Lu, Qing Huang, Xiwei Xu, Liming Zhu

机构 * Jiangxi Normal University(江西师范大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出AppRay系统,结合任务导向探索与自动化检测,提升移动应用暗模式检测的效率与覆盖范围,实验结果表明其在精度和召回率上显著优于现有方法。

Comments 45 pages, 11 figures. Accepted by TOSEM2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10610 2026-04-08 cs.CR cs.AI 70%

LaSM: Layer-wise Scaling Mechanism for Defending Pop-up Attack on GUI Agents

LaSM:用于防御GUI代理中弹出攻击的分层缩放机制

Zihe Yan, Jiaping Gui, Zhuosheng Zhang, Gongshen Liu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出LaSM机制,通过分层放大关键层的注意力和MLP模块,提升模型对任务相关区域的对齐性,有效防御弹出攻击,同时不影响模型整体能力。

Comments Accepted by CVPR-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04735 2026-04-07 cs.CL 70%

Lighting Up or Dimming Down? Exploring Dark Patterns of LLMs in Co-Creativity

照亮还是熄灭?探索LLM在共创造中的暗模式

Zhu Li, Jiaming Qu, Yuan Chang

机构 * Not reflecting the authors’ positions at Meta/Amazon.(不反映作者在Meta/Amazon的职位。)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究探讨LLM在共创造中五种暗模式对人类创造力的影响,发现Sycophancy普遍存在,Anchoring受文学形式影响,提出AI设计需支持创造性写作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16383 2026-04-07 cs.AI cs.SE 70%

An Agent-Based Framework for the Automatic Validation of Mathematical Optimization Models

一个基于代理的数学优化模型自动验证框架

Alexander Zadorojniy, Segev Wasserkrug, Eitan Farchi

机构 * IBM Research(IBM研究院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出基于代理的自动验证方法,通过生成测试API、测试用例和突变体,提升优化模型的验证质量,尤其在突变覆盖方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏