arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12266 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12266 篇

2504.18576 2026-04-28 cs.RO 71%

DriVerse: Navigation World Model for Driving Simulation via Multimodal Trajectory Prompting and Motion Alignment

DriVerse:通过多模态轨迹提示和运动对齐实现驾驶模拟的导航世界模型

Xiaofan Li, Chenming Wu, Zhao Yang, Zhihao Xu, Dingkang Liang, Yumeng Zhang, Ji Wan, Jun Wang

机构 * Baidu Inc.(百度公司)

专题命中 其他LLM :prompting(title)

AI总结 DriVerse通过多模态轨迹提示和运动对齐技术,实现从单张图像和未来轨迹生成导航驱动的驾驶场景,提升了动态对象的生成精度和时间一致性。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15326 2026-04-20 cs.HC 71%

Analyzing the Presentation, Content, and Utilization of References in LLM-powered Conversational AI Systems

分析基于大语言模型的对话式人工智能系统中参考文献的呈现、内容和利用

Jianheng Ouyang, Arpit Narechania

专题命中 其他LLM :LLM(title)

AI总结 研究分析了九个系统中1517个参考文献的呈现方式和质量,发现不同系统在参考文献数量和质量上有显著差异,需改进界面设计以提升用户对参考文献的信任度。

Comments 8 pages, 5 figures, Accepted to ACM CHI 2026 Extended Abstract/Poster/Case Study Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06607 2026-04-14 cs.AR 71%

CoverAssert: Iterative LLM Assertion Generation Driven by Functional Coverage via Syntax-Semantic Representations

CoverAssert: 通过语法-语义表示驱动的功能覆盖率迭代LLM断言生成

Yonghao Wang, Yang Yin, Hongqin Lyu, Jiaxin Zhou, Zhiteng Chao, Mingyu Shi, Wenchao Ding, Yunlin Du, Jing Ye, Tiancheng Wang, Huawei Li

专题命中 其他LLM :LLM(title)

AI总结 CoverAssert通过语法-语义表示驱动LLM生成断言,利用功能覆盖率反馈迭代优化,提升分支、语句和切换覆盖率。

Comments 3 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14288 2026-04-07 q-fin.PM q-fin.GN q-fin.PR 71%

Beyond Prompting: An Autonomous Framework for Systematic Factor Investing via Agentic AI

超越提示:通过代理AI实现系统性因子投资的自主框架

Allen Yikuan Huang, Zheqi Fan

专题命中 其他LLM :prompting(title)

AI总结 本文提出一种自主框架,通过代理AI实现系统性因子投资,采用自驱动引擎生成可解释的交易信号,通过实证纪律和经济合理性要求减少数据窥探偏差,实证显示其投资组合年化夏普比率达3.11,回报率为59.53%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00627 2026-04-02 cs.CR 71%

When Safe Models Merge into Danger: Exploiting Latent Vulnerabilities in LLM Fusion

当安全模型融合进入危险:在LLM融合中利用潜在漏洞

Jiaqing Li, Zhibo Zhang, Shide Zhou, Yuxi Li, Tianlong Yu, Kailong Wang

专题命中 其他LLM :LLM(title)

AI总结 研究揭示模型融合引入的新攻击面,提出TrojanMerge框架通过约束优化问题攻击安全对齐,实验显示融合模型产生高危害响应,源模型保持安全。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23650 2026-03-26 cs.CV 71%

Foundation Model Embeddings Meet Blended Emotions: A Multimodal Fusion Approach for the BLEMORE Challenge

基础模型嵌入与混合情感:一种多模态融合方法用于BLEMORE挑战

Masoumeh Chapariniya, Aref Farhadipour, Sarah Ebling, Volker Dellwo, Teodora Vukovic

机构 * Department of Computational Linguistics, University of Zürich(苏黎世大学计算语言学系)

专题命中 其他LLM :foundation model(title)

AI总结 本文提出了一种多模态融合方法,结合六个编码器家族进行后期概率融合,通过选择冻结的Wav2Vec2的语调编码层和Gemini Embedding 2.0,提升了混合情感识别的性能,最终在测试集上获得0.279的分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21856 2026-03-24 cs.CV 71%

Climate Prompting: Generating the Madden-Julian Oscillation using Video Diffusion and Low-Dimensional Conditioning

气候提示:利用视频扩散和低维条件生成 Madden-Julian 振荡

Sulian Thual, Feiyang Cai, Jingjing Wang, Feng Luo

机构 * School of Computing(计算学院)

专题命中 其他LLM :prompting(title)

AI总结 本文提出利用视频扩散模型生成MJO序列,通过低维指标条件化生成MJO,并通过理想化条件分析其物理驱动机制,为热带大气预测提供新框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08604 2026-03-10 cs.HC 71%

What to Make Sense of in the Era of LLM? A Perspective from the Structure and Efforts in Sensemaking

在大语言模型时代如何寻求意义?从意义建构的结构和努力角度的视角

Tianyi Li, Satya Samhita Bonepalli, Vikram Mohanty

专题命中 其他LLM :LLM(title)

AI总结 本文探讨了GPT-4在解读虚构恐怖分子计划中的意义建构任务,通过整体和逐步两种方法,探索人机协作提升复杂情境下的意义建构效率。

Comments CHI 2024 Sensemaking Workshop https://sites.google.com/view/chi2024-sensemaking-workshop/home?pli=1

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07817 2026-03-10 cs.CV 71%

Tracking Phenological Status and Ecological Interactions in a Hawaiian Cloud Forest Understory using Low-Cost Camera Traps and Visual Foundation Models

利用低成本相机陷阱和视觉基础模型追踪夏威夷云林 understory 的物候状态和生态互动

Luke Meyers, Anirudh Potlapally, Yuyan Chen, Mike Long, Tanya Berger-Wolf, Hari Subramoni, Remi Megret, Daniel Rubenstein

机构 * Computer Science, The Ohio State University, Columbus, Ohio, USA(俄亥俄州立大学计算机科学系) Computer Science, The University of Puerto Rico Rio Piedras, San Juan, Puerto Rico(波多黎各大学里奥皮埃拉斯分校计算机科学系) Computer Science, McGill University, Montreal, Quebec, Canada(麦吉尔大学计算机科学系) Battele Ecology, Neon Domain 20, Hilo, Hawaii(Battele生态研究所) Ecology, Princeton University, Princeton, New Jersey, USA(普林斯顿大学生态学系)

专题命中 其他LLM :foundation model(title)

AI总结 本研究利用低成本相机陷阱和视觉基础模型,追踪夏威夷云林 understory 的植物物候变化及生态互动,揭示时间精细度高的物候趋势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13127 2026-03-09 cs.CV cs.CR 71%

SPARK: Jailbreaking T2V Models by Synergistically Prompting Auditory and Recontextualized Knowledge

SPARK:通过协同提示音频与重新上下文化知识实现T2V模型的劫持

Zonghao Ying, Moyang Chen, Nizhang Li, Zhiqiang Wang, Wenxin Zhang, Quanchen Zou, Zonglei Jing, Aishan Liu, Xianglong Liu

机构 * State Key Laboratory of Complex \& Critical Software Environment, Beihang University College of Science, Mathematics Technology, Wenzhou-Kean University 360 AI Security Lab Faculty of Innovation Engineering, Macau University of Science Hong Kong University of Science University of Chinese Academy of Sciences

专题命中 其他LLM :prompting(title)

AI总结 SPARK通过模块化提示设计,利用音频与视觉关联模式,实现对T2V模型的高效劫持,提升攻击成功率23%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07967 2026-03-09 cs.HC 71%

Pre/Absence: Prompting Cultural Awareness and Understanding for Lost Architectural Heritage in Virtual Reality

预/缺席:在虚拟现实中提示文化意识与理解以应对失落的建筑遗产

Yaning Li, Ke Zhao, Shucheng Zheng, Xingyu Chen, Chenyi Chen, Wenxi Dai, Weile Jiang, Qi Dong, Yiqing Zhao, Meng Li, Lin-Ping Yuan

专题命中 其他LLM :prompting(title)

AI总结 本研究通过虚拟现实设计 Pre/Absence,探索如何在虚拟环境中提升用户对失落建筑遗产的文化意识与理解,通过对比实验发现 VR 能更有效地增强文化认知与情感参与。

Comments for further revisions

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25128 2026-03-06 astro-ph.IM astro-ph.HE 71%

Towards a foundation model for astrophysical source detection: An End-to-End Gamma-Ray Data Analysis Pipeline Using Deep Learning

迈向天体源检测的基础模型:一种使用深度学习的端到端伽马射线数据分析流水线

Judit Pérez-Romero, Saptashwa Bhattacharyya, Sascha Caron, Dmitry Malyshev, Rodney Nicolas, Giacomo Principe, Zoja Rokavec, Roberto Ruiz de Austri, Danijel Skočaj, Fiorenzo Stoppa, Domen Tabernik, Gabrijela Zaharijas

专题命中 其他LLM :foundation model(title)

AI总结 本文提出了一种基于深度学习的端到端伽马射线数据分析流水线,扩展了AutoSourceID方法以应用于CTAO模拟数据,为天体源检测提供灵活且鲁棒的解决方案。

Comments 6 pages, 3 figures, presented at EuCAIFCon 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19430 2026-02-26 cs.CV 71%

TherA: Thermal-Aware Visual-Language Prompting for Controllable RGB-to-Thermal Infrared Translation

TherA: 用于可控RGB到热红外转换的热感知视觉-语言提示

Dong-Guw Lee, Tai Hyoung Rhee, Hyunsoo Jang, Young-Sik Shin, Ukcheol Shin, Ayoung Kim

机构 * Seoul National University(首尔国立大学) Kyungpook National University(庆北国立大学) KENTECH

专题命中 其他LLM :prompting(title)

AI总结 TherA通过热感知视觉-语言提示方法,实现了可控的RGB到热红外转换,提升了翻译性能和细粒度控制能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20656 2026-02-25 cs.DC 71%

Lagom: Unleashing the Power of Communication and Computation Overlapping for Distributed LLM Training

Lagom:释放通信与计算重叠在分布式大模型训练中的潜力

Guanbin Xu, ZhenGuo Xu, Yuzhe Li, Youhui Bai, Ping Gong, Chaoyi Ruan, Cheng Li

专题命中 其他LLM :LLM(title)

AI总结 Lagom通过统一成本模型和优先级搜索算法,优化分布式大模型训练中的通信与计算重叠,实现速度提升。

Comments 6 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19811 2026-02-24 cs.DB 71%

Semantic Caching for OLAP via LLM-Based Query Canonicalization (Extended Version)

通过基于LLM的查询规范化实现OLAP的语义缓存

Laurent Bindschaedler

专题命中 其他LLM :LLM(title)

AI总结 本文提出基于LLM的查询规范化方法,通过统一的OLAP意图签名提升OLAP缓存命中率,实现82%的高命中率,显著优于传统方法。

Comments 12 pages, 2 figures, 5 tables. Extended version of the short paper published at DOLAP 2026 (co-located with EDBT/ICDT 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04272 2026-02-23 hep-ph 71%

tZ FCNC Case study: LLM Application in signal/Background discrimination analyses in Particle Physics

tZ FCNC案例研究:在粒子物理中利用大语言模型进行信号/背景区分分析

A. Saqlain, Z. E. Çabukoğlu, J. Smiesko, S. Kartal

专题命中 其他LLM :LLM(title)

AI总结 本研究利用大语言模型o3在粒子物理中提高信号与背景区分效率,展示其在FCNC顶夸克耦合分析中的应用潜力。

Comments 19 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10313 2026-02-18 cs.CV cs.MM 71%

Hierarchical Refinement of Universal Multimodal Attacks on Vision-Language Models

面向视觉语言模型的层次化通用多模态攻击

Peng-Fei Zhang, Zi Huang

机构 * School of Electrical Engineering and Computer Science, the University of Queensland(电气工程与计算机科学学院,昆士兰大学) Department of Computer Science, City University of Hong Kong(计算机科学系,香港城市大学)

专题命中 其他LLM :language model(title)

AI总结 本文提出HRA框架,通过层次化优化路径和文本重要性建模,实现对视觉语言模型的通用多模态攻击,验证了其在多种任务和数据集上的优越迁移性能。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15234 2026-02-03 cs.HC 71%

LLM-based In-situ Thought Exchanges for Critical Paper Reading

基于大型语言模型的现场思维交流用于批判性论文阅读

Xinrui Fang, Anran Xu, Chi-Lan Yang, Ya-Fang Lin, Sylvain Malacria, Koji Yatani

专题命中 其他LLM :LLM(title)

AI总结 本文提出基于大型语言模型的现场思维交流系统,通过代理介导的交互提升初级研究人员的批判性思维能力,实验表明多代理条件下的参与度和视角分析效果最佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12051 2026-01-21 cs.CV 71%

A Unified Masked Jigsaw Puzzle Framework for Vision and Language Models

面向视觉和语言模型的统一遮蔽拼图框架

Weixin Ye, Wei Wang, Yahui Liu, Yue Song, Bin Ren, Wei Bi, Rita Cucchiara, Nicu Sebe

机构 * Beijing Jiaotong University(北京交通大学) Kuaishou(快手) Hong Kong University of Science and Technology(香港科技大学) Caltech(加州理工学院) University of Trento(特伦特大学) University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学)

专题命中 其他LLM :language model(title)

AI总结 本文提出MJP框架,通过随机token洗牌和未知位置嵌入遮蔽,提升Transformer模型在视觉和语言任务中的鲁棒性与性能。

Comments 9 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10352 2025-12-19 hep-ph hep-ex nucl-ex nucl-th 71%

Toward a foundation model for heavy-ion collision experiments based on point-cloud diffusion

基于点云扩散的重离子碰撞实验基础模型

Manjunath Omana Kuttan, Kai Zhou, Jan Steinheimer, Horst Stoecker

专题命中 其他LLM :foundation model(title)

AI总结 本文提出一种基于点云扩散的重离子碰撞基础模型,能快速生成事件级碰撞输出,适用于理论与实验研究。

Comments Matches published version. 8 pages, 6 figures

Journal ref Phys.Rev.C 112 (2025) 5, L051902

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14373 2025-12-17 cs.CV 71%

EcoScapes: LLM-Powered Advice for Crafting Sustainable Cities

EcoScapes: 由LLM驱动的城市可持续发展建议

Martin Röhn, Nora Gourmelon, Vincent Christlein

机构 * Technische Universität Nürnberg(图宾根技术大学) Friedrich-Alexander-Universität Erlangen-Nürnberg(埃尔兰根-纽伦堡弗里德里希-亚历山大大学)

专题命中 其他LLM :LLM(title)

AI总结 EcoScapes利用LLM、卫星影像和知识库,为小型城市提供气候适应策略建议,提升可持续发展能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08935 2025-12-10 cs.IR 71%

Personalize Before Retrieve: LLM-based Personalized Query Expansion for User-Centric Retrieval

在检索前个性化:基于LLM的个性化查询扩展用于以用户为中心的检索

Yingyi Zhang, Pengyue Jia, Derong Xu, Yi Wen, Xianneng Li, Yichao Wang, Wenlin Zhang, Xiaopeng Li, Weinan Gan, Huifeng Guo, Yong Liu, Xiangyu Zhao

专题命中 其他LLM :LLM(title)

AI总结 本文提出PBR框架,通过在检索前个性化查询扩展,提升用户个性化检索的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16092 2025-11-21 cs.SE 71%

The Future of Development Environments with AI Foundation Models: NII Shonan Meeting 222 Report

人工智能基础模型对未来开发环境的未来影响:NII Shonan会议222报告

Xing Hu, Raula Gaikovina Kula, Christoph Treude

专题命中 其他LLM :foundation model(title)

AI总结 人工智能基础模型对开发环境的影响及未来发展方向,通过专家讨论探讨其在软件工程和人机交互中的挑战与机遇。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16128 2025-11-13 eess.AS 71%

Exploiting Foundation Models and Speech Enhancement for Parkinson's Disease Detection from Speech in Real-World Operative Conditions

Moreno La Quatra, Maria Francesca Turco, Torbjørn Svendsen, Giampiero Salvi, Juan Rafael Orozco-Arroyave, Sabato Marco Siniscalchi

专题命中 其他LLM :foundation model(title)

Comments Accepted at INTERSPEECH 2024

Journal ref Interspeech 2024, 25th Annual Conference of the International Speech Communication Association, pages 1405-1409, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08177 2025-11-12 cs.HC cs.SE 71%

GazeCopilot: Evaluating Novel Gaze-Informed Prompting for AI-Supported Code Comprehension and Readability

Yasmine Elfares, Gül Çalikli, Mohamed Khamis

专题命中 其他LLM :prompting(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04623 2025-11-07 cs.SD eess.AS 71%

PromptSep: Generative Audio Separation via Multimodal Prompting

Yutong Wen, Ke Chen, Prem Seetharaman, Oriol Nieto, Jiaqi Su, Rithesh Kumar, Minje Kim, Paris Smaragdis, Zeyu Jin, Justin Salamon

机构 * Adobe Research(Adobe研究院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) MIT(麻省理工学院)

专题命中 其他LLM :prompting(title)

Comments Submitted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01391 2025-11-05 quant-ph physics.atom-ph 71%

Parallel assembly of neutral atom arrays with an SLM using linear phase interpolation

Ivo H. A. Knottnerus, Yu Chih Tseng, Alexander Urech, Robert J. C. Spreeuw, Florian Schreck

专题命中 其他LLM :SLM(title)

Journal ref SciPost Phys. 19, 118 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15625 2025-09-22 cs.SD eess.AS 71%

The Rhythm In Anything: Audio-Prompted Drums Generation with Masked Language Modeling

Patrick O'Reilly, Julia Barnett, Hugo Flores García, Annie Chu, Nathan Pruyne, Prem Seetharaman, Bryan Pardo

专题命中 其他LLM :language model(title)

Comments ISMIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12145 2025-09-16 cs.CV 71%

Open-ended Hierarchical Streaming Video Understanding with Vision Language Models

Hyolim Kang, Yunsu Park, Youngbeom Yoo, Yeeun Choi, Seon Joo Kim

机构 * Yonsei University(延世大学)

专题命中 其他LLM :language model(title)

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10427 2025-09-15 cs.HC 71%

My Favorite Streamer is an LLM: Discovering, Bonding, and Co-Creating in AI VTuber Fandom

Jiayi Ye, Chaoran Chen, Yue Huang, Yanfang Ye, Toby Jia-Jun Li, Xiangliang Zhang

专题命中 其他LLM :LLM(title)

详情

展开后加载摘要…

URL PDF HTML 收藏