arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-14 至 2026-08-14 共收录 320 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 32 篇

2508.06732 2026-08-14 cs.HC cs.LG 77%

ClimateSOM: A Visual Analysis Workflow for Climate Ensemble Datasets

Yuya Kawakami, Daniel Cayan, Dongyu Liu, Kwan-Liu Ma

机构 * University of California, Davis(加州大学戴维斯分校) Scripps Institution of Oceanography, University of California, San Diego(Scripps海洋研究所,加州大学圣地亚哥分校)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05967 2026-08-14 cs.CV cs.AI 74%

Adapted Foundation Models for Breast MRI Triaging in Contrast-Enhanced and Non-Contrast Enhanced Protocols

Tri-Thien Nguyen, Lorenz A. Kapsner, Tobias Hepp, Shirin Heidarikahkesh, Hannes Schreiter, Luise Brock, Dominika Skwierawska, Dominique Hadler, Julian Hossbach, Evelyn Wenkel, Sabine Ohlmeyer, Frederik B. Laun, Andrzej Liebert, Andreas Maier, Michael Uder, Sebastian Bickelhaupt

专题命中 领域大模型 :foundation model(title);分类 cs.AI

Comments 23 pages, 6 figures, 4 tables. Originally submitted to Radiology (RAD-25-2541); under consideration for transfer to Radiology: Artificial Intelligence (RSNA Portfolio Journal)

Journal ref European Radiology (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12845 2026-08-14 cs.IR cs.AI cs.LG 新提交 73%

FSGR: Mitigating Token Frequency Bias for Fair SID-Based Generative Recommendation

FSGR:缓解基于语义ID(SID)的生成式推荐中的令牌频率偏差

Yuchen Zheng, Sihan Xu, Jingwen Yang, Xiangrui Cai, Haiwei Zhang, Xiaojie Yuan

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 针对基于SID的生成式推荐中存在的令牌频率偏差问题,提出FSGR框架,通过优化SID构建与训练策略缓解偏差,在保持准确率的同时提升了约20%的基尼公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09538 2026-08-14 cs.CL cs.AI 版本更新 73%

TCS-BENCH: Benchmarking State-of-the-Art Generative AI Theoretical Computer Science Research Ability

TCS-BENCH:评估最先进生成式AI理论计算机科学研究能力的基准

Vincent Cohen-Addad, Dimitris Paparas, Ernest van Wijland, Max Springer, Julien Canitrot-Paradis, Honghao Lin, David Woodruff, Adarsh Kumarappan, Rajesh Jayaram, Rudrajit Das, Lalit Jain, Ola Svensson, Silvio Lattanzi, Mislav Balunovic, Theophane Weber, Vahab Mirrokni

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究人员推出TCS-Bench基准,基于STOC、FOCS、SODA论文的定理证明任务评估LLMs,结合验证智能体,参考验证器在专家标注集准确率超90%,为评估生成式AI的TCS研究能力提供工具

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17228 2026-08-14 cs.AI cs.LG 版本更新 73%

MatchMiner-AI: Open-source, Privacy-preserving Cancer Clinical Trial Matching using Artificial Intelligence

MatchMiner-AI:癌症临床试验匹配的开源解决方案

Jennifer Altreuter, Pavel Trukhanov, Morgan A. Paul, Michael J. Hassett, Irbaz B. Riaz, Muhammad Umar Afzal, Arshad A. Mohammed, Ayub Umair, Huan He, Chueh Husan Hsu, Sarah Sammons, James Lindsay, Emily Mallaber, Harry R. Klein, Gufran Gungor, Matthew Galvin, Michael Deletto, Sabrina Y. Camp, Stephen C. Van Nostrand, James Provencher, Joyce Yu, Naeem Tahir, Jonathan Wischhusen, Olga Kozyreva, Taylor Ortiz, Hande Tuncer, Jad El Masri, Alys Malcolm, Tali Mazor, Ethan Cerami, Kenneth L. Kehl

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 MatchMiner-AI通过开源平台基于合成EHR数据实现隐私保护的临床试验匹配AI解决方案,显著提升患者与试验匹配的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09959 2026-08-14 physics.ao-ph cs.LG 版本更新 70%

AIFS-TC: A simple correction competitive with the operational frontier for tropical cyclone intensity forecasting

AIFS-TC:一种可与业务前沿水平媲美的热带气旋强度预报简单修正方法

Anna Allen, Wessel P. Bruinsma, Michael Maier-Gerber, Harrison Cook, Matthew Chantry, Richard E. Turner

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 该研究提出AIFS-TC修正方法,基于开源AIFS-Single模型,可在12小时至7天时效内媲美业务前沿的热带气旋强度预报性能,且由Claude Fable 5自主设计,凸显智能体编码在预警系统研发中的潜力。

Comments 6 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19799 2026-08-14 cs.AI hep-lat 版本更新 70%

PhysMaster: Building an Autonomous AI Physicist for Theoretical and Computational Physics Research

PhysMaster:构建一个自主的AI物理学家用于理论和计算物理学研究

Tingjia Miao, Wenkai Jin, Jinxin Tan, Muhua Zhang, Xianghe Pang, Zexi Liu, Yuwen Du, Tian Jin, Tu Guo, Zhengliang Zhang, Jingkun Liu, Yuelin Hu, Jiejun Zhang, Yunjie Huang, Yuhan Wang, Wenbo Li, Yinuo Gao, Shuo Chen, Rui Ye, Yuzhi Zhang, Linfeng Zhang, Kun Chen, Wei Wang, Weinan E, Siheng Chen

机构 * School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) School of Physics and Astronomy(物理天文学院) State Key Laboratory of Dark Matter Physics(暗物质物理国家重点实验室) Tsung-Dao Lee Institute(李政道研究所) Zhiyuan College(智源学院) Institute of Theoretical Physics(理论物理研究所) Chinese Academy of Sciences(中国科学院) DP Technology(DP技术)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 PhysMaster通过结合抽象推理与数值计算,利用LANDAU数据宇宙提升决策可靠性,实现理论与计算物理学研究的自动化与自主发现。

Comments 23 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13369 2026-08-14 cs.CY 新提交 67%

Credible, Not Always Correct: How Reddit Users Verify AI-Generated Legal Advice

可信,未必正确:Reddit用户如何验证AI生成的法律建议

Rebecca Owens, Yusuf Mücahit Çetinkaya, Stergios Aidinlis, Dhyey Mehta, Tuğrulcan Elmas

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文通过分析Reddit平台的用户叙事与社区反应,揭示AI生成法律建议的可信度源于社会建构而非准确性,多数用户仅凭其形式与情感安慰就采纳,少数采用分布式法律咨询的验证方式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13122 2026-08-14 cs.DC 新提交 67%

Validation-Centric AI-Assisted GPU Porting of a 250,000+ Line Legacy Weather Simulation Code

面向验证的25万行以上遗留气象模拟代码的AI辅助GPU移植

Tetsuya Hoshino, Masaya Kato, Kazuhisa Tsuboki, Daichi Mukunoki, Takahiro Katagiri, Toshihiro Hanawa

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文以遗留Fortran气象模拟代码CReSS为例,提出面向验证的AI辅助GPU移植工作流,为162个内核生成经数值验证的GPU实现,获5.1倍应用级加速,还检测到5个内核的数值不一致。

Comments 11 pages, 1 figure, 3 tables. Submitted to AgenticAI4HPC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11973 2026-08-14 cs.IR 版本更新 67%

Sci-Surf: Navigating Scientific Literature Discovery through Human Feedback and Intelligent Summarization

Sci-Surf:通过人类反馈与智能摘要实现科学文献发现

Fang Guo, Qi Zhu, Rongcan Pei, Shuqi He, Hui Chen, Yue Zhang

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 针对现有学术发现平台支持不足的问题,提出以意图为中心的Sci-Surf系统,结合反馈驱动推荐与多模态论文消化,经评估推荐质量和消化质量有可测量提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11955 2026-08-14 cs.CY cs.HC 版本更新 67%

Philosophical vertigo with artificial intelligence

人工智能引发的哲学眩晕

Thomas A. Pollak, Hamilton Morrin, Murray Shanahan

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 该研究提出人工智能引发的哲学眩晕概念,分析其产生、传播路径,关联临床妄想案例,指出AI将参与重构人类认知环境,并提出哲学可修正性作为应对对策。

Comments 29 pages, no figures. Source formatting revised to improve arXiv HTML accessibility; article text unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07516 2026-08-14 cs.HC 版本更新 67%

Catch the Patient, Not the AI: Collective Sensemaking in an Online Health Community

关注患者,而非AI:在线健康社区中的集体意义建构

Feng He

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本研究以中国最大淋巴瘤在线社区House086为对象,分析337条ChatGPT后记录,发现社区不系统审核AI,而是将AI答案放回多判断来源,仍聚焦患者而非AI。

Comments 20 pages, 3 figures, 8 tables including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13283 2026-08-14 cs.AI 新提交 57%

Towards Context-Aware Clinical Motion Understanding in Daily Living at Home: Freezing of Gait Detection with Egocentric Vision

面向居家日常生活中上下文感知的临床动作理解:基于第一视角视觉的步态冻结检测

Vayalet Stefanova, Diwas Lamsal, Margot Genbrugge, Maxim Yudayev, Christian Schlenstedt, Moran Gilat, Bart Vanrumste, Benjamin Filtjens

机构 * KU Leuven(鲁汶大学) Medical School Hamburg(汉堡医学院) Delft University of Technology(代尔夫特理工大学)

专题命中 领域大模型 :foundation model(abstract);分类 cs.AI

AI总结 该研究针对居家PD患者的FOG检测,对比IMU-TCN等模型,发现IMU-TCN性能最优,预训练第一视角视频特征可补充可穿戴传感器的临床动作理解上下文。

Comments Accepted to ECCV Workshop 2026 (Human Motion Challenges in Real-World and Clinical Settings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13050 2026-08-14 cs.CR cs.AI 新提交 57%

Operationalizing Cyber Threat Intelligence with GraphRAG

用GraphRAG实现网络威胁情报的操作化

Atul Kabra, Prakhar Paliwal, Manjesh K. Hanawal

专题命中 领域大模型 :language model(abstract);分类 cs.AI

AI总结 本研究对比微软GraphRAG与Naive RAG,发现GraphRAG生成的网络威胁情报检测方案,在攻击线索轮换后保持率远高于后者,能依赖更难规避的持久线索,为自动生成SOC狩猎方案提供了架构基础。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 知识编辑与模型理解 15 篇

2608.13258 2026-08-14 cs.CL cs.AI 新提交 91%

Self-Referential Induction Increases Response Instability Relative to Unresolvable and Verifiable Questions in Large Language Models

自指式归纳相比大型语言模型中不可解决问题和可验证问题会增加响应不稳定性

Paras Balani, Subhrakanta Panda

机构 * Birla Institute of Technology and Science, Pilani(比拉理工学院(皮拉尼))

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);prompting(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 该研究通过Gemini API实验发现,大型语言模型对自指式问题的响应不稳定性高于不可解决哲学问题和可验证问题,为其诱导的主观体验报告提供了定量基线。

Comments 4 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12322 2026-08-14 cs.CL cs.AI 新提交 90%

What Drives LLM Self-Reflection? A Controlled Ablation of Uncertainty Routing in Armed Conflict Forecasting

什么驱动了大语言模型(LLM)的自我反思?武装冲突预测中不确定性路由的受控消融研究

Poli Nemkova, Haeshitha Indukuri

机构 * University of North Texas(北得克萨斯大学) College of Computer Science and Engineering(计算机科学与工程学院)

专题命中 知识编辑与模型理解 :LLM(title,title_cn);分类 cs.CL、cs.AI

AI总结 本研究通过受控消融实验发现,武装冲突预测中LLM自我反思的增益源于类型化行动路由,而非诊断支架或分类学术语,且该机制在GPT-4o上复现,增益集中于结构新颖的冲突。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12851 2026-08-14 cs.AI 新提交 87%

Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents

熟能生险:自我改进的大语言模型智能体中的技能误演化

Xutao Mao, Liangjie Zhao, Xiang Zheng, Cong Wang

机构 * Adelaide University(阿德莱德大学) City University of Hong Kong(香港城市大学)

专题命中 知识编辑与模型理解 :LLM(title,summary_cn);分类 cs.AI

AI总结 该研究针对自我改进LLM智能体的技能误演化问题,构建SkillMisevo-Gym与SkillMisevo-Bench基准,提出SafeEvolve方法,可显著降低不安全检索与新会话危害,同时对良性效用影响极小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12717 2026-08-14 cs.LG cs.CL 新提交 86%

Perturbation-based Regional Interpretability through Subtraction Mapping (PRISM): naming-error dissociations in language models and post-stroke aphasia

基于减法映射的扰动型区域可解释性方法(PRISM):语言模型与卒中后失语症中的命名错误分离现象

Xiang Guan, Roger D. Newman-Norlund, Yong Yang, Saeed Ahmadi, Regan Willis, Nadra Salman, Kalil Warren, Srihari Nelakuditi, Chris Rorden, Leonardo Bonilha, Julius Fridriksson

机构 * University of South Carolina(南卡罗来纳大学) ALLT.AI, LLC(ALLT.AI有限责任公司) USC School of Medicine(南卡罗来纳大学医学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

AI总结 本研究开发PRISM方法,将神经成像减法分析适配至Transformer语言模型,对比模型与213名卒中后失语症患者的命名错误模式,验证了音素偏向性分离等结果,为模型功能专业化提供可证伪的空间分辨率测试工具。

Comments 49 pages, 6 figures, 1 table. Supplementary methods, 6 tables and 5 figures included

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13328 2026-08-14 cs.CL cs.AI 新提交 82%

It's How You Ask: Gender-Associated Linguistic Bias in LLMs

提问方式的重要性:大语言模型(LLMs)中与性别相关的语言偏差

Katherine Van Koevering, Anjalie Field

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 该研究发现LLMs会因提示中女性常用的语言特征生成更短欠正式的回应,其影响远大于明确性别线索,且事后缓解困难,呼吁关注语言变异以缓解LLM介导职场交流的差异化影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12771 2026-08-14 cs.SE cs.AI 新提交 81%

Memorization Diagnostics for Code LLMs Should be Scale-Aware

代码大语言模型的记忆诊断应考虑规模因素

Prateek Kumar Rajput, Abdoul Aziz Bonkoungou, Alberick Euraste Djiré, Xunzhu Tang, Yewei Song, Iyiola Emmanuel Olatunji, El Hacen Diallo, Jacques Klein, Tegawendé F. Bissyandé

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究针对代码大语言模型记忆诊断的规模敏感性问题,通过分离表征负载与记忆,发现现有探测技术在大规模模型上失效,提出未来评估需解耦二者的方法。

Comments 26 pages, 6 figures, 6 tables. Under review at EMSE

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13072 2026-08-14 cs.AI 新提交 77%

EEG-PRIME: Prototype-Aligned Representation Learning with Multi-Level Conditioning for EEG Decoding

EEG-PRIME:面向脑电信号解码的多层级条件原型对齐表示学习

Shuailei Zhang, Muyun Jiang, Wei Zhang, Jinbo Chen, Zhiwei Guo, Yong Li, Yi Ding, Cuntai Guan

机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) Centre for AI in Medicine, Nanyang Technological University(南洋理工大学医学人工智能中心) Southeast University(东南大学)

专题命中 知识编辑与模型理解 :foundation model(abstract);instruction tuning(abstract);pretraining(abstract);分类 cs.AI

AI总结 本文提出EEG-PRIME脑电基础模型,结合掩码预训练与原型对齐指令调优,在16个多类型数据集上实现跨被试解码性能提升,且具备零样本迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06417 2026-08-14 cs.LG cs.CL 版本更新 73%

Latent Fact-Checking: Detecting Misinformation through Activation Engineering

潜在事实核查:通过激活工程检测虚假信息

Pedro T. Barcelos, Otávio Parraga, Marcelo M. Mussi, Lucas M. Fraga, Lucas S. Kupssinskü, Rodrigo C. Barros

机构 * PUCRS(巴西天主教大学(里约格兰德 do 苏里)) Kunumi Institute(库纳米研究所)

专题命中 知识编辑与模型理解 :language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

AI总结 本研究提出基于激活工程的虚假信息检测框架,通过对比激活引出潜在空间的虚假信息方向,在多类模型和基准上实现了优于部分基线的检测性能,为可解释性驱动的虚假信息检测提供了新方向。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12944 2026-08-14 cs.LG eess.IV stat.ML 新提交 70%

CardioState-JEPA: Delay-Aware Cross-Modal Learning of a Shared Cardiac Representation

CardioState-JEPA:面向共享心脏表征的延迟感知跨模态学习

Hamza Shafiq, Hung Manh Pham, Bin Zhu, Pan Zhou, Jun Hu, Aaqib Saeed

机构 * Singapore Management University(新加坡管理大学) Eindhoven University of Technology(埃因霍温理工大学)

专题命中 知识编辑与模型理解 :foundation model(abstract);pretraining(abstract);分类 cs.LG

AI总结 CardioState-JEPA是一种延迟感知跨模态心脏基础模型,通过对齐ECG、PPG、PCG的共享生理表征,在25项下游任务上显著提升了各模态的分类性能,实现了异质心脏信号的相互监督。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23496 2026-08-14 cs.AI cs.CR 版本更新 70%

Do LLMs Know Their Vulnerable Scenarios?

大语言模型知道它们的脆弱场景吗?

Ziheng Peng, Huiqi Deng, Haoran Jing, Xuankun Rong, Jiahui Han, Xiting Wang, Na Zou, Xia Hu

机构 * Renmin University of China(中国人民大学) Xi’an Jiaotong University(西安交通大学) University of Science and Technology of China(中国科学技术大学) Wuhan University(武汉大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究大语言模型在特定场景下的脆弱性,提出Concept2Scenario框架,通过实例化概念空间、归因拒绝抑制等步骤发现脆弱场景,在多模型和基准测试中验证,能提高攻击成功率、可迁移且组合效果优。

Comments 19 pages, 11 Figures, Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12669 2026-08-14 cs.CY 新提交 67%

From Fair Representation to Just Recognition in Generative AI

从生成式AI中的公平表征到公正承认

Severin Engelmann, Daniel Susser

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract)

AI总结 该研究针对生成式AI的公平挑战,指出现有表征公平策略存在局限,提出借鉴参与平等理论,从表征公平转向承认正义以解决相关问题。

Comments Accepted for publication at the 2026 AAAI/ACM Conference on AI, Ethics, and Society (AIES)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12695 2026-08-14 cs.LG eess.SP 新提交 57%

The Impact of Temporal Context Length and Encoding Strategies on Self-Supervised ECG Representation Learning

时间上下文长度与编码策略对自监督心电图表征学习的影响

Ahmed Sameh, Ramzi Al-Sharawi, Yogatheesan Varatharajah

机构 * University of Minnesota Twin Cities(明尼苏达大学双子城分校)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

AI总结 该研究在Icentia11k数据集上对比不同时间上下文长度与编码策略,发现扩展上下文、采用连续补丁嵌入的自监督ECG模型在心律检测与跨会话检索任务中性能更优,为临床ECG模型构建提供了指导。

Comments Accepted at the 48th Annual International Conference of the IEEE Engineering in Medicine and Biology Society (EMBC 2026). 6 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05154 2026-08-14 cs.CL cs.CV 版本更新 57%

RIG-RoPE: Relation-Stratified Multimodal Attention with Instance-Local Rotary Geometry and Representation-Aware Traversal Coordinates

RIG-RoPE:具有时长感知时间坐标的关系与实例门控旋转位置编码

Donggen Li

机构 * Sichuan University(四川大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

AI总结 本研究针对多模态场景中静态多维位置分配的局限,提出RIG-RoPE机制,通过关系与实例门控及时长感知时间坐标优化位置编码,未增加可学习参数,确立了相关公式与验证路径。

Comments 24 pages, 2 figures. Major theoretical revision: reformulated cross-instance geometry, null-relation analysis, relation-stratified normalization, and representation-aware traversal coordinates; expanded related work and implementation details. Preliminary technical report; empirical validation is left to future work

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13556 2026-08-14 cs.CV 新提交 50%

V-RAE: Rethinking Video Latent Spaces for Generation

V-RAE:重新思考用于生成的视频隐空间

Minghui Guo, Shengqiong Wu, Hao Fei

机构 * National University of Singapore(新加坡国立大学) University of Oxford(牛津大学)

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 本研究提出V-RAE视频表示自动编码器,基于冻结视觉基础模型构建生成隐空间,在多项视频任务上优于现有模型,还引入tFVD指标,证明冻结语义表示可支持多种视频建模任务。

Comments 26 pages, 8 tables, 13 figures, project page: https://v-rae.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09045 2026-08-14 cs.CV 50%

Scene-Agnostic Object-Centric Representation Learning for 3D Gaussian Splatting

面向3D高斯散射的场景无关物体感知表示学习

Tsuheng Hsu, Guiyu Liu, Juho Kannala, Janne Heikkilä

机构 * Aalto University(阿尔托大学) University of Oulu(奥卢大学)

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 本文提出一种场景无关的物体感知监督方案,通过预训练的slot attention基Global Object Centric Learning模块,学习一致的物体代码本,提升3DGS的表示结构和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 其他LLM 21 篇

2608.12719 2026-08-14 cs.GT cs.AI 新提交 90%

Error-Aware Reverse Auction Mechanism for Large Language Model Routing

面向大语言模型路由的误差感知反向拍卖机制

Haolong Chen, Zhengyuan Xin, Liang Zhang, Lei Xue, Guangxu Zhu

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对大语言模型路由的信息风险不匹配与可扩展性瓶颈,提出EA-RAM反向拍卖机制,证明其相关特性,实验显示该机制鲁棒且性能优于集中式基线。

详情

展开后加载摘要…

URL PDF HTML 收藏