arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 2049 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 2049 篇

2606.21968 2026-06-23 cs.CV cs.CL 新提交 57%

Look Before You Zoom: Adaptive Routing for the Resolution-Context Trade-off in Visual RAG

先看再缩放:视觉RAG中分辨率-上下文权衡的自适应路由

Oanh N. Tran, Thanh Quoc Hung Le, Oscar Chew, Kuan-Hao Huang, Khoa D. Doan

机构 * VinUni-Illinois Smart Health Center, VinUniversity(VinUni-Illinois智慧健康中心,VinUniversity) Texas A&M University(德克萨斯农工大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 提出ViRGo框架,通过自适应路由选择全局感知、基于补丁或注意力的检索,以平衡小目标细节和大目标上下文,提升视觉RAG的精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21947 2026-06-23 cs.CV cs.AI 新提交 57%

ScalePredictor: Instance-aware Scale Learning for Accurate Quantization of Vision Transformers

ScalePredictor:面向视觉Transformer精确量化的实例感知尺度学习

Changjun Li, Runqing Jiang, Lian Xu, Ye Zhang, Qingyong Hu, Yulan Guo

机构 * School of Electronics and Communication Engineering, Shenzhen Campus, Sun Yat-sen University(中山大学深圳校区电子与通信工程学院) Computer Science and Software Engineering, The University of Western Australia(西澳大学计算机科学与软件工程学院) University of Oxford(牛津大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

AI总结 提出动态量化框架ScalePredictor,通过浅层激活分布范围与深层最优尺度的隐藏关联,利用多项式尺度投影模块高效生成所有量化尺度,在ImageNet上取得更优精度-效率权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21851 2026-06-23 cs.CL 新提交 57%

TALAS: Teacher-Anchored Layer Alignment with Adaptive Sharpness-Aware Minimization for Embedding Distillation

TALAS:基于教师锚定的层对齐与自适应锐度感知最小化的嵌入蒸馏

Quoc Phong Dao, Hoang Son Nguyen, Pham Khanh Chi, Linh Ngo Van, Nguyen Thi Ngoc Diep, Thien Huu Nguyen, Trung Le

机构 * Hanoi University of Science and Technology(河内科技大学) VNU University of Engineering and Technology(越南国立大学工程与技术大学) University of Oregon(俄勒冈大学) Monash University(莫纳什大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 提出TALAS框架,通过教师锚定机制仅蒸馏最终句子嵌入到学生上层,结合层对齐自蒸馏和自适应锐度感知最小化,在降低计算成本的同时提升句子嵌入蒸馏性能。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21786 2026-06-23 cs.LG 新提交 57%

RocketPFN: Accurate Time Series Classification via In-Context Learning

RocketPFN:通过上下文学习实现精确时间序列分类

Franco Martino O'Rourke, Ana Trisovic, Dimitris Bertsimas

机构 * Prior Labs Team(Prior Labs)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 提出RocketPFN,结合随机卷积特征提取与预训练表格基础模型的上下文分类,在92个UCR数据集上达到与最强方法HC2相当的精度,无需目标数据训练。

Comments 10 pages main text, 4 figures; 15 pages including references and appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21372 2026-06-23 cs.RO cs.LG 新提交 57%

NAC: Neural Action Codec for Vision-Language-Action Models

NAC: 面向视觉-语言-动作模型的神经动作编解码器

Ahad Jawaid, Yu Xiang

机构 * The University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 提出神经动作编解码器(NAC),采用多尺度RVQGAN架构将短动作轨迹视为多通道1D信号进行压缩,以替代现有离散动作分词器,在LIBERO-10等任务中实现更低重建误差和更高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20867 2026-06-23 cs.CV cs.AI 新提交 57%

FOCA: Future-Oriented Conditioning for Data-Efficient Vision-Language-Action Adaptation

FOCA: 面向未来的条件化用于数据高效的视觉-语言-动作适应

Duc Minh Nguyen, Nghiem Tuong Diep, Binh Gia Nguyen, Trong-Bao Ho, Doanh Le, Tan Q. Nguyen, Thien-Loc Ha, Nhiem Tran, Bao Thach, Nhat X. Tran, Tuan A. Tran, Artur Habuda, Philip Lund Møller, Tran Nguyen Le, Daniel Sonntag, Matthias Niepert, Khoa D. Doan, Vu Duong, Hung Ngo, Minh N. Vu, Duy M. H. Nguyen, An Thai Le, Ngo Anh Vien

机构 * Center for AI Research, VinUniversity, Vietnam University of Utah, USA German Research Center for Artificial Intelligence (DFKI) Technical University of Denmark, Denmark University of Oldenburg, Germany University of Stuttgart, Germany Max Planck Research School for Intelligent Systems (IMPRS-IS), Germany

专题命中 效率与部署 :pretraining(abstract);分类 cs.AI

AI总结 提出FOCA框架,结合未来交互嵌入预测与目标观测隐式对齐,实现数据高效的VLA少样本适应,在LIBERO、RoboCasa和真实机器人上取得新最优结果。

Comments Accepted at ICML 2026. Project page: https://focavla.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20626 2026-06-23 cs.CY cs.AI 新提交 57%

Efficient Safety Benchmarking via Item Response Theory

通过项目反应理论实现高效安全基准测试

Fabio Spagliardi, Mírian Silva, Ayan Datta, Aiden Zhou, Vamshi Bonagiri, Diogo Cruz

机构 * Supervised Program for Alignment Research (SPAR)(对齐研究监督计划) Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学) Yale University(耶鲁大学)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 针对安全基准测试中项目信息量不均的问题,利用项目反应理论(IRT)实现自适应项目选择,将评估成本降低至少80%,最高达99.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20583 2026-06-23 cs.NI cs.AI 新提交 57%

Physical-AI: From Channel Awareness to Environmental Intelligence in 6G Wireless Networks

Physical-AI: 从信道感知到6G无线网络中的环境智能

Farooque Hassan Kumbhar, Kapal Dev, Sunder Ali Khowaja, Alexandros-Apostolos A. Boulogeorgos, Mehdi Bennis, Yuanwei Liu

机构 * Augmented Cognition Meta-communications ERC Research Center, Korea University, Korea(增强认知元通信ERC研究中心,韩国大学,韩国) Department of Computer Science, Munster Technological University (MTU)(计算机科学系,穆斯特技术大学(MTU)) School of Computing, Faculty of Engineering and Computing, Dublin City University, Ireland(计算学院,工程与计算学院,都柏林城市大学,爱尔兰) Department of Electrical and Computer Engineering of the Democritus University, Greece(德米特里大学电气与计算机工程系,希腊) Department of Electrical and Computer Engineering, The University of Hong Kong, Hong Kong(电气与计算机工程系,香港大学,香港) Department of Electronic Engineering, Kyung Hee University, Yongin-si, Gyeonggi-do 17104, South Korea(电子工程系, Kyung Hee大学, Yongin-si, Gyeonggi-do 17104, 韩国)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 提出Physical-AI架构,利用自监督时空无线电基础模型将分布式观测转化为共享环境表征,通过多推理头估计阻塞、用户分布等环境属性,并基于神经决策层实现主动控制,降低中断概率和阻塞响应延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08892 2026-06-19 cs.LG 新提交 57%

Diffuse AI Control on Fuzzy Tasks

模糊任务上的扩散AI控制

Mikhail Terekhov, Caglar Gulcehre, Vivek Hebbar, Joe Benton

机构 * Anthropic Fellows Program (via MATS)(Anthropic 研究员计划(通过 MATS)) EPFL(洛桑联邦理工学院) Redwood Research(红木研究) Anthropic

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 针对AI在模糊任务上的长期扩散威胁,提出蓝队与红队对抗框架,通过弱模型评分训练强模型,并发现红队可利用多目标进化提示优化找到评分高但性能差的子版本行为,蓝队则通过对抗优化提升鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18875 2026-06-18 cs.CL 新提交 57%

Efficient Financial Language Understanding via Distillation with Synthetic Data

通过合成数据蒸馏实现高效金融语言理解

Wen-Fong, Huang, Edwin Simpson

机构 * School of Engineering Mathematics and Technology(工程数学与技术学院) University of Bristol(布里斯托大学)

专题命中 效率与部署 :prompting(abstract);分类 cs.CL

AI总结 提出一种在低资源条件下通过合成数据蒸馏进行金融情感分析的框架,利用聚类种子选择生成代表性合成数据,使紧凑模型在少量标注下达到强性能,甚至在某些任务上超越教师模型。

Journal ref Proceedings of the Fifteenth Language Resources and Evaluation Conference (LREC 2026), European Language Resources Association (ELRA), 2026, pp. 10242-10254

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18537 2026-06-18 cs.LG 新提交 57%

Do as the Romans Do: Learning Universal Behaviors from Heterogeneous Agents

入乡随俗:从异构智能体学习通用行为

Caleb Chang, Davin Win Kyi, Natasha Jaques, Karen Leung

机构 * University of Washington(华盛顿大学) NVIDIA(英伟达)

专题命中 效率与部署 :pretraining(abstract);分类 cs.LG

AI总结 提出GRID方法,从追求不同目标的异构示范者中提取通用奖励,训练通用智能体以学习环境通用能力,避免模式平均偏差,提升下游任务微调效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18323 2026-06-18 cs.SD cs.LG 新提交 57%

Reliable Neural-Codec Text-to-Speech by ASR Self-Verification and Distillation: Near-Zero Catastrophic Failures Across Models and Codecs

通过ASR自验证与蒸馏实现可靠的神经编解码文本转语音:跨模型与编解码器的近零灾难性失败

Ali Asaria, Tony Salomone, Deep Gandhi

机构 * Transformer Lab

专题命中 效率与部署 :preference optimization(abstract);分类 cs.LG

AI总结 针对开放自回归神经编解码TTS模型的随机灾难性失败(静音、早停、重复或幻觉),提出基于ASR往返的格式鲁棒度量,通过最佳N自验证将失败率降至近零,并通过蒸馏将鲁棒性迁移至单次解码,在无测试代价下关闭约52-58%的失败。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18247 2026-06-17 cs.RO cs.AI 新提交 57%

Visual Verification Enables Inference-time Steering and Autonomous Policy Improvement

视觉验证实现推理时引导与自主策略改进

Mingtong Zhang, Dhruv Shah

机构 * Princeton University(普林斯顿大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

AI总结 提出VERITAS框架,利用预训练通用机器人策略作为生成器,结合无梯度视觉验证器在推理时评估动作,实现无需额外训练的推理时策略引导和离线策略改进。

Comments Website: https://veritas-improvement.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17294 2026-06-17 cs.RO cs.LG 新提交 57%

VISTA: Scale-Aware Visual Navigation via Action History Conditioning

VISTA:通过动作历史条件实现尺度感知的视觉导航

Maeva Guerrier, Koki Kobayashi, Simon Roy, Jana Pavlasek, Giovanni Beltrame

机构 * Polytechnique Montreal(蒙特利尔理工学院) MILA(MILA研究所) Institute of Science Tokyo(东京科学大学) CoRA Lab(CoRA实验室) Mist Lab(Mist实验室)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 针对视觉导航基础模型因动作归一化导致的尺度脆弱性,提出通过动作历史条件化提供物理位移上下文,并集成DINOv3编码器增强重复环境中的特征表示,实现零样本跨环境部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17249 2026-06-17 cs.AR cs.LG cs.NE eess.SP 新提交 57%

From Compression to Deployment: Real-Time and Energy-Efficient FastGRNN on Ultra-Constrained Microcontrollers

从压缩到部署:超受限微控制器上的实时节能FastGRNN

Emre Can Kizilates

机构 * Electronics Engineer Independent Researcher, Izmir, Turkey

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 针对超受限微控制器,提出端到端开源FastGRNN压缩部署方案,结合低秩分解、稀疏化和量化,在8位和16位MCU上实现实时50Hz推理,模型仅566字节权重,F1达0.918,并贡献了跨平台确定性推理、循环预热延迟、无乘法器查找表和硬件能耗分析。

Comments 14 pages, 8 figures. Code: https://github.com/emre1998/fastgrnn-har

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16925 2026-06-16 cs.AI 新提交 57%

RAID: Semantic Graph Diffusion for True Cold-Start and Cross-Lingual Forecasting

RAID: 面向真正冷启动和跨语言预测的语义图扩散

Arunkumar V, Manoranjan Gandhudi, Gangadharan G. R., Arun Prakash, S. Senthilkumar

机构 * University College of Engineering, Anna University Tiruchirappalli(安娜大学蒂鲁吉拉伯利工程学院) Central University of Karnataka(卡纳塔克中央大学) National Institute of Technology Tiruchirappalli(蒂鲁吉拉伯利国立理工学院) Jawaharlal Nehru University(贾瓦哈拉尔·尼赫鲁大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 针对时间序列基础模型在无历史数据时失效的问题,提出RAID框架,利用元数据语义检索和图条件扩散实现冷启动预测,在准确性和推理速度上超越现有方法,并支持零样本跨语言迁移。

Comments 25 pages, 4 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16295 2026-06-16 cs.CV cs.CL 新提交 57%

VisualClaw: A Real-Time, Personalized Agent for the Physical World

VisualClaw:面向物理世界的实时个性化智能体

Haoqin Tu, Jianwen Chen, Zijun Wang, Siwei Han, Juncheng Wu, Hardy Chen, Haonian Ji, Kaiwen Xiong, Jiaqi Liu, Peng Xia, Jieru Mei, Hongliang Fei, Jason Eshraghian, Zeyu Zheng, Yuyin Zhou, Huaxiu Yao, Cihang Xie

机构 * UC Santa Cruz(加州大学圣克鲁兹分校) UNC-Chapel Hill(北卡罗来纳大学教堂山分校) Google(谷歌) UC Berkeley(加州大学伯克利分校)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 提出VisualClaw,一种自进化多模态智能体,通过混合编码和技能进化机制降低部署成本并提升准确性,在多个视频QA基准上实现平均-98%的API成本削减和最高+15.80%的准确率提升。

Comments H. T. and J. C. contribute to this project equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16131 2026-06-16 cs.CV cs.LG 新提交 57%

Shift-and-Sum Quantization for Visual Autoregressive Models

Shift-and-Sum 量化用于视觉自回归模型

Jaehyeon Moon, Bumsub Ham

机构 * Yonsei University(延世大学) Articron

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 提出针对视觉自回归模型的训练后量化框架,通过移位求和量化减少注意力值乘积误差,并采用重采样策略校准数据,在图像生成等任务上达到新最优。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16038 2026-06-16 cs.SE cs.AI 新提交 57%

Open-SWE-Traces: Advancing Dual-Mode Multilingual Distillation for Software Engineering Agents

Open-SWE-Traces:推进软件工程智能体的双模式多语言蒸馏

Wasi Uddin Ahmad, Nikolai Ludwig, Somshubra Majumdar, Boris Ginsburg

机构 * NVIDIA(英伟达)

专题命中 效率与部署 :LLM(abstract_cn);分类 cs.AI

AI总结 为解决软件工程智能体训练数据稀缺问题,构建包含20万条轨迹、覆盖9种编程语言的数据集,采用混合推理合成方法,微调Qwen3-30B-A3B系列模型,在SWE-bench基准上取得领先性能。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16028 2026-06-16 cs.LG cs.IT math.FA math.IT 新提交 57%

The Information-Theoretic Benefit of Shared Representations under Orthogonality Constraints

正交约束下共享表示的信息论优势

Thomas Dittrich, Oliver Potocki, Philipp Grohs

机构 * Johann Radon Institute of Computational and Applied Mathematics, Austrian Academy of Sciences(奥地利科学院约翰·拉东计算与应用数学研究所) Faculty of Mathematics, University of Vienna(维也纳大学数学学院)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 本文通过信息论框架,证明在正交约束下,联合近似比单独近似需要更少的描述长度,揭示了共享表示在组合架构中的效率优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15716 2026-06-16 cs.LG 新提交 57%

How to Score Experts for One-Shot MoE Expert Pruning: A Unified Formulation and Selection Principle

如何为一次性MoE专家剪枝评分:统一公式与选择原则

Zongfang Liu, Jinghui Zhang, Zijian Ma, Guangyi Chen, Xin Yuan

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 提出一次性MoE专家剪枝的统一公式,基于路由频率、门控权重和激活强度三个因素,推导出任务无关剪枝应使用基于激活的准则,任务特定剪枝可保留路由频率和门控信息,并据此提出两种新准则MAN和MSAN,在多个模型和基准上取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15512 2026-06-16 cs.LG physics.plasm-ph 新提交 57%

Towards Data-Efficient Cross-Device Generalization of Grad-Shafranov Equilibria via Transfer Learning Neural Operator

通过迁移学习神经算子实现Grad-Shafranov平衡的数据高效跨设备泛化

Jay Phil Yoo, William Howes, Yashika Ghai, Kazuma Kobayashi, Souvik Chakraborty, Syed Bahauddin Alam

机构 * Grainger College of Engineering, Nuclear, Plasma & Radiological Engineering Department, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校格兰杰工程学院核、等离子体与放射工程系) Fusion Energy Division, Oak Ridge National Lab(橡树岭国家实验室聚变能源部) National Center for Supercomputing Applications(国家超级计算应用中心) Department of Applied Mechanics, Indian Institute of Technology Delhi(印度理工学院德里分校应用力学系) Yardi School of Artificial Intelligence, Indian Institute of Technology Delhi(印度理工学院德里分校亚迪人工智能学院)

专题命中 效率与部署 :pretraining(abstract);分类 cs.LG

AI总结 提出跨设备神经算子框架,将平衡重建转化为算子学习问题,通过多几何预训练实现数据高效迁移,Wavelet Neural Operator在100个目标样本下达到低于4%的L2误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14792 2026-06-16 cs.CV cs.AI 新提交 57%

Efficient Reinforcement for Visual-Textual Thinking with Discrete Diffusion Model

基于离散扩散模型的视觉-文本思维高效强化学习

Yoonjeon Kim, Yuhta Takida, Chieh-Hsin Lai, Eunho Yang, Yuki Mitsufuji

机构 * KAIST(韩国科学技术院) Sony AI(索尼AI) AITRICS Sony Group Corporation(索尼集团公司)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

AI总结 提出用离散扩散模型替代自回归模型进行多模态强化学习,通过局部视觉编辑减少计算量,并设计分解奖励分配策略解决跨模态干扰问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13300 2026-06-16 cs.LG 新提交 57%

Quantizing Time-Series Models As Dynamical Systems: Trajectory-Based Quantization Sensitivity Score

将时间序列模型量化为动力系统:基于轨迹的量化敏感度评分

Mariya Pavlova, Harrison Bo Hua Zhu, Lidia Vitanova, Elizaveta Semenova, Yingzhen Li

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 提出基于轨迹的量化敏感度评分(TQS),从动力系统稳定性角度分析量化误差传播,实现无需校准数据的混合精度量化。

Comments ICML 2026, Workshop on Forecasting as a New Frontier of Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14598 2026-06-15 cs.LG 新提交 57%

Realizing Native INT8 Compute for Diffusion Transformers on Consumer GPUs: A Fused INT8 GEMM Kernel for Ideogram 4.0

在消费级GPU上实现扩散Transformer的原生INT8计算:用于Ideogram 4.0的融合INT8 GEMM内核

Ali Asaria, Tony Salomone, Deep Gandhi

机构 * Transformer Lab

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 针对消费级Ampere GPU上INT8量化比FP8/NF4更慢的问题,提出融合Triton INT8 GEMM内核,直接利用INT8张量核心,在Ideogram 4.0中实现2.8-4.2倍加速,端到端速度提升约10%,使1024px单卡可行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14353 2026-06-15 cs.LG 新提交 57%

Can Deep Neural Networks Improve Compression of Very Large Scientific Data?

深度神经网络能否改善超大规模科学数据的压缩?

Muhannad Alhumaidi, Guozhong Li, Spiros Skiadopoulos, Panos Kalnis

机构 * King Abdullah University of Science and Technology(阿卜杜拉国王科技大学) University of the Peloponnese(伯罗奔尼撒大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 本文提出将深度学习预测器集成到传统误差有界压缩框架中,通过气候数据实验发现,尽管ML预测器能提高预测精度和重建质量,但由于残差空间结构影响熵编码效率,未能提升整体压缩比。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13267 2026-06-12 cs.CV cs.CL cs.IR 新提交 57%

TimeLens: On-Device Artifact Recognition with Retrieval-Augmented Question Answering for the Grand Egyptian Museum

TimeLens: 面向大埃及博物馆的基于检索增强问答的设备端文物识别

Rawan Hesham, Ali Ashraf, Amr Ahmed, Malak Alaa, Omar Ahmed, Omar Wagih

机构 * Grand Egyptian Museum(大埃及博物馆)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 针对博物馆场景中的细粒度视觉相似性、训练数据与手持相机差距以及AI幻觉问题,提出设备端文物检测器与双语检索增强生成(RAG)问答系统,实现实时识别与可靠问答。

Comments 6 pages, 4 figures, 5 tables. Submitted to AIVRCH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12925 2026-06-12 cs.CV cs.LG 新提交 57%

Multi-Label Test-Time Adaptation with Bayesian Conditional Priors

基于贝叶斯条件先验的多标签测试时自适应

Qiru Li, Ao Zhou, Zhiwei Jiang, Zifeng Cheng, Cong Wang, Yafeng Yin, Qing Gu

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 提出贝叶斯条件先验估计(BCP),一种无梯度的测试时自适应方法,通过在线估计锚定条件先验注入标签依赖性,提升冻结视觉语言模型在多标签识别中的分布偏移鲁棒性。

Comments accepted by ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12806 2026-06-12 quant-ph cs.LG 新提交 57%

Quantum Reservoir Computing for Short-Term Power Load Forecasting in Resource-Constrained Energy Systems

量子储层计算在资源受限能源系统中的短期电力负荷预测

Mansi Od, Param Pathak, Nouhaila Innan, Muhammad Shafique

机构 * University of Waterloo(滑铁卢大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 提出一种硬件高效的量子储层计算框架,通过固定量子储层和压缩经典读出层,在有限内存和硬件噪声下实现短期负荷预测,6位量化保留全精度性能并减少81.2%内存。

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11500 2026-06-11 eess.IV cs.CE cs.IT cs.LG math.IT q-bio.NC 新提交 57%

FlexiBrain: Resolution-Agnostic Voxel-Level Encoding for Native fMRI

FlexiBrain: 面向原生fMRI的分辨率无关体素级编码

Mo Wang, Wenhao Ye, Junfeng Xia, Minghao Xu, Hongkai Wen, Quanying Liu

机构 * Southern University of Science and Technology(南方科技大学) University of Warwick(沃里克大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 提出FlexiBrain,一种基于Mamba-JEPA的分辨率无关体素级编码框架,通过动态补丁调整直接处理原生fMRI数据,避免破坏性空间标准化,在五个下游任务中性能提升达12个百分点,并显著降低预处理成本。

详情

展开后加载摘要…

URL PDF HTML 收藏