arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 8057 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 8057 篇

2604.03980 2026-04-07 cs.CV cs.AI 57%

Gram-Anchored Prompt Learning for Vision-Language Models via Second-Order Statistics

基于二阶统计的Gram锚定提示学习用于视觉-语言模型

Minglei Chen, Weilong Wang, Jiang Duan, Ye Deng

机构 * Southwestern University of Finance and Economics(西南财经大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出GAPL框架,通过引入Gram矩阵增强局部语义对齐与全局结构一致性,解决传统一阶特征在领域偏移下的鲁棒性不足问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03267 2026-04-07 cs.CV cs.AI 57%

A reconfigurable smart camera implementation for jet flames characterization based on an optimized segmentation model

一种基于优化分割模型的可重构智能相机实现,用于喷射火焰特征识别

Gerardo Valente Vazquez-Garcia, Carmina Perez Guerrero, Eduardo Garduño, Miguel Gonzalez-Mendoza, Adriana Palacios, Gerardo Rodriguez-Hernandez, Vahid Foroughi, Alba Àgueda, Elsa Pastor, Gilberto Ochoa-Ruiz

机构 * Universidad de las Américas Puebla(普埃布拉美洲大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本文提出一种智能相机平台,用于工业喷射火焰特征识别,通过优化UNet分割模型实现边缘计算,降低延迟,提升处理效率。

Comments Paper submitted to EAAI (Elsevier) for peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19606 2026-04-07 cs.CL 57%

Languages in Whisper-Style Speech Encoders Align Both Phonetically and Semantically

语言在Whisper风格的语音编码器中同时对齐语音和语义

Ryan Soh-Eun Shim, Domenico De Cristofaro, Chengzhi Martin Hu, Alessandro Vietti, Barbara Plank

机构 * LMU Munich(慕尼黑大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Free University of Bozen-Bolzano(博尔扎诺自由大学) Technical University of Munich(慕尼黑工业大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 研究通过控制发音验证跨语言对齐源于语义而非语音相似性,发现语音翻译检索在无语音提示时仍表现优异,且在低资源语言上提升了自动语音识别性能。

Comments Submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03110 2026-04-06 cs.CL 57%

Multi-Aspect Knowledge Distillation for Language Model with Low-rank Factorization

多方面知识蒸馏用于具有低秩因子化的语言模型

Zihe Liu, Yulong Mao, Jinan Xu, Xinrui Peng, Kaiyu Huang

机构 * Key Laboratory of Big Data & Artificial Intelligence in Transportation(交通大数据与人工智能重点实验室) School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文提出多方面知识蒸馏方法,通过深入模仿自注意力和前馈模块,捕捉不同方面的丰富语言知识,实验表明其在相同存储预算下能与强基线模型竞争,并在蒸馏自回归架构模型中表现良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02770 2026-04-06 cs.AI 57%

Improving Role Consistency in Multi-Agent Collaboration via Quantitative Role Clarity

通过量化角色清晰度提升多智能体协作中的角色一致性

Guoling Zhou, Wenpei Han, Fengqin Yang, Li Wang, Yingcong Zhou, Zhiguo Fu

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出量化角色清晰度以提升多智能体协作中的角色一致性,通过构建角色分配矩阵和角色清晰度矩阵,利用Frobenius范数量化角色描述与行为轨迹的一致性,并在轻量微调中作为正则化项提升任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02627 2026-04-06 cs.CV cs.AI cs.MM 57%

Smart Transfer: Leveraging Vision Foundation Model for Rapid Building Damage Mapping with Post-Earthquake VHR Imagery

智能迁移:利用视觉基础模型实现地震后高分辨率影像快速建筑损坏映射

Hao Li, Liwei Zou, Wenping Yin, Gulsen Taskin, Naoto Yokoya, Danfeng Hong, Wufan Zhao

机构 * Department of Geography, National University of Singapore(新加坡国立大学地理系) Urban Governance and Design Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)城市治理与设计学域) School of Environment and Spatial Informatics, China University of Mining and Technology(中国矿业大学环境与空间信息学院) Disaster Management Institute, Istanbul Technical University(伊斯坦布尔技术大学灾害管理研究所) Department of Complexity Science and Engineering, University of Tokyo(东京大学复杂科学与工程系) School of Automation, Southeast University(东南大学自动化学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出Smart Transfer框架,利用先进视觉基础模型实现快速建筑损坏映射,通过像素聚类和距离惩罚三元组策略提升跨区域迁移性能,为灾害响应提供可扩展的自动化解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02479 2026-04-06 cs.CV cs.AI 57%

Generating Satellite Imagery Data for Wildfire Detection through Mask-Conditioned Generative AI

通过掩码条件生成式AI生成卫星图像数据用于野火检测

Valeria Martin, K. Brent Venable, Derek Morgan

机构 * Department of Intelligent Systems and Robotics, University of West Florida(西佛罗里达大学智能系统与机器人系) IHMC(人类与机器认知研究所)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文探讨了基于地球观测扩散模型EarthSynth生成野火后Sentinel-2 RGB图像的可能性,通过不同实验配置评估生成效果,发现修补生成优于全图生成,且VLM辅助修补与手工提示效果相当。

Comments 22 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28225 2026-04-06 cs.LG 57%

Detecting the Unexpected: AI-Driven Anomaly Detection in Smart Bridge Monitoring

发现意外:智能桥梁监控中的AI驱动异常检测

Rahul Jaiswal, Joakim Hellum, Halvor Heiberg

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 本文提出基于AI的智能桥梁监控异常检测方法,利用实时传感器数据训练简单机器学习模型,实验表明DBSCAN模型在准确检测桥梁事故方面表现优异,提升了公共安全。

Comments 6 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00961 2026-04-06 cs.LG 57%

Goal-Driven Reward by Video Diffusion Models for Reinforcement Learning

通过视频扩散模型实现目标驱动的奖励用于强化学习

Qi Wang, Mian Wu, Yuyang Zhang, Mingqi Yuan, Wenyao Zhang, Haoxiang You, Yunbo Wang, Xin Jin, Xiaokang Yang, Wenjun Zeng

机构 * Shanghai Jiao Tong University(上海交通大学) Ningbo Key Laboratory of Spatial Intelligence and Digital Derivative, Ningbo Institute of Digital Twin, Eastern Institute of Technology, Ningbo(宁波市空间智能与数字衍生重点实验室,东方理工高等研究院宁波数字孪生研究院,宁波) Zhejiang Key Laboratory of Industrial Intelligence and Digital Twin(浙江省工业智能与数字孪生重点实验室) Zhongguancun Academy(中关村学院) Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算学系) Department of Mechanical Engineering, Yale University(耶鲁大学机械工程系)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出利用预训练的视频扩散模型为强化学习代理提供目标驱动的奖励信号,通过视频级和帧级目标提升轨迹的连贯性和目标导向性。

Comments Accepted by CVPR 2026. Project page: https://qiwang067.github.io/genreward

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02280 2026-04-03 cs.AI cs.CV 57%

Novel Memory Forgetting Techniques for Autonomous AI Agents: Balancing Relevance and Efficiency

新颖的记忆遗忘技术用于自主AI代理:在相关性和效率之间平衡

Payal Fofadiya, Sunil Tiwari

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出一种自适应预算遗忘框架,通过相关性引导评分和有界优化,提升长周期对话任务的F1分数和记忆一致性,减少虚假记忆。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02211 2026-04-03 cs.IR cs.AI cs.MA 57%

Multi-Agent Video Recommenders: Evolution, Patterns, and Open Challenges

多智能体视频推荐系统:演进、模式与开放挑战

Srivaths Ranganathan, Abhishek Dharmaratnakar, Anushree Sinha, Debanshu Das

机构 * Google LLC(谷歌公司)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文探讨多智能体视频推荐系统的演进、协作模式及挑战,分析了从早期MARL到LLM驱动架构的发展,并提出可扩展性、多模态理解等开放问题。

Comments Accepted for publication in The Nineteenth ACM International Conference on Web Search and Data Mining (WSDM Companion 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00261 2026-04-03 cs.CL 57%

Can Large Language Models Self-Correct in Medical Question Answering? An Exploratory Study

大语言模型能否在医疗问答中自我纠正?一项探索性研究

Zaifu Zhan, Mengyuan Cui, Rui Zhang

机构 * Department of Electrical and Computer Engineering, University of Minnesota(明尼苏达大学电气与计算机工程系) Division of Computational Health Sciences, Department of Surgery, University of Minnesota(明尼苏达大学外科学系计算健康科学部) Department of Software Engineering, University of St. Thomas(圣托马斯大学软件工程系)

专题命中 其他安全 :safety(abstract);分类 cs.CL

AI总结 本文探讨大语言模型在医疗问答中的自我反思能力,通过比较标准Co-T提示与迭代自我反思循环,发现自我反思并不总能提升准确性,且效果依赖于数据集和模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06763 2026-04-03 cs.CV cs.AI 57%

SafePLUG: Empowering Multimodal LLMs with Pixel-Level Insight and Temporal Grounding for Traffic Accident Understanding

SafePLUG: 通过像素级洞察和时间锚定赋能多模态大语言模型以理解交通事故

Zihao Sheng, Zilin Huang, Yansong Qu, Jiancong Chen, Yuhao Luo, Yen-Jung Chen, Yue Leng, Sikai Chen

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Purdue University(普渡大学) Google(谷歌)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本文提出SafePLUG框架,通过像素级理解和时间锚定提升多模态大语言模型在交通事故分析中的能力,引入新数据集并实现区域问答、像素分割、时间事件定位等任务的高性能表现。

Comments The code, dataset, and model checkpoints will be made publicly available at: https://zihaosheng.github.io/SafePLUG

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01630 2026-04-03 cs.CL 57%

Grounding AI-in-Education Development in Teachers' Voices: Findings from a National Survey in Indonesia

将教育中的AI发展扎根于教师的声音:来自印度尼西亚全国调查的结果

Nurul Aisyah, Muhammad Dehan Al Kautsar, Arif Hidayat, Fajri Koto

机构 * Quantic School of Business and Technology(昆蒂克商业与技术学院) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Indonesia University of Education(印度尼西亚教育大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 研究通过全国性调查揭示印尼教师对AI在教育中的应用现状,发现AI在教学、内容开发和教学媒体中日益普及,但应用不均,教师更倾向于利用AI减轻教学准备负担。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01234 2026-04-03 cs.CV cs.AI eess.IV 57%

CLPIPS: A Personalized Metric for AI-Generated Image Similarity

CLPIPS:一种用于AI生成图像相似度的个性化度量标准

Khoi Trinh, Jay Rothenberger, Scott Seidenberger, Dimitrios Diochnos, Anindya Maiti

机构 * University of Oklahoma(俄克拉荷马大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出CLPIPS,一种基于LPIPS的个性化度量标准,通过人类反馈优化提升感知对齐,展示有限的人工调整可显著增强文本到图像工作流中的感知对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22294 2026-04-03 cs.CV cs.LG 57%

Structure is Supervision: Multiview Masked Autoencoders for Radiology

结构是监督:用于放射学的多视图掩码自编码器

Sonia Laguna, Andrea Agostini, Alain Ryser, Samuel Ruiperez-Campillo, Irene Cannistraci, Moritz Vandenhirtz, Stephan Mandt, Nicolas Deperrois, Farhad Nooralahzadeh, Michael Krauthammer, Thomas M. Sutter, Julia E. Vogt

机构 * Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系) Department of Computer Science, UC Irvine(加州大学尔湾分校计算机科学系) Department of Quantitative Biomedicine, University of Zurich(苏黎世大学定量生物医学系)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出多视图掩码自编码器(MVMAE),通过利用放射学研究的多视图结构学习视图不变和疾病相关表征,并在三个公开数据集上验证了其在疾病分类任务中的优越性能。

Journal ref Transactions on Machine Learning Research (TMLR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00397 2026-04-02 cs.CV cs.AI 57%

Improving Generalization of Deep Learning for Brain Metastases Segmentation Across Institutions

提升跨机构深度学习在脑转移瘤分割中的泛化能力

Yuchen Yang, Shuangyang Zhong, Haijun Yu, Langcuomu Suo, Hongbin Han, Florian Putz, Yixing Huang

机构 * Peking University Health Science Center(北京大学医学部) Beijing Key Laboratory of Intelligent Neuromodulation and Brain Disorder Treatment(北京智能神经调控与脑疾病治疗重点实验室) University Hospital Erlangen(埃尔朗根大学医院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出VAE-MMD方法,通过结合变分自编码器和最大均值差异损失,提升跨机构脑转移瘤分割的泛化能力,实验显示在多个数据集上均取得了显著提升。

Comments 5 figures and 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02418 2026-04-02 cs.CR cs.LG 57%

Leveraging Large Language Models to Bridge Cross-Domain Transparency in Stablecoins

利用大型语言模型弥合稳定币跨领域透明度

Yuexin Xiang, Yuchen Lei, Yuanzhe Zhang, Qin Wang, Tsz Hon Yuen, Andreas Deppeler, Jiangshan Yu

机构 * Faculty of Information Technology, Monash University(莫纳什大学信息技术学院) School of Cyber Science and Engineering, Wuhan University(武汉大学网络空间安全学院) Digital Trust Centre, Nanyang Technological University(南洋理工大学数字信任中心) School of Business, Monash University(莫纳什大学商学院) School of Computer Science, The University of Sydney(悉尼大学计算机科学学院)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出利用大型语言模型整合稳定币跨领域透明度,通过语义对齐发行披露与市场数据,揭示披露与可验证数据间的系统性差距,提升去中心化金融的自动化审计能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00057 2026-04-02 cs.MM cs.AI 57%

Towards Automatic Soccer Commentary Generation with Knowledge-Enhanced Visual Reasoning

面向知识增强视觉推理的自动足球解说生成

Zeyu Jin, Xiaoyu Qin, Songtao Zhou, Kaifeng Yun, Jia Jia

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) BNRist, Tsinghua University(清华大学北京信息科学与技术国家研究中心)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出GameSight模型,通过视觉推理与知识增强生成更准确的足球解说,提升解说质量与上下文相关性。

Comments Accepted by ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15929 2026-04-02 cs.AI math.AP math.LO 57%

Semi-Autonomous Formalization of the Vlasov-Maxwell-Landau Equilibrium

半自动化的Vlasov-Maxwell-Landau平衡形式化

Vasily Ilin

机构 * University of Washington(华盛顿大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文展示了一个完整的Lean 4形式化,用于Vlasov-Maxwell-Landau系统中的平衡特性描述,通过AI辅助数学研究流程,结合AI推理模型、编码工具和专业证明器,实现了高效的形式化验证。

Comments 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23095 2026-04-01 cs.HC cs.CY 57%

Exploring Sidewalk Sheds in New York City through Chatbot Surveys and Human Computer Interaction

通过聊天机器人调查和人机交互探索纽约市人行道遮蔽物

Junyi Li, Zhaoxi Zhang, Tamir Mendel, Takahiro Yabe

专题命中 其他安全 :safety(abstract);分类 cs.CY

AI总结 本文通过聊天机器人调查和人机交互研究纽约市人行道遮蔽物对行人可见性和通行的影响,利用AI模型分析遮蔽物设计特征,提供实证数据支持改进遮蔽物规范。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00241 2026-04-01 cs.HC cs.AI 57%

Balancing Efficiency and Empathy: Healthcare Providers' Perspectives on AI-Supported Workflows for Serious Illness Conversations in the Emergency Department

平衡效率与同理心:急诊部门医护人员对AI支持的严重疾病对话工作流的视角

Menglin Zhao, Zhuorui Yong, Ruijia Guan, Kai-Wei Chang, Adrian Haimovich, Kei Ouchi, Timothy Bickmore, Zhan Zhang, Bingsheng Yao, Dakuo Wang, Smit Desai

机构 * Northeastern University(东北大学) University of California, Los Angeles(加州大学洛杉矶分校) Beth Israel Deaconess Medical Center(贝斯以色列女执事医疗中心) Harvard Medical School, Dana-Farber Cancer Institute, Brigham and Women’s Hospital(哈佛医学院、丹娜-法伯癌症研究所、布里格姆妇女医院) Pace University(佩斯大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 研究探讨急诊医护人员在严重疾病对话中使用AI技术的挑战与机遇,提出四阶段工作流及设计指南,强调效率与人文关怀的平衡。

Comments To appear at ACM CHI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29432 2026-04-01 cs.LG eess.SP 57%

mtslearn: Machine Learning in Python for Medical Time Series

mtslearn:用于医疗时间序列的Python机器学习

Zhongheng Jiang, Yuechao Zhao, Donglin Xie, Chenxi Sun, Rongchen Lu, Silu Luo, Zisheng Liang, Shenda Hong

机构 * Nanjing University of Information Science and Technology(南京信息工程大学) National Institute of Health Data Science, Peking University(北京大学健康医疗大数据国家研究院) School of Health Humanities, Peking University Health Science Center(北京大学医学人文学院) Institute of Medical Technology, Peking University Health Science Center(北京大学医学技术研究院) Harvard Medical School(哈佛医学院) Beth Israel Deaconess Medical Center(贝斯以色列女执事医疗中心) School of Business English, Sichuan International Studies University(四川外国语大学商务英语学院) School of Clinical Medicine, Chengdu Medical College(成都医学院临床医学院) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) State Key Laboratory of Vascular Homeostasis and Remodeling, NHC Key Laboratory of Cardiovascular Molecular Biology and Regulatory Peptides, Peking University(北京大学血管稳态与重构全国重点实验室、国家卫生健康委员会心血管分子生物学与调节肽重点实验室)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出mtslearn,一个专为医疗时间序列设计的端到端工具包,通过统一数据接口和模块化设计,简化数据处理流程,降低临床人员使用门槛,促进先进算法在临床实践中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21223 2026-04-01 cs.CV cs.CL 57%

Sigma: Semantically Informative Pre-training for Skeleton-based Sign Language Understanding

Sigma:基于骨骼的语义信息预训练用于手语理解

Muxin Pu, Mei Kuan Lim, Chun Yong Chong, Chen Change Loy

机构 * School of Information Technology, Monash University(莫纳什大学信息技术学院) S-Lab, Nanyang Technological University(南洋理工大学S-Lab)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 Sigma提出一种统一的骨骼手语理解框架,通过语义对齐学习和预训练策略提升手语识别与翻译性能,展现语义信息预训练在多语言手语任务中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27836 2026-03-31 quant-ph cs.CL 57%

Q-Bridge: Code Translation for Quantum Machine Learning via LLMs

Q-Bridge:通过LLM实现量子机器学习的代码翻译

Runjia Zeng, Priyabrata Senapati, Ruixiang Tang, Dongfang Liu, Qiang Guan

机构 * Rochester Institute of Technology(罗彻斯特理工学院) Kent State University(肯特州立大学) Rutgers University(罗格斯大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 Q-Bridge通过LLM指导的代码翻译框架,系统性地将经典机器学习实现转换为可执行的量子机器学习变体,建立了首个可重复的框架和数据集,为可扩展的量子AI发展奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13516 2026-03-31 cs.CV cs.AI 57%

Bidirectional Multimodal Prompt Learning with Scale-Aware Training for Few-Shot Multi-Class Anomaly Detection

双向多模态提示学习与尺度感知训练用于少样本多类异常检测

Yujin Lee, Sewon Kim, Daeun Moon, Seoyoon Jang, Hyunsoo Yoon

机构 * Yonsei University(延世大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出AnoPLe框架,通过双向交互文本与视觉提示,实现高效多类异常检测,在MVTec-AD等数据集上超越现有方法,且具备良好的泛化能力。

Comments accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27169 2026-03-31 cs.AI 57%

Aligning LLMs with Graph Neural Solvers for Combinatorial Optimization

对齐大语言模型与图神经求解器以解决组合优化问题

Shaodi Feng, Zhuoyi Lin, Yaoxin Wu, Haiyan Yin, Yan Jin, Senthilnath Jayavelu, Xun Xu

机构 * National Yang Ming Chiao Tung University(国立阳明交通大学) Eindhoven University of Technology(埃因霍温理工大学) Centre for Frontier AI Research, A*STAR(前沿人工智能研究中心,新加坡科技研究局) Huazhong University of Science and Technology(华中科技大学) National University of Singapore(新加坡国立大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出AlignOPT方法,通过结合大语言模型与图神经求解器,提升组合优化问题的求解能力,实现语义与结构表示的对齐,实验显示其在多种优化问题中表现优异。

Comments 18 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27135 2026-03-31 cs.LG stat.ML 57%

Spectral-Aware Text-to-Time Series Generation with Billion-Scale Multimodal Meteorological Data

具有十亿级多模态气象数据的频谱感知文本到时间序列生成

Shijie Zhang

机构 * School of Computer Science and Engineering, Northeastern University, Shenyang, China(东北大学计算机科学与工程学院,沈阳,中国)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出MTransformer模型,通过频谱提示生成器实现文本到时间序列的精确语义控制,利用大规模气象数据提升生成质量与跨模态对齐精度。

Comments Accepted By IJCNN 2026 (WCCI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26859 2026-03-31 cs.CV cs.AI eess.IV 57%

Beyond Textual Knowledge-Leveraging Multimodal Knowledge Bases for Enhancing Vision-and-Language Navigation

超越文本知识的多模态知识库用于增强视觉-语言导航

Dongsheng Yang, Yinfeng Yu, Liejun Wang

机构 * School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院) Joint International Research Laboratory of Silk Road Multilingual Cognitive Computing(丝绸之路多语言认知计算联合国际研究实验室)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出BTK框架,通过整合环境特定文本知识与生成图像知识库,提升视觉-语言导航中的语义 grounding 和跨模态对齐,实验表明在R2R和REVERIE数据集上性能显著提升。

Comments Main paper (37 pages). Accepted for publication by the Information Processing and Management,Volume 63,Issue 6,September 2026,104766

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26804 2026-03-31 cs.CV cs.AI 57%

The Language of Touch: Translating Vibrations into Text with Dual-Branch Learning

触觉的语言:通过双分支学习将振动转化为文本

Jin Chen, Yifeng Lin, Chao Zeng, Si Wu, Tiesong Zhao

机构 * Fujian Key Lab for Intelligent Processing and Wireless Transmission of Media Information, Fuzhou University(福州大学福建省媒体信息智能处理与无线传输重点实验室) Fujian Science and Technology Innovation Laboratory for Optoelectronic Information of China(福建省光电信息科学与技术创新实验室) School of Artificial Intelligence, Hubei University(湖北大学人工智能学院) Key Laboratory of Intelligent Sensing System and Security, Hubei University and Ministry of Education(湖北大学及教育部智能感知系统与安全重点实验室) School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文首次尝试解决触觉描述生成问题,提出ViPAC方法,通过双分支策略和动态融合机制处理触觉数据的周期性和非周期性特性,构建首个触觉-文本配对数据集LMT108-CAP,实验表明其在词汇准确性和语义对齐方面优于基线方法。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏