arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Korea Advanced Institute of Science and Technology(韩国科学技术院)

2026-03-20 至 2026-03-20 共收录 6
2603.19008 2026-03-20 cs.CL cs.AI cs.LG

Hypothesis-Conditioned Query Rewriting for Decision-Useful Retrieval

基于假设的查询重写用于决策有用的检索

Hangeol Chang, Changsun Lee, Seungjoon Rho, Junho Yeo, Jong Chul Ye

机构 * Graduate School of AI, KAIST, Republic of Korea(韩国科学技术院人工智能研究生院) School of Electrical Engineering, KAIST, Republic of Korea(韩国科学技术院电气工程学院) Department of Industrial Engineering, Yonsei University, Republic of Korea(延世大学工业工程系)

AI总结 本文提出HCQR框架,通过重写查询获取证据支持假设、区分替代方案和验证关键线索,提升检索与答案选择的对齐度,实验表明在MedQA和MMLU-Med上优于传统RAG方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18892 2026-03-20 cs.CV cs.AI

MultihopSpatial: Multi-hop Compositional Spatial Reasoning Benchmark for Vision-Language Model

MultihopSpatial: 用于视觉语言模型的多跳组合空间推理基准

Youngwan Lee, Soojin Jang, Yoorhim Cho, Seunghwan Lee, Yong-Ju Lee, Sung Ju Hwang

机构 * Electronics and Telecommunications Research Institute, South Korea(韩国电信研究院) Korea Advanced Institute of Science and Technology, South Korea(韩国科学技术院) Sungkyunkwan University, South Korea(成均馆大学) DeepAuto, South Korea(DeepAuto)

AI总结 本文提出MultihopSpatial基准,针对多跳组合空间推理问题,引入Acc@50IoU指标,并通过大规模训练集提升视觉语言模型的空间推理能力。

Comments Project page: https://youngwanlee.github.io/multihopspatial

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23098 2026-03-20 cs.CV cs.AI

Blind to Position, Biased in Language: Probing Mid-Layer Representational Bias in Vision-Language Encoders for Zero-Shot Language-Grounded Spatial Understanding

无视位置,语言偏见:探测视觉语言编码器中中间层表征偏见以实现零样本语言基础空间理解

Na Min An, Inha Kang, Minhyun Lee, Hyunjung Shim

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院) Samsung Electronics(三星电子)

AI总结 研究探讨了视觉语言编码器中间层中位置和语言相关信息的偏见,通过层间分析发现常规最终层多模态嵌入优先考虑全局语义对齐,导致视觉嵌入对位置线索敏感性低,多语言文本嵌入在共享空间中形成语言依赖的几何偏移,提出构建空间地图的方法提升零样本图像分割性能。

Comments 61 pages, 28 Figures, 15 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18493 2026-03-20 cs.CV cs.AI cs.LG

FILT3R: Latent State Adaptive Kalman Filter for Streaming 3D Reconstruction

FILT3R:用于流式3D重建的潜在状态自适应卡尔曼滤波器

Seonghyun Jin, Jong Chul Ye

机构 * KAIST AI(韩国科学技术院人工智能研究所)

AI总结 FILT3R通过将递归状态更新转化为token空间的随机状态估计,解决了流式3D重建中状态更新规则不稳定的问题,提升了长期稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13323 2026-03-20 cs.LG

GeoReg: Weight-Constrained Few-Shot Regression for Socio-Economic Estimation using LLM

GeoReg: 基于LLM的带权重少样本回归用于社会经济估计

Kyeongjin Ahn, Sungwon Han, Seungeon Lee, Donghyun Ahn, Hyoshin Kim, Jungwon Kim, Jihee Kim, Sangyoon Park, Meeyoung Cha

机构 * School of Computing, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院计算机科学学院) College of Business, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院商学院) Graduate School of Data Science, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院数据科学研究生院) Division of Social Science, Hong Kong University of Science and Technology (HKUST)(香港科学与技术大学社会科学系) Max Planck Institute for Software Systems (MPI-SWS)(马克斯·普朗克软件系统研究所) Max Planck Institute for Security and Privacy (MPI-SP)(马克斯·普朗克安全与隐私研究所)

AI总结 GeoReg通过整合卫星图像和网络地理信息等数据源,利用大语言模型的先验知识,在数据稀缺地区实现社会经济指标的少样本回归估计,实验表明其在不同发展水平国家均优于基线模型。

Comments 10 pages, 9 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08625 2026-03-20 cs.CL

RAISE: Enhancing Scientific Reasoning in LLMs via Step-by-Step Retrieval

RAISE:通过逐步检索增强大语言模型的科学推理

Minhae Oh, Jeonghye Kim, Nakyung Lee, Donggeon Seo, Taeuk Kim, Jungwoo Lee

机构 * Seoul National University(首尔国立大学) KAIST(韩国科学技术院) Hanyang University(翰阳大学)

AI总结 RAISE通过逐步检索增强科学推理,其核心方法是问题分解、逻辑查询生成和逻辑检索,优于其他基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏