arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Southern California(南加州大学)

2025-11-25 至 2025-11-25 共收录 9
2511.19417 2025-11-25 cs.CL cs.AI cs.LG

Be My Eyes: Extending Large Language Models to New Modalities Through Multi-Agent Collaboration

Be My Eyes: 通过多智能体协作扩展大型语言模型到新模态

James Y. Huang, Sheng Zhang, Qianchu Liu, Guanghui Qin, Tinghui Zhu, Tristan Naumann, Muhao Chen, Hoifung Poon

机构 * University of Southern California(南加州大学) Microsoft Research(微软研究院) University of California, Davis(加州大学戴维斯分校)

AI总结 BeMyEyes通过多智能体协作扩展LLMs到多模态推理,利用高效VLMs与强大LLMs的互补优势,实现轻量级开源解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19057 2025-11-25 cs.CV

LAA3D: A Benchmark of Detecting and Tracking Low-Altitude Aircraft in 3D Space

LAA3D:3D空间中低空飞行器检测与跟踪的基准数据集

Hai Wu, Shuai Tang, Jiale Wang, Longkun Zou, Mingyue Guo, Rongqin Liang, Ke Chen, Yaowei Wang

机构 * Pengcheng Laboratory(鹏城实验室) South China University of Technology(南方科技大学) University of Southern California(南加州大学)

AI总结 LAA3D是一个大规模数据集,用于3D空间中低空飞行器的检测与跟踪,包含真实和合成数据,支持多种3D任务,提出MonoLAA基线模型实现稳健的3D定位。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18680 2025-11-25 cs.GR cs.CV

Inverse Rendering for High-Genus Surface Meshes from Multi-View Images

从多视角图像逆向渲染高亏格表面网格

Xiang Gao, Xinmu Wang, Xiaolong Wu, Jiazhi Li, Jingyu Shi, Yu Guo, Yuanpeng Liu, Xiyun Song, Heather Yu, Zongfang Lin, Xianfeng David Gu

机构 * Futurewei Technologies(未来科技公司) Stony Brook University(石溪大学) Purdue University(普渡大学) University of Southern California(南加州大学) George Mason University(乔治·马歇尔大学)

AI总结 本文提出了一种结合自适应V-循环重新网格化和重新参数化Adam优化器的方法,用于从多视角图像中逆向渲染高亏格表面网格,提升了拓扑和几何意识,有效改善了高亏格和低亏格表面的重建效果。

Comments 3DV2026 Accepted (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18679 2025-11-25 cs.CV

Neural Geometry Image-Based Representations with Optimal Transport (OT)

基于最优传输的神经几何图像表示

Xiang Gao, Yuanpeng Liu, Xinmu Wang, Jiazhi Li, Minghao Guo, Yu Guo, Xiyun Song, Heather Yu, Zhiqiang Lao, Xianfeng David Gu

机构 * Futurewei Technologies(未来智科) Stony Brook University(石溪大学) University of Southern California(南加州大学) Massachusetts Institute of Technology(麻省理工学院) George Mason University(乔治·玛莎大学)

AI总结 本文提出一种基于最优传输的神经几何图像表示方法,通过将不规则网格转换为规则图像网格,实现高效存储和神经处理,实验显示其在存储效率和恢复精度上优于现有方法。

Comments WACV2026 Rround 2 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18464 2025-11-25 stat.ML cs.LG

Reliable Selection of Heterogeneous Treatment Effect Estimators

可靠选择异质处理效应估计器

Jiayi Guo, Zijun Gao

机构 * Peking University(北京大学) Marshall School of Business, University of Southern California(南加州大学马歇尔商学院)

AI总结 本文提出一种无需真实值的可靠方法,用于在异质处理效应估计中选择最佳估计器,并在多个基准测试中展示了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18335 2025-11-25 cs.CL cs.AI cs.LG

OmniStruct: Universal Text-to-Structure Generation across Diverse Schemas

OmniStruct: 跨多样的模式生成的通用文本到结构生成

James Y. Huang, Wenxuan Zhou, Nan Xu, Fei Wang, Qin Liu, Sheng Zhang, Hoifung Poon, Muhao Chen

机构 * University of Southern California(南加州大学) University of California, Davis(加州大学戴维斯分校) Microsoft Research(微软研究院)

AI总结 OmniStruct提出了一种跨多种模式的通用文本到结构生成方法,通过合成数据训练小型模型,实现与GPT-4o相当的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17850 2025-11-25 physics.acc-ph cs.LG

Efficient Dynamic and Momentum Aperture Optimization for Lattice Design Using Multipoint Bayesian Algorithm Execution

利用多点贝叶斯算法执行实现晶格设计的高效动态和动量孔径优化

Z. Zhang, I. Agapov, S. Gasiorowski, T. Hellert, W. Neiswanger, X. Huang, D. Ratner

机构 * SLAC National Accelerator Laboratory(SLAC国家加速器实验室) Lawrence Berkeley National Laboratory(伯克利国家实验室) University of Southern California(南加州大学)

AI总结 本文提出利用多点贝叶斯算法执行实现存储环设计的高效动态和动量孔径优化,通过减少计算成本提升设计质量。

Comments 10 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17765 2025-11-25 cs.RO cs.LG cs.MA

LEARN: Learning End-to-End Aerial Resource-Constrained Multi-Robot Navigation

LEARN: 一种端到端的空载资源受限多机器人导航学习

Darren Chiu, Zhehui Huang, Ruohai Ge, Gaurav S. Sukhatme

机构 * University of Southern California(美国南加州大学)

AI总结 LEARN通过轻量级强化学习框架实现多无人机在复杂环境中的高效导航,相比现有方法在资源利用和性能上均有显著提升。

Comments 20 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17609 2025-11-25 cs.CL cs.LG

TyphoFormer: Language-Augmented Transformer for Accurate Typhoon Track Forecasting

TyphoFormer:语言增强的Transformer用于准确的台风路径预测

Lincan Li, Eren Erman Ozguven, Yue Zhao, Guang Wang, Yiqun Xie, Yushun Dong

机构 * Florida State University(佛罗里达州立大学) FAMU-FSU College of Engineering(FAMU-FSU 工程学院) University of Southern California(南加州大学) University of Maryland(马里兰大学)

AI总结 TyphoFormer通过结合自然语言描述提升台风路径预测准确性,优于现有方法,尤其在复杂场景中表现突出。

Comments Accepted by ACM SIGSPATIAL 2025. Received SIGSPATIAL '25 Best Short Paper Award

详情

展开后加载摘要…

URL PDF HTML 收藏