arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7583 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7583 篇

2412.18235 2024-12-25 cs.CV 78%

Band Prompting Aided SAR and Multi-Spectral Data Fusion Framework for Local Climate Zone Classification

Haiyan Lan, Shujun Li, Mingjie Xie, Xuanjia Zhao, Hongning Liu, Pengming Feng, Dongli Xu, Guangjun He, Jian Guan

专题命中 知识编辑与模型理解 :prompting(title,abstract)

Comments Accepted by ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10843 2024-12-17 cs.CV 78%

Learning Semantic-Aware Representation in Visual-Language Models for Multi-Label Recognition with Partial Labels

Haoxian Ruan, Zhihua Xu, Zhijing Yang, Yongyi Lu, Jinghui Qin, Tianshui Chen

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments ACM Transactions on Multimedia Computing Communications and Applications

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07518 2024-12-11 cs.CV 78%

Hallucination Elimination and Semantic Enhancement Framework for Vision-Language Models in Traffic Scenarios

Jiaqi Fan, Jianhua Wu, Hongqing Chu, Quanbo Ge, Bingzhao Gao

专题命中 知识编辑与模型理解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14064 2024-12-03 cs.CV 78%

HGCLIP: Exploring Vision-Language Models with Graph Representations for Hierarchical Understanding

Peng Xia, Xingtong Yu, Ming Hu, Lie Ju, Zhiyong Wang, Peibo Duan, Zongyuan Ge

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11919 2024-12-03 cs.CV 78%

VL-Uncertainty: Detecting Hallucination in Large Vision-Language Model via Uncertainty Estimation

Ruiyang Zhang, Hu Zhang, Zhedong Zheng

专题命中 知识编辑与模型理解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15628 2024-11-26 cs.CV 78%

ACE: Action Concept Enhancement of Video-Language Models in Procedural Videos

Reza Ghoddoosian, Nakul Agarwal, Isht Dwivedi, Behzad Darisuh

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments Accepted at WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13840 2024-11-22 cs.CV 78%

Segment Anything in Light Fields for Real-Time Applications via Constrained Prompting

Nikolai Goncharov, Donald G. Dansereau

专题命中 知识编辑与模型理解 :prompting(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13777 2024-11-15 cs.RO 78%

Embedding Pose Graph, Enabling 3D Foundation Model Capabilities with a Compact Representation

Hugues Thomas, Mouli Sivapurapu, Jian Zhang

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00307 2024-11-04 cs.CV 78%

HENASY: Learning to Assemble Scene-Entities for Egocentric Video-Language Model

Khoa Vo, Thinh Phan, Kashu Yamazaki, Minh Tran, Ngan Le

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20667 2024-10-29 q-bio.BM 78%

PepDoRA: A Unified Peptide Language Model via Weight-Decomposed Low-Rank Adaptation

Leyao Wang, Rishab Pulugurta, Pranay Vure, Yinuo Zhang, Aastha Pal, Pranam Chatterjee

专题命中 知识编辑与模型理解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01107 2024-10-17 cs.RO cs.MA cs.SY eess.SY 78%

CoViS-Net: A Cooperative Visual Spatial Foundation Model for Multi-Robot Applications

Jan Blumenkamp, Steven Morad, Jennifer Gielis, Amanda Prorok

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04035 2024-10-08 cs.HC 78%

Gamifying XAI: Enhancing AI Explainability for Non-technical Users through LLM-Powered Narrative Gamifications

Yuzhe You, Jian Zhao

专题命中 知识编辑与模型理解 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01144 2024-10-03 cs.CV 78%

Uncertainty-Guided Enhancement on Driving Perception System via Foundation Models

Yunhao Yang, Yuxin Hu, Mao Ye, Zaiwei Zhang, Zhichao Lu, Yi Xu, Ufuk Topcu, Ben Snyder

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19042 2024-10-01 eess.AS cs.SD 78%

Probing mental health information in speech foundation models

Marc de Gennes, Adrien Lesage, Martin Denais, Xuan-Nga Cao, Simon Chang, Pierre Van Remoortere, Cyrille Dakhlia, Rachid Riad

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13984 2024-09-24 cs.CV 78%

Cycle-Consistency Uncertainty Estimation for Visual Prompting based One-Shot Defect Segmentation

Geonuk Kim

专题命中 知识编辑与模型理解 :prompting(title,abstract)

Comments ECCV 2024 VISION workshop Most Innovative Prize

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12528 2024-09-20 cs.SD eess.AS 78%

SoundBeam meets M2D: Target Sound Extraction with Audio Foundation Model

Carlos Hernandez-Olivan, Marc Delcroix, Tsubasa Ochiai, Daisuke Niizumi, Naohiro Tawara, Tomohiro Nakatani, Shoko Araki

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11630 2024-09-19 cs.SD eess.AS 78%

Speaking from Coarse to Fine: Improving Neural Codec Language Model via Multi-Scale Speech Coding and Generation

Haohan Guo, Fenglong Xie, Dongchao Yang, Xixin Wu, Helen Meng

专题命中 知识编辑与模型理解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06485 2024-09-11 cs.CV 78%

Mitigating Hallucination in Visual-Language Models via Re-Balancing Contrastive Decoding

Xiaoyu Liang, Jiayuan Yu, Lianrui Mu, Jiedong Zhuang, Jiaqi Hu, Yuchen Yang, Jiangnan Ye, Lu Lu, Jian Chen, Haoji Hu

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments PRCV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06305 2024-09-11 cs.CV 78%

High-Performance Few-Shot Segmentation with Foundation Models: An Empirical Study

Shijie Chang, Lihe Zhang, Huchuan Lu

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05904 2024-09-05 cs.CV 78%

Enhancing Representation in Radiography-Reports Foundation Model: A Granular Alignment Algorithm Using Masked Contrastive Learning

Weijian Huang, Cheng Li, Hong-Yu Zhou, Hao Yang, Jiarun Liu, Yong Liang, Hairong Zheng, Shaoting Zhang, Shanshan Wang

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

Journal ref Nature Communications 15, 7620 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08542 2024-09-04 cs.CV 78%

AIGCs Confuse AI Too: Investigating and Explaining Synthetic Image-induced Hallucinations in Large Vision-Language Models

Yifei Gao, Jiaqi Wang, Zhiyu Lin, Jitao Sang

专题命中 知识编辑与模型理解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15676 2024-08-29 cs.SD eess.AS 78%

VoxInstruct: Expressive Human Instruction-to-Speech Generation with Unified Multilingual Codec Language Modelling

Yixuan Zhou, Xiaoyu Qin, Zeyu Jin, Shuoyi Zhou, Shun Lei, Songtao Zhou, Zhiyong Wu, Jia Jia

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments Accepted by ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01867 2024-08-06 cs.RO 78%

TrustNavGPT: Modeling Uncertainty to Improve Trustworthiness of Audio-Guided LLM-Based Robot Navigation

Xingpeng Sun, Yiran Zhang, Xindi Tang, Amrit Singh Bedi, Aniket Bera

专题命中 知识编辑与模型理解 :LLM(title,abstract)

Journal ref IROS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08265 2024-07-29 cs.CV 78%

Coordinate-Aware Thermal Infrared Tracking Via Natural Language Modeling

Miao Yan, Ping Zhang, Haofei Zhang, Ruqian Hao, Juanxiu Liu, Xiaoyang Wang, Lin Liu

专题命中 知识编辑与模型理解 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15605 2024-07-23 cs.CV 78%

Probing Fine-Grained Action Understanding and Cross-View Generalization of Foundation Models

Thinesh Thiyakesan Ponbagavathi, Kunyu Peng, Alina Roitberg

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11335 2024-07-19 cs.CV 78%

LaMI-DETR: Open-Vocabulary Detection with Language Model Instruction

Penghui Du, Yu Wang, Yifan Sun, Luting Wang, Yue Liao, Gang Zhang, Errui Ding, Yan Wang, Jingdong Wang, Si Liu

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments ECCV2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09128 2024-07-18 cs.CV 78%

Tokenize Anything via Prompting

Ting Pan, Lulu Tang, Xinlong Wang, Shiguang Shan

专题命中 知识编辑与模型理解 :prompting(title,abstract)

Comments code, model, and demo: https://github.com/baaivision/tokenize-anything

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09768 2024-06-14 cs.CV 78%

Contrastive Pretraining for Visual Concept Explanations of Socioeconomic Outcomes

Ivica Obadic, Alex Levering, Lars Pennig, Dario Oliveira, Diego Marcos, Xiaoxiang Zhu

专题命中 知识编辑与模型理解 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16094 2024-06-04 cs.CV 78%

PLUG: Revisiting Amodal Segmentation with Foundation Model and Hierarchical Focus

Zhaochen Liu, Limeng Qiao, Xiangxiang Chu, Tingting Jiang

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16311 2024-05-28 cs.HC 78%

Understanding Stakeholders' Perceptions and Needs Across the LLM Supply Chain

Agathe Balayn, Lorenzo Corti, Fanny Rancourt, Fabio Casati, Ujwal Gadiraju

专题命中 知识编辑与模型理解 :LLM(title,abstract)

Comments Paper accepted at the HCXAI workshop, co-located with CHI'24

详情

展开后加载摘要…

URL PDF HTML 收藏