PointT2I: LLM-based text-to-image generation via keypoints
PointT2I: 通过关键点生成基于大语言模型的文本到图像生成
Taekyung Lee, Donggyu Lee, Myungjoo Kang
机构
*
Interdisciplinary Program in Artificial Intelligence, Seoul National University(人工智能跨学科项目,首尔国立大学)
;
Department of Mathematical Sciences, Seoul National University(数学科学系,首尔国立大学)
专题命中
指令微调
:LLM(title,abstract);large language model(abstract);language model(abstract)
GRASP: Guided Region-Aware Sparse Prompting for Adapting MLLMs to Remote Sensing
GRASP: 基于区域感知的稀疏提示引导方法用于适应遥感图像的多模态大语言模型
Qigan Sun, Chaoning Zhang, Jianwei Zhang, Xudong Wang, Jiehui Xie, Pengcheng Zheng, Haoyu Wang, Sungyoung Lee, Chi-lok Andy Tai, Yang Yang, Heng Tao Shen
机构
*
School of Computing, Kyung Hee University(京畿大学计算机学院)
;
School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院)
;
School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院)
;
College of Computer Science and Information Engineering, Harbin Normal University(哈尔滨师范大学计算机科学与信息工程学院)
;
College of Professional and Continuing Education, The Hong Kong Polytechnic University(香港理工大学专业及继续教育学院)
;
School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)
专题命中
指令微调
:prompting(title,abstract);large language model(abstract);language model(abstract)
Chasing Shadows: Pitfalls in LLM Security Research
追影:大语言模型安全研究中的陷阱
Jonathan Evertz, Niklas Risse, Nicolai Neuer, Andreas Müller, Philipp Normann, Gaetano Sapia, Srishti Gupta, David Pape, Soumya Shaw, Devansh Srivastav, Christian Wressnegger, Erwin Quiring, Thorsten Eisenhofer, Daniel Arp, Lea Schönherr
专题命中
指令微调
:LLM(title);large language model(abstract);language model(abstract);prompting(abstract)
YOLOA: Real-Time Affordance Detection via LLM Adapter
YOLOA:通过LLM适配器实现实时的可及性检测
Yuqi Ji, Junjie Ke, Lihuo He, Jun Liu, Kaifan Zhang, Yu-Kun Lai, Guiguang Ding, Xinbo Gao
机构
*
School of Electronic Engineering, Xidian University(电子工程学院,西安电子科技大学)
;
School of Software, Tsinghua University(软件学院,清华大学)
;
School of Computer Science and Informatics, Cardiff University(计算机科学与信息学院,卡迪夫大学)
专题命中
指令微调
:LLM(title,abstract);large language model(abstract);language model(abstract)
AutoPrompt: Automated Red-Teaming of Text-to-Image Models via LLM-Driven Adversarial Prompts
Yufan Liu, Wanqian Zhang, Huashan Chen, Lin Wang, Xiaojun Jia, Zheng Lin, Weiping Wang
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
;
School of Cyberspace, Hangzhou Dianzi University(杭州电子科技大学网络空间学院)
;
Nanyang Technological University(南洋理工大学)
专题命中
指令微调
:LLM(title,abstract);large language model(abstract);language model(abstract)
CoIDO: Efficient Data Selection for Visual Instruction Tuning via Coupled Importance-Diversity Optimization
Yichen Yan, Ming Zhong, Qi Zhu, Xiaoling Gu, Jinpeng Chen, Huan Li
机构
*
The State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室)
;
Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院)
;
Hangzhou Dianzi University(杭州电子科技大学)
;
School of Computer Science (National Pilot Software Engineering School), BUPT(计算机学院(国家级试点软件工程学院),北京邮电大学)
专题命中
指令微调
:instruction tuning(title,abstract);large language model(abstract);language model(abstract)
Comments22 pages, 8 figures, 39th Conference on Neural Information Processing Systems (NeurIPS 2025)
In the Eye of MLLM: Benchmarking Egocentric Video Intent Understanding with Gaze-Guided Prompting
Taiying Peng, Jiacheng Hua, Miao Liu, Feng Lu
机构
*
State Key Laboratory of VR Technology and Systems, School of CSE, Beihang University(虚拟现实技术与系统国家重点实验室,北京航空航天大学计算机科学与工程学院)
;
College of AI, Tsinghua University(清华大学人工智能学院)
专题命中
指令微调
:prompting(title,abstract);large language model(abstract);language model(abstract)