LLM-Bootstrapped Targeted Finding Guidance for Factual MLLM-based Medical Report Generation
基于大语言模型的引导式目标发现指导:用于基于事实的多模态大语言模型医疗报告生成
Cunyuan Yang, Dejuan Song, Xiaotao Pang, Qianqian Shen, Wenjie Nie, Yifan Huang, Lei Wu, Wei Han, Haishuai Wang, Jiajun Bu
机构
*
Zhejiang University(浙江大学)
;
The Second Affiliated Hospital Zhejiang University School of Medicine(浙江大学医学院附属第二医院)
;
Hangzhou Pu Jian Medical Technology Co., Ltd.(杭州普健医疗科技有限公司)
Interaction2Code: Benchmarking MLLM-based Interactive Webpage Code Generation from Interactive Prototyping
Interaction2Code: 基于MLLM的交互式网页代码生成基准测试
Jingyu Xiao, Yuxuan Wan, Yintong Huo, Zixin Wang, Xinyi Xu, Wenxuan Wang, Zhiyao Xu, Yuhang Wang, Michael R. Lyu
机构
*
The Chinese University of Hong Kong, China(香港中文大学)
;
Singapore Management University, Singapore(新加坡管理学院)
;
Renmin University of China, China(中国人民大学)
;
Tsinghua University, China(清华大学)
;
Southwest University, China(西南大学)
机构
*
Alibaba Group(阿里巴巴集团)
;
Peking University(北京大学)
;
Beijing University of Aeronautics and Astronautics(北京航空航天大学)
;
Wuhan University, School of Computer Science(武汉大学计算机学院)
OSDM-MReg: Multimodal Image Registration based One Step Diffusion Model
OSDM-MReg: 基于一步扩散模型的多模态图像配准
Xiaochen Wei, Weiwei Guo, Wenxian Yu, Feiming Wei, Dongying Li
机构
*
Shanghai Key Laboratory of Intelligent Sensing and Recognition(上海智能感知与识别重点实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
Center of Digital Innovation(数字创新中心)
TTOM: Test-Time Optimization and Memorization for Compositional Video Generation
TTOM:测试时优化与记忆化用于组合视频生成
Leigang Qu, Ziyang Wang, Na Zheng, Wenjie Wang, Liqiang Nie, Tat-Seng Chua
机构
*
National University of Singapore(国立新加坡大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
Towards Transferable Defense Against Malicious Image Edits
面向恶意图像编辑的可迁移防御
Jie Zhang, Shuai Dong, Shiguang Shan, Xilin Chen
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences (CAS)(人工智能安全国家重点实验室,计算技术研究所,中国科学院)
;
University of China Academy of Sciences(中国科学院大学)
;
School of Computer Science, China University of Geosciences(中国地质大学(武汉)计算机学院)
专题命中
多模态生成
:image-text(abstract);分类 cs.CV、cs.AI
AI总结
TDAE通过双模优化提升图像对恶意编辑的免疫性,实现跨模型的可迁移防御。
Comments14 pages, 5 figures, accepted by IEEE TPAMI
机构
*
Guangzhou Institute of Technology, Xidian University, Xi’an, China(广州科技研究院,西安电子科技大学,中国)
;
Department of Computer Science, Tianjin University of Technology, Tianjin, China(天津理工大学计算机学院,天津,中国)
;
Department of Respiratory, The Second Hospital of Tianjin Medical University, China(天津医科大学第二医院呼吸科,中国)
;
College of Pulmonary and Critical Care Medicine, Chinese PLA General Hospital, Beijing, China(中国人民解放军总医院呼吸与危重症医学科,北京,中国)
;
HeartVoice Medical Technology, Hefei, China(合肥心声医疗技术有限公司,中国)
;
School of Life Science and Technology, Xidian University, Xi’an, China(西安电子科技大学生命科学与技术学院,中国)
;
National Institute of Health Data Science, Peking University, Beijing, China(北京大学国家健康数据科学研究院,北京,中国)
;
Institute for Artificial Intelligence, Peking University, Beijing, China(北京大学人工智能研究院,北京,中国)
Junbo Wang, Haofeng Tan, Bowen Liao, Albert Jiang, Teng Fei, Qixing Huang, Bing Zhou, Zhengzhong Tu, Shan Ye, Yuhao Kang
机构
*
The University of Texas at Austin(德克萨斯大学奥斯汀分校)
;
University of Tennessee, Knoxville(田纳西大学基洛纳分校)
;
University of South Carolina(南卡罗来纳大学)
;
Arizona State University(亚利桑那州立大学)
;
University of Canterbury(坎特伯雷大学)
;
Texas A&M University(德克萨斯A&M大学)
;
University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
EfficientPosterGen: Semantic-aware Efficient Poster Generation via Token Compression and Accurate Violation Detection
EfficientPosterGen: 通过令牌压缩和准确违规检测的语义感知高效海报生成
Wenxin Tang, Jingyu Xiao, Yanpei Gong, Fengyuan Ran, Tongchuan Xia, Junliang Liu, Man Ho Lam, Wenxuan Wang, Michael R. Lyu
机构
*
Tsinghua University(清华大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Wuhan University(武汉大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Dalian Maritime University(大连海事大学)
;
Renmin University of China(中国人民大学)
机构
*
Department of Electrical Engineering, Indian Institute of Technology Madras, Chennai, India(电子工程系,印度理工学院马德拉斯,钦奈,印度)
;
Sudha Gopalakrishnan Brain Centre, Indian Institute of Technology Madras, Chennai, India(苏达·戈帕拉克里希南脑中心,印度理工学院马德拉斯,钦奈,印度)
;
Department of Electrical Engineering, Indian Institute of Technology Madras Chennai, India(电子工程系,印度理工学院马德拉斯钦奈,印度)
LLaDA-o: An Effective and Length-Adaptive Omni Diffusion Model
LLaDA-o:一种高效且长度自适应的多模态扩散模型
Zebin You, Xiaolu Zhang, Jun Zhou, Chongxuan Li, Ji-Rong Wen
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China, Beijing, China.(中国人民大学人工智能学院)
;
Beijing Key Laboratory of Research on Large Models(北京大型模型研究关键实验室)
;
Engineering Research Center of Next-Generation Intelligent Search(下一代智能搜索工程研究中心)