arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-12 至 2025-12-12 共收录 32 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32 篇

2511.19877 2025-12-12 cs.MM cs.CV cs.LG eess.AS 89%

It Hears, It Sees too: Multi-Modal LLM for Depression Detection By Integrating Visual Understanding into Audio Language Models

它能听,也能看 too:通过将视觉理解整合到音频语言模型中构建多模态大语言模型以检测抑郁症

Xiangyu Zhao, Yaling Shen, Yiwen Jiang, Zimu Wang, Jiahe Liu, Maxmartwell H Cheng, Guilherme C Oliveira, Robert Desimone, Dominic Dwyer, Zongyuan Ge

机构 * Monash University(墨尔本大学) Massachusetts Institute of Technology(麻省理工学院) The University of Melbourne(墨尔本大学)

专题命中 评测与基准 :LLM(title,abstract);language model(title,abstract);large language model(abstract);分类 cs.LG

AI总结 本文提出了一种多模态大语言模型框架,通过整合视觉理解到音频语言模型中,提升抑郁症检测的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19999 2025-12-12 cs.CL 88%

The SIFo Benchmark: Investigating the Sequential Instruction Following Ability of Large Language Models

SIFo基准:研究大型语言模型的顺序指令遵循能力

Xinyi Chen, Baohao Liao, Jirui Qi, Panagiotis Eustratiadis, Christof Monz, Arianna Bisazza, Maarten de Rijke

机构 * University of Amsterdam(阿姆斯特丹大学) University of Groningen(格罗宁根大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 SIFo基准通过四个任务评估大型语言模型在多指令遵循中的能力,发现较新和更大的模型在任务表现上更优,揭示了当前语言模型在指令序列处理上的鲁棒性不足。

Comments EMNLP 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.11255 2025-12-12 cs.HC 88%

Visualization Generation with Large Language Models: An Evaluation

利用大语言模型进行可视化生成:一项评估

Xinyu Wang, Chenwei Liang, Shunyuan Zheng, Jinyuan Liang, Guozheng Li, Yu Zhang, Chi Harold Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract)

AI总结 本文评估了不同大语言模型在NL2VIS任务中生成可视化规范的能力,发现提示策略、图表类型和模型间存在显著性能差异,并提出改进基准的方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10791 2025-12-12 cs.CL cs.AI 87%

The FACTS Leaderboard: A Comprehensive Benchmark for Large Language Model Factuality

FACTS排行榜:大型语言模型事实性的综合基准

Aileen Cheng, Alon Jacovi, Amir Globerson, Ben Golan, Charles Kwong, Chris Alberti, Connie Tao, Eyal Ben-David, Gaurav Singh Tomar, Lukas Haas, Yonatan Bitton, Adam Bloniarz, Aijun Bai, Andrew Wang, Anfal Siddiqui, Arturo Bajuelos Castillo, Aviel Atias, Chang Liu, Corey Fry, Daniel Balle, Deepanway Ghosal, Doron Kukliansky, Dror Marcus, Elena Gribovskaya, Eran Ofek, Honglei Zhuang, Itay Laish, Jan Ackermann, Lily Wang, Meg Risdal, Megan Barnes, Michael Fink, Mohamed Amin, Moran Ambar, Natan Potikha, Nikita Gupta, Nitzan Katz, Noam Velan, Ofir Roval, Ori Ram, Polina Zablotskaia, Prathamesh Bang, Priyanka Agrawal, Rakesh Ghiya, Sanjay Ganapathy, Simon Baumgartner, Sofia Erell, Sushant Prakash, Thibault Sellam, Vikram Rao, Xuanhui Wang, Yaroslav Akulov, Yulong Yang, Zhen Yang, Zhixin Lai, Zhongru Wu, Anca Dragan, Avinatan Hassidim, Fernando Pereira, Slav Petrov, Srinivasan Venkatachary, Tulsee Doshi, Yossi Matias, Sasha Goldshtein, Dipanjan Das

机构 * Google(谷歌)

专题命中 评测与基准 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

AI总结 FACTS排行榜为大型语言模型提供事实性评估的综合基准,通过四个子排行榜全面衡量模型在不同场景下的事实准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10262 2025-12-12 cs.CV 86%

VLM-NCD:Novel Class Discovery with Vision-Based Large Language Models

基于视觉大语言模型的新型类别发现

Yuetong Su, Baoguo Wei, Xinyu Wang, Xu Li, Lixin Li

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract)

AI总结 基于视觉大语言模型的新型类别发现方法,通过融合视觉-文本语义和原型引导聚类,提升未知类别分类准确率25.3%,并展现对长尾分布的鲁棒性。

Comments 8 pages, 5 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03859 2025-12-12 cs.CL 85%

Anthropocentric bias in language model evaluation

语言模型评估中的人本偏见

Raphaël Millière, Charles Rathkopf

机构 * University of Oxford(牛津大学) Forschungszentrum Jülich(尤利希研究中心)

专题命中 评测与基准 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

AI总结 本文指出语言模型评估中存在人本偏见,提出通过结合行为实验与机制研究来减少这些偏见,以更准确评估模型能力。

Comments Published in Computational Linguistics

Journal ref Computational Linguistics, 1-10. (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21336 2025-12-12 cs.CV 85%

UniBiomed: A Universal Foundation Model for Grounded Biomedical Image Interpretation

UniBiomed: 一种用于 grounded 生物医学图像解释的通用基础模型

Linshan Wu, Yuxiang Nie, Sunan He, Jiaxin Zhuang, Luyang Luo, Tao Li, Zhuoyao Xie, Dexuan Chen, Yinghua Zhao, Neeraj Mahboobani, Varut Vardhanabhuti, Ronald Cheong Kin Chan, Yifan Peng, Pranav Rajpurkar, Hao Chen

专题命中 评测与基准 :foundation model(title,abstract);large language model(abstract);language model(abstract)

AI总结 UniBiomed是一种基于多模态大语言模型和Segment Anything Model的通用基础模型,能够同时生成诊断结果并分割生物医学目标,提升生物医学图像分析的可解释性与性能。

Comments A universal foundation model for grounded biomedical image interpretation

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10487 2025-12-12 cs.CR 85%

LLM-Assisted AHP for Explainable Cyber Range Evaluation

基于大语言模型的AHP可解释性网络评估

Vyron Kampourakis, Georgios Kavallieratos, Georgios Spathoulas, Vasileios Gkioulos, Sokratis Katsikas

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于大语言模型的AHP方法,用于可解释性网络评估,通过多准则决策方法评估CR平台的技术真实性和其他关键因素,实现一致的评估标准和可重复的对比结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10065 2025-12-12 cs.AI cs.HC 84%

Linear socio-demographic representations emerge in Large Language Models from indirect cues

大语言模型中线性社会人口表示从间接线索中涌现

Paul Bouchaud, Pedro Ramaciotti

机构 * Complex Systems Institute of Paris Ile-de-France CNRS(巴黎法兰西大区复杂系统研究所 CNRS) médialab, Sciences Po(媒体实验室,巴黎政治学院) Learning Planet Institute, CY Cergy Paris University(学习星球研究所,CY塞quenes巴黎大学)

专题命中 评测与基准 :large language model(title);language model(title);分类 cs.AI

AI总结 研究揭示大语言模型通过间接线索形成社会人口统计学表示,并展示这些隐性偏见如何影响下游任务如职业推荐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12617 2025-12-12 q-bio.GN cs.LG 83%

Same model, better performance: the impact of shuffling on DNA Language Models benchmarking

同一体模型,更好表现:洗牌对DNA语言模型基准测试的影响

Davide Greco, Konrad Rawlik

机构 * Baillie Gifford Pandemic Science Hub(巴利尔·吉福德流行病科学中心) University of Edinburgh(爱丁堡大学)

专题命中 评测与基准 :language model(title,abstract);large language model(abstract);分类 cs.LG

AI总结 本研究发现数据洗牌对DNA语言模型基准测试性能有显著影响,提出预洗牌解决方案以提高基准可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10384 2025-12-12 cs.CV cs.AI 79%

Towards Fine-Grained Recognition with Large Visual Language Models: Benchmark and Optimization Strategies

基于大视觉语言模型的细粒度识别:基准测试与优化策略

Cong Pang, Hongtao Yu, Zixuan Chen, Lewei Lu, Xin Lou

机构 * ShanghaiTech University(上海科技大学) Southeast University(东南大学) SenseTime Research(商汤科技研究院)

专题命中 评测与基准 :language model(title,abstract);分类 cs.AI

AI总结 本文提出FROW基准测试和优化策略,通过马赛克数据和开放世界数据提升大视觉语言模型的细粒度识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21356 2025-12-12 cs.SD cs.LG eess.AS 79%

Towards Robust Assessment of Pathological Voices via Combined Low-Level Descriptors and Foundation Model Representations

通过结合低级描述符和基础模型表示实现病理声音的稳健评估

Whenty Ariyanti, Kuan-Yu Chen, Sabato Marco Siniscalchi, Hsin-Min Wang, Yu Tsao

机构 * Department of Computer Science and Information Engineering, National Taiwan University of Science and Technology(国家交通大学科学与信息工程系) Research Center for Information Technology Innovation, Academia Sinica(学术院资讯科技创新研究中心) University of Palermo(巴勒莫大学) Institute of Information Science, Academia Sinica(学术院资讯科学研究所) Department of Electrical Engineering, Chung Yuan Christian University(Chung Yuan Christian University电子工程系)

专题命中 评测与基准 :foundation model(title,abstract);分类 cs.LG

AI总结 本文提出VOQANet和VOQANet+,结合基础模型嵌入与低级声学特征,提升病理声音评估的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.20145 2025-12-12 cs.CL 79%

Leveraging language models for summarizing mental state examinations: A comprehensive evaluation and dataset release

利用语言模型进行精神状态检查的摘要:全面评估和数据集发布

Nilesh Kumar Sahu, Manjeet Yadav, Mudita Chaturvedi, Snehil Gupta, Haroon R Lone

机构 * IISER Bhopal India(比哈尔印度IISER)

专题命中 评测与基准 :language model(title,abstract);分类 cs.CL

AI总结 本研究利用语言模型对MSE进行摘要生成,通过开发问卷和收集数据,评估多种模型性能,最终发布数据集和模型供心理健康研究使用。

Comments Appeared in: Proceedings of the 31st International Conference on Computational Linguistics (COLING 2025), Abu Dhabi, UAE. ACL Anthology ID: 2025.coling-main.182. (https://aclanthology.org/2025.coling-main.182/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10148 2025-12-12 cs.CL cs.AI 79%

PARAN: Persona-Augmented Review ANswering system on Food Delivery Review Dataset

PARAN:基于食品配送评论数据集的个性化评论回复系统

Moonsoo Park, Jeongseok Yun, Bohyung Kim

机构 * Lemong Research(Lemong研究)

专题命中 评测与基准 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 PARAN通过从短评论文本中推断用户个性,提升食品配送评论回复的个性化和相关性,无需模型微调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01524 2025-12-12 cs.CL cs.AI 79%

V-VAE: A Variational Auto Encoding Framework Towards Fine-Grained Control over Human-Like Chat

V-VAE:一种面向人类样聊天的变分自编码框架

Qi Lin, Weikai Xu, Lisi Chen, Bin Dai

机构 * University of Electronic Science and Technology of China(电子科学与技术大学)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 V-VAE通过细粒度控制空间和高质量数据集提升人类样聊天的响应质量与一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03403 2025-12-12 cs.CL cs.AI 79%

BoundingDocs: a Unified Dataset for Document Question Answering with Spatial Annotations

BoundingDocs: 一个用于文档问答的统一数据集,包含空间标注

Simone Giovannini, Fabio Coppini, Andrea Gemelli, Simone Marinai

机构 * Università degli Studi di Firenze(佛罗伦萨大学) LETXBE

专题命中 评测与基准 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 BoundingDocs数据集通过整合文档AI和视觉丰富文档理解任务,统一了文档问答任务,提供精确的边界框标注以提升大语言模型在文档理解中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10895 2025-12-12 cs.AI 77%

LLMs Can Assist with Proposal Selection at Large User Facilities

大语言模型可帮助大型用户设施进行提案选择

Lijie Ding, Janell Thomson, Jon Taylor, Changwoo Do

机构 * Neutron Scattering Division, Oak Ridge National Laboratory, Oak Ridge, TN 37831, USA(奥克力国家实验室中子散射部)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 大语言模型通过高效且低成本的方式提升大型用户设施提案选择的准确性与一致性。

Comments 9 pages, 8figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05414 2025-12-12 cs.CL 77%

LMSpell: Neural Spell Checking for Low-Resource Languages

LMSpell:低资源语言的神经拼写检查

Akesh Gunathilake, Nadil Karunarathna, Tharusha Bandaranayake, Nisansa de Silva, Surangika Ranathunga

机构 * Department of Computer Science and Engineering, University of Moratuwa(穆塔瓦大学计算机科学与工程系) School of Mathematical and Computational Sciences, Massey University(马希大学数学与计算科学学院)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 LMSpell通过对比不同预训练语言模型在低资源语言拼写纠正中的表现,提出了一种易于使用的工具包,并通过僧伽罗语案例研究揭示了该领域存在的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09964 2025-12-12 q-bio.GN 75%

Development of an Agentic AI Model for NGS Downstream Analysis Targeting Researchers with Limited Biological Background

面向生物背景有限研究者的NGS下游分析代理AI模型开发

Donghyeon Lee, Dongseok Kim, Seokhwan Ko, Seo-Young Park, Junghwan Cho

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出了一种面向生物背景有限研究者的代理AI模型,通过自动化NGS下游分析、文献支持的解释和高级分析方法推荐,实现从基础数据处理到假设验证的无缝过渡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16528 2025-12-12 cs.LG 74%

Aligning ASR Evaluation with Human and LLM Judgments: Intelligibility Metrics Using Phonetic, Semantic, and NLI Approaches

对齐语音识别评估与人类和LLM判断:利用音系、语义和NLI方法的可理解性度量

Bornali Phukon, Xiuwen Zheng, Mark Hasegawa-Johnson

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 评测与基准 :LLM(title);分类 cs.LG

AI总结 本文提出结合NLI、语义和音系相似性的新型语音识别评估度量,以提高对口吃和发音障碍语音的可理解性评估精度。

Comments 5 pages, 2 figures, Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11375 2025-12-12 cs.AI cs.CL 73%

Benchmarking Multimodal LLMs on Recognition and Understanding over Chemical Tables

在化学表格上评估多模态大语言模型的基准测试

Yitong Zhou, Mingyue Cheng, Qingyang Mao, Yucong Luo, Qi Liu, Yupeng Li, Xiaohan Zhang, Deguang Liu, Xin Li, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) University of Science and Technology of China(中国科学技术大学) Artificial Intelligence Research Institute(人工智能研究院) iFLYTEK Co., Ltd(iFLYTEK公司)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出ChemTable基准,用于评估多模态模型在理解化学表格中的能力,揭示了现有模型在跨模态对齐和领域推理方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00597 2025-12-12 cs.CL cs.AI 73%

On the Consistency of Multilingual Context Utilization in Retrieval-Augmented Generation

在检索增强生成中多语言上下文利用的一致性

Jirui Qi, Raquel Fernández, Arianna Bisazza

机构 * Center for Language and Cognition (CLCG), University of Groningen(格罗宁根大学语言与认知中心) Institute for Logic, Language and Computation (ILLC), University of Amsterdam(阿姆斯特丹大学逻辑、语言与计算研究所)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究探讨LLMs在多语言RAG中利用不同语言上下文的一致性,发现其能提取异语言信息但难以生成正确语言答案。

Comments Best Paper Award at MRL Workshop 2025, colocated with EMNLP 2025. All codes and data are released at https://github.com/Betswish/mRAG-Context-Consistency

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10624 2025-12-12 cs.CL 70%

AgriGPT-Omni: A Unified Speech-Vision-Text Framework for Multilingual Agricultural Intelligence

AgriGPT-Omni: 一种统一的语音-视觉-文本框架用于多语言农业智能

Bo Yang, Lanfei Feng, Yunkui Chen, Yu Zhang, Jianyu Zhang, Xiao Xu, Nueraili Aierken, Shijian Li

机构 * Zhejiang University(浙江大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 AgriGPT-Omni提出了一种统一的语音-视觉-文本框架,通过数据合成、多阶段训练和三模态基准,提升多语言农业智能的性能和可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10403 2025-12-12 cs.SD cs.CL 70%

BRACE: A Benchmark for Robust Audio Caption Quality Evaluation

BRACE:一种用于鲁棒音频描述质量评估的基准

Tianyu Guo, Hongyu Chen, Hao Liang, Meiyi Qiang, Bohan Zeng, Linzhuang Sun, Bin Cui, Wentao Zhang

机构 * Peking University(北京大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 评测与基准 :LLM(abstract);language model(abstract);分类 cs.CL

AI总结 BRACE基准用于评估参考自由环境下音频描述质量,揭示CLAP模型和LALM的局限性,推动未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05647 2025-12-12 cs.CL 70%

A Greek Government Decisions Dataset for Public-Sector Analysis and Insight

一个用于公共部门分析与洞察的希腊政府决策数据集

Giorgos Antoniou, Giorgos Filandrianos, Aggelos Vlachos, Giorgos Stamou, Lampros Kollimenos, Konstantinos Skianis, Michalis Vazirgiannis

机构 * National Technical University of Athens, Greece(希腊国家技术大学) University of Thessaly, Greece(希腊塞萨洛尼基大学) University of Ioannina, Greece(希腊伊奥安尼纳大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 该研究提出了一种大规模公共部门语料库,用于分析和生成公共决策信息,支持高级信息检索和透明度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10114 2025-12-12 cs.AI 70%

AgriRegion: Region-Aware Retrieval for High-Fidelity Agricultural Advice

AgriRegion: 基于区域意识的高保真农业建议检索

Mesafint Fanuel, Mahmoud Nabil Mahmoud, Crystal Cook Marshal, Vishal Lakhotia, Biswanath Dari, Kaushik Roy, Shaohu Zhang

机构 * North Carolina A\&T State University(北卡罗来纳A&T州立大学) The University of Alabama(阿拉巴马大学) North Carolina Agricultural and Technical State University(北卡罗来纳农业与技术州立大学) Amazon AWS(亚马逊AWS)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 AgriRegion通过区域意识检索增强生成框架,提升农业建议的本地准确性与可靠性。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10336 2025-12-12 cs.CL cs.AI 62%

Multilingual VLM Training: Adapting an English-Trained VLM to French

多语言视觉语言模型训练:将英语训练的VLM适应到法语

Jules Lahmi, Alexis Roger

机构 * Ecole Polytechnique(巴黎政治学院) Mila - Quebec AI Institute(魁北克人工智能研究所) McGill University(麦吉尔大学)

专题命中 评测与基准 :language model(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了将英语训练的视觉语言模型适应到法语等其他语言的挑战,通过比较不同方法的性能和计算成本,发现数据翻译是多语言VLM性能的主要瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10863 2025-12-12 cs.CV cs.AI 57%

MMSI-Video-Bench: A Holistic Benchmark for Video-Based Spatial Intelligence

MMSI-Video-Bench: 一个面向视频基于空间智能的综合基准

Jingli Lin, Runsen Xu, Shaohao Zhu, Sihan Yang, Peizhou Cao, Yunlong Ran, Miao Hu, Chenming Zhu, Yiman Xie, Yilin Long, Wenbo Hu, Dahua Lin, Tai Wang, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiaotong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) Beihang University(北京航空航天大学) Xi’an Jiaotong University(西安交通大学) University of Hong Kong(香港大学) Fudan University(复旦大学) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 评测与基准 :prompting(abstract);分类 cs.AI

AI总结 MMSI-Video-Bench是一个综合评估视频基于空间智能的基准,通过多任务和多数据集评估25个MLLMs,揭示了人机推理差距和模型泛化不足的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10596 2025-12-12 cs.CV cs.AI 57%

Beyond Pixels: A Training-Free, Text-to-Text Framework for Remote Sensing Image Retrieval

超越像素:一种无训练的文本到文本框架用于遥感图像检索

J. Xiao, Y. Guo, X. Zi, K. Thiyagarajan, C. Moreira, M. Prasad

机构 * Information Technology University of Technology Sydney Sydney, Australia(信息科技技术大学悉尼分校悉尼澳大利亚) Robotics Laboratory (SensR Lab) Centre for Advanced Manufacturing Technology Western Sydney University Sydney, Australia(机器人实验室(SensR实验室)先进制造技术中心西悉尼大学悉尼澳大利亚) The Data Science Institute Faculty of Engineering(数据科学学院工程学院)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

AI总结 本文提出无训练的文本到文本框架TRSLLaVA,通过结构化文本实现高效遥感图像检索,实验表明其性能优于现有监督模型。

Comments 6 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10808 2025-12-12 cs.CV 50%

Graph Laplacian Transformer with Progressive Sampling for Prostate Cancer Grading

基于渐进采样的图拉普拉变换用于前列腺癌分级

Masum Shah Junayed, John Derek Van Vessem, Qian Wan, Gahie Nam, Sheida Nabavi

机构 * School of Computing, University of Connecticut (UConn)(计算学院,康涅狄格大学) Pathology and Laboratory Medicine, UConn Health(病理学与实验室医学,UConn健康)

专题命中 评测与基准 :foundation model(abstract)

AI总结 本文提出基于渐进采样的图拉普拉变换用于前列腺癌分级,通过改进的特征学习和空间一致性建模,提升分类性能。

Comments International Conference on Medical Image Computing and Computer-Assisted Intervention (MICCAI) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏