arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-19 至 2026-01-19 共收录 14 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 14 篇

2507.03585 2026-01-19 cs.CV cs.AI cs.CL 92%

Causal-SAM-LLM: Large Language Models as Causal Reasoners for Robust Medical Segmentation

Causal-SAM-LLM:大型语言模型作为因果推理器用于稳健的医学分割

Tao Tang, Shijie Xu, Jionglong Su, Zhixiang Lu

机构 * City University of Hong Kong, Hong Kong, China(香港城市大学) Xi’an Jiaotong-liverpool University, Suzhou, China(西安交通大学利物浦大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 Causal-SAM-LLM利用大型语言模型作为因果推理器,提升医学图像分割的鲁棒性和泛化能力。

Comments Accepted by IEEE ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11311 2026-01-19 cs.LG 89%

FORESTLLM: Large Language Models Make Random Forest Great on Few-shot Tabular Learning

FORESTLLM:大型语言模型使随机森林在少样本表格学习中表现卓越

Zhihan Yang, Jiaqi Wei, Xiang Zhang, Haoyu Dong, Yiwen Wang, Xiaoke Guo, Pengkun Zhang, Yiwei Xu, Chenyu You

机构 * Microsoft Research Asia(微软亚洲研究院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 FORESTLLM结合决策森林的结构归纳偏见和LLM的语义推理能力,通过语义分割和上下文推理机制,在少样本表格学习中实现高性能。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11124 2026-01-19 cs.IR cs.AI 85%

Learn Before Represent: Bridging Generative and Contrastive Learning for Domain-Specific LLM Embeddings

在表示之前学习:连接生成学习与对比学习以构建领域特定的LLM嵌入

Xiaoyu Liang, Yuchen Peng, Jiale Luo, Wenhao Wang, Haoji Hu, Xincheng Zhou

机构 * Zhejiang University(浙江大学) Peking University(北京大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出LBR框架,通过生成学习和对比学习结合,在垂直领域中提升LLM嵌入的准确性和鲁棒性。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13246 2026-01-19 cs.CL cs.CY 84%

When People are Floods: Analyzing Dehumanizing Metaphors in Immigration Discourse with Large Language Models

当人们是洪水:利用大型语言模型分析移民话语中的去人性化隐喻

Julia Mendelsohn, Ceren Budak

机构 * University of Maryland(马里兰大学) University of Michigan(密歇根大学)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL

AI总结 本文利用大型语言模型分析移民话语中的去人性化隐喻,探讨隐喻、政治意识形态与用户参与之间的关系。

Comments To appear at ACL 2025. Please cite ACL version when proceedings are available

Journal ref Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (2025) 8079-8103

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10880 2026-01-19 cs.CV cs.AI 83%

Medical SAM3: A Foundation Model for Universal Prompt-Driven Medical Image Segmentation

医学SAM3:一种通用提示驱动的医学图像分割基础模型

Chongcong Jiang, Tianxingjian Ding, Chuhan Song, Jiachen Tu, Ziyang Yan, Yihua Shao, Zhenyi Wang, Yuzhang Shang, Tianyu Han, Yu Tian

机构 * University of Central Florida, Orlando, USA(佛罗里达大学) University College London, London, UK(伦敦大学学院) University of Illinois Urbana-Champaign, Champaign, USA(伊利诺伊大学厄巴纳-香槟分校) University of Trento, Trento, Italy(特伦托大学) The Hong Kong Polytechnic University, China(香港理工大学) University of Pennsylvania, Philadelphia, USA(宾夕法尼亚大学)

专题命中 领域大模型 :foundation model(title,abstract);prompting(abstract);分类 cs.AI

AI总结 Medical SAM3通过微调SAM3模型,提升医学图像分割的通用提示驱动能力,解决领域偏移和复杂结构推理问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10926 2026-01-19 cs.CL cs.AI 81%

Selecting Language Models for Social Science: Start Small, Start Open, and Validate

为社会科学选择语言模型:从小处入手,开放并验证

Dustin S. Stoltz, Marshall A. Taylor, Sanuj Kumar

机构 * Department of Sociology and Anthropology, Lehigh University(社会学与人类学系,莱恩大学) Department of Sociology, New Mexico State University(社会学系,新墨西哥州立大学) Department of Computer Science, New Mexico State University(计算机科学系,新墨西哥州立大学)

专题命中 领域大模型 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出通过选择较小且开放的语言模型,并构建限定性基准测试来验证计算流程的有效性,以提高社会科学中语言模型选择的可重复性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10951 2026-01-19 cs.CL cs.AI 79%

Multi-Stage Patient Role-Playing Framework for Realistic Clinical Interactions

多阶段患者角色扮演框架用于真实临床互动

Shijie Jiang, Zefan Zhang, Kehua Zhu, Tian Bai, Ruihong Zhao

机构 * College of Computer Science and Technology, Key Laboratory of Symbolic Computation and Knowledge Engineering, Ministry of Education, Jilin University(计算机科学与技术学院、符号计算与知识工程重点实验室、教育部、吉林大学) College of Software, Jilin University(软件学院、吉林大学) Gastrointestinal Endoscopy Center, The First Hospital of Jilin University(吉林大学第一医院消化内窥镜中心)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出无需训练的多阶段患者角色扮演框架,通过分解互动为三个阶段,提升模型在模拟患者行为时的个性化和真实性。

Comments 22 pages, 5figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05202 2026-01-19 cs.AI cs.LG 73%

Stock Market Price Prediction using Neural Prophet with Deep Neural Network

利用深度神经网络的神经先知进行股票市场价格预测

Navin Chhibber, Sunil Khemka, Navneet Kumar Tyagi, Rohit Tewari, Bireswar Banerjee, Piyush Ranjan

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出NP-DNN模型,利用深度神经网络和多层感知机预测股票价格,准确率达99.21%。

Comments Accepted at 2nd International Conference on Software, Systems and Information Technology (SSITCON) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03687 2026-01-19 cs.CL cs.AI 73%

MedReflect: Teaching Medical LLMs to Self-Improve via Reflective Correction

MedReflect: 通过反思修正教学医疗LLM自我改进

Yue Huang, Yanyuan Chen, Dexuan Xu, Chenzhuo Zhao, Weihua Yue, Yu Huang

机构 * Peking University(北京大学) University of Virginia(弗吉尼亚大学) Peking University Sixth Hospital(北京大学第六医院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 MedReflect通过自我反思机制提升医疗LLM的自主学习能力,减少外部数据依赖,实现高效医疗问题解决。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22753 2026-01-19 cs.CL 70%

Opportunities and Challenges of LLMs in Education: An NLP Perspective

大语言模型在教育中的机遇与挑战:一种自然语言处理视角

Sowmya Vajjala, Bashar Alhafni, Stefano Bannò, Kaushal Kumar Maurya, Ekaterina Kochmar

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文从自然语言处理视角探讨大语言模型在教育中的应用,分析其在教学、学习和评估中的机遇与挑战。

Comments Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10773 2026-01-19 cs.SE cs.AI 70%

LogicLens: Leveraging Semantic Code Graph to explore Multi Repository large systems

LogicLens: 通过语义代码图探索多仓库大型系统

Niko Usai, Dario Montagnini, Kristian Ilianov Iliev, Raffaele Camanzo

机构 * Sourcesense

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 LogicLens通过构建语义多仓库图,帮助开发者探索复杂软件系统,支持自然语言交互和动态检索子图,实现领域逻辑和运行时行为的分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11522 2026-01-19 cs.CV 67%

UniX: Unifying Autoregression and Diffusion for Chest X-Ray Understanding and Generation

UniX: 统一自回归与扩散以实现胸部X光理解与生成

Ruiheng Zhang, Jingfeng Yao, Huangxuan Zhao, Hao Yan, Xiao He, Lei Chen, Zhou Wei, Yong Luo, Zengmao Wang, Lefei Zhang, Dacheng Tao, Bo Du

机构 * Wuhan University(武汉大学) Huazhong University of Science and Technology(华中科技大学) Nanyang Technological University(南洋理工大学)

专题命中 领域大模型 :LLM(abstract);foundation model(abstract)

AI总结 UniX通过统一自回归与扩散模型,实现了胸部X光的高效理解和生成,显著提升了性能并减少了参数使用。

Comments Codes and models are available at https://github.com/ZrH42/UniX

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10837 2026-01-19 cs.CL cs.IR 57%

EncodeRec: An Embedding Backbone for Recommendation Systems

EncodeRec: 一个用于推荐系统的嵌入骨干网络

Guy Hadad, Neomi Rabaev, Bracha Shapira

机构 * Ben-Gurion University of the Negev(贝拉谢瓦巴内格利大学)

专题命中 领域大模型 :language model(abstract);分类 cs.CL

AI总结 EncodeRec通过直接从项目描述中学习紧凑且信息丰富的嵌入,提升推荐系统在语义ID标记化和顺序推荐中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10730 2026-01-19 cs.CR 50%

PQ-CAN: A Framework for Simulating Post-Quantum Cryptography in Embedded Systems

PQ-CAN:用于嵌入式系统中模拟后量子密码学的框架

Mauro Conti, Francesco Marchiori, Sebastiano Matarazzo, Marco Rubin

专题命中 领域大模型 :prompting(abstract)

AI总结 PQ-CAN框架用于模拟PQC算法在嵌入式系统中的性能和开销,评估其在汽车通信中的可行性和局限性。

Comments Accepted at QSNS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏