arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-17 至 2025-09-17 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 11 篇

2509.12679 2025-09-17 cs.LG cs.CE quant-ph 89%

Large Language Model Scaling Laws for Neural Quantum States in Quantum Chemistry

Oliver Knitter, Dan Zhao, Stefan Leichenauer, Shravan Veerapaneni

机构 * University of Michigan(密歇根大学) SandboxAQ New York University(纽约大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments 16 pages, 5 figures, to be submitted for peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12818 2025-09-17 cs.CV cs.AI 83%

Data Scaling Laws for Radiology Foundation Models

Maximilian Ilse, Harshita Sharma, Anton Schwaighofer, Sam Bond-Taylor, Fernando Pérez-García, Olesya Melnichenko, Anne-Marie G. Sykes, Kelly K. Horst, Ashish Khandelwal, Maxwell Reynolds, Maria T. Wetscherek, Noel C. F. Codella, Javier Alvarez-Valle, Korfiatis Panagiotis, Valentina Salvatelli

机构 * Microsoft Health Futures UK(微软健康未来英国) Microsoft Health Futures US(微软健康未来美国) Mayo Clinic M.D(梅奥诊所) Radiology AI Lab, Mayo Clinic M.D(放射学AI实验室,梅奥诊所) Microsoft Health & Life Sciences(微软健康与生命科学) Cambridge University Hospitals M.D(剑桥大学医院)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00033 2025-09-17 cs.SE cs.AI cs.CL 79%

GPT-4.1 Sets the Standard in Automated Experiment Design Using Novel Python Libraries

Nuno Fachada, Daniel Fernandes, Carlos M. Fernandes, Bruno D. Ferreira-Saraiva, João P. Matos-Carvalho

机构 * Copelabs, Lusófona University(Copelabs与卢斯奥法纳大学) Center of Technology and Systems (UNINOVA-CTS) and Associated Lab of Intelligent Systems (LASI)(技术与系统中心(UNINOVA-CTS)及智能系统关联实验室) CICANT, Lusófona University(CICANT与卢斯奥法纳大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments The peer-reviewed version of this paper is published in Future Internet at https://doi.org/10.3390/fi17090412. This version is typeset by the author and differs only in pagination and typographical detail

Journal ref Future Internet. 2025; 17(9):412

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12546 2025-09-17 cs.CV 78%

Agent4FaceForgery: Multi-Agent LLM Framework for Realistic Face Forgery Detection

Yingxin Lai, Zitong Yu, Jun Wang, Linlin Shen, Yong Xu, Xiaochun Cao

专题命中 预训练与数据 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12474 2025-09-17 cs.CV 78%

Image Tokenizer Needs Post-Training

Kai Qiu, Xiang Li, Hao Chen, Jason Kuen, Xiaohao Xu, Jiuxiang Gu, Yinyi Luo, Bhiksha Raj, Zhe Lin, Marios Savvides

机构 * Carnegie Mellon University(卡内基梅隆大学) Adobe Research(Adobe研究) University of Michigan(密歇根大学)

专题命中 预训练与数据 :post-training(title,abstract)

Comments 21 pages, 16 figures, 10 tables. arXiv admin note: substantial text overlap with arXiv:2503.08354

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13305 2025-09-17 cs.LG cs.CL 73%

WebSailor-V2: Bridging the Chasm to Proprietary Agents via Synthetic Data and Scalable Reinforcement Learning

Kuan Li, Zhongwang Zhang, Huifeng Yin, Rui Ye, Yida Zhao, Liwen Zhang, Litu Ou, Dingchu Zhang, Xixi Wu, Jialong Wu, Xinyu Wang, Zile Qiao, Zhen Zhang, Yong Jiang, Pengjun Xie, Fei Huang, Jingren Zhou

专题命中 预训练与数据 :LLM(abstract);post-training(abstract);分类 cs.CL、cs.LG

Comments https://tongyi-agent.github.io/blog/introducing-tongyi-deep-research/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16408 2025-09-17 cs.CL 70%

From Surveys to Narratives: Rethinking Cultural Value Adaptation in LLMs

Muhammad Farid Adilazuarda, Chen Cecilia Liu, Iryna Gurevych, Alham Fikri Aji

机构 * MBZUAI Technical University of Darmstadt and National Research Center for Applied Cybersecurity ATHENE(德意志技术大学和应用网络安全国家研究中心ATHENE)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22413 2025-09-17 cs.CR cs.LG 70%

Instance-Level Data-Use Auditing of Visual ML Models

Zonghao Huang, Neil Zhenqiang Gong, Michael K. Reiter

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12893 2025-09-17 cs.CV 67%

MEJO: MLLM-Engaged Surgical Triplet Recognition via Inter- and Intra-Task Joint Optimization

Yiyi Zhang, Yuchen Yuan, Ying Zheng, Jialun Pei, Jinpeng Li, Zheng Li, Pheng-Ann Heng

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07459 2025-09-17 cs.CL 57%

AIxcellent Vibes at GermEval 2025 Shared Task on Candy Speech Detection: Improving Model Performance by Span-Level Training

Christian Rene Thelen, Patrick Gustav Blaneck, Tobias Bornheim, Niklas Grieger, Stephan Bialonski

机构 * Department of Medical Engineering and Technomathematics(医学工程与技术学系) Institute for Data-Driven Technologies(数据驱动技术研究所) FH Aachen University of Applied Sciences(亚琛应用科学大学) Academic and Research Department Engineering Hydrology(工程水文学学术与研究部门) IT Center RWTH Aachen University(亚琛工业大学IT中心) Department for Data Science and AI(数据科学与人工智能部门) ORDIX AG(ORDIX公司) Department of Information and Computing Sciences(信息与计算科学系)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL

Comments 6 pages, 1 figure, 2 tables

Journal ref Proceedings of the 21st Conference on Natural Language Processing (KONVENS 2025): Workshops, pages 398-403, Hannover, Germany

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13695 2025-09-17 cs.IR 50%

OneRec Technical Report

Guorui Zhou, Jiaxin Deng, Jinghao Zhang, Kuo Cai, Lejian Ren, Qiang Luo, Qianqian Wang, Qigen Hu, Rui Huang, Shiyao Wang, Weifeng Ding, Wuchao Li, Xinchen Luo, Xingmei Wang, Zexuan Cheng, Zixing Zhang, Bin Zhang, Boxuan Wang, Chaoyi Ma, Chengru Song, Chenhui Wang, Di Wang, Dongxue Meng, Fan Yang, Fangyu Zhang, Feng Jiang, Fuxing Zhang, Gang Wang, Guowang Zhang, Han Li, Hengrui Hu, Hezheng Lin, Hongtao Cheng, Hongyang Cao, Huanjie Wang, Jiaming Huang, Jiapeng Chen, Jiaqiang Liu, Jinghui Jia, Kun Gai, Lantao Hu, Liang Zeng, Liao Yu, Qiang Wang, Qidong Zhou, Shengzhe Wang, Shihui He, Shuang Yang, Shujie Yang, Sui Huang, Tao Wu, Tiantian He, Tingting Gao, Wei Yuan, Xiao Liang, Xiaoxiao Xu, Xugang Liu, Yan Wang, Yi Wang, Yiwu Liu, Yue Song, Yufei Zhang, Yunfan Wu, Yunfeng Zhao, Zhanyu Liu

专题命中 预训练与数据 :LLM(abstract)

Comments Authors are listed alphabetically by their first name

详情

展开后加载摘要…

URL PDF HTML 收藏