arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-03 至 2025-11-03 共收录 160 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 14 篇

2510.27522 2025-11-03 cs.LG cs.AI 84%

Leveraging Generic Time Series Foundation Models for EEG Classification

Théo Gnassounou, Yessin Moakher, Shifeng Xie, Vasilii Feofanov, Ievgen Redko

机构 * Université Paris-Saclay, Inria, CEA(巴黎萨克雷大学、法国国家信息与自动化研究所、法国原子能委员会) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

Journal ref NeurIPS 2025 Workshop "Recent Advances in Time Series Foundation Models Have We Reached the 'BERT Moment'?"

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27254 2025-11-03 cs.CL cs.AI cs.LG 80%

Languages are Modalities: Cross-Lingual Alignment via Encoder Injection

Rajan Agarwal, Aarush Gupta

机构 * University of Waterloo(多伦多大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 14 pages, 3 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27569 2025-11-03 cs.CL 77%

MARAG-R1: Beyond Single Retriever via Reinforcement-Learned Multi-Tool Agentic Retrieval

Qi Luo, Xiaonan Li, Yuxin Wang, Tingshuo Fan, Yuan Li, Xinchi Chen, Xipeng Qiu

机构 * School of Computer Science, Fudan University(复旦大学计算机学院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07877 2025-11-03 cs.CL 77%

Ready to Translate, Not to Represent? Bias and Performance Gaps in Multilingual LLMs Across Language Families and Domains

Md. Faiyaz Abdullah Sayeedi, Md. Mahbub Alam, Subhey Sadi Rahman, Md. Adnanul Islam, Jannatul Ferdous Deepti, Tasnim Mohiuddin, Md Mofijul Islam, Swakkhar Shatabda

机构 * United International University(国际联合大学) Qatar Computing Research Institute(卡塔尔计算研究所) Amazon GenAI(亚马逊生成人工智能) University of Virginia(弗吉尼亚大学) BRAC University(布拉克大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26847 2025-11-03 cs.CR cs.AI cs.CL cs.IT math.IT 73%

Broken-Token: Filtering Obfuscated Prompts by Counting Characters-Per-Token

Shaked Zychlinski, Yuval Kainan

机构 * JFrog

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27448 2025-11-03 cs.AI 70%

GeoFM: Enhancing Geometric Reasoning of MLLMs via Synthetic Data Generation through Formal Language

Yuhao Zhang, Dingxin Hu, Tinghao Yu, Hao Liu, Yiting Liu

机构 * Tencent Hunyuan Team(腾讯文言团队)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12301 2025-11-03 cs.CL 70%

SMOL: Professionally translated parallel data for 115 under-represented languages

Isaac Caswell, Elizabeth Nielsen, Jiaming Luo, Colin Cherry, Geza Kovacs, Hadar Shemtov, Partha Talukdar, Dinesh Tewari, Baba Mamadi Diane, Djibrila Diane, Solo Farabado Cissé, Koulako Moussa Doumbouya, Edoardo Ferrante, Alessandro Guasoni, Christopher Homan, Mamadou K. Keita, Sudhamoy DebBarma, Ali Kuzhuget, David Anugraha, Muhammad Ravi Shulthan Habibi, Genta Indra Winata, Anthony Munthali, Sina Ahmadi, Andrei Chemyshev, Mingfei Lau, Jonathan Eng

机构 * Stanford University(斯坦福大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments ~10 pages with appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27062 2025-11-03 cs.LG cs.AI 62%

Consistency Training Helps Stop Sycophancy and Jailbreaks

Alex Irpan, Alexander Matt Turner, Mark Kurzeja, David K. Elson, Rohin Shah

机构 * Google(谷歌)

专题命中 预训练与数据 :LLM(abstract);分类 cs.AI、cs.LG

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27337 2025-11-03 cs.CL 57%

TransAlign: Machine Translation Encoders are Strong Word Aligners, Too

Benedikt Ebing, Christian Goldschmied, Goran Glavaš

机构 * University of Würzburg Center for Artificial Intelligence and Data Science (CAIDAS)(乌尔姆大学人工智能与数据科学中心(CAIDAS))

专题命中 预训练与数据 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27114 2025-11-03 cs.RO cs.LG 57%

Learning Generalizable Visuomotor Policy through Dynamics-Alignment

Dohyeok Lee, Jung Min Lee, Munkyung Kim, Seokhun Ju, Jin Woo Koo, Kyungjae Lee, Dohyeong Kim, TaeHyun Cho, Jungwoo Lee

机构 * Department of Electrical and Computer Engineering, Seoul National University(电子与计算机工程系,首尔国立大学) Department of Statistics, Korea University(统计系,韩国大学)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27090 2025-11-03 cs.LG eess.SP 57%

Functional embeddings enable Aggregation of multi-area SEEG recordings over subjects and sessions

Sina Javadzadeh, Rahil Soroushmojdehi, S. Alireza Seyyed Mousavi, Mehrnaz Asadi, Sumiko Abe, Terence D. Sanger

机构 * Department of Biomedical Engineering, University of California Irvine(生物医学工程系,加州大学尔湾分校) Department of Electrical Engineering, University of California Irvine(电气工程系,加州大学尔湾分校) Department of Neurology, Rady Children’s Health(神经病学系,Rady儿童健康中心)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

Comments Submitted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11420 2025-11-03 cs.LG cs.CE 57%

PPDiff: Diffusing in Hybrid Sequence-Structure Space for Protein-Protein Complex Design

Zhenqiao Song, Tiaoxiao Li, Lei Li, Martin Renqiang Min

机构 * Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所) NEC Laboratories America(日本电报电话公司美洲实验室)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27547 2025-11-03 cs.CV 50%

MapSAM2: Adapting SAM2 for Automatic Segmentation of Historical Map Images and Time Series

Xue Xia, Randall Balestriero, Tao Zhang, Yixin Zhou, Andrew Ding, Dev Saini, Lorenz Hurni

机构 * ETH Zurich(苏黎世联邦理工学院) Brown University(布朗大学) Wuhan University(武汉大学)

专题命中 预训练与数据 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22706 2025-11-03 cs.CV 50%

IGGT: Instance-Grounded Geometry Transformer for Semantic 3D Reconstruction

Hao Li, Zhengyu Zou, Fangfu Liu, Xuanyang Zhang, Fangzhou Hong, Yukang Cao, Yushi Lan, Manyuan Zhang, Gang Yu, Dingwen Zhang, Ziwei Liu

机构 * NWPU(西北工业大学) S-Lab, NTU(NTU实验室) StepFun, Inc.(StepFun公司) THU(清华大学) MMLab, CUHK(CUHK实验室)

专题命中 预训练与数据 :language model(abstract)

Comments https://github.com/lifuguan/IGGT_official

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 8 篇

2510.27172 2025-11-03 cs.LG cs.AI 88%

Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler

Zixuan Hu, Li Shen, Zhenyi Wang, Yongxian Wei, Dacheng Tao

机构 * Nanyang Technological University(南洋理工大学) Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区) University of Central Florida(佛罗里达大学) Tsinghua University(清华大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23724 2025-11-03 cs.LG cs.AI 79%

SC-LoRA: Balancing Efficient Fine-tuning and Knowledge Preservation via Subspace-Constrained LoRA

Minrui Luo, Fuhang Kuang, Yu Wang, Zirui Liu, Tianxing He

机构 * Shanghai Qi Zhi Institute(上海启智研究院) Institute for Interdisciplinary Information Sciences, Tsinghua University(清华大学交叉信息研究院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Xiongan AI Institute(雄安人工智能研究院)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27047 2025-11-03 cs.CV 78%

AD-SAM: Fine-Tuning the Segment Anything Vision Foundation Model for Autonomous Driving Perception

Mario Camarena, Het Patel, Fatemeh Nazari, Evangelos Papalexakis, Mohamadhossein Noruzoliaee, Jia Chen

专题命中 指令微调 :foundation model(title,abstract)

Comments Submitted to IEEE Transactions on Intelligent Transportation Systems (IEEE T-ITS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18779 2025-11-03 cs.CL 77%

KAT-Coder Technical Report

Zizheng Zhan, Ken Deng, Jinghui Wang, Xiaojiang Zhang, Huaixi Tang, Minglei Zhang, Zhiyi Lai, Haoyang Huang, Wen Xiang, Kun Wu, Wenhao Zhuang, Shaojie Wang, Shangpeng Yan, Kepeng Lei, Zongxian Feng, Huiming Wang, Zheng Lin, Mengtong Li, Mengfei Xie, Yinghan Cui, Xuxing Chen, Chao Wang, Weihao Li, Wenqiang Zhu, Jiarong Zhang, Jingxuan Xu, Songwei Yu, Yifan Yao, Xinping Lei, C. Zhang, Han Li, Junqi Xiong, Zuchen Gao, Dailin Li, Haimo Li, Jiaheng Liu, Yuqun Zhang, Junyi Peng, Haotian Zhang, Bin Chen

机构 * Kwaipilot Team(Kwaipilot 团队)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17336 2025-11-03 cs.MM cs.CL cs.CV 70%

Mano Technical Report

Tianyu Fu, Anyang Su, Chenxu Zhao, Hanning Wang, Minghui Wu, Zhe Yu, Fei Hu, Mingjia Shi, Wei Dong, Jiayao Wang, Yuyang Chen, Ruiyang Yu, Siran Peng, Menglin Li, Nan Huang, Haitian Wei, Jiawei Yu, Yi Xin, Xilin Zhao, Kai Gu, Ping Jiang, Sifan Zhou, Shuo Wang

机构 * Mininglamp Technology(Mininglamp技术)

专题命中 指令微调 :language model(abstract);foundation model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27672 2025-11-03 cs.CL 57%

Culture Cartography: Mapping the Landscape of Cultural Knowledge

Caleb Ziems, William Held, Jane Yu, Amir Goldberg, David Grusky, Diyi Yang

专题命中 指令微调 :LLM(abstract);分类 cs.CL

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21657 2025-11-03 cs.CV 50%

FantasyWorld: Geometry-Consistent World Modeling via Unified Video and 3D Prediction

Yixiang Dai, Fan Jiang, Chiyu Wang, Mu Xu, Yonggang Qi

机构 * AMAP, Alibaba Group(阿里集团AMAP) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 指令微调 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01930 2025-11-03 cs.CV 50%

PROFIT: A Specialized Optimizer for Deep Fine Tuning

Anirudh S Chakravarthy, Shuai Kyle Zheng, Xin Huang, Sachithra Hemachandra, Xiao Zhang, Yuning Chai, Zhao Chen

机构 * GM Cruise LLC

专题命中 指令微调 :language model(abstract)

Comments technical report, 23 pages, NeurIPS 2025 poster

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 3 篇

2505.13487 2025-11-03 cs.CL cs.AI 86%

Detecting Prefix Bias in LLM-based Reward Models

Ashwin Kumar, Yuzi He, Aram H. Markosyan, Bobbie Chern, Imanol Arrieta-Ibarra

机构 * Washington University in St Louis(华盛顿大学圣路易斯分校) Meta Platforms, Inc.(Meta平台公司)

专题命中 后训练与偏好优化 :LLM(title,abstract);language model(abstract);RLHF(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05102 2025-11-03 cs.CL cs.AI cs.LG 75%

SparsePO: Controlling Preference Alignment of LLMs via Sparse Token Masks

Fenia Christopoulou, Ronald Cardenas, Gerasimos Lampouras, Haitham Bou-Ammar, Jun Wang

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) University College London(伦敦大学学院)

专题命中 后训练与偏好优化 :language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 27 pages, 9 figures, 5 tables. Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27671 2025-11-03 cs.AI cs.LG 62%

MolChord: Structure-Sequence Alignment for Protein-Guided Drug Design

Wei Zhang, Zekun Guo, Yingce Xia, Peiran Jin, Shufang Xie, Tao Qin, Xiang-Yang Li

机构 * School of Computer Science and Technology, University of Science and Technology of China(1 计算机科学与技术学院,中国科学技术大学) Zhongguancun Academy(2 中关村学院)

专题命中 后训练与偏好优化 :preference optimization(abstract);分类 cs.AI、cs.LG

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 13 篇

2506.05079 2025-11-03 cs.SE 85%

LLM-Guided Scenario-based GUI Testing

Shengcheng Yu, Yuchen Ling, Chunrong Fang, Quan Zhou, Yi Zhao, Chunyang Chen, Shaomin Zhu, Zhenyu Chen

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27418 2025-11-03 cs.CL 83%

Dynamic Affective Memory Management for Personalized LLM Agents

Junfeng Lu, Yueyan Li

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments 12 pasges, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26835 2025-11-03 cs.DB cs.AI cs.LG 81%

Category-Aware Semantic Caching for Heterogeneous LLM Workloads

Chen Wang, Xunzhuo Liu, Yue Zhu, Alaa Youssef, Priya Nagpurkar, Huamin Chen

机构 * IBM Research(IBM研究院) Tencent(腾讯) Red Hat(红帽)

专题命中 长上下文与记忆 :LLM(title,abstract);分类 cs.AI、cs.LG

Comments 13 pages including reference, position paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09045 2025-11-03 cs.SE cs.AI cs.IR cs.LG 81%

LLM Based Long Code Translation using Identifier Replacement

Manojit Chakraborty, Madhusudan Ghosh, Rishabh Gupta

机构 * Bosch Research & Technology Center(博世研究与技术中心) Indian Association for the Cultivation of Science(印度科学培养协会)

专题命中 长上下文与记忆 :LLM(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00254 2025-11-03 cs.CV cs.AI 79%

AVA: Towards Agentic Video Analytics with Vision Language Models

Yuxuan Yan, Shiqi Jiang, Ting Cao, Yifan Yang, Qianqian Yang, Yuanchao Shu, Yuqing Yang, Lili Qiu

机构 * Zhejiang University(浙江大学) Microsoft Research(微软研究院) Tsinghua University(清华大学)

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.AI

Comments Accepted to NDSI 2026, 19pages, 12 figures, complementary evaluations and appendix

详情

展开后加载摘要…

URL PDF HTML 收藏