arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12637 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12637 篇

2608.13587 2026-08-17 cs.HC 新提交 80%

Student-ChatGPT Interaction Visible: Designing a Teacher Dashboard for EFL Writing Education

学生与ChatGPT交互可视化:为英语作为外语写作教育设计教师仪表盘

Minsun Kim, Seon Gyeom Kim, Suyoun Lee, Yoosang Yoon, Junho Myung, Haneul Yoo, Jieun Han, Hyunseung Lim, Yoonsu Kim, So-Yeon Ahn, Juho Kim, Alice Oh, Hwajung Hong, Tak Yeon Lee

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 该研究设计了用于EFL写作教育的Prompt Analytics Dashboard,可追踪学生与LLM的交互,经教师测试后能降低监控负担并优化干预时机。

Journal ref Companion Proceedings 16th International Conference on Learning Analytics & Knowledge(LAK 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23053 2026-08-14 stat.OT 版本更新 80%

LLteacher: A Tool for the Integration of Generative AI into Statistics Assignments

LLteacher: 一种将生成式AI整合到统计作业中的工具

Emanuela Furfaro, Simone Mosciatti

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 LLteacher是一种利用LLM辅助统计作业学习的开源工具,通过保留学习过程和引导学生与AI互动,支持知识回忆和新概念发现。

Journal ref Technology Innovations in Statistics Education, 17(1), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12228 2026-08-13 cs.SE 新提交 80%

Towards Automated Domain Model Extraction from Source Code using Heuristics and Open-Source LLMs

基于启发式方法与开源大语言模型(LLMs)从源代码中自动提取领域模型的研究

Alessandra Mancas, Mounir Ammam, Hyacinth Ali, Kevin Delcourt, Houari Sahraoui

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出结合启发式方法与开源LLMs的自动领域模型提取方法,克服上下文限制,在10个项目数据集上获高F1分数,适用于隐私敏感的工业逆向工程场景。

Comments To appear in the Proceedings of the 29th International Conference on Model Driven Engineering Languages and Systems (MODELS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07503 2026-08-11 cs.HC 新提交 80%

Exploring AI-Supported Disciplinary Mediation in Student Project Teams' Text-Based Communication

探索AI支持的学生项目团队基于文本的交流中的学科调解

Ching-Jung Cheng, Yu-Chan Chung, Bing-Chen Chiu, Yu-Hsun Lin, Jia-Wei Liao

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 本研究提出基于Discord的LLM工具Spritz,通过监测群聊边界信号、匿名综合观点等方式调解学生跨学科项目团队交流,发现其兼具认知与关系价值,但需解决AI角色扩展带来的中立性张力问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07373 2026-08-10 physics.ed-ph 新提交 80%

A bottom-up taxonomy of student discourse with a Socratic AI physics tutor

基于苏格拉底式AI物理导师的学生话语自下而上分类学

Syed Furqan Abbas Hashmi, N. Sanjay Rebello

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本研究针对苏格拉底式AI物理导师,构建学生话语自下而上分类学,明确其分布特征,为物理教育研究提供学生与该类AI导师互动的话语参考

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05134 2026-08-06 cs.HC 新提交 80%

DeepConnect: A Visual Analytics System for Bridging Interdisciplinary Research Collaborations

DeepConnect:用于搭建跨学科研究合作的可视分析系统

Yingchaojie Feng, Zekai Shao, Yiqun Sun, Yixuan Tang, Anthony K. H. Tung

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 DeepConnect是一种LLM增强的可视分析系统,可解决跨学科合作启动难的问题,通过转化合作目标、检索论文、可视化比较研究者等功能,经评估可用于互补团队组建等场景。

Comments 11 pages, 7 figures, and 1 table. Accepted at IEEE VIS 2026; to appear in IEEE Transactions on Visualization and Computer Graphics

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03285 2026-08-05 cs.AR 新提交 80%

Fovea: Physical-Implication-Aware Wafer-Scale DSE with Decision-Domain-Guided Cross-Fidelity Refinement

Fovea:具备物理含义感知的晶圆级设计空间探索,结合决策域引导的跨保真度优化

Jinxi Li, Huizheng Wang, Jinyi Deng, Yang Hu, Shouyi Yin

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 Fovea是一种晶圆级设计空间探索方法,通过物理含义感知的空间构建与决策域引导的跨保真度优化,在LLM训练工作负载的晶圆架构选择中实现了最优解恢复与显著加速。

Comments 13 pages, 10 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15631 2026-08-04 cs.HC cs.SE 版本更新 80%

Meflex: A Multi-agent Scaffolding System for Entrepreneurial Ideation Iteration via Nonlinear Business Plan Writing

Meflex:一种基于非线性商业计划写作的多智能体支架系统,用于创业构想迭代

Lan Luo, Dongyijie Primo Pan, Junhua Zhu, Muzhi Zhou, Pan Hui

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 Meflex通过非线性商业计划写作支架系统,支持创业构想的迭代发展,提升反思与元反思能力,降低认知负担。

Comments In Proceedings of The First Reflection in Creative Experience (RiCE) Workshop (RiCE W1) arXiv:2607.24558

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28841 2026-08-03 cs.MA cs.SE 新提交 80%

CyberNeuro: A Privacy-Preserving Agentic Workbench for Cohort-Scale Neuroimage and Clinical Data Analysis

CyberNeuro:用于队列规模神经影像与临床数据分析的隐私保护智能体工作台

Ran Ren, Junhong Tong, Yunxi Kong, Yiyao Chen, Yucheng Li, Kunhao Zhou, Shaoqi Wang, Yuxiang Tao, Shuheng Cao, Zhihao Fan, Marissa DiPiero, Tingting Dan, Guorong Wu

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 CyberNeuro是配备WandaMind本地LLM的隐私保护智能体工作台,通过四个专用智能体实现神经影像与临床数据分析自动化,在NeuroBench上提升了域准确率,还降低了令牌使用量。

Comments 25 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28292 2026-07-31 cs.CL cs.AI cs.CE cs.LG 新提交 80%

CACHE-UK: A Stability-Aware Memory Editor for Sequentially Updated Quantized LLMs in Finance

CACHE-UK:面向金融领域顺序更新量化大语言模型的稳定性感知内存编辑器

Anubhav Lakra, Yue Feng

机构 * Indian Institute of Technology Madras(马德拉斯印度理工学院) University of Birmingham(伯明翰大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 针对动态金融环境中量化大语言模型的顺序内存编辑退化问题,提出CACHE-UK框架,将知识退化降低11%-17%,测试泛化率达28%,提升6个百分点。

Comments 10 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27682 2026-07-31 cs.IR 新提交 80%

Restoring Collaborative Signals in Semantic-ID Generative Recommendation via Personalized Natural Language

通过个性化自然语言恢复语义-ID生成式推荐中的协同信号

Changjiang Han, Qingyang Li, Yaqiang Zang, Jikun Kang, Pinghua Gong, Xue Liu, Bowei He

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 该研究针对基于LLM的生成式推荐模型中SID丢失协同信号导致准确率受限的问题,提出个性化自然语言引导的框架,通过添加分层协同线索恢复信号,提升推荐准确率。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27822 2026-07-31 nucl-th hep-ph 新提交 80%

CLVisc Agent for autonomous relativistic hydrodynamics studies

用于自主相对论流体动力学研究的CLVisc智能体

Qi Wang, Long-Gang Pang, Shi Pu, Xin-Nian Wang

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本研究开发了一种基于大语言模型的智能体,通过元技能自主完成相对论重离子碰撞的流体动力学模拟与分析,可应用于CLVisc代码,支持核物理研究的自动化工作流程。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21920 2026-07-27 stat.AP 新提交 80%

Systematic Literature Reviews With Two Multi-Agentic Systems And Human-In-The-Loop

基于两个多智能体系统和人在回路的系统文献综述

Zexin Ren, Zixuan Zhao, Qiyun Li, Yawen Wu, Lanjing Wang, Renjie Luo, Yi Xu, Qing Guo, Jin Shi, En Xie, Feifang Hu, Qian Shi

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 针对临床试验系统文献综述传统方法的不足,提出含人在回路的两个多智能体系统,筛选MAS用多LLM智能体等提高准确性,提取MAS结合多种手段确保准确与可扩展,重现网络荟萃分析得出新临床结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13398 2026-07-16 cs.IR 新提交 80%

TMallGS: Scaling Unified Feature and Sequence Modeling for Generative E-commerce Search

天猫GS:为生成式电商搜索扩展统一特征和序列建模

Zhentao Song, Yufeng Gao, Xing Fang, Jing Wang, Guangxin Song, Bokang Wang, Yipin Dai, He Guo

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 研究工业搜索和排名系统中CTR预测从DLRM转向Transformer架构的问题,提出天猫GS可扩展排名架构,含分层分布校准令牌化等五个关键组件,经实验和测试,该架构提高训练吞吐量,提升UCTCVR和GMV。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13257 2026-07-16 cs.SE 新提交 80%

Can LLMs Learn and Apply Multi-Level Modelling Semantics? A First Empirical Study

大语言模型能否学习并应用多层次建模语义?首次实证研究

Yuhong Fu, Weixing Zhang, Bowen Jiang, Haowei Cheng, Karamjti Kaur, Markus Stumptner

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究大语言模型能否学习应用多层次建模语义,通过让三种商业大语言模型在六种提示策略下为挑战生成模型并与参考对比,发现句法正确性可及,语义正确性部分实现,明确能力边界,为工业5.0建模工作流设计提供参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24236 2026-07-07 cs.IR 80%

MeVer at CheckThat! 2026: Cluster-Aware Hard-Negative Mining for Multilingual Scientific Source Retrieval

MeVer 在 CheckThat! 2026:面向多语言科学文献检索的聚类感知难负样本挖掘

Juli Bakagianni, Symeon Papadopoulos

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 针对社交媒体主张的科学文献来源检索任务,提出聚类感知的难负样本挖掘策略,结合密集检索、重排序和基于LLM的争议解决器,在共享任务中排名第6。

Comments Technical report for CLEF 2026 CheckThat! Task 1 shared task submission. 13 pages, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00798 2026-07-02 cs.CV 新提交 80%

ClinRAG-GRAPH: Clinical-prior Retrieval-Augmented Graph Model with Domain Adversarial Learning for Breast pCR Prediction

ClinRAG-GRAPH: 基于临床先验的检索增强图模型与领域对抗学习用于乳腺癌pCR预测

Yaofei Duan, Yuhao Huang, Tianyu Zhang, Yuan Gao, Luyi Han, Xin Wang, Xinyu Xie, Xinglong Liang, Chunyao Lu, Muzhen He, Patrick Pang, Yue Sun, Ning Mao, Tao Tan, Ritse Mann

机构 * Department of Medical Imaging, Radboud University Medical Center, Nijmegen, The Netherlands(拉德堡德大学医学中心医学影像科,奈梅亨,荷兰) The Netherlands Cancer Institute, Amsterdam, The Netherlands(荷兰癌症研究所,阿姆斯特丹,荷兰) Faculty of Applied Sciences, Macao Polytechnic University, Macau, China(澳门理工大学应用科学学院,澳门,中国) Boston Children’s Hospital, Harvard Medical School, Boston, USA(波士顿儿童医院,哈佛医学院,波士顿,美国) Centre for Artificial Intelligence and Robotics, Hong Kong Institute of Science & Innovation, Chinese Academy of Sciences, Hong Kong, China(中国科学院香港创新研究院人工智能与机器人创新中心,香港,中国) Imaging Division, University Medical Center Utrecht, Utrecht, The Netherlands(乌得勒支大学医学中心影像部,乌得勒支,荷兰) Department of Radiology, Fuzhou University Affiliated Provincial Hospital, Fuzhou, China(福州大学附属省立医院放射科,福州,中国) Department of Radiology, Yantai Yuhuangding Hospital, Shandong, China(烟台毓璜顶医院放射科,山东,中国)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出ClinRAG-GRAPH框架,通过构建患者内临床先验图、双分支领域对抗学习和大语言模型驱动的子图检索增强模块,实现术前pCR预测,在内部和外部测试集上取得良好性能。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30921 2026-07-01 cs.DC 新提交 80%

Towards Transparent Checkpointing with AI-driven Code Generation

迈向基于AI驱动代码生成的透明检查点

Hai Duc Nguyen, Tekin Bicer, Kyle Chard, Ian Foster, Bogdan Nicolae

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 研究使用大型语言模型自动为MPI科学应用生成检查点/重启代码,平均50分钟完成,开销可忽略,恢复效率与人工实现相当。

Journal ref FlexScience'26: The 2026 Workshop on AI and Scientific Computing at Scale using Flexible Computing Infrastructures (in conjunction with HPDC'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16532 2026-07-01 cs.IR 版本更新 80%

Causal-Invariant Cross-Domain Out-of-Distribution Recommendation

因果不变的跨域分布外推荐

Jiajie Zhu, Yan Wang, Feng Zhu, Pengfei Ding, Hongyang Liu, Zhu Sun

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 提出CICDOR框架,通过双层级因果结构推断域特定和域共享的因果不变用户偏好,并利用LLM发现混杂因子,解决跨域和单域分布偏移导致的分布外问题,提升推荐准确性。

Comments Corrected author affiliation. Accepted by ACM TOIS for publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26573 2026-06-26 cs.CY cs.HC 新提交 80%

Pingquanqi (Equalizer): A Cross-Domain Sociotechnical Framework for Human-Agent Interaction Governance

Pingquanqi(均衡器):人机交互治理的跨领域社会技术框架

Yu Wang

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 提出Pingquanqi框架,通过用户状态区分、贝叶斯止损、可控摩擦和透明度度量等组件,优化LLM代理交互成本,保护用户时间资源,兼顾企业经济效益。

Comments 31 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03724 2026-06-26 cs.IR 版本更新 80%

Rank, Don't Generate: Statement-level Ranking for Explainable Recommendation

排序,而非生成:面向可解释推荐的语句级排序

Ben Kabongo, Arthur Satouf, Vincent Guigue

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出将可解释推荐形式化为语句级排序问题,通过从评论中提取解释性语句并排序,避免生成式幻觉,支持细粒度事实分析和标准化评估。

Comments 12 pages, 7 tables, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25398 2026-06-25 cs.RO 新提交 80%

MAPL: Multi-Objective Preference Learning for Robot Locomotion

MAPL:机器人运动的多目标偏好学习

Xiyue Chen, Muhan Lin, Shuyang Shi, Joseph Campbell

机构 * Purdue University(普渡大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出MAPL框架,利用大语言模型从自然语言目标中学习多目标偏好,替代手工奖励函数,在四足机器人运动任务中达到或超越专家设计奖励的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22803 2026-06-24 cs.IR 新提交 80%

Towards Fast Domain Adaptation and Fine-Grained User Simulation for Evaluating Conversational Recommender Systems

面向快速领域自适应和细粒度用户模拟的对话推荐系统评估

Yuanzi Li, Quanyu Dai, Xueyang Feng, Zihang Tian, Junhao Wang, Xu Chen, Zhenhua Dong, Huifeng Guo

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出AdaptSim框架,通过自动提示生成和开放动作机制实现快速领域自适应,采用“思考-响应”策略控制语言风格,并基于广度优先搜索的逐轮对比评估对话推荐系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21389 2026-06-23 cs.CR 新提交 80%

From Production SIEM to Reusable Cybersecurity Artifacts

从生产SIEM到可复用的网络安全工件

Sidnei Barbieri, Leonardo Vaz de Meneses, Ágney Lopes Roth Ferraz, Wagner Comin Sonaglio, Lourenço Alves Pereira Júnior

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出一种从生产金融安全运营中心提取、匿名化、结构化并验证SIEM数据的方法,生成可复用的研究工件,并通过训练和测量实验验证其隐私-效用边界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17179 2026-06-16 cs.MA 版本更新 80%

Ablation Study of a Fairness Auditing Agentic System for Bias Mitigation in Early-Onset Colorectal Cancer Detection

公平性审计代理系统在早发性结直肠癌检测中缓解偏见的消融研究

Amalia Ionescu, Jose Guadalupe Hernandez, Jui-Hsuan Chang, Emily F. Wong, Paul Wang, Jason H. Moore, Tiffani J. Bright

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出双代理架构(领域专家代理+公平性顾问代理),通过消融实验比较不同配置下大语言模型在公平性审计中的表现,发现带RAG的代理系统在识别差异方面语义相似度最高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09290 2026-06-10 cs.SE cs.CE cs.MA 版本更新 80%

ToolRosella: Translating Code Repositories into Standardized Tools for Scientific Agents

ToolRosella: 将代码仓库翻译为科学智能体的标准化工具

Shimin Di, Xujie Yuan, Hanghui Guo, Chaoqian Ouyang, Yongxu Liu, Ling Yue, Zhangze Chen, Libin Zheng, Jia Zhu, Shaowu Pan, Jian Yin, Yong Rui, Min-Ling Zhang

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出ToolRosella框架,通过仓库分析、工具接口构建、执行测试和迭代修复,自动将异构科学代码仓库转化为标准化、可被智能体调用的工具,在122个仓库上达到61.5%的转换成功率,下游任务成功率为84.0%。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03852 2026-06-10 physics.geo-ph 版本更新 80%

Advancing Subsurface Discovery and Geothermal Monitoring with an Agentic Artificial Intelligence Framework

基于智能体人工智能框架推进地下发现与地热监测

Randy Harsuko, Zhengfa Bi, Guodong Chen, Nori Nakata

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出GAIA系统,结合大语言模型、数字孪生与检索增强生成,实现地热开发中的多学科任务自动化与智能决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09637 2026-06-09 cs.SE 新提交 80%

Agentic Persona Generation with Critique-Refinement: An Industrial Evaluation

基于批评-改进的智能体角色生成:工业评估

Mohammad Hossein Amini, David Dewar, Shiva Nejati, Mehrdad Sabetzadeh

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 提出PerGent方法,通过迭代批评-改进循环利用LLM智能体生成角色,在工业部署中专家认可率达96.9%,优于单次生成方法。

Comments Accepted in the Industry Track of the Requirements Engineering (RE) 2026 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06749 2026-06-08 q-bio.QM 新提交 80%

Deterministic access to global viral sequence data enables robust agentic scientific discovery

确定性访问全球病毒序列数据实现稳健的自主科学发现

Ferdous Nasri, Sarah Gurev, Patrick Varilly, Krithik Ramesh, Nuala A. O'Leary, Jonah Cool, Bernhard Y. Renard, Pardis C. Sabeti, Laura Luebbert

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对基于大语言模型的科学代理在病毒数据检索中的高错误率问题,提出确定性查询框架gget virus,通过形式化NCBI Virus过滤流程、元数据约束和结构化记录检索,将检索准确率提升至90%以上,并减少98%数据传输。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17601 2026-06-08 cs.IR cs.SI 80%

Why They Link: An Intent Taxonomy for Including Hyperlinks in Social Posts

为何他们链接:一种包含超链接在社交帖子中的意图分类

Fangping Lan, Abdullah Aljebreen, Eduard C. Dragut

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出一种意图分类,通过混合方法分析用户对超链接的感知意图,揭示广告、论证和分享是最常见的意图,并在微博客检索任务中展示其应用价值。

Comments 10 pages including references, 5 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏