arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12597 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12597 篇

2605.01189 2026-08-17 cs.AI 版本更新 81%

NEURON: A Neuro-symbolic System for Grounded Clinical Explainability

NEURON:一种面向临床可解释性的神经符号系统

Anuradha Chandrasekaran, Dimitrios Zikos, Mutlu Mete, Alan Pang, Brady D. Lund, Kewei Sha

机构 * University of North Texas(北卡罗来纳大学达顿分校) Texas Tech University Health Sciences Center(德克萨斯农工大学健康科学中心)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 NEURON结合医学本体和机器学习模型,提升预测可靠性与临床可解释性,通过RAG层生成自然语言解释,在MIMIC-IV数据集上提升AUC至0.84-0.88。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12395 2026-08-14 cs.AI 新提交 81%

Research Assistant: AstraZeneca's Agentic System for R&D

研究助手:阿斯利康的研发智能体系统

Piotr Grabowski, Mohamed Alameen, Jorge Bretones, Sabina Cardell, Miguel Carmona, Gavin Edwards, Ben Grainger, Sameh Hassan, Erik Jansson, Artur Kuziakhmetov, Albert Maristany, Hebatallah Mohamed, Andriy Nikolov, Sebastian Nilsson, Mark O'Donoghue, James Pacileo, Ashiq Sultan, Alex Voegele, Michael Ughetto

机构 * AstraZeneca(阿斯利康)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 阿斯利康研发了基于LLM的智能体系统Research Assistant,整合多类生物医学数据,支持两种问答模式,可溯源证据,为研发工作提供支持。

Comments 16 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.11641 2026-08-14 cs.CL 版本更新 81%

Revolutionizing Finance with LLMs: An Overview of Applications and Insights

用LLMs革新金融:应用与洞察综述

Huaqin Zhao, Zhengliang Liu, Zihao Wu, Yiwei Li, Tianze Yang, Peng Shu, Shaochen Xu, Haixing Dai, Lin Zhao, Hanqi Jiang, Yi Pan, Junhao Chen, Yifan Zhou, Zheyuan Zhang, Zeyu Zhang, Ruitong Sun, Gengchen Mai, Ninghao Liu, Tianming Liu

机构 * School of Computing, The University of Georgia(佐治亚大学计算机学院) Computer Science and Engineering, The University of Texas at Arlington(德克萨斯大学阿灵顿分校计算机科学与工程系) Department of Geography, University of Georgia(佐治亚大学地理系)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文综述了LLMs在金融领域的应用与洞察,探讨了其在自动化报告、市场预测和投资建议等方面的作用,并展示了GPT-4在金融任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04571 2026-08-13 cs.AI 版本更新 81%

OpenAg: Democratizing Agricultural Intelligence

OpenAg:推动农业智能的平民化

Srikanth Thudumu, Jason Fisher

机构 * Institute of Applied Artificial Intelligence and Robotics (IAAIR)(应用人工智能与机器人研究所)

专题命中 领域大模型 :LLM(abstract_cn);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 本研究提出OpenAg框架,结合多类技术构建农业通用人工智能系统,以解决现有农业智能系统的不足,助力符合当地实际的农业决策。

Comments 10 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10039 2026-08-12 cs.LG 新提交 81%

FlowScout: From Execution Feedback to Reliable Tool-Using Agent Workflows

FlowScout:从执行反馈到可靠的工具使用智能体工作流

Shuo Hao, You Lu, Bihuan Chen, Xin Peng

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 FlowScout是从历史任务记录生成工具集成型智能体工作流的执行引导框架,经多任务域评估,其工具调用正确性与执行质量均显著优于PM4Py等基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08163 2026-08-11 cs.AI 新提交 81%

Agentic AI-driven Immersive Simulation: A Knowledge-Aware Virtual Training Platform forHigh Dose Rate (HDR) Brachytherapy

智能体AI驱动的沉浸式模拟:用于高剂量率(HDR)近距离放射治疗的知识感知虚拟训练平台

Ronghua Xu, Kepha Barasa, Manoj Kumal, Xinyun Liu, Weihua Zhou, Xin Qian

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究提出一款智能体AI驱动的沉浸式模拟平台,用于HDR阴道圆柱近距离放射治疗虚拟训练,集成VR、移动计算与RAG技术,经原型验证可提供高保真无风险训练环境,具备合适延迟与高RAG支持质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07547 2026-08-11 cs.CV cs.AI 新提交 81%

Learning an Interior Layout Policy in a Domain Specific Language Action Space

在领域特定语言动作空间中学习室内布局策略

Yuhao Lu, Weichen Zhang, Wenyi Xiao, Haohui Chen, Yiyun Fei

机构 * Taobao & Tmall Group of Alibaba(阿里巴巴淘宝与天猫集团)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 针对现有室内布局生成方法的缺陷,该研究提出基于LLM的LayoutDSL框架,通过领域特定语言动作空间学习布局策略,结合数据集构建与强化学习优化,显著提升了布局的空间合理性与设计逻辑性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16902 2026-08-11 cs.LG 版本更新 81%

ArtifactLinker: Linking Scientific Artifacts for Automatic State-of-the-Art Discovery

ArtifactLinker: 通过自动发现最新研究成果来链接科学制品

Haofei Yu, Jiaxuan You, Peter Clark, Bodhisattwa Prasad Majumder, Kyle Richardson

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Allen Institute for AI(人工智能算法研究所)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出ArtifactLinker框架,通过图神经网络和大语言模型预测模型-数据集链接,并通过编码实验验证,以实现自动发现最新研究成果

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17902 2026-08-11 cs.AI cs.MA cs.SE physics.chem-ph 版本更新 81%

El Agente Gráfico: A Semantic Execution Runtime for Scientific Agents

图形代理:用于科学代理的结构化执行图

Jiaru Bai, Abdulrahman Aldossary, Thomas Swanick, Marcel Müller, Yeonghun Kang, Changhyeok Choi, Naruki Yoshikawa, Zijian Zhang, Jin Won Lee, Tsz Wai Ko, Aiwei Yin, Mohammad Ghazi Vakili, Chris Crebolder, Varinia Bernales, Alán Aspuru-Guzik

机构 * School of Computer Science, McGill University(计算机科学学院,麦吉尔大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 El Agente Gráfico通过结构化执行图和类型安全机制,实现科学代理的高效自动化,适用于复杂计算任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06471 2026-08-10 cs.CR cs.AI cs.SE 新提交 81%

CyberForge: Verified Vulnerability Injection at Repository Level for Cybersecurity Agent Training

CyberForge:用于网络安全智能体训练的、基于代码仓库级别的经验证漏洞注入框架

Amine Lbath, Manan Suri, Aurelien Delaitre, Vadim Okun, Massih-Reza Amini, Ram D. Sriram, Dinesh Manocha

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出CyberForge框架,通过向真实C/C++项目注入漏洞生成经验证的代码仓库级安全训练数据,微调后可提升智能体在SEC-bench和PatchEval上的漏洞修复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05430 2026-08-07 cs.CR cs.LG 新提交 81%

Robust Context-Aware Detection of Malicious Instructions in Text

文本中恶意指令的鲁棒上下文感知检测

Buzhao Liu, Xinhang Ma, Yevgeniy Vorobeychik

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.LG

AI总结 该研究针对LLM易受间接提示注入攻击的问题,提出上下文感知的恶意句子分类方法及两种对抗训练技术,在静态和自适应攻击下均提升了IPI防御性能,且需根据领域调整参数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03283 2026-08-05 cs.AI 新提交 81%

AgentPanel: Toward a New Paradigm for Human--AI Collaboration in Exploring Scientific Questions

AgentPanel:面向科学问题探索的人机协作新范式

Zhiyao Cui, Qianyi Wang, Haoyang Yan, Yiqun Zhang, Siyue Ren, Hangfan Zhang, Zelin Tan, Hao Li, Chunjiang Mu, Dexian Cai, Shao Zhang, Chen Zhang, Meng Li, Jianan Chai, Yuting Fan, Zichao Ye, Xiaolei Yang, Xinyao Lu, Yuyang Yu, Wenjie Lou, Xiaosong Wang, Fenghua Ling, Shiyang Feng, Mao Su, Qiaosheng Zhang, Bo Zhang, Yang Chen, Lei Bai, Shuyue Hu

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究人员探索科学问题时视角有限,本文提出人机协作多智能体论坛AgentPanel,其在多维度评估中表现优于基线,获多数用户认可,可用于早期科学探索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02955 2026-08-05 cs.HC cs.AI cs.CY eess.IV 新提交 81%

Chat Debugging: An Exploratory Study of Human-AI Collaboration to Debug Analog Circuits

聊天调试:人机协作调试模拟电路的探索性研究

John Hu, Andrew Ash

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究通过分析本科生与开源大型语言模型(LLMs)协作调试模拟电路的聊天记录,揭示了人机协作调试的模式、LLMs的优势与不足及学生的技能短板,为优化人机协作调试提供了依据。

Comments This is the accepted version of a paper to be presented at the 2026 IEEE Frontiers in Education Conference (FIE). The final version will be available via IEEE Xplore

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02712 2026-08-05 cs.SE cs.AI 新提交 81%

Don't Regenerate, Debug: A Domain-Specific Agent for Repairing Near-Miss Hardware Operators

不要重新生成,要调试:一种用于修复近失配硬件算子的领域特定智能体

Yansong Sun, Shenxiu Wu, Siyuan Chen, Runlin Hou, Junhao Qiu, Junming Cao, Shudi Shao, Zhichao Lu, Qingfu Zhang

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究提出领域特定调试智能体,通过调试而非重新生成修复硬件近失配算子,其调试Pass@1准确率更高、token消耗更少,可拓展能力边界并降低成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28027 2026-07-31 cs.MA cs.AI cs.CE 新提交 81%

VISA: A Structured Description Protocol for Agent-Based Simulation Models Towards Machine Reproducibility

VISA:面向智能体可复现性的智能体仿真模型结构化描述协议

Zhou He

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 该研究提出VISA结构化描述协议,通过八个表格及可执行规则、LLM技能提升智能体模型可复现性,在三类平台的ABMs上验证了其有效性,将复现障碍转化为可处理的依赖项。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28200 2026-07-31 physics.app-ph cond-mat.mtrl-sci cs.AI 新提交 81%

Vibe-FDTR: An agent-oriented framework for reproducible frequency-domain thermoreflectance data analysis

Vibe-FDTR:一种面向智能体的可复现频域热反射数据分析框架

Fuwei Yang, Weiheng Li, Bai Song

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Vibe-FDTR是面向智能体的FDTR数据分析框架,结合领域代码包与智能体技能,在基准测试中表现优异,可降低计算成本与执行时间,助力低门槛可信热计量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25253 2026-07-30 cs.AI cs.IR 版本更新 81%

The User Asks, Platforms Compete: How Agentic Recommendation Markets Take Shape

用户提问,平台竞争:代理推荐市场如何形成

Deyao Hong, Kehan Zheng, Qian Li, Jun Zhang, Jie Jiang, Hongning Wang

机构 * Tsinghua University(清华大学) Tencent Inc.(腾讯公司)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 研究基于LLM的代理推荐市场,用户先提需求平台竞争注意力。实验发现新设置在获取与注意力间有紧张关系,竞争引发平台策略行为,关联反馈可增加购买机会,强调设计代理推荐需综合考虑多方面并作为联合机制设计问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16379 2026-07-30 cs.IR cs.CL 版本更新 81%

LLMAR: A Tuning-Free Recommendation Framework for Sparse and Text-Rich Industrial Domains

LLMAR:一种适用于稀疏且文本丰富的工业领域的无调优推荐框架

Ryogo Hishikawa, Ichiro Kataoka, Shinya Yuda

机构 * Hitachi, Ltd. Research and Development Group(日立株式会社研发部门) Hitachi Power Solutions Co., Ltd.(日立电力解决方案公司)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 LLMAR通过无调优框架整合大语言模型推理,捕捉用户潜在动机,解决工业领域数据稀疏问题,提升推荐准确率和效率。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08286 2026-07-30 cs.CL 版本更新 81%

LAMUS: A Large-Scale Corpus for Legal Argument Mining from U.S. Caselaw using LLMs

LAMUS:利用LLMs构建大规模美国判例法法律论证语料库

Serene Wang, Lavanya Pobbathi, Haihua Chen

机构 * University of North Texas(北卡罗来纳大学达顿分校)

专题命中 领域大模型 :LLM(abstract,abstract_cn);language model(abstract);prompting(abstract);分类 cs.CL

AI总结 LAMUS利用LLMs构建大规模美国判例法法律论证语料库,通过数据驱动方法提升法律NLP研究的可扩展性和实证支持。

Comments This article has been peer reviewed and formally published in the Journal of Computational Law and Legal Technology (JCLLT). The final Version of Record is available at: https://doi.org/10.47852/bonviewJCLLT62029649

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00176 2026-07-29 cs.IR cs.AI 81%

Effectiveness of LLMs in Temporal User Profiling for Recommendation

在推荐系统中利用大语言模型进行时间用户画像的有效性

Milad Sabouri, Masoud Mansoury, Kun Lin, Bamshad Mobasher

机构 * DePaul University, USA(德保罗大学) Delft University of Technology, Netherlands(代尔夫特理工大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究了大语言模型在时间用户画像中的有效性,发现其在用户活跃度高的领域表现更好,但计算成本较高,且在不同领域中效果存在差异。

Comments Accepted to the IEEE International Conference on Data Mining (ICDM 2025), Workshop on User Modeling and Recommendation (UMRec). To appear in the IEEE ICDMW 2025 proceedings

Journal ref 2025 IEEE International Conference on Data Mining Workshops (ICDMW), pp. 2330-2335, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21625 2026-07-27 cs.AI 新提交 81%

Trajectory-Aware Retrieval Agents for Temporal Decision- Making

用于时间决策的轨迹感知检索代理

Jing Wang, Jie Shen, Xing Niu

机构 * Amazon(亚马逊)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究用大语言模型代理从长篇时间结构化文本中决策的问题,针对标准RAG丢弃时间结构缺陷,引入闭环代理框架TLM,其关键技术是LGCM,在医学问答、收益电话会议惊喜预测和隔夜股票缺口预测任务中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20560 2026-07-24 cs.LG 新提交 81%

Chronofy: A Temporal-Logical Decay Architecture for Information Validity in Time-Aware Retrieval-Augmented Generation

Chronofy:一种用于时间感知检索增强生成中信息有效性的时态逻辑衰减架构

Muntaser Syed, Marius Silaghi, Sheikh Abujar, Sharun Akter

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究针对RAG系统中因未考虑时间来源导致的时间幻觉问题,提出Chronofy三层神经符号框架,通过嵌入时间有效性到表示、检索和推理层,经实验验证该框架能提高检索精度、减少幻觉并启用数据重新获取触发机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.28061 2026-07-21 cs.DL cs.CL 版本更新 81%

Measuring research data reuse in scholarly publications using generative artificial intelligence: Open Science Indicator development and preliminary results

利用生成式人工智能测量学术出版物中的研究数据重用:开放科学指标开发与初步结果

Lauren Cadwallader, Iain Hrynaszkiewicz, parth sarin, Tim Vines

机构 * PLOS DataSeer

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 本文开发了基于LLM的开放科学指标,发现研究数据重用率高达43%,高于传统文献计量方法,展示了生成式AI在大规模测量数据重用方面的潜力。

Comments v2: 12 pages. Revised and accepted following feedback from review process of 30th Annual International Conference on Science and Technology Indicators. Revisions are the addition of 1) information on the definition of "data reuse" and 2) discussion of prevalent errors identified in the model. V1: 12 pages. Submitted to 30th Annual International Conference on Science and Technology Indicators

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05353 2026-07-21 cs.LG cs.IT math.IT 版本更新 81%

GlyRAG: Context-Aware Retrieval-Augmented Framework for Blood Glucose Forecasting

GlyRAG:用于血糖预测的上下文感知检索增强框架

Shovito Barua Soumma, Hassan Ghasemzadeh

机构 * College of Health Solutions, Arizona State University(亚利桑那州立大学健康解决方案学院) School of Computing and Augmented Intelligence, Arizona State University(亚利桑那州立大学计算与增强智能学院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究旨在利用连续血糖监测数据进行准确血糖预测,开发了GlyRAG框架,结合大语言模型提取上下文信息并通过检索增强预测,在OhioT1DM和AZT1D数据集上评估,显著提高长期预测的均方根误差,多数预测落在临床可接受区域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26614 2026-07-20 cs.HC cs.AI cs.GR 版本更新 81%

HiLSVA: Design and Evaluation of a Human-in-the-Loop Agentic System for Scientific Visualization

HiLSVA:用于科学可视化的人机协同智能系统设计与评估

Kuangshi Ai, Patrick Phuoc Do, Chaoli Wang

机构 * Department of Computer Science and Engineering, University of Notre Dame(Notre Dame 大学计算机科学与工程系)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出HiLSVA,一种人机协同智能系统,通过计划优先的多智能体架构、显式人类监督和逐步溯源,支持混合主动的科学可视化工作流,增强而非替代人类分析推理。

Comments IEEE Transactions on Visualization and Computer Graphics (IEEE VIS '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14970 2026-07-17 cs.AI 新提交 81%

Explaining Process Control Optimisation Recommendations via GradientSHAP and Implicit Differentiation

通过GradientSHAP和隐函数求导解释过程控制优化建议

Paul Darm, Cem Alpturk, Kenneth Ulrich, William Duncan, Ali Anwar, Annalisa Riccardi

机构 * University of Strathclyde(斯特拉斯克莱德大学) Weir(威尔)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对工业过程控制优化中算法设计者与操作员的信任问题,提出结合隐函数定理灵敏度分析、SHAP归因及大语言模型叙述生成的方法,在HPGR控制优化问题上实现等效SHAP归因且加速超40倍,能实时生成自然语言解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10522 2026-07-14 cs.CV cs.AI 新提交 81%

Towards Autonomous and Auditable Medical Imaging Model Development

迈向自主且可审计的医学成像模型开发

Shengyuan Liu, Jia-Xuan Jiang, Boyun Zheng, Cheng Wang, Zipei Wang, Wentao Pan, Hongtao Wu, Houwen Peng, Yu Gu, Lichao Sun, Yixuan Yuan

机构 * The Chinese University of Hong Kong(香港中文大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Microsoft Research(微软研究院) Lehigh University(里海大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对医学成像模型开发困难的问题,提出AMID自主多代理框架。该框架含数据条件方法规划和验证引导两阶段优化,经20个医学成像任务验证,其性能优于通用MLE系统,能将特定任务模型开发转变为高效可审计的代理工作流程。

Comments 18 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28533 2026-07-14 cs.IR cs.AI 版本更新 81%

CMSL: Constructive Multi-Sequence Learning for Recommendation Systems

CMSL:面向推荐系统的建设性多序列学习

Zikun Cui, Renzhi Wu, Junjie Yang, Li Sheng, Jijie Wei, Linfeng Liu, Tai Guo, Tao Jia, Xiaodong Wang, Hong Li, Li Yu, Sri Reddy, Hong Yan

机构 * Meta MRS Meta PyTorch Meta FB Monetization

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对用户历史行为序列中多兴趣混杂导致的上下文污染问题,提出CMSL方法,通过可学习的序列构建模块在隐空间解耦出多个纯主题序列,并利用线性注意力高效建模,在Meta多个场景的排序和检索任务中取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08257 2026-07-10 cs.AI 新提交 81%

MentalHospital: A Virtual Environment for Evaluating Psychiatric Clinical Encounters

精神病院:一个用于评估精神科临床问诊的虚拟环境

Yuming Yang, Xiao Sun, Yuanwei Zou, Zhengxiao Wu, Yun Chen, Jiang Zhong, Haoyang Zeng, Jingwang Huang, Kaiwen Wei

机构 * School of Computer Science, Chongqing University(重庆大学计算机科学学院) School of Computer Science, Hunan University(湖南大学计算机科学学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

AI总结 研究针对大语言模型在精神科临床问诊评估不足的问题,引入MentalHospital虚拟环境,实例化S.O.A.P.工作流程,用双轨协议评估,开发MentalEval,经测试其具有临床保真度且与专家高度一致,指出大语言模型在精神状态评估上落后临床医生。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01131 2026-07-02 cs.CV cs.AI 新提交 81%

Autonomous Scientific Discovery via Iterative Meta-Reflection

通过迭代元反射实现自主科学发现

Bingchen Zhao, Sara Beery, Oisin Mac Aodha

机构 * University of Edinburgh(爱丁堡大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出DiscoPER框架,利用大语言模型进行开放式的自主科学发现,通过动态代码生成、统计检验和二阶推理机制,在iNatDisco基准上以72.7%假设支持率恢复8/9已知模式。

详情

展开后加载摘要…

URL PDF HTML 收藏