arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12720 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12720 篇

2606.28929 2026-06-30 cs.CR cs.LG 70%

Cybersecurity is the True Frontier for Generative AI Success or Failure

网络安全是生成式AI成功或失败的真正前沿

Edward Raff, Maor Ashkenazi, Sagar Samtani, David J. Elkind, Sven Krasser

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出网络安全是比自然语言和计算机视觉更复杂的AI测试床,因其数据规模大、标注成本高、环境动态变化且要求低延迟和可解释性。

Comments to appear in the 5'th Workshop on Rethinking Malware Analysis (WoRMA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28353 2026-06-30 cs.IR cs.AI 70%

From Regulatory Approvals to Patents: Cross-Domain Linking for Cardiovascular Device Traceability

从监管批准到专利:心血管设备可追溯性的跨领域链接

Yang Qingqing, Liu Haijiang, Li Moyan

机构 * HKUST (Guangzhou)(香港科技大学(广州)) Wuhan Univ. of Sci. & Tech.(武汉科技大学) Hubei Key Lab. of Intelligent Info. Processing & Real-time Industrial System(湖北省智能信息处理与实时工业系统重点实验室)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对FDA批准设备与USPTO专利的跨领域链接任务,提出Bridge-MedDevKG框架,通过领域本体、多信号候选生成和异构重排序,在心血管设备数据集上实现91.6%召回率和50.9%噪声降低。

Comments Accepted by ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27394 2026-06-29 cs.DL cs.LG 新提交 70%

Forecasting Technological Directions in Wireless Networks and Mobile Computing via AutoML Framework

通过AutoML框架预测无线网络与移动计算的技术方向

Ahmed Abolfadl, Marwa Mahmoud, Basma Afifi, Mervat Abu-Elkheir, Maggie Mashaly

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 提出一种集成聚类、主题建模和时间序列分析的自动化管道,用于预测无线网络与移动计算领域的研究趋势,通过元学习选择聚类算法和逐次减半策略优化主题模型,结合ARIMA等模型预测主题热度,实验RMSE为36.76。

Comments Conference: 2025 IEEE Middle East Conference on Communications and Networking (MECOM)

Journal ref Proc. IEEE IEEE Middle East Conference on Communications and Networking (MECOM), Cairo, Egypt, 2025, pp. 1-6

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27386 2026-06-29 cs.DL cs.AI 新提交 70%

Agentic Publication Protocol: An Attempt to Modernize Scientific Publication

Agentic Publication Protocol:科学出版现代化的一次尝试

Sirui Lu, Xiao-Liang Qi

机构 * Max-Planck-Institut für Quantenoptik(马克斯·普朗克量子光学研究所) Munich Center for Quantum Science and Technology(慕尼黑量子科学与技术中心) Leinweber Institute for Theoretical Physics(莱因韦伯理论物理研究所)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出Agentic Publication Protocol(APP),一种将论文与代码、数据、环境信息及智能体指令打包的轻量级仓库格式,使未来研究者能直接使用操作知识。

Comments 16 pages, 5 figures and 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09698 2026-06-25 cs.IR cs.AI 版本更新 70%

Evaluating Scene-based In-Situ Item Labeling for Immersive Conversational Recommendation

评估基于场景的原位物品标签用于沉浸式对话推荐

Jiazhou Liang, Yifan Simon Liu, David Guo, Minqi Sun, Yilun Jiang, Scott Sanner

机构 * University of Toronto(多伦多大学) University of Waterloo(滑铁卢大学) Vector Institute of Artificial Intelligence(向量人工智能研究所)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对沉浸式对话推荐系统,提出基于显式意图满足和主动信息需求的原位标签分类与评估指标,基准测试显示现有方法在利用场景信息、避免冗余和预测主动需求方面存在局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01299 2026-06-25 astro-ph.IM cs.AI 版本更新 70%

Domain-Specific Agents for Cherenkov Telescope Array Control Software and Gamma-Ray Data Analysis

用于切伦科夫望远镜阵列控制软件和伽马射线数据分析的领域专用智能体

Dmitriy Kostunin, Elisa Jones, Vladimir Sotnikov, Valery Sotnikov, Sergo Golovachev, Alexandre Strube

机构 * Deutsches Elektronen-Synchrotron DESY(德意志电子同步辐射研究中心) JetBrains Limited(JetBrains有限公司) JetBrains GmbH(JetBrains德国公司) Jülich Supercomputing Centre(吕贝克超级计算中心)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出领域自适应的大语言模型智能体,结合上下文知识、自动验证和迭代修正,支持切伦科夫望远镜阵列操作与数据分析,减少人工、提高一致性并加速工作流。

Comments EuCAIFCon 2025 proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24346 2026-06-24 cs.IR cs.CL 新提交 70%

PETRA: Transforming Web Text for Petroleum-Engineering Domain Adaptation

PETRA: 将网络文本转化为石油工程领域适应的数据集

Kirill Dubovikov, Omar El Mansouri, Hachem Madmoun, Yanda Li, Sandeep Kumar, Aya El Mir, Supriyo Ghosh, Writabrata Bhattacharya, Adrian Garcia-Garcia, Onkar Pandit, Sunil Kumar Sahu, Federico Castanedo, Larry Murray, Martin Takac, Salem Lahlou

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎伊德大学人工智能学院) Inception AI

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 针对石油工程检索中领域标签稀缺的问题,提出PETRA数据集和流程,通过噪声网络数据构建领域语料和合成监督信号,显著提升检索与重排序性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22906 2026-06-23 cs.SE cs.AI 新提交 70%

From Fragments to Paths: Task-Level Context Recovery for Large Industrial Codebases

从片段到路径:大型工业代码库的任务级上下文恢复

Jiawei He, Weisong Sun, Mengyu Shi, Jie Jia, Tong Bian, Xikai Yang, Dong Sun

机构 * AMAP, Alibaba Group(阿里集团AMAP) Nanyang Technological University(南洋理工大学) Nanjing University(南京大学) University of Cambridge(剑桥大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出DeepDiscovery方法,通过两阶段定位-推理框架在预算约束下恢复任务级上下文,显著提升大型工业代码库的文件检索和下游软件工程任务性能。

Comments 12 pages, 3figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21963 2026-06-23 cs.AI cs.SE 新提交 70%

Holmes: Multimodal Agentic Diagnosis for Mixed-Language Mobile Crashes at Industrial Scale

Holmes: 工业级混合语言移动崩溃的多模态智能诊断

Jia Li, Wenyuan Ma, Ting Peng, Haibin Zheng, Yuetang Deng

机构 * The Chinese University of Hong Kong(香港中文大学) Tencent Inc.(腾讯公司)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 提出多智能体系统Holmes,通过多模态运行时信号合成重构崩溃上下文,采用层次化检索-探索-推理架构,在70M行代码中实现87.6%函数级定位准确率,将平均排查时间降低98%至约77秒。

Comments Accepted at FSE'26 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21168 2026-06-23 cs.CL 新提交 70%

Dementia-Agents: A Multi-Modal Multi-Agent System for Dementia Staging and Phenotyping

Dementia-Agents:用于痴呆分期和表型分析的多模态多智能体系统

Yaling Shen, Maja Christensen, Yiwen Jiang, Jenna Dennison, David Darby, Amy Brodtmann, Zongyuan Ge

机构 * Monash University(莫纳什大学) Eastern Health(东部健康) Lived Experience Advisor(生活经验顾问)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出Dementia-Agents多智能体框架,通过数据翻译、专家预测和协调聚合三步流程,在真实临床队列中实现优于单一MLLM和先前多智能体系统的痴呆综合征级分期与表型分析。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20978 2026-06-23 cs.AI cs.HC 新提交 70%

How Should Agents Read Demonstrations? Hierarchical Structure Beats Flat Action Logs

智能体应如何阅读演示?层级结构优于扁平动作日志

Honjar Xing, Jefferson Lin, Henry Lieberman

机构 * MIT Computer Science and Artificial Intelligence Laboratory (CSAIL)(麻省理工学院计算机科学与人工智能实验室(CSAIL))

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出将演示中的动作序列组织为带标签的层级子目标,在85个Web自动化任务中,层级结构将模糊描述任务的通过率从76.7%提升至90.7%,而扁平结构改进不显著,消融实验表明子目标分组是唯一驱动因素。

Comments Accepted at the 5th Deep Learning for Code (DL4C) Workshop, ICML 2026. 8 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20910 2026-06-23 cs.CR cs.AI 新提交 70%

Whose Agent Are You? Multi-Layer Fingerprinting and Attribution of Autonomous Web Agents

你是谁的代理?自主网络代理的多层指纹识别与归因

Dayeon Kang, Hyejun Jeong, Jade Sheffey, Pubali Datta, Amir Houmansadr

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对AI网络代理的隐私与安全挑战,提出基于网络层和浏览器交互行为的多层指纹识别方法,通过决策树分类器实现97%准确率的代理识别与归因。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13405 2026-06-23 cs.AI cs.MA 新提交 70%

Neuro-Symbolic Agents for Regulated Process Automation: Challenges and Research Agenda

用于受规管流程自动化的神经符号代理:挑战与研究议程

Alexander Rombach, Chantale Lauer, Nijat Mehdiyev

机构 * German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心(DFKI)) Saarland University(萨尔大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 提出将领域内符号结构(法规、流程模型、合规约束)作为代理核心架构组件,实现合规性内置(compliance-by-construction)以补充护栏监控,并列出神经符号研究挑战。

Comments Accepted as a poster in NILA Workshop @ IJCAI-ECAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19836 2026-06-23 cs.CL physics.ed-ph 版本更新 70%

A Framework for Deductive Semantic Content Analysis at Scale in Science Education Using Text Embeddings

使用文本嵌入进行科学教育中大规模演绎语义内容分析的框架

Jonas Timmann Mjaaland, Markus Fleten Kreutzer, Halvor Tyseng, Rebeckah K. Fussell, Gina Passante, N. G. Holmes, Anders Malthe-Sørenssen, Tor Ole B. Odden

机构 * Center for Interdisciplinary Education, University of Oslo(interdisciplinary Education 中心,奥斯陆大学) Laboratory of Atomic and Solid State Physics, Cornell University(原子与固体物理实验室,康奈尔大学) Department of Physics, California State University Fullerton(物理系,弗里蒙特加州州立大学) Center for Computing in Science Education, University of Oslo(科学教育计算中心,奥斯陆大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出基于文本嵌入的分类框架DeSCA,仅需少量示例即可实现大规模开放题编码,与人类编码者高度一致,并支持编码一致性审计。

Comments 47 pages plus supplementary information, 5 figures. Version 2 has been lightly edited and formatted to fit better with the field of science education research, including updating the title and adding a brief literature review of NLP methods applied to textual datasets in science education. Results are unchanged since original version

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19700 2026-06-19 cs.CL 新提交 70%

TerraMARS: A Domain-Adapted Small-Language-Model Pipeline for Mars Terraforming Literature

TerraMARS: 用于火星地球化改造文献的领域自适应小语言模型管道

Jyotsna Singh, Ash Black, Jeff Larsen, Scott R. Saleska

机构 * University of Arizona(亚利桑那大学) College of Information Science, University of Arizona(亚利桑那大学信息科学学院) Biosphere 2, University of Arizona(亚利桑那大学生物圈2) Department of Ecology and Evolutionary Biology, University of Arizona(亚利桑那大学生态与进化生物学系) Department of Environmental Sciences, University of Arizona(亚利桑那大学环境科学系)

专题命中 领域大模型 :language model(abstract);small language model(abstract);分类 cs.CL

AI总结 提出TerraMARS管道,结合领域自适应小语言模型,从火星科学文献中提取结构化信息,支持地球化改造研究。

Comments 16 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20231 2026-06-19 cs.AI cond-mat.stat-mech cs.IT math-ph math.IT math.MP nlin.AO 新提交 70%

Thermodynamic Measure of Intelligence

智能的热力学度量

Ishanu Chattopadhyay

机构 * Institute for Biomedical Informatics, University of Kentucky(肯塔基大学生物医学信息学研究所) Department of Computer Science, University of Kentucky(肯塔基大学计算机科学系)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出智能是稀有但有效未来的合法放大,通过递归自模拟实现,并给出热力学度量,证明该结构对高智能必要且近乎充分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19893 2026-06-19 cs.LG 版本更新 70%

EQPO: Equitable Group Relative Policy Optimization for Clinical Reasoning

EQPO: 面向临床推理的公平群体相对策略优化

Shiqi Dai, Wei Dai, Jiaee Cheong, Paul Pu Liang

机构 * MIT(麻省理工学院) Harvard University(哈佛大学)

专题命中 领域大模型 :foundation model(abstract);post-training(abstract);分类 cs.LG

AI总结 提出EQPO分层强化学习方法,通过自适应重加权样本促进异质临床人群的均衡学习,在7个诊断基准上降低F1标准差43.9%,缩小预测公平差距27.2%。

Comments Accepted as Oral on NeurIPS 2025 GenAI4Health Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18506 2026-06-18 cs.LG eess.SP stat.AP 新提交 70%

Beyond AHI: An Interpretable Causal-Discovery-Guided Framework for Sleep Recovery in Connected Health

超越AHI:一种可解释的因果发现引导的睡眠恢复框架在互联健康中的应用

Saba A. Farahani, Elahe Khatibi, Manoj Vishwanath, Amir M. Rahmani, Hung Cao

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 提出一种可解释的因果发现引导框架,从多模态PSG中推导层次化睡眠恢复评分(SRS),在两大队列中SRS与感知恢复的关联强度是AHI的2.5倍。

Comments 6 pages, 2 figures, 2 tables. Accepted at the 2nd Workshop on Sensing and Computing for Smart and Connected Health (SCH), co-located with IEEE/ACM CHASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18256 2026-06-18 cs.HC cs.AI 新提交 70%

Dynamic In-Group Persona Generation for Enhancing Human-AI Rapport

动态内群体人格生成以增强人机融洽关系

Yoonseok Oh, Inseo Jung, Jinkyu Kim, Jungbeom Lee, Minwoo Kang, Suhong Moon

机构 * Korea University(韩国大学) Kakao Mobility University of California, Berkeley(加州大学伯克利分校)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 提出一种动态内群体人格生成方法,通过识别用户主要关切并生成共享相似关切的内群体人格,显著提升人机融洽关系,实验表明该方法优于无人格条件和最小自我表露基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15504 2026-06-18 cs.AI 新提交 70%

Toward Vibe Medicine: A Self-Evolving Multi-Agent Framework for Clinical Decision Support

迈向振动医学:一种用于临床决策支持的自演化多智能体框架

Qianxue Zhang, Yiming Ren, Shihuan Qin, Xiao Zhang, Liao Zhang, Jinyang Huang, Zhengliang Liu, Chenbin Liu, Hongying Feng, Jingyuan Chen, Yuzhen Ding, Weihang You, Hanqi Jiang, Yi Pan, Yifan Zhou, Junhao Chen, Lifeng Chen, Wei Liu, Tianming Liu, Zengren Zhao, Lian Zhang

机构 * Medical AI Lab, The First Hospital of Hebei Medical University(河北医科大学第一医院医学人工智能实验室) Hebei Provincial Engineering Research Center for AI-Based Cancer Treatment Decision-Making, The First Hospital of Hebei Medical University(河北省人工智能癌症治疗决策工程研究中心,河北医科大学第一医院) State Key Laboratory of Neurology and Oncology Drug Development(神经与肿瘤药物研发国家重点实验室) School of Computing, University of Georgia(佐治亚大学计算学院) Department of Radiation Oncology, National Cancer Center/National Clinical Research Center for Cancer/Cancer Hospital and Shenzhen Hospital, Chinese Academy of Medical Sciences and Peking Union Medical College(中国医学科学院北京协和医学院国家癌症中心/国家肿瘤临床医学研究中心/肿瘤医院深圳医院放射治疗科) Department of Radiation Oncology, Mayo Clinic(梅奥诊所放射肿瘤科) College of Mechanical and Power Engineering, China Three Gorges University(三峡大学机械与动力工程学院) Department of Radiation Oncology, Guangzhou Concord Cancer Center(广州康华肿瘤中心放射治疗科) Gastrointestinal Disease Diagnosis and Treatment Center, The First Hospital of Hebei Medical University(河北医科大学第一医院胃肠疾病诊疗中心) Department of General Surgery, The First Hospital of Hebei Medical University(河北医科大学第一医院普通外科)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出VIBEMed多智能体框架,通过自演化机制和架构级安全沙箱,从交互历史中动态学习,实现个性化临床决策支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14288 2026-06-18 astro-ph.CO cs.AI cs.CE gr-qc hep-th 版本更新 70%

DeepInflation: an AI agent for research and model discovery of inflation

DeepInflation:用于暴胀研究与模型发现的AI智能体

Ze-Yu Peng, Hao-Shi Yuan, Qi Lai, Jun-Qian Jiang, Gen Ye, Jun Zhang, Yun-Song Piao

机构 * School of Physical Sciences, University of Chinese Academy of Sciences, Beijing 100049, China International Centre for Theoretical Physics Asia-Pacific, University of Chinese Academy of Sciences, 100190 Beijing, China Taiji Laboratory for Gravitational Wave Universe, University of Chinese Academy of Sciences, 100049 Beijing, China School of Fundamental Physics Mathematical Sciences, Hangzhou Institute for Advanced Study, UCAS, Hangzhou 310024, China Institute of Theoretical Physics, Chinese Academy of Sciences, P.O. Box 2735, Beijing 100190, China D\' e partement de Physique Th\' e orique, Universit\' e de Gen\` e ve, 24 quai Ernest-Ansermet, CH-1211 Gen\` e ve 4, Switzerland

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出基于多智能体架构的AI智能体DeepInflation,集成大语言模型、符号回归引擎和检索增强生成知识库,自动发现与最新观测一致的单场慢滚暴胀势,并解释理论背景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07375 2026-06-18 cs.CL cs.SD eess.AS 版本更新 70%

TurnGuide: Enhancing Meaningful Full Duplex Spoken Interactions via Dynamic Turn-Level Text-Speech Interleaving

TurnGuide: 通过动态轮次级文本-语音交错增强有意义的全双工口语交互

Wenqian Cui, Lei Zhu, Xiaohui Li, Zhihan Guo, Haoli Bai, Lu Hou, Irwin King

机构 * The Chinese University of Hong Kong(香港中文大学) Huawei Technologies(华为技术)

专题命中 领域大模型 :language model(abstract);foundation model(abstract);分类 cs.CL

AI总结 提出TurnGuide方法,通过动态分割助手语音为对话轮次并交错生成轮次级文本和语音,解决全双工语音语言模型在连续双通道音频中集成离散文本令牌导致的时间对齐问题,显著提升语义连贯性和轮次交互性能。

Comments Interspeech 2026 Long Paper Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00567 2026-06-18 cs.IR cs.AI 版本更新 70%

Improving Scientific Document Retrieval with Academic Concept Index

利用学术概念索引改进科学文献检索

Jeyun Lee, Junhyoung Lee, Wonbin Kweon, Bowen Jin, Yu Zhang, Susik Yoon, Dongha Lee, Hwanjo Yu, Jiawei Han, Seongku Kang

机构 * Korea University Seoul South Korea University of Illinois Urbana-Champaign Champaign United States Texas A\&M University College Station United States Yonsei University Seoul South Korea Pohang University of Science Korea University University of Illinois Urbana-Champaign Texas A\&M University Yonsei University

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对通用检索器在科学领域因词汇和需求不匹配而表现不佳的问题,提出基于学术概念索引的方法,通过概念覆盖查询生成和概念聚焦上下文扩展,提升查询质量和检索性能。

Comments Accepted for publication in ACM TIST, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26195 2026-06-17 cs.CR cs.AI 版本更新 70%

CyberEvolver: Structured Self-Evolution for Cybersecurity Agents On the Fly

CyberEvolver:面向网络安全代理的即时结构化自我进化

Yihe Fan, Changyi Li, Lichen Xu, Xudong Pan, Jiarun Dai, Hong Geng, Min Yang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Pudong Research Institute of Cryptology(上海浦东密码研究院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 提出CyberEvolver框架,通过四层可进化架构、痕迹诊断机制和种群波束搜索,实现网络安全代理基于失败经验的支架自我进化,平均成功率提升13.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16626 2026-06-16 cs.HC cs.AI 新提交 70%

Using AI in engineering education: a balancing act, driven by clear purpose

在工程教育中使用AI:基于明确目的的平衡行为

Olya Kudina

机构 * TU Delft(代尔夫特理工大学) North-West University(北开普大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 基于对100名高等教育学生(主要来自工程领域)的问卷调查和文献综述,探讨学生如何使用和看待大语言模型(LLMs),并主张在工程教育中采用目的驱动、情境敏感的AI整合方法。

Comments To appear in The Routledge Handbook of the Philosophy of Engineering, 2nd ed. Edited By Diane P. Michelfelder, Neelke Doorn

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06173 2026-06-16 cs.IR cs.AI 版本更新 70%

Beyond Case Law: Evaluating Structure-Aware Retrieval and Safety in Statute-Centric Legal QA

超越判例法:评估法规中心型法律问答中的结构感知检索与安全性

Kyubyung Chae, Jewon Yeom, Jeongjae Park, Seunghyun Bae, Ijun Jang, Hyunbin Jin, Jinkwan Jang, Taesup Kim

机构 * Graduate School of Data Science, Seoul National University(数据科学研究生院,首尔国立大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对法规中心型法律问答中层级检索困难与模型幻觉问题,提出结构-安全感知基准SearchFireSafety,通过图引导检索提升性能,但揭示领域适应模型在证据缺失时更易幻觉。

Comments Accepted to ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21613 2026-06-16 cs.IR cs.AI 版本更新 70%

AgenticRec: A Recommendation-Oriented Agentic Framework with Progressive Tool-Integrated Reasoning Optimization

AgenticRec:面向推荐的智能体框架与渐进式工具集成推理优化

Tianyi Li, Zixuan Wang, Guidong Lei, Xiaodong Li, Hui Li

机构 * Xiamen University(厦门大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出AgenticRec框架,将推荐建模为工具集成推理过程,并设计两阶段训练范式,通过隐式反馈激活和渐进偏好细化提升推荐准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13931 2026-06-15 cs.CL 新提交 70%

DLawBench: Evaluating LLMs Through Multi-Turn Legal Consultation

DLawBench: 通过多轮法律咨询评估大语言模型

Li Zhang, Yuzhen Shi, Yiran Hu, Jingwen Zhang, Wenbo Lv, Yubo Ma, Wei Wang, Rongyao Shi, Yuanyang Qiu, Xinran Xu, Yuemeng Qi, Linlin Miao, Jaromir Savelka, Yun Liu, Kevin Ashley, Bing Zhao, Hu Wei, Lin Qu

机构 * University of Pittsburgh(匹兹堡大学) Alibaba Group(阿里巴巴集团) University of Waterloo(滑铁卢大学) Shandong University(山东大学) Skylenage China University of Political Science and Law(中国政法大学) Qwen Team, Alibaba Group(阿里巴巴集团Qwen团队) Fordham University(福特汉姆大学) Shanghai Jiao Tong University(上海交通大学) Carnegie Mellon University(卡内基梅隆大学) Tsinghua University(清华大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出DLawBench基准,通过模拟四种客户类型(合作、依赖、退缩、对抗)的多轮对话,评估大语言模型在真实法律咨询中的交互能力。

Comments 37 pages, 8 figures, 26 tables. Code and data: https://github.com/SKYLENAGE-AI/DLawBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16073 2026-06-15 cs.CL 版本更新 70%

ClaimFlow: Tracing the Evolution of Scientific Claims in NLP

ClaimFlow: 追踪自然语言处理中科学主张的演变

Aniket Pramanick, Yufang Hou, Saif M. Mohammad, Iryna Gurevych

机构 * Ubiquitous Knowledge Processing Lab (UKP Lab)(通用知识处理实验室) Department of Computer Science and Hessian Center for AI (hessian.AI)(计算机科学系和海斯曼人工智能中心) Technische Universität Darmstadt(德累斯顿技术大学) IT:U Interdisciplinary Transformation University Austria(奥地利跨学科转型大学) National Research Council Canada(加拿大国家研究委员会)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出ClaimFlow框架,通过标注1617篇论文中的5689个主张和4871个跨论文关系,定义主张关系分类任务,并分析NLP领域主张的演变模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13211 2026-06-12 cs.AI 新提交 70%

Hallucination in Medical Imaging AI: A Cross-Modality Analytical Framework for Taxonomy, Detection, and Mitigation under Regulatory Constraints

医学影像AI中的幻觉:跨模态分析框架用于分类、检测与监管约束下的缓解

Omar Alshahrani, Muzammil Behzad

机构 * King Fahd University of Petroleum & Minerals, Saudi Arabia(沙特阿拉伯法赫德国王石油矿产大学) SDAIA-KFUPM Joint Research Center for Artificial Intelligence, Saudi Arabia(沙特阿拉伯SDAIA-KFUPM人工智能联合研究中心)

专题命中 领域大模型 :foundation model(abstract);prompting(abstract);分类 cs.AI

AI总结 本文提出跨模态分析框架,统一五种影像模态的幻觉分类、检测与缓解策略,发现通用基础模型在幻觉基准上优于医学专用模型,并映射到FDA全生命周期监管。

详情

展开后加载摘要…

URL PDF HTML 收藏