arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 397 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 397 篇

2607.13357 2026-07-24 cs.HC 版本更新 86%

TANDE: Disentangling Verbal and Nonverbal Backchannels in Emotional AI-Avatar Conversations with Young Adults

TANDE:在与年轻人的情感人工智能-虚拟化身对话中区分言语和非言语反馈渠道

Ann-Kareen Gedeus, Jack Good, Nadine Wagener, Angelique Taylor

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 研究在与年轻人的情感人工智能-虚拟化身对话中反馈渠道模式的影响,引入TANDE这个由LLM驱动的ECA,通过实验探讨其对融洽关系、同理心和参与度的作用及性别差异,得出相关设计启示。

Comments This paper has been accepted for publication at the 28th ACM International Conference on Multimodal Interaction (ICMI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13317 2026-06-25 cs.CL cs.AI cs.CY cs.LG cs.SI 版本更新 86%

Paid Voices vs. Public Feeds: Interpretable Cross-Platform Theme-Based Analysis of Climate Discourse

付费声音 vs. 公共信息流:可解释的跨平台主题式气候话语分析

Samantha Sudhoff, Pranav Perumal, Zhaoqing Wu, Tunazzina Islam

机构 * Department of Computer Science, Purdue University(普渡大学计算机科学系)

专题命中 其他LLM :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出可解释的主题发现流程,通过语义聚类和LLM标注,比较Meta付费广告与Bluesky公共帖子中的气候话语,发现两者在主题、语气和焦点上存在系统性差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29064 2026-08-11 cs.CL cs.CV cs.HC cs.MA 版本更新 85%

Persona Prompting in Multimodal Urban Perception: Descriptive Convergence and Interpretive Variation

分析多模态大语言模型代理在城市感知中生成解释的角色效应

Neemias da Silva, Matt Ratto, Myriam Delgado, Rodrigo Minetto, Daniel Silver, Thiago H Silva

机构 * Universidade Tecnologica Federal do Parana(巴西南里奥格兰德联邦技术大学) University of Toronto(多伦多大学)

专题命中 其他LLM :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 通过对比不同角色提示和无角色设置下多模态大语言模型生成的文本,发现标题描述趋同,但理由描述随社会经济和政治属性系统变化,感知标签无显著差异。

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17192 2026-08-03 cs.AI 版本更新 85%

Shall We Play a Game? Language Models for Open-ended Wargames

我们要玩一场游戏吗?用于开放式兵棋推演的语言模型

Glenn Matlin, Isaac Song, Yixiong Hao, Parv Mahajan, Evan Montoya, Ryan Bard, Stuart R. Topp, Anthony Wen-Ming Zang, Mohammed Rehan Parwani, Soham Shetty, Mark Riedl

专题命中 其他LLM :language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究通过对223篇相关论文的范围综述,明确了兵棋推演中语言模型的控制角色现状,指出需关注模型对行动与后果的控制程度以保障模拟保真度。

Comments 49 pages (9-page body), 3 figures. Published at the Social Sim'26 Workshop at COLM 2026 (non-archival)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06543 2026-08-04 cs.CL cs.LG 版本更新 85%

The Illusion of Stochasticity in LLMs

大语言模型中的随机性错觉

Xiangming Gu, Soham De, Michalis Titsias, Larisa Markeeva, Petar Veličković, Razvan Pascanu

机构 * Google DeepMind(谷歌DeepMind) National University of Singapore(新加坡国立大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究指出大语言模型作为智能体在随机采样方面存在根本性缺陷,通过多模型家族和分布的实证分析揭示了这一问题。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10341 2026-06-09 cs.LG cs.CL 版本更新 85%

Formalizing Learning from Language Feedback with Provable Guarantees

从语言反馈中学习的形式化与可证明保证

Wanqiao Xu, Allen Nie, Ruijie Zheng, Aditya Modi, Adith Swaminathan, Ching-An Cheng

机构 * University of California, Berkeley(加州大学伯克利分校) University of Washington(华盛顿大学) University of Toronto(多伦多大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文形式化语言反馈学习问题,提出转移埃尔泽维度刻画学习难度,并开发无遗憾算法HELiX,证明其性能保证,展示丰富语言反馈可指数级加速学习。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04619 2026-08-11 cs.LG cs.AI cs.CL cs.HC 版本更新 85%

Transformer Explainer: Learning LLM Transformers with Interactive Visual Explanation and Experimentation

Transformer解释器:通过交互式可视化解释与实验学习大型语言模型Transformer

Aeree Cho, Grace C. Kim, Alexander Karpekov, Seongmin Lee, Alec Helbling, Benjamin Hoover, Zijie J. Wang, Minsuk Kahng, Duen Horng Chau

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 针对非专家难以学习Transformer的问题,本文推出交互式可视化工具Transformer Explainer,可在浏览器运行GPT-2实例支持实验,经90人研究验证其提升理解与参与度的优势,已获超49万用户使用。

Comments CHI 2026 full paper. Extended version of the 2-page paper presented at IEEE VIS 2024, which won Best Poster Award and remains available as arXiv v1. Project page: https://poloclub.github.io/transformer-explainer/

Journal ref CHI '26: Proceedings of the 2026 CHI Conference on Human Factors in Computing Systems, Article 7 (2026), 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17848 2026-07-14 cs.CR cs.SE 版本更新 85%

RISKTAGGER: Evidence-Guided LLM Agent for Post-Incident Forensic Analysis of Money Laundering in Web3

RISKTAGGER:用于Web3中洗钱事件后法医分析的证据引导大语言模型智能体

Dan Lin, Yanli Ding, Weipeng Zou, Jiajing Wu, Zhiyin Wu, Jiachi Chen, Xiapu Luo, Zibin Zheng

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 针对Web3加密货币洗钱法医分析面临的挑战,提出RISKTAGGER,将大语言模型作为证据约束决策组件,从公共事件材料提取线索,递归扩展资金流图并生成报告。经多案例评估,能恢复资金路径、识别风险账户,组织证据成可验证报告。

Comments 11 pages(main text), 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04630 2026-07-07 cs.SE 版本更新 85%

Foundation Models for Software Engineering of Cyber-Physical Systems: the Road Ahead

网络物理系统软件工程的基础模型:未来之路

Chengjie Lu, Pablo Valle, Jiahui Wu, Erblin Isaku, Hassan Sartaj, Aitor Arrieta, Shaukat Ali

专题命中 其他LLM :foundation model(title,abstract);large language model(abstract);language model(abstract)

AI总结 探讨基础模型在网络物理系统软件工程中的应用,指出除语言模型外其他模型潜力大。通过文献等得出前瞻性研究路线图,突出挑战与机会,还讨论了应用模型的常见挑战,为研究和实践提供指导。

Comments 3 figures, 20 tables, 53 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17139 2026-07-01 cs.CL cs.IR 版本更新 84%

Rethinking On-policy Optimization for Query Augmentation

重新思考查询增强的在线策略优化

Zhichao Xu, Shengyao Zhuang, Xueguang Ma, Bingsen Chen, Yijun Tian, Fengran Mo, Tao Li, Jie Cao, Vivek Srikumar

机构 * University of Utah(犹他大学) The University of Queensland(昆士兰大学) University of Waterloo(滑铁卢大学) New York University(纽约大学) University of Notre Dame(圣母大学) Université de Montréal(蒙特利尔大学) Google DeepMind(谷歌DeepMind) University of Oklahoma(俄克拉荷马大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文系统比较了基于提示和强化学习的查询增强方法,发现计算量感知下简单方法常优于RL方法,并提出混合方法OPQE,通过RL生成伪文档以最大化检索性能。

Comments TMLR camera ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09767 2026-08-06 cs.HC 版本更新 83%

LLMs are the Ideal Candidate for Mixed-Initiative Game Design Pillar Workflows

LLMs是混合倡议游戏设计支柱工作流的理想候选人

Julian Geheeb, Marvin Julian Schwarz, Daniel Dyrda, Georg Groh

专题命中 其他LLM :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文探讨了LLM在游戏设计支柱工作流中的应用,提出SPINE原型,并通过实验验证其在早期开发阶段的价值,展示了LLM在生成和决策过程中的有效性。

Comments 10 pages, 1 figure, 3 tables. 6 pages appendix, 13 tables

Journal ref Proceedings of the 21st International Conference on Foundations of Digital Games (FDG '26), Copenhagen, Denmark, August 10-13, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17178 2026-08-20 cs.CR cs.AI cs.AR 版本更新 83%

TrojanGYM: A Detector-in-the-Loop LLM for Adaptive RTL Hardware Trojan Insertion

TrojanGYM:一种检测器在环的大语言模型用于自适应RTL硬件木马插入

Saideep Sreekumar, Zeng Wang, Akashdeep Saha, Weihua Xiao, Minghao Shao, Muhammad Shafique, Ozgur Sinanoglu, Ramesh Karri, Johann Knechtel

机构 * NYU Tandon School of Engineering(纽约大学Tandon工程学院) NYU Abu Dhabi(纽约大学阿布扎克分校)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 提出TrojanGYM框架,利用大语言模型智能体自动生成多样化的硬件木马,暴露基于GNN的检测器盲点,并设计鲁棒检测器Robust-GNN4TJ,在生成的基准上将检测率从0%提升至60%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13993 2026-08-06 cs.CL 版本更新 83%

The Holistic Storage of Verb+Up Phrases in Text-based and Audio-based Language Models

文本和音频语言模型中动词+up短语的整体存储

Zachary Nicholas Houghton, Yu Zhou, Dan Pluth, Jordan Hosier, Vijay K. Gurbani

机构 * University of Oregon(俄勒冈大学) Vail Systems, Inc(Vail Systems公司)

专题命中 其他LLM :language model(title,abstract);LLM(abstract_cn);分类 cs.CL

AI总结 研究文本和音频语言模型对动词+up短语的整体存储,发现频率和可预测性驱动独立表征,支持基于使用的语言理论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02356 2026-08-05 cs.AI 版本更新 83%

SkillTrace: Traversing a Query-Skill Graph for Composable LLM Agents

SkillTrace:遍历查询-技能图以构建可组合的大语言模型智能体

Yue Yao, Shengyuan Wang, Xin Chen, Minke Zhang, Jia He, Bingjun Luo, Tom Gedeon

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 SkillTrace通过查询-技能图的三个层级关系实现技能组合,在SkillsBench和ALFWorld上取得SOTA性能,且对不同骨干语言模型具备通用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28360 2026-08-04 cs.AI 版本更新 83%

Prompt Codebooks: Discrete Compositional Optimization for Language Model Instruction Refinement

提示码本:面向语言模型指令精炼的离散组合优化

Jyotirmoy Nath, Neeraj Kumar, Brejesh Lall

机构 * IIT Delhi(印度德里理工学院)

专题命中 其他LLM :language model(title);LLM(abstract,abstract_cn);分类 cs.AI

AI总结 提出Prompt Codebooks (PCO)框架,将自动提示优化重构为离散组合学习,通过可重用的自然语言本能单元实现实例级路由和结构化反馈,在多个基准上提升性能并压缩提示长度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00847 2026-08-03 cs.GT cs.AI 版本更新 83%

Pay for The Second-Best Service: A Game-Theoretic Approach Against Dishonest LLM Providers

为次优服务付费:一种对抗不诚实大语言模型提供者的博弈论方法

Yuhan Cao, Yu Wang, Sitong Liu, Miao Li, Yixin Tao, Tianxing He

机构 * Shanghai Qi Zhi Institute(上海启智研究院) ShanghaiTech University(上海科技大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Beijing Institute for General Artificial Intelligence(北京通用人工智能研究院) Shanghai University of Finance(上海财经大学) Tsinghua University(清华大学)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一种博弈论方法,通过设计近似激励相容机制,解决大语言模型服务提供者可能存在的不诚实行为问题,并保证用户效用的次优性。

Comments Published as a conference paper at WWW 2026; 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04260 2026-07-28 cs.HC cs.AI 版本更新 83%

Steerable Chatbots: Exploring Personalization Control Interfaces via LLM Activation Steering

可控聊天机器人:通过大语言模型激活引导探索个性化控制界面

Jessica Y. Bo, Tianyu Xu, Ishan Chatterjee, Katrina Passarella-Ward, Achin Kulshrestha, D Shin

机构 * University of Toronto(多伦多大学) Google AR(谷歌AR)

专题命中 其他LLM :LLM(title,abstract);prompting(abstract);分类 cs.AI

AI总结 研究探索可控聊天机器人范式,通过激活引导实现个性化,利用线性标量控制偏好表达强度,设计三种界面原型并进行用户研究,发现其在冷启动任务中比单独提示更能契合用户偏好,揭示了相关个性化方面的不同价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18798 2026-07-16 cs.MM cs.AI 版本更新 83%

ELF: A Family of Encoder-Free ECG-Language Models

ELF:无编码器心电图语言模型家族

William Han, Tony Chen, Chaojing Duan, Xiaoyu Song, Yihang Yao, Yuzhe Yang, Michael A. Rosenberg, Emerson Liu, Ding Zhao

机构 * Carnegie Mellon University(卡内基梅隆大学) Allegheny Health Network(阿勒格尼医疗网络) University of California Los Angeles(加州大学洛杉矶分校) University of Colorado(科罗拉多大学) Allergy and Immunology(过敏与免疫学)

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.AI

AI总结 提出三种无编码器架构的ECG语言模型ELF,简化架构和训练流程,在两个数据集上达到或超越现有最优模型。

Comments 34 pages, 12 figures; Accepted to MLHC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07500 2026-06-23 cs.LG cs.IT math.IT 版本更新 83%

Black-Box Detection of LLM-Generated Text Using Generalized Jensen-Shannon Divergence

基于广义吉辛森-香农散度的LLM生成文本黑盒检测

Shuangyi Chen, Ashish Khisti

机构 * Department of Electrical and Computer Engineering, University of Toronto, Toronto, Canada(电子与计算机工程系,多伦多大学,多伦多,加拿大)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.LG

AI总结 本文提出SurpMark检测器,通过文本token意外性动态总结,利用广义吉辛森-香农散度衡量测试文本与人类和机器生成文本的差异,验证了其在不同领域和生成器上的鲁棒性。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10842 2026-06-09 cs.SE cs.AI 版本更新 83%

Resilient Write: A Six-Layer Durable Write Surface for LLM Coding Agents

抗挫写入:一种六层耐用写入表面用于大语言模型编码代理

Justice Owusu Agyemang, Jerry John Kponyo, Elliot Amponsah, Godfred Manu Addo Boakye, Kwame Opuni-Boachie Obour Agyekum

机构 * Sperixlabs, Ghana(塞普里克斯实验室,加纳) Kwame Nkrumah University of Science and Technology, Kumasi, Ghana(库马西技术大学,加纳) VIA Cybersecurity Lab, Kwame Nkrumah University of Science and Technology, Kumasi, Ghana(VIA网络安全实验室,库马西技术大学,加纳)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文提出Resilient Write,通过六层耐用写入表面提升编码代理在文件写入时的容错能力,减少恢复时间并提高自我纠正率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06114 2026-08-20 cs.CL cs.AI 版本更新 82%

Making Implicit Premises Explicit in Logical Understanding of Enthymemes

在演绎推理中显式化隐含前提

Xuyao Feng, Anthony Hunter

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种整合大型语言模型和神经符号推理器的管道,用于将隐含前提显式化并解码逻辑蕴含。

Comments Accepted at the 17th International Conference on Scalable Uncertainty Management (SUM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26998 2026-08-12 cs.CR cs.CL cs.LG 版本更新 82%

AgentSnare: Learning to Delay, Divert, and Defuse Autonomous Penetration Agents

AgentSnare:学习延迟、转移和瓦解自主渗透智能体

Ruoyu Wang, Heng Zhao, Renjie Wu, Mengnan Zhao, Zhixuan Chu, Wanyu Lin, Tianhang Zheng

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 AgentSnare是一种轨迹自适应欺骗系统,通过动态构建诱饵环境,吸收渗透智能体工具调用、转移其轨迹并瓦解攻击,在CVE-Bench实验中成功阻止了所有真实目标被利用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.05000 2026-07-21 cs.LG cs.AI 版本更新 82%

Automated Reinforcement Learning: An Overview

自动化强化学习:综述

Reza Refaei Afshar, Joaquin Vanschoren, Uzay Kaymak, Rui Zhang, Yaoxin Wu, Wen Song, Yingqian Zhang

机构 * Eindhoven University of Technology(埃因霍温理工大学) Jheronimus Academy of Data Science(赫尔蒙尼乌斯数据科学学院) Shandong University(山东大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文综述了自动化强化学习的发展,包括基于大语言模型的技术,并探讨了其挑战和未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16398 2026-07-01 cs.CY cs.CL cs.LG 版本更新 82%

White-Box Sensitivity Auditing with Steering Vectors

白盒敏感性审计与引导向量

Hannah Cyberey, Yangfeng Ji, David Evans

机构 * University of Virginia(弗吉尼亚大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出白盒敏感性审计框架,通过激活引导进行更严格的模型内部评估,用于检测大语言模型中的偏见,揭示模型对保护属性的依赖。

Comments Accepted to Transactions on Machine Learning Research (TMLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01656 2026-06-12 cs.CL cs.AI cs.CY cs.HC physics.soc-ph 版本更新 82%

Authorship Attribution in Multilingual Machine-Generated Texts

多语言机器生成文本的作者归属

Lucio La Cava, Dominik Macko, Róbert Móro, Ivan Srba, Andrea Tagarelli

机构 * DIMES Department, University of Calabria(卡利博大学DIMES系) Kempelen Institute of Intelligent Technologies(智能技术研究所)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出多语言作者归属问题,研究单语言方法在18种语言和8个生成器上的跨语言迁移能力,发现显著局限。

Comments Accepted at ACL 2026 - Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01567 2026-06-09 cs.CR cs.AI cs.CL 版本更新 82%

Defenses & Enablers For Skill Injection Attacks on Terminal Based Agents

针对终端代理的技能注入攻击的防御与使能因素

Yoshinari Fujinuma, Varun Gangal, Traian Rebedea, Makesh Narsimhan Sreedhar, Prasoon Varshney, Rebecca Qian, Anand Kannappan

机构 * Patronus AI NVIDIA

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究基于大语言模型的代理在重用技能时面临的安全威胁,提出守护者防御(动态和静态)将攻击成功率降低过半,并测试了攻击重述的鲁棒性。

Comments First version, small updates and clarifications likely in v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02096 2026-08-14 cs.SE 版本更新 82%

Foundation Models as Oracles for Refactoring Correctness Detection

基础模型作为重构正确性检测的神谕

Rohit Gheyi, Rian Melo, Jonhnanthan Oliveira, Marcio Ribeiro, Baldoino Fonseca

专题命中 其他LLM :foundation model(title,abstract);prompting(abstract)

AI总结 研究评估基础模型在Java程序重构错误检测中的有效性,通过零样本提示测试226个真实重构错误,GPT-5.4达到93.8%准确率,模型可提供解释并跨重构类型工作。

Comments Accepted for publication in Empirical Software Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00299 2026-08-06 cs.HC 版本更新 82%

ReVoicer: Conversational Voice Annotation for Human-Centered, LLM-Assisted Peer Review

ReVoicer:以人为中心、由大语言模型辅助的同行评审对话式语音标注系统

Matt Gottsacker, Ahinya Alwin, Hiroshi Furuya, Robert W. Lindeman, Gerd Bruder, Gregory F. Welch

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract)

AI总结 该研究提出ReVoicer原型系统,支持评审人员阅读论文时对话式语音标注,借助大语言模型润色、分类并锚定评论,最终基于评审人员自身评论生成符合风格指南的评审意见,计划与ISMAR社区开展评估。

Comments IEEE ISMAR 2026 Alt'ISMAR workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24343 2026-08-03 cs.LG cs.AI cs.CL 版本更新 82%

Beyond Aggregate Risk: Role-Stratified Conformal Risk Control for LLM Tool Calls

超越总体风险:用于大语言模型工具调用的角色分层共形风险控制

Md Ashikur Rahman, Md Arifur Rahman, Niamul Hassan Samin, Khandaker Rifah Tasnia, Md Hasibul Amin, Sifat Rahman Ahona, Juena Ahmed Noshin

专题命中 其他LLM :LLM(title);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究大语言模型工具调用中参数的不同风险,提出角色分层共形风险控制方法,为语义参数角色设阈值和预算,实验表明该方法能有效实现特定角色预算合规,证明应在语义角色层面认证结构化工具调用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17394 2026-07-28 cs.HC 版本更新 82%

TaskArtisan: Designing Composable Generative Widgets for LLM-Assisted Analysis

TaskArtisan:为大语言模型辅助分析设计可组合的生成式小部件

Meng Chen, Amy Pavel

专题命中 其他LLM :LLM(title,abstract);prompting(abstract)

AI总结 研究探索大语言模型辅助分析中生成式用户界面带来的新机会。通过采访、分析工具及比较研究,发现GUI利弊,总结权衡形成临时设计框架,为未来大语言模型辅助分析工作流程中的生成式用户界面设计提供参考。

Comments Accepted to the 2026 IEEE Symposium on Visual Languages and Human-Centric Computing (VL/HCC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏