Empowering Economic Simulation Through Situation-Aware Llm-Driven Generative System
通过情境感知的LLM驱动生成系统赋能经济模拟
专题命中 其他LLM :LLM(title,title_cn)
AI总结 提出SAMAS系统,利用大语言模型嵌入宏观经济理解和模拟轨迹,联合建模宏观结构与微观动态,提升波动真实性和拐点预测能力。
Comments ICASSP 2026
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
通过情境感知的LLM驱动生成系统赋能经济模拟
专题命中 其他LLM :LLM(title,title_cn)
AI总结 提出SAMAS系统,利用大语言模型嵌入宏观经济理解和模拟轨迹,联合建模宏观结构与微观动态,提升波动真实性和拐点预测能力。
Comments ICASSP 2026
Moodie:基于LLM的聊天机器人支持错失恐惧症的早期设计探索
专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)
AI总结 提出基于大语言模型的聊天机器人Moodie,通过情绪调节支持减少错失恐惧症,初步评估显示其相比通用模型能提高用户参与度和社交连接。
Comments 7 pages, 1 figure, 1 table. Preliminary work submitted to the ACM CUI 2026 Works-in-Progress (WiP) track
健康科学领域中用于人类三重盲同行评审的本地AI预筛选
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 该研究针对健康科学领域同行评审的AI滥用问题,提出三重盲多LLM本地预筛选框架,保留人类最终裁决权,可减少评审延迟且更透明合规。
Comments 16 pages, 1 figure
MDB-Link:面向多数据库Text-to-SQL的分层模式链接方法
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 本文针对多数据库Text-to-SQL场景提出分层模式链接框架MDB-Link,结合LLM实现数据库定位与列选择,在多个数据集上性能及运行速度均优于基线方法,可高效支撑SQL生成。
用于分布式并行AI程序验证的定向神经符号随机执行
机构 * Quandary Peak Research(昆达里峰研究院)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 针对分布式并行AI程序的可靠性缺口,提出DNSSE混合测试框架,结合LLM调度预测与符号约束求解等,实现更优的并发bug检测率与分支覆盖率。
Comments 1 Figure, 1 Algorithm, 1 Figure, 2 Tables
QuanTiMedAI:由智能体人工智能引导的量子增强时间序列模型用于心脏骤停死亡率预测
机构 * North South University(北南大学) ; Memorial University(纪念大学)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 该研究针对心脏骤停死亡率预测的静态数据局限,提出QuanTiMedAI量子-智能体框架,结合智能体LLM与量子循环网络,在MIMIC-IV数据集上仅用605个参数实现0.852的AUROC,优于现有最先进基线。
Comments Submitted for review
模型收敛与人类分歧:开放式生成中分布多元性的覆盖框架
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 本文针对LLM与人类写作间的分布差距问题,提出以人类写作经验分布为基准的框架,通过LLM-Cov和IBR指标测量LLM生成内容的分布广度,发现当前LLM内容合理但狭窄,可用于评估其“文化覆盖范围”。
Comments 18 pages, 4 figures
AutoFOAM:自优化自主OpenFOAM智能体
机构 * SimuNetics ; Onnes Cryogenics ; Quasi AI
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 AutoFOAM是基于Qwen-coder 2.5-14B微调的自主LLM智能体,通过7阶段迭代循环及三种抗退化机制,可基于自然语言指令完成OpenFOAM模拟,助力CFD工作流程普及与快速原型开发。
人类多样性催生了大型语言模型无法模拟或维持的集体创造力
专题命中 其他LLM :large language model(title);language model(title);prompting(abstract);分类 cs.AI
AI总结 该研究通过实验发现,L2写作者的集体多样性优于L1写作者,AI构思会压缩集体多样性而AI润色可保留,模拟显示AI无法达到人类群体的创意多样性,人机协作设计影响人类多样性的存续。
语音信号补充大语言模型用于预测速配中的人际吸引力
机构 * Japan Advanced Institute of Science and Technology(日本先进科学技术学院) ; NTT, Inc.(日本电报电话公司)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 研究利用日语速配对话,结合仅基于转录本的LLM预测与语音预测器预测来估计参与者对约会对象的喜好,发现语音能补充LLM预测,二者结合可提高两两排序准确率,且互补性有条件,还明确了语音预测价值及互补性出现的情况。
Comments Accepted at the 28th ACM International Conference on Multimodal Interaction (ICMI 2026). 16 pages total, including a 7-page supplementary appendix
迈向基于智能体的智能体模型:可行性、性能和统计模型检查
机构 * Sant’Anna School of Advanced Studies Pisa(比萨圣安娜高等研究学校) ; Sapienza University of Rome(罗马第一大学) ; DTU Technical University of Denmark(丹麦技术大学) ; University of Pisa(比萨大学)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 研究引入大语言模型驱动决策对基于智能体模型模拟的影响,以Mesa ABM模型为对象,扩展谢林隔离模型,通过统计模型检查进行分析,实验表明较小本地服务LLM有问题,较大模型通过初步检查,还探讨了统计模型检查的作用。
用于端到端概率地震危险性和风险分析的智能体接口
机构 * Université Paris-Saclay, CentraleSupélec, ENS Paris-Saclay, CNRS, LMPS — Laboratoire de Mécanique Paris-Saclay(巴黎-萨克莱大学、中央超导学院、巴黎-萨克莱高等师范学院、国家科学研究中心、LMPS——巴黎-萨克莱力学实验室) ; GFZ Helmholtz Centre for Geosciences(德国地球科学霍普夫兹中心) ; University of Potsdam, Institute of Geosciences(波茨坦大学、地球科学学院)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 研究针对概率地震危险性和风险分析专家化问题,提出通过开源服务器及MCP构建智能体接口,利用LLM与OpenQuake引擎等协作计算,实现多功能分析,结果与官方值匹配度高且计算快,还能接受自定义GMM并添加新功能,设计层可拓展。
Comments 24 pages, 8 figures
多智能体语言模型无法相互探索
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 研究多智能体系统中LLM智能体相互探索的问题,提出轻量级框架MACE,通过结构化同伴选择促进探索,改善了探索行为和任务性能,凸显当前LLM智能体局限,强调明确引导探索对多智能体自主性的重要性。
拒绝背后:通过行为监控确定护栏激活
机构 * Mindgard ; Lancaster University(兰卡斯特大学)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 提出首个黑盒护栏侦察方法,通过HTTP、词汇和时序信号行为监控检测AI系统中护栏的存在,准确率100%,并能区分护栏拦截与LLM拒绝。
Comments 19 pages, 13 figures, 4 tables
DREAM:通过自回归建模的密集检索嵌入
机构 * The Hong Kong University of Science and Technology(香港科技大学)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 提出DREAM方法,利用冻结LLM的自回归预测损失训练密集检索器,通过注意力机制注入查询-文档相似度,在BEIR和RTEB上优于基线。
眼睛所见,大语言模型所不见:利用人类感知进行对抗性文本攻击
机构 * University of Connecticut(康涅狄格大学) ; University of Tennessee(田纳西大学) ; University of California, Santa Barbara(加州大学圣芭芭拉分校) ; Iowa State University(爱荷华州立大学)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.LG
AI总结 针对LLM内容审核系统忽视人类视觉线索的缺陷,提出人类可感知对抗攻击(HPAA),通过排版操纵嵌入有害内容,在仅三次查询下实现86%人类识别率而机器检测率低于1%。
Comments This work has been accepted for publication at USENIX Security 2026. This paper includes examples of harmful, hateful, or abusive language for research purposes. Reader discretion is advised
通过智能体发现混合结构学习心脏电生理数字孪生
机构 * Rochester Institute of Technology(罗彻斯特理工学院)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 提出LEADS框架,利用LLM智能体在结构化动作空间中迭代发现混合物理-神经模型,实现个性化心脏电生理数字孪生构建,优于人工设计和其他LLM方法。
Comments 10 pages, 4 figures
大型语言模型中地理条件化的意外效应
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 其他LLM :large language model(title);language model(title);LLM(abstract_cn);分类 cs.CL
AI总结 本研究评估了大型语言模型在接收地理中立提示时,因用户元数据中的位置信息导致的地理泄露现象,并发现位置占位符“Unknown”本身也会引发泄露,揭示了用户档案框架的生成条件化效应。
Comments To appear at the Second Workshop on Customizable NLP (CustomNLP4U) at ACL 2026
自评之言:论大语言模型在机器翻译中的口头化置信度
机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) ; Johannes Gutenberg University Mainz(美因茨约翰内斯·古腾堡大学)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 本研究设计了五种无需内部信号的口头化方法提取LLM逐词置信度,并与内部确定性信号比较,发现两者在细粒度错误检测和校准上表现相似但相关性低。
从准社会脚本到自主AI智能体社区中的二元持久性
机构 * University of Utah(犹他大学) ; University of Virginia(弗吉尼亚大学)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 研究自主AI智能体社区中是否存在准社会互动(PSI)线索,通过关键词匹配、少样本LLM标注等方法分析帖子与评论,发现PSI线索与OP再参与及互惠回复结构强相关,并通过二元持久性测试验证了互动层面的PSI脚本与重复二元模式的一致性。
Comments Submitted for review in ARR for EMNLP 2026
智能体AI中的弹性共识
机构 * KTH(瑞典皇家理工学院) ; University of Pennsylvania(宾夕法尼亚大学)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 研究LLM智能体在多智能体系统中的共识问题,发现经典弹性共识理论在LLM智能体中失效,但结合经典滤波器可改善一致性。
你的解嵌入矩阵实际上是文本嵌入的特征透镜
机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) ; Lenovo Group Limited(联想集团有限公司) ; Wuhan University(武汉大学)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 发现LLM文本嵌入与高频词对齐导致语义捕获不足,提出EmbedFilter通过过滤解嵌入矩阵中的高频子空间来增强表示,并实现降维加速检索。
Comments preprint
大语言模型生成的测试套件的覆盖度和变异分数与其有效性相关吗?(可重复性研究)
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 研究大语言模型生成测试套件时,覆盖度和变异分数与有效性的关系。通过重复研究发现其有用性依赖上下文,在不同场景表现不同,且测试套件大小非主要混杂因素,为评估此类测试生成提供指导。
Comments 24 pages, 4 figures, 14 tables. Accepted at ISSTA 2026; to appear in Proceedings of the ACM on Software Engineering (PACMSE), Vol. 3, No. ISSTA, Article ISSTA002
大语言模型增强的合作多智能体强化学习的状态条件稳定化
机构 * National School of Artificial Intelligence (ENSIA)(国立人工智能学院(ENSIA)) ; Cosys-Grettia, Univ Gustave Eiffel(古斯塔夫·埃菲尔大学Cosys-Grettia实验室)
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 研究大语言模型与合作多智能体强化学习集成时训练动态,指出非策略学习中动态更新奖励权重违反平稳假设。提出基于阶段的冻结计划和指数移动平均平滑两种稳定策略并评估,揭示奖励信号平稳性是必要设计约束。
路由感知的专家校准用于混合专家语言模型中的机器遗忘
机构 * Renmin University of China(中国人民大学) ; Tsinghua University(清华大学) ; Zhejiang University(浙江大学) ; Lightstandard
专题命中 其他LLM :language model(title,abstract);LLM(abstract_cn);large language model(abstract);分类 cs.CL、cs.AI
AI总结 针对MoE模型中遗忘数据与保留数据路由不匹配导致遗忘关键专家正则化不足的问题,提出TRACE方法,通过离线激活统计检测遗忘关键专家并重新加权保留损失以校准保留侧激活频率,实验表明在WMDP和MUSE-BOOKS上遗忘-效用权衡提升9%。
GuideFetch:用于辅助机器狗并发导航与物体检索的任务协调框架
机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) ; Hunan University(湖南大学)
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)
AI总结 针对异构辅助机器狗的导航与物体检索并发任务,提出GuideFetch协调框架,通过LLM规划与状态验证提升执行效率,并行执行可缩短41.3%平均总完成时间。
MAG-Bot:一种用于社交机器人检测的多智能体审计框架
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)
AI总结 本研究提出基于LangGraph的多智能体框架MAG-Bot,用于社交机器人检测,通过角色约束的证据分解修正单LLM审计的盲点,在TwiBot-22测试集上显著提升了检测的准确率、召回率与F1值。
搜索还是聊天?对比我们如何了解有争议的话题
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)
AI总结 该研究通过194人参与的众包实验,对比传统搜索与LLM聊天界面对学习有争议话题的影响,发现工具无显著差异,用户特征对学习结果影响更大。
罕见异常失效下的解释性参与:模型行为中的渐近稀有性(或:渐近式AI)
专题命中 其他LLM :LLM(summary_cn,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 本研究探究LLM在低可控失效概率工作流中,解释性参与度随失效渐近稀有性的变化,发现触发结构是关键调节变量,不同模型的异常识别与参与表现存在差异。
Comments 11 figures. Elicitation-condition sweep across three open-weight models (qwen3:8b, llama3.1:8b, mistral:7b); pipeline scripts and experimental data available upon reasonable request
MultiFixer:一种用于修复多块漏洞的基于协调者-提议者的多智能体框架
专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)
AI总结 该研究针对现有LLM-based APR方法难以修复多块漏洞的问题,提出MultiFixer多智能体框架,经多基准测试,其在Defects4J等数据集上达到最优修复效果,能有效修复多块漏洞。
Comments Accepted to 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026)