arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12266 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12266 篇

2604.05966 2026-05-18 cs.CL 70%

FinReporting: An Agentic Workflow for Localized Reporting of Cross-Jurisdiction Financial Disclosures

FinReporting: 一种用于跨司法管辖区财务披露本地化报告的代理工作流

Fan Zhang, Mingzi Song, Rania Elbadry, Yankai Chen, Shaobo Wang, Yixi Zhou, Xunwen Zheng, Yueru He, Yuyang Dai, Georgi Georgiev, Ayesha Gull, Muhammad Usman Safder, Fan Wu, Liyuan Meng, Fengxian Ji, Junning Zhao, Xueqing Peng, Jimin Huang, Yu Chen, Xue, Liu, Preslav Nakov, Zhuohan Xie

机构 * MBZUAI The University of Tokyo(东京大学) Meiji Gakuin University(明治大学) McGill University(麦吉尔大学) Kyoto University(京都大学) Columbia University(哥伦比亚大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出FinReporting,一种代理工作流,用于跨司法管辖区的财务披露本地化报告。该系统构建了涵盖损益表、资产负债表和现金流量表的统一本体,将报告分解为可审计的阶段,并通过约束验证器提升一致性和可靠性。

Comments Accepted at ACL 2026 Demo Track. 9 pages, including figures and tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22440 2026-05-18 cs.CY cs.LG cs.MA econ.GN q-fin.EC 70%

From Model Design to Organizational Design: Complexity Redistribution and Trade-Offs in Generative AI

从模型设计到组织设计:生成AI中的复杂性再分配与权衡

Sharique Hasan, Alexander Oettl, Sampsa Samila

机构 * Duke University(杜克大学) Georgia Institute of Technology(佐治亚理工学院) IESE Business School(IESE商学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出GAS框架,分析大语言模型如何重塑组织与竞争策略,揭示生成AI中通用性、准确性与简洁性之间的权衡及复杂性再分配对管理挑战的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02832 2026-05-18 cs.CR cs.AI 70%

FlipAttack: Jailbreak LLMs via Flipping

FlipAttack:通过翻转对大型语言模型进行劫持

Yue Liu, Xiaoxin He, Miao Xiong, Jinlan Fu, Shumin Deng, Yingwei Ma, Jiaheng Zhang, Bryan Hooi

机构 * Engineering Programme, NUS Graduate School, National University of Singapore(国立新加坡大学整合科学与工程计划) Institute of Data Science (IDS), National University of Singapore(国立新加坡大学数据科学研究所) Department of Computer Science, School of Computing, National University of Singapore(国立新加坡大学计算机科学系)

专题命中 其他LLM :LLM(summary_cn);分类 cs.AI

AI总结 FlipAttack通过在提示左侧添加噪声,利用语言模型自左向右理解文本的特性,实现对黑盒LLM的高效劫持,实验显示其在多个模型上均表现出高成功率。

Comments 43 pages, 31 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14200 2026-05-15 cs.LG stat.ML 70%

How to Scale Mixture-of-Experts: From muP to the Maximally Scale-Stable Parameterization

如何扩展专家混合模型:从muP到最大可扩展性参数化

Leena Chennuru Vankadara, Moritz Haas, Luke Hayward, Sebastian Bordt, Alessandro Breccia

机构 * Gatsby Computational Neuroscience Unit, University College London(Gatsby计算神经科学单元,伦敦大学学院) Amazon University of Tübingen, Tübingen AI Center(亚马逊图宾根大学,图宾根人工智能中心)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文研究了专家混合模型(MoE)在不同扩展制度下的参数缩放问题,提出最大可扩展性参数化(MSSP)以实现稳定性和性能优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13044 2026-05-14 cs.CR cs.AI 70%

No Attack Required: Semantic Fuzzing for Specification Violations in Agent Skills

无需攻击:用于代理技能规范违规的语义模糊测试

Ying Li, Hongbo Wen, Yanju Chen, Hanzhi Liu, Yuan Tian, Yu Feng

机构 * University of California, San Diego(加州大学圣迭戈分校)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出Sefz框架,通过语义模糊测试发现代理技能中的规范违规问题,揭示了安全规则漏洞对用户信任的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21577 2026-05-14 cs.LG 70%

Collaborative Parameter Learning: Mitigating Forgetting via Parameter-Level Gradient Analysis

协同参数学习:通过参数级梯度分析缓解遗忘

Mutian Yang, Zisen Zhan, Yutong Chen, Haolin Li, Kaiwen Wang, Kaili Zheng, Yuguang Wang, Qi Wang, Jiandong Gao, Ji Wu

机构 * Department of Electronic Engineering, Tsinghua University, Beijing, China(清华大学电子工程系,北京,中国) Institute of Medical Technology, Peking University Health Science Center, Peking University, Beijing, China(北京大学医学部医学技术研究所,北京大学,北京,中国) College of Information Science and Engineering, Northeastern University, Shenyang, China(东北大学信息科学与工程学院,沈阳,中国) College of AI, Tsinghua University, Beijing, China(清华大学人工智能学院,北京,中国) Beijing National Research Center for Information Science and Technology, Beijing, China(北京信息科学与技术国家研究中心,北京,中国)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出协同参数学习方法,通过分析参数级梯度相似性,识别冲突参数和协作参数,冻结冲突参数以减少遗忘,提升模型在多任务和多语言场景下的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06394 2026-05-12 cond-mat.dis-nn cs.LG hep-th 70%

Lecture Notes on Statistical Physics and Neural Networks

统计物理与神经网络讲义

Olaf Hohm

机构 * Institute for Physics, Humboldt University Berlin(柏林洪堡大学物理研究所)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 讲义介绍统计物理与神经网络相关的经典主题,包括玻尔兹曼-吉布斯分布、相变及玻尔兹曼机的学习算法,以及深度学习的发展背景。

Comments 56 pages, 7 figures, based on a course given at Humboldt University Berlin

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00541 2026-05-12 cs.LG stat.ML 70%

Spectral Condition for $μ$P under Width-Depth Scaling

在宽度-深度扩展下μP的谱条件

Chenyu Zheng, Rongzhen Wang, Xinyu Zhang, Chongxuan Li

机构 * Gaoling School of AI, Renmin University of China(中国人民大学东城区人工智能学院)

专题命中 其他LLM :language model(abstract);foundation model(abstract);分类 cs.LG

AI总结 本文提出一种统一的谱框架,用于在宽度-深度扩展下实现μP,揭示了从k=1到k≥2的转变,统一了不同μP形式并验证了其在实际架构中的有效性。

Comments 76 pages, 13 figures, 40 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18273 2026-05-12 cs.LG 70%

Decoding Islamophobic Discourse: Using LLMs to Identify Tropes and Semi-Coded Hate Speech

解码伊斯兰恐惧言论:利用大语言模型识别隐喻和半编码仇恨言论

Raza Ul Mustafa, Roi Dupart, Gabrielle Smith, Noman Ashraf, Nathalie Japkowicz

机构 * Loyola University New Orleans(洛伊拉大学新奥尔良分校) Tulane University(Tulane 大学) American University(美国大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文利用大语言模型分析极端社交平台上的隐喻伊斯兰恐惧术语,发现其难以被人类和系统识别,通过BERT主题建模揭示了伊斯兰恐惧言论在不同政治和右翼运动中的传播情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01302 2026-05-05 cs.CL cs.IR 70%

Beyond Semantic Relevance: Counterfactual Risk Minimization for Robust Retrieval-Augmented Generation

超越语义相关性:为鲁棒检索增强生成的反事实风险最小化

Peiyang Liu, Qiang Yan, Ziqiang Cui, Di Liang, Xi Wang, Wei Ye

机构 * National Engineering Research Center for Software Engineering, Peking University(软件工程国家工程研究中心,北京大学) City University of Hong Kong(香港城市大学) Tencent Technology(腾讯科技) Peking University(北京大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文提出CoRM-RAG框架,通过因果干预模拟用户偏差来提升检索鲁棒性,在对抗性场景中优于传统检索器和重排序器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00963 2026-05-05 cs.RO cs.AI 70%

Ablation Study of Multimodal Perception, Language Grounding, and Control for Human-Robot Interaction in an Object Detection and Grasping Task

多模态感知、语言接地与控制在物体检测与抓取任务中的人机交互消融研究

Zi Tian, Guanting Shen

机构 * Dalian University of Technology(大连理工大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过消融研究探讨多模态感知、语言接地和控制模块对端到端性能的影响,评估最佳组合以优化执行时间和成功率。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23940 2026-05-05 cs.SE cs.AI 70%

Constraint-Guided Multi-Agent Decompilation for Executable Binary Recovery

基于约束的多智能体反编译用于可执行二进制恢复

Yifan Zhang, Xiaohan Wang, Yueke Zhang, Yu Huang, Kevin Leach

机构 * Vanderbilt University(范德比大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出一种多智能体框架,通过多级约束引导反编译(MCGD)将反编译代码转换为可执行源代码,提升反编译结果的可执行性与正确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27534 2026-05-01 cs.CL 70%

Entropy of Ukrainian

乌克兰语的熵

Anton Lavreniuk, Mykyta Mudryi, Markiian Chaklosh

机构 * Polish-Japanese Academy of Information Technology(波兰-日本信息科技学院) University of the National Education Commission in Kraków(克拉科夫国家教育委员会大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文通过招募184名志愿者预测乌克兰语句子中下一个字符,计算出其熵上限为1.201 bits/character,并与现有大语言模型进行对比。

Comments 8 pages, 5 figures, 2 tables. Accepted at UNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27369 2026-05-01 cs.CL cs.SI 70%

Emotion-Aware Clickbait Attack in Social Media

社交媒体中具有情绪感知的点击欺诈攻击

Syed Mhamudul Hasan, Mohd. Farhan Israk Soumik, Abdur R. Shahid

机构 * Southern Illinois University(南方伊利诺伊大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出一种基于情感空间的点击欺诈生成攻击方法,通过风格转换优化情感影响,实验显示其显著降低现有分类器性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17736 2026-04-28 cs.HC cs.AI 70%

From Static to Interactive: Authoring Interactive Visualizations via Natural Language

从静态到交互:通过自然语言实现交互式可视化

Can Liu, Jaeuk Lee, Tianhe Chen, Zhibang Jiang, Xiaolin Wen, Yong Wang

机构 * Nanyang Technological University(南洋理工大学) Ajou University(阿乔大学) Providence Health & Services(普罗维登斯健康与服务)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出Athanor方法,利用多模态大语言模型和自然语言指令将静态可视化转为交互式,通过三种创新设计提升用户交互体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03191 2026-04-28 cs.CL 70%

CLIX: Cross-Lingual Explanations of Idiomatic Expressions

CLIX: 习语的跨语言解释

Aaron Gluck, Katharina von der Wense, Maria Leonor Pacheco

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) Johannes Gutenberg University Mainz(美因茨约翰尼斯·古腾堡大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究提出CLIX任务,探讨NLP模型在生成习语跨语言解释中的能力,发现大语言模型有潜力,但需进一步解决错误分析中的关键挑战。

Comments Accepted to Findings of ACL 2025

Journal ref Findings of ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22143 2026-04-27 cs.CY cs.CL 70%

Recognition Without Authorization: LLMs and the Moral Order of Online Advice

无需授权的识别:大语言模型与在线建议的道德秩序

Tom van Nuenen

机构 * Social Sciences Data Lab(社会科学数据实验室) UC Berkeley(伯克利大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文研究大语言模型在处理日常人际困境时的建议倾向,发现其在识别问题时较少给予行动授权,特别是在社区共识强烈的情况下,模型推荐退出的比例显著低于人类,且保持较高的谨慎和治疗框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20199 2026-04-23 cs.CL 70%

All Languages Matter: Understanding and Mitigating Language Bias in Multilingual RAG

所有语言都重要:理解并缓解多语言RAG中的语言偏差

Dan Wang, Guozhao Mo, Yafei Shi, Cheng Zhang, Bo Zheng, Boxi Cao, Xuanang Chen, Yaojie Lu, Hongyu Lin, Ben He, Xianpei Han, Le Sun

机构 * Chinese Information Processing Laboratory, Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所信息处理实验室) University of Chinese Academy of Sciences(中国科学院大学) MYbank, AntGroup(蚂蚁集团MYbank)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文研究多语言RAG中的语言偏差问题,提出LAURA方法,通过多语言证据排名与生成效用对齐,有效缓解语言偏差并提升性能。

Comments ACL 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19925 2026-04-23 econ.GN cs.AI cs.CY cs.HC q-fin.EC 70%

Behavioral Transfer in AI Agents: Evidence and Privacy Implications

人工智能代理中的行为迁移:证据与隐私影响

Shilei Luo, Zhiqi Zhang, Hengchen Dai, Dennis Zhang

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究探讨了AI代理是否系统性地反映其人类所有者的行为特征,发现代理与所有者在行为上存在系统性迁移,且可能带来隐私风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19816 2026-04-23 cs.AI 70%

Emergence Transformer: Dynamical Temporal Attention Matters

涌现变换器:动态时间注意力至关重要

Zihan Zhou, Bo-Wei Qin, Kai Du, Wei Lin

机构 * School of Mathematical Sciences(数学科学学院) Shanghai Center for Mathematical Sciences(上海数学中心) Research Institute of Intelligent Complex Systems(智能复杂系统研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) State Key Laboratory of Medical Neurobiology(医学神经生物学国家重点实验室) MOE Frontiers Center for Brain Science(教育部脑科学前沿中心) Institute of Brain Science(脑科学研究院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出基于动态时间注意力的涌现变换器,通过时间变化的查询、键、值矩阵,实现组件间动态注意力交互,促进或抑制涌现一致性,应用于社会 coherence 和 Hopfield 神经网络,实现持续学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19803 2026-04-23 cs.AI cs.IT cs.MA math.IT 70%

The AI Telco Engineer: Toward Autonomous Discovery of Wireless Communications Algorithms

AI电信工程师:迈向无线通信算法的自主发现

Fayçal Aït Aoudia, Jakob Hoydis, Sebastian Cammerer, Lorenzo Maggi, Gian Marti, Alexander Keller

机构 * NVIDIA

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文探讨了代理AI自主设计无线通信算法的能力,通过框架生成、评估和优化候选算法,在物理层和介质访问控制层完成任务,算法性能优于传统方法且具备可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19977 2026-04-23 cs.AI 70%

Context Attribution with Multi-Armed Bandit Optimization

基于多臂老虎机优化的上下文归因

Deng Pan, Keerthiram Murugesan, Ting Hua, Nuno Moniz, Nitesh Chawla

机构 * Lucy Family Institute for Data & Society, University of Notre Dame(数据与社会学院卢西家庭研究所,圣约翰大学) Department of Computer Science & Engineering, University of Notre Dame(计算机科学与工程系,圣约翰大学) IBM Research(IBM研究院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种将上下文归因问题建模为组合多臂老虎机问题的框架,利用线性汤普森采样高效识别关键上下文片段,减少模型查询次数,实验表明在多个问答基准上实现30%的查询减少同时保持归因质量。

Comments Accepted as a Findings paper at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19309 2026-04-22 cs.HC cs.AI 70%

Co-Refine: AI-Powered Tool Supporting Qualitative Analysis

Co-Refine:支持定性分析的AI工具

Athikash Jeyaganthan, Kai Xu, Franziska Becker, Steffen Koch

机构 * University of Nottingham(诺丁汉大学) University of Stuttgart(斯图加特大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 Co-Refine通过三阶段审计流程提供持续反馈,解决定性编码中代码解释随时间变化的问题,提升分析可信度。

Comments 7 pages, 4 figures. Includes details on system architecture, a three-stage audit pipeline, and a formative user study

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27889 2026-04-22 cs.CL 70%

Article and Comment Frames Shape the Quality of Online Comments

文章与评论框架影响在线评论的质量

Matteo Guida, Yulia Otmakhova, Eduard Hovy, Lea Frermann

机构 * School of Computing and Information Systems, The University of Melbourne(墨尔本大学计算与信息系统学院)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文研究框架如何影响评论质量,通过分析100万条评论发现,文章框架显著预测评论健康度,采用文章框架的评论更健康,且不健康的顶级评论会生成更多不健康的回应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18362 2026-04-21 cs.CL cs.IR 70%

ArbGraph: Conflict-Aware Evidence Arbitration for Reliable Long-Form Retrieval-Augmented Generation

ArbGraph:面向可靠长形式检索增强生成的冲突感知证据仲裁

Qingying Niu, Yuhao Wang, Ruiyang Ren, Bohui Fang, Wayne Xin Zhao

机构 * Gaoling School of Artificial Intelligence(高岭人工智能学院) Renmin University of China(中国人民大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 ArbGraph通过预生成阶段的证据仲裁解决长形式RAG中的事实冲突,提升事实一致性与信息密度,减少幻觉和检索噪声影响。

Comments 23 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18320 2026-04-21 cs.CV cs.AI 70%

EVE: Verifiable Self-Evolution of MLLMs via Executable Visual Transformations

EVE: 通过可执行视觉变换实现多模态大语言模型的可验证自进化

Yongrui Heng, Chaoya Jiang, Han Yang, Shikun Zhang, Wei Ye

机构 * National Engineering Research Center for Software Engineering, Peking University(软件工程国家级工程研究中心,北京大学) School of Control Science and Engineering, Shandong University(控制科学与工程学院,山东大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出EVE框架,通过可执行视觉变换实现多模态大语言模型的可验证自进化,解决伪标签方法和模板方法的不足,通过双策略架构和多维奖励系统提升模型自进化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23179 2026-04-21 cs.AI 70%

Universal Adversarial Attacks against Closed-Source MLLMs via Target-View Routed Meta Optimization

针对闭源多模态大语言模型的通用对抗攻击:通过目标视角路由元优化

Hui Lu, Yi Yu, Yiming Yang, Chenyu Yi, Xueyi Ke, Qixing Zhang, Bingquan Shen, Alex Kot, Xudong Jiang

机构 * Rapid-Rich Object Search Lab, Interdisciplinary Graduate Programme, Nanyang Technological University, Singapore(快速丰富目标搜索实验室,跨学科研究生项目,南洋理工大学,新加坡) School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(电气与电子工程学院,南洋理工大学,新加坡) College of Computing and Data Science, Nanyang Technological University, Singapore(计算与数据科学学院,南洋理工大学,新加坡) DSO National Laboratories, Singapore(新加坡国防科学实验室)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出MCRMO-Attack,通过多作物聚合与注意力引导裁剪稳定监督,通过对齐性门控令牌路由提升token级可靠性,并元学习跨目标扰动先验,从而在商业MLLM上提升未见图像攻击成功率。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04052 2026-04-21 cs.RO cs.CL 70%

Stable Language Guidance for Vision-Language-Action Models

用于视觉-语言-动作模型的稳定语言引导

Zhihao Zhan, Yuhao Chen, Jiaying Zhou, Qinhan Lyu, Hao Liu, Keze Wang, Liang Lin, Guangrun Wang

机构 * Sun Yat-sen University(中山大学) Guangdong Key Lab of Big Data Analysis & Processing(广东大数据分析与处理重点实验室) X-Era AI Lab(X-Era AI实验室)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文提出RSS框架,通过解耦物理 affordance 与语义执行,提升视觉-语言-动作模型在语言扰动下的鲁棒性,实验表明其在多种操作基准测试中达到最优性能。

Comments Accepted to ACL2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05067 2026-04-21 cs.CV cs.AI 70%

LLaVA-Octopus: Unlocking Instruction-Driven Adaptive Projector Fusion for Video Understanding

LLaVA-Octopus:解锁指令驱动的自适应投影器融合用于视频理解

Boyuan Sun, Jiaxing Zhao, Xiang Chen, Xihan Wei, Qibin Hou

机构 * VCIP, CS, Nankai University(南开大学计算机科学与技术学院) Tongyi Group, Alibaba(阿里巴巴通义集团)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 LLaVA-Octopus通过根据用户指令动态调整不同视觉投影器的特征权重,提升视频理解任务的性能,实验表明其在多个基准测试中表现优异。

Comments 18 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16968 2026-04-21 cs.CL 70%

On Safety Risks in Experience-Driven Self-Evolving Agents

经验驱动自演化代理中的安全风险

Weixiang Zhao, Yichen Zhang, Yingshuo Wang, Yang Deng, Yanyan Zhao, Xuda Zhi, Yongbo Huang, HaoHe, Wanxiang Che, Bing Qin, Ting Liu

机构 * Harbin Institute of Technology(哈尔滨工业大学) Singapore Management University(新加坡管理大学) SERES

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究经验积累与利用对自演化代理在网页和具身环境中的安全性能影响,揭示经验驱动导致的安全性下降及安全-效用权衡问题。

Comments Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏