arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-05 至 2025-12-05 共收录 134 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 11 篇

2512.04545 2025-12-05 cs.CL 81%

EvoEdit: Lifelong Free-Text Knowledge Editing through Latent Perturbation Augmentation and Knowledge-driven Parameter Fusion

EvoEdit: 通过潜在扰动增强和知识驱动参数融合实现终身自由文本知识编辑

Pengfei Cao, Zeao Ji, Daojian Zeng, Jun Zhao, Kang Liu

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 EvoEdit通过潜在扰动增强和知识驱动参数融合,实现终身自由文本知识编辑,有效解决知识更新与遗忘问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04112 2025-12-05 cs.MM cs.AI 77%

MindFuse: Towards GenAI Explainability in Marketing Strategy Co-Creation

MindFuse:迈向营销策略协同创作中的生成式AI可解释性

Aleksandr Farseev, Marlo Ongpin, Qi Yang, Ilia Gossoudarev, Yu-Yi Chu-Farseeva, Sergey Nikolenko

机构 * ITMO University(ITMO大学) SoMin.ai Research(SoMin.ai研究) Faculty of Software Engineering(软件工程学院) Computer Systems, ITMO University(计算机系统,ITMO大学) ISP RAS Research Center for Trusted Artificial Intelligence(俄罗斯科学院信息与系统研究所以及可信人工智能研究中心)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 MindFuse通过可解释生成式AI框架,实现营销策略协同创作中的内容生成、推理和实时优化,提升营销效率12倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03771 2025-12-05 cs.CL cs.AI cs.CR cs.LG 75%

In-Context Representation Hijacking

上下文表示劫持

Itay Yona, Amir Sarid, Michael Karasik, Yossi Gandelsman

机构 * Mentaleap Independent Researcher(独立研究者) UC Berkeley(加州大学伯克利分校)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Doublespeak通过替换有害关键词为无害标记,使模型内部表示收敛至有害语义,从而绕过安全对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04309 2025-12-05 cs.CV cs.CL 70%

Text-Only Training for Image Captioning with Retrieval Augmentation and Modality Gap Correction

仅文本训练的图像描述生成:结合检索增强与模态差距校正

Rui Fonseca, Bruno Martins, Gil Rocha

机构 * INESC-ID, Instituto Superior Tecnico, University of Lisbon(INESC-ID,理工学院,里斯本大学)

专题命中 知识编辑与模型理解 :language model(abstract);prompting(abstract);分类 cs.CL

AI总结 TOMCap通过检索增强和模态差距校正,实现无需对齐图像-文本对的纯文本训练图像描述生成。

Comments Submitted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22345 2025-12-05 cs.CV 50%

Flowing Backwards: Improving Normalizing Flows via Reverse Representation Alignment

反向流动:通过反向表征对齐改进规范化流

Yang Chen, Xiaowei Xu, Shuai Wang, Chenhui Zhu, Ruxue Wen, Xubin Li, Tiezheng Ge, Limin Wang

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 通过反向表征对齐改进规范化流,提升生成质量和分类准确性,训练速度提升3.3倍,实现ImageNet新state-of-the-art结果。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04483 2025-12-05 cs.CV 50%

DeRA: Decoupled Representation Alignment for Video Tokenization

DeRA: 解耦表示对齐用于视频标记化

Pengbo Guo, Junke Wang, Zhen Xing, Chengxu Liu, Daoguo Dong, Xueming Qian, Zuxuan Wu

机构 * Xi’an Jiaotong University(西安交通大学) Shanghai Innovation Institute(上海创新研究院) Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究院)

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 DeRA通过解耦时空表示学习,提升视频标记化效率和性能,并在视频生成任务中取得新突破。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他LLM 8 篇

2512.04129 2025-12-05 cs.CR 78%

Tipping the Dominos: Topology-Aware Multi-Hop Attacks on LLM-Based Multi-Agent Systems

推倒多米诺骨牌:面向基于大语言模型的多智能体系统的拓扑感知多跳攻击

Ruichao Liang, Le Yin, Jing Chen, Cong Wu, Xiaoyu Zhang, Huangpeng Gu, Zijian Zhang, Yang Liu

专题命中 其他LLM :LLM(title,abstract)

AI总结 针对基于大语言模型的多智能体系统,提出拓扑感知多跳攻击方法,揭示其内在安全漏洞并提出基于拓扑信任的防御框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04121 2025-12-05 cs.CY cs.AI cs.CL 73%

Can machines perform a qualitative data analysis? Reading the debate with Alan Turing

机器能否进行定性数据分析?通过阿兰·图灵阅读辩论

Stefano De Paoli

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文通过图灵的思想重新审视LLMs在定性分析中的应用,强调应关注LLMs生成分析结果与人类分析师的可比性,而非单纯探讨机器能否进行定性分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04987 2025-12-05 cs.CL 70%

Nex-N1: Agentic Models Trained via a Unified Ecosystem for Large-Scale Environment Construction

Nex-N1: 通过统一生态系统训练的代理模型用于大规模环境构建

AGI Team, Yuxuan Cai, Lu Chen, Qiaoling Chen, Yuyang Ding, Liwen Fan, Wenjie Fu, Yufei Gao, Honglin Guo, Pinxue Guo, Zhenhua Han, Zhengfu He, Hanglei Hu, Kai Hu, Shengjia Hua, Tianyu Huai, Baodai Huang, Li Ji, Zhen Jiang, Zhikai Lei, Bufan Li, Jiahang Lin, Lizhi Lin, Jinxiu Liu, Shichun Liu, Ziming Liu, Yuchen Ni, Pengfang Qian, Yujiong Shen, Qingyun Shi, Wentao Shu, Peng Sun, Yiran Suo, Tian Tang, Boyu Tian, Guoteng Wang, Junzhe Wang, Peixin Wang, Zhiheng Xi, Hang Yan, Jie Yang, Zhixiong Yang, Tianchu Yao, Guangze Ye, Qianxi Yu, Shuo Zhang, Xinyue Zhang, Yiqi Zhang, Jiarong Zhao, Miao Zheng, Rui Zheng, Enyu Zhou, Jiazheng Zhou, Maosen Zhou, Yuhao Zhou, Tao Gui, Yining Zheng, Xinchi Chen, Jie Zhou, Siyuan Feng, Qin Chen, Liang He, Qi Zhang, Xuanjing Huang, Xipeng Qiu

机构 * AGI Team(AGI团队)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 Nex-N1通过统一生态系统训练的代理模型,实现了大规模环境构建,展示了在复杂代理任务中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19550 2025-12-05 cs.AI 70%

Turing Test 2.0: The General Intelligence Threshold

Turing Test 2.0:通用智能阈值

Georgios Mappouras

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出图灵测试2.0框架,通过设定通用智能阈值来检测是否达到人工通用智能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04232 2025-12-05 q-bio.PE cs.CY 67%

Decentralized Social Media and Artificial Intelligence in Digital Public Health Monitoring

去中心化的社交媒体与人工智能在数字公共卫生监测中的应用

Marcel Salathé, Sharada P. Mohanty

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文探讨了去中心化社交媒体与人工智能在数字公共卫生监测中的应用,分析了数据获取与AI技术之间的矛盾,并提出了适应性策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04895 2025-12-05 cs.AI cs.MA 57%

Chameleon: Adaptive Adversarial Agents for Scaling-Based Visual Prompt Injection in Multimodal AI Systems

Chameleon:基于尺度的视觉提示注入的自适应对抗代理

M Zeeshan, Saud Satti

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 Chameleon是一种自适应对抗框架,通过动态优化图像扰动来暴露和利用多模态AI系统中的缩放漏洞,显著提高攻击成功率并影响决策准确性。

Comments 5 pages, 2 figures, IEEE Transactions on Dependable and Secure Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04444 2025-12-05 stat.ME stat.AP 50%

Bayesian Graphical High-Dimensional Time Series Models for Detecting Structural Changes

贝叶斯图示高维时间序列模型用于检测结构变化

Shuvrarghya Ghosh, Arkaprava Roy, Anindya Roy, Subhashis Ghosal

专题命中 其他LLM :prompting(abstract)

AI总结 本文提出spOUTAR模型,用于检测经济危机中多变量时间序列的结构变化,通过联合建模和贝叶斯估计分析宏观经济指标的依赖关系变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04381 2025-12-05 cs.RO 50%

FALCON: Actively Decoupled Visuomotor Policies for Loco-Manipulation with Foundation-Model-Based Coordination

FALCON:基于基础模型的解耦视觉-运动政策用于具有基础模型协调的移动- manipulation

Chengyang He, Ge Sun, Yue Bai, Junkai Lu, Jiadong Zhao, Guillaume Sartoretti

机构 * Department of Mechanical Engineering, College of Design and Engineering, National University of Singapore(机械工程系,设计与工程学院,新加坡国立大学)

专题命中 其他LLM :foundation model(abstract)

AI总结 FALCON通过基于基础模型的解耦视觉-运动策略,实现移动- manipulation任务中更高效的协调与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏