arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-01-16 至 2026-01-16 共收录 41 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. AI治理与伦理 2 篇

2601.10220 2026-01-16 cs.SE 50%

Agentic Pipelines in Embedded Software Engineering: Emerging Practices and Challenges

嵌入式软件工程中的代理流水线:新兴实践与挑战

Simin Sun, Miroslaw Staron

专题命中 AI治理与伦理 :safety(abstract)

AI总结 本文探讨嵌入式软件工程中生成式AI的整合挑战与实践,通过专家访谈揭示代理流水线的发展与可持续采用策略。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他安全 10 篇

2601.10064 2026-01-16 cs.CL 79%

Long-Chain Reasoning Distillation via Adaptive Prefix Alignment

通过自适应前缀对齐实现长链推理蒸馏

Zhenghao Liu, Zhuoyang Wu, Xinze Li, Yukun Yan, Shuo Wang, Zulong Chen, Yu Gu, Ge Yu, Maosong Sun

机构 * School of Computer Science and Engineering, Northeastern University, China(东北大学计算机科学与工程学院) Department of Computer Science and Technology, Institute for AI, Tsinghua University, China(清华大学计算机科学与技术系) Alibaba Group, China(阿里巴巴集团)

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 通过自适应前缀对齐方法提升学生模型的推理能力,有效蒸馏教师生成的长推理轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09732 2026-01-16 cs.CL 79%

Benchmarking Cross-Lingual Semantic Alignment in Multilingual Embeddings

在多语言嵌入中评估跨语言语义对齐的基准测试

Wen G. Gong

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 本研究提出语义亲和力指标,评估多语言嵌入的跨语言语义对齐,发现训练目标而非规模决定对齐效果,强调显式翻译监督的重要性。

Comments 20 pages, 9 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15372 2026-01-16 cs.IR cs.AI cs.CV cs.LG cs.MM 62%

Image Complexity-Aware Adaptive Retrieval for Efficient Vision-Language Models

面向高效视觉-语言模型的图像复杂度感知自适应检索

Mikel Williams-Lekuona, Georgina Cosma

机构 * Computer Science, Loughborough University, Loughborough, UK(计算机科学,洛桑大学,洛桑,英国)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 ICAR通过自适应计算方法提升视觉-语言模型效率,实现高效图像-文本匹配与复杂度评估。

Comments Camera-ready version for ECIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10310 2026-01-16 cs.CL 57%

Multilinguality as Sense Adaptation

多语言性作为意义适应

Jan Christian Blaise Cruz, David Ifeoluwa Adelani, Alham Fikri Aji

机构 * MBZUAI McGill University(麦吉尔大学) Mila - Quebec AI Institute(魁北克人工智能研究所) Canada CIFAR AI Chair(加拿大CIFAR人工智能席位) SEACrowd

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 SENSIA通过意义层面的对齐和上下文表示,实现多语言转换,优于现有方法并以更少数据获得竞争力结果。

Comments Code available at https://github.com/jcblaisecruz02/sensia

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10025 2026-01-16 cs.AI 57%

Structured Personality Control and Adaptation for LLM Agents

结构化人格控制与适应用于大语言模型代理

Jinpeng Wang, Xinyu Jia, Wei Wei Heng, Yuquan Li, Binbin Shi, Qianlei Chen, Guannan Chen, Junxia Zhang, Yuyu Yin

机构 * Key Laboratory of Complex Systems Modeling and Simulation of Ministry of Education(教育部复杂系统建模与仿真重点实验室) Hangzhou Dianzi University(杭州电子科技大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出基于荣格心理学类型模型的结构化人格控制框架,通过协调、强化补偿和反思机制实现LLM人格的细腻表达与动态适应,提升人机交互中的自然代理设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09971 2026-01-16 cs.LG 57%

An Exploratory Study to Repurpose LLMs to a Unified Architecture for Time Series Classification

一项探索性研究:将大语言模型重新利用到时间序列分类的统一架构中

Hansen He, Shuheng Li

机构 * Canyon Crest Academy(山崖顶学术院) UC San Diego(圣迭戈大学)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本研究探索了将大语言模型与时间序列编码器结合的混合架构,发现Inception模型在提升性能方面表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09755 2026-01-16 cs.NE cs.AI cs.RO 57%

Heterogeneous computing platform for real-time robotics

异构计算平台用于实时机器人

Jakub Fil, Yulia Sandamirskaya, Hector Gonzalez, Loïc Azzalin, Stefan Glüge, Lukas Friedenstab, Friedrich Wolf, Tim Rosmeisl, Matthias Lohrmann, Mahmoud Akl, Khaleel Khan, Leonie Wolf, Kristin Richter, Holm Puder, Mazhar Ali Bari, Xuan Choo, Noha Alharthi, Michael Hopkins, Mansoor Hanif Christian Mayr, Jens Struckmeier, Steve Furber

机构 * WAIYS GmbH(WAIYS公司) Zurich University of Applied Sciences(苏黎世应用科学大学) SpiNNcloud Systems GmbH(SpiNNcloud系统公司) TU Dresden(德累斯顿技术大学) Applied Brain Research(应用脑科研) NEOM The University of Manchester(曼彻斯特大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本文提出一种异构计算平台,结合神经形态计算硬件与AI计算集群,用于实时机器人感知与交互任务,提升机器人自主性和智能水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10332 2026-01-16 cs.CV 50%

Think-Then-Generate: Reasoning-Aware Text-to-Image Diffusion with LLM Encoders

思考-然后-生成:基于LLM编码器的推理感知文本到图像扩散模型

Siqi Kou, Jiachun Jin, Zetong Zhou, Ye Ma, Yugang Wang, Quan Chen, Peng Jiang, Xiao Yang, Jun Zhu, Kai Yu, Zhijie Deng

机构 * Shanghai Jiao Tong University(上海交通大学) Kuaishou Technology(快手科技) Tsinghua University(清华大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出基于LLM编码器的推理感知文本到图像扩散模型,通过推理重写提示提升生成质量,达到接近GPT-4的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10253 2026-01-16 cs.HC cs.SE 50%

Developer Interaction Patterns with Proactive AI: A Five-Day Field Study

开发者与前瞻性AI的交互模式:一项为期五天的实地研究

Nadine Kuo, Agnia Sergeyuk, Valerie Chen, Maliheh Izadi

专题命中 其他安全 :alignment(abstract)

AI总结 本研究通过五天实地观察,揭示开发者对前瞻性AI建议的接受模式,发现干预时机和上下文对使用效果有显著影响。

Comments 14 pages, 6 figures, accepted to IUI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08676 2026-01-16 cs.SE cs.HC 50%

Developer Needs and Feasible Features for AI Assistants in IDEs

IDE中AI助手的开发者需求及可行功能

Agnia Sergeyuk, Ekaterina Koshchenko, Ilya Zakharov, Timofey Bryksin, Maliheh Izadi

专题命中 其他安全 :alignment(abstract)

AI总结 本文研究了IDE中AI助手的开发者需求及可行功能,通过调查和预测市场分析,揭示了不同开发者群体的需求差异及技术实现的可行性。

Comments Accepted to ICSE'26 SEIP. 11 pages, 2 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏