arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-07-30 至 2025-07-30 共收录 9 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 9 篇

2504.10227 2025-07-30 cs.CL 89%

Probing then Editing Response Personality of Large Language Models

Tianjie Ju, Zhenyu Shao, Bowen Wang, Yujia Chen, Zhuosheng Zhang, Hao Fei, Mong-Li Lee, Wynne Hsu, Sufeng Duan, Gongshen Liu

机构 * Shanghai Jiao Tong University(上海交通大学) National University of Singapore(新加坡国立大学) Sichuan University(四川大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted at COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15836 2025-07-30 cs.CV 82%

VLM-CPL: Consensus Pseudo Labels from Vision-Language Models for Annotation-Free Pathological Image Classification

Lanfeng Zhong, Zongyao Huang, Yang Liu, Wenjun Liao, Shichuan Zhang, Guotai Wang, Shaoting Zhang

机构 * School of Mechanical and Electrical Engineering, University of Electronic Science and Technology of China(电子科技大学机械与电子工程学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Department of Pathology, Sichuan Clinical Research Center for Cancer, Sichuan Cancer Hospital & Institute, Affiliated Cancer Hospital of University of Electronic Science and Technology of China(pathology department, 四川省癌症临床研究中心, 四川省肿瘤医院及研究所, 电子科技大学附属肿瘤医院) Department of Radiation Oncology, Sichuan Cancer Hospital and Institute, University of Electronic Science and Technology of China(放射肿瘤科, 四川省肿瘤医院及研究所, 电子科技大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);prompting(abstract)

Comments Accepted at TMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15549 2025-07-30 cs.LG cs.AI cs.CL 81%

Latent Adversarial Training Improves Robustness to Persistent Harmful Behaviors in LLMs

Abhay Sheshadri, Aidan Ewart, Phillip Guo, Aengus Lynch, Cindy Wu, Vivek Hebbar, Henry Sleight, Asa Cooper Stickland, Ethan Perez, Dylan Hadfield-Menell, Stephen Casper

机构 * Georgia Institute of Technology(佐治亚理工学院) University of Bristol(布里斯托大学) University of Maryland(马里兰大学) University College London(伦敦大学学院) MATS Astra MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

专题命中 知识编辑与模型理解 :LLM(abstract,comments);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Code at https://github.com/aengusl/latent-adversarial-training. Models at https://huggingface.co/LLM-LAT

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18985 2025-07-30 cs.CV cs.AI 80%

GLIMPSE: Holistic Cross-Modal Explainability for Large Vision-Language Models

Guanxi Shen

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI

Comments Keywords: Explainable Computer Vision, Large Vision-Language Models, AI Interpretability, Explainable AI, Visual Saliency, Attribution Maps, Cross-Modal Attribution, Human Attention Alignment, AI Transparency

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21406 2025-07-30 cs.AI 77%

Shapley Uncertainty in Natural Language Generation

Meilin Zhu, Gaojie Jin, Xiaowei Huang, Lijun Zhang

机构 * University of Exeter(埃克塞特大学) University of Liverpool(利物浦大学) ISCAS(国际信息科学协会)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21141 2025-07-30 cs.AI 77%

The Geometry of Harmfulness in LLMs through Subconcept Probing

McNair Shah, Saleena Angeline, Adhitya Rajendra Kumar, Naitik Chheda, Kevin Zhu, Vasu Sharma, Sean O'Brien, Will Cai

机构 * Algoverse AI Research(Algoverse AI研究院) Berkeley(伯克利大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11468 2025-07-30 cs.LG 70%

Can sparse autoencoders make sense of gene expression latent variable models?

Viktoria Schuster

机构 * Eric and Wendy Schmidt Center, Broad Institute of MIT and Harvard(埃里克和文迪斯中心,哈佛-麻省理工Broad研究所) Department of Computer Science, University of Copenhagen(哥本哈根大学计算机科学系)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01751 2025-07-30 cs.AI cs.CL cs.LG 67%

SAKE: Steering Activations for Knowledge Editing

Marco Scialanga, Thibault Laugel, Vincent Grari, Marcin Detyniecki

机构 * EPFL(苏黎世联邦理工学院) AXA(安盛集团) TRAIL, LIP6, Sorbonne Université(TRAIL、LIP6、索邦大学) Polish Academy of Science, IBS PAN(波兰科学院、IBS PAN)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21369 2025-07-30 cs.CL 57%

Turbocharging Web Automation: The Impact of Compressed History States

Xiyue Zhu, Peng Tang, Haofu Liao, Srikar Appalaraju

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) AWS AI Labs(亚马逊AWS人工智能实验室)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏