arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-27 至 2026-08-27 共收录 239 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 9 篇

2608.25657 2026-08-27 cs.AI cs.LG cs.PL cs.SE 新提交 91%

Narcissus: Program Synthesis Using Context-Aware LLM Approximations

Narcissus:使用上下文感知大语言模型近似值的程序合成

Tilman Hinnerichs, Sebastijan Dumancic, Neil Yorke-Smith

机构 * Delft University of Technology(代尔夫特理工大学)

专题命中 预训练与数据 :LLM(title,summary_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 Narcissus是一种程序合成器,通过保留LLM提议的语法树并结合上下文评分与正则化项,在多领域搜索中优于静态引导及修复提议的方法,解决ARC任务的比例显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25904 2026-08-27 cs.CL 新提交 88%

One Form to Transfer Them All: Pretraining Multilingual Language Models Beyond Native Orthography

一种实现跨语言迁移的统一形式:超越原生正字法的多语言语言模型预训练

Muge Zhang, Aaron Jencks, Krishna Badikela, Yulia Tsvetkov, Sachin Kumar

机构 * Ohio State University(俄亥俄州立大学) University of Washington(华盛顿大学)

专题命中 预训练与数据 :language model(title,abstract);pretraining(title,abstract);分类 cs.CL

AI总结 本文通过系统对比三种输入表示,发现罗马化预训练可实现最强跨语言迁移,且优势随模型规模增大而扩大,提出多语言模型应将罗马化作为预训练核心设计选择的结论。

Comments EMNLP 2026 (Main Conference). 9 pages, 6 figures (plus appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25663 2026-08-27 cs.IR cs.AI cs.DB cs.DL 新提交 88%

Data Citation for Large Language Models: A Challenge

大语言模型的数据引用:一项挑战

Gianmaria Silvello

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文指出大语言模型的数据引用是一项开放挑战,提出训练数据归因、推理时数据引用、知识图谱事实引用三个研究方向,需跨领域协同推进以解决该问题。

Comments 7 pages, journal paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25768 2026-08-27 cs.CL cs.AI 新提交 86%

MoganBert-TR: A Turkish Encoder Foundation Model Trained from Scratch with a CLM-to-MLM Curriculum

MoganBert-TR:采用CLM到MLM课程从头训练的土耳其编码器基础模型

Furkan Yilmaz, Habibe Aleyna Tasdemir, Muhammed Faruk Gozay

专题命中 预训练与数据 :foundation model(title,abstract);language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

AI总结 本文提出从头训练的土耳其编码器基础模型MoganBert-TR,采用CLM到MLM两阶段课程学习,在TrGLUE等任务上优于同类模型,其衍生嵌入模型MoganBert-Embed在MTEB(土耳其)学生模型中排名第一

Comments 32 pages, 4 figures, 18 tables. Model weights, tokenizer, embedding model and evaluation code: this https URL (https://huggingface.co/moganai)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26088 2026-08-27 cs.AI cs.LG 新提交 81%

Planetary Prediction Engine: Autonomous Geospatial Prediction via Intelligent Data Selection and Foundation Model Embeddings

行星预测引擎:通过智能数据选择和基础模型嵌入实现自主地理空间预测

Evelyn Ma, Rama Kumar Pasumarthi, Kishwar Shafin, Mandar Sharma, Mimi Sun, Hamed Sadeghi, Dav M. Ebengo, Mbulayi Onesime, Rouslan Solomakhin, John Wamburu, William Ogallo, Aisha Walcott-Bryant, Sanxing Chen, Arbaaz Muslim, Yael Mayer, Ronald Ho, Roy Lee, Ruth Alcantara, Abdoulaye Diack, Monica Bharel, Lambert Rosique, Jeremy Amez-Droz, Christopher Haire, James Manyika, Yossi Matias, Niv Efron, Gautam Prasad, Shravya Shetty

机构 * Google Research(谷歌研究院) Institut National de Recherche Biomédicale(国家生物医学研究院)

专题命中 预训练与数据 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究提出行星预测引擎(PPE),一种自主AI系统,可根据自然语言查询完成地理空间预测的端到端工作流程,在多类任务中优于现有模型,降低了行星规模分析的技术门槛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25701 2026-08-27 cs.CV 新提交 78%

Skeleton-based Zero-Shot Spatio-Temporal Action Localization via Weakly-Supervised Pretraining

基于骨骼的零样本时空动作定位:弱监督预训练方法

Koshiro Nagano, Fumiaki Sato, Ryo Hachiuma, Kazuki Tsutsukawa, Taiki Sekii

机构 * Konica Minolta, Inc.(柯尼卡美能达公司) Keio University(庆应义塾大学) CyberAgent(CyberAgent公司) NVIDIA(英伟达公司)

专题命中 预训练与数据 :pretraining(title,abstract)

AI总结 该研究提出基于骨骼的零样本时空动作定位方法,通过弱监督视觉-语言预训练与场景混合判别对比学习,解决标注限制问题,在四个公开数据集上验证了有效性。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25418 2026-08-27 cs.CV 新提交 78%

Bootstrapping a 4D LiDAR Annotation Tool from Video Foundation Models

基于视频基础模型引导的4D激光雷达标注工具

Jihun Kim, Hyun-Kurl Jang, Hyemin Yang, Jinnyeong Yang, Hyeokjun Kweon, Kuk-Jin Yoon

机构 * KAIST(韩国科学技术院) Chung-Ang University(中央大学)

专题命中 预训练与数据 :foundation model(title,abstract)

AI总结 研究针对4D激光雷达标注成本高、难扩展的问题,提出LiDAR-SAM2框架,借助SAM2自动生成标注,大幅降低3D/4D场景理解的标注负担。

Comments ECCV 2026 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25478 2026-08-27 cs.CL 新提交 77%

VietAIDetector: An Open-Source Zero-Shot Detector for Vietnamese AI-Generated Text

VietAIDetector:一款开源的越南语AI生成文本零样本检测器

Trieu Hai Nguyen, Van-Dung Hoang

机构 * Nha Trang University(芽庄大学) Ho Chi Minh City University of Technology and Engineering(胡志明市技术与工程大学)

专题命中 预训练与数据 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究提出开源越南语AI生成文本零样本检测器VietAIDetector,基于越南语专用语言模型,在域外数据集上性能优于英语现有方法,可通过Gradio网页界面交互,支持多类输入并输出检测结果。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25140 2026-08-27 cs.CV cs.CL 新提交 70%

RefLAM: A Reference-Grounded Line Annotation Pipeline for Historical Arabic Manuscripts

RefLAM:一种用于历史阿拉伯文手稿的参考依据型行标注流水线

Mohamed Guechaoui, Mohamed Diaa Zellagui, Souleyman Chaib, Sahraoui Dhelim

机构 * Higher School of Computer Science (ESI-SBA)(高等计算机科学学院(ESI-SBA))

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 RefLAM是用于历史阿拉伯文手稿的参考依据型行标注流水线,结合深度学习、MLLM与模糊对齐引擎,可高效生成标注数据,吞吐量较手动标注提升75倍,发布的AraMS-28k可用于HTR模型微调。

Comments 11 pages, 6 figures, 3 tables, 2 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 22 篇

2608.25068 2026-08-27 cs.CV 新提交 91%

SHIFT-LLM: Distribution Shift Correction in Depth-Pruned LLMs

SHIFT-LLM:深度剪枝大语言模型中的分布偏移校正

Ali Bahri, Hang Li, Hongliang Li, Zhitang Chen

机构 * Huawei Noah’s Ark Lab(华为诺亚方舟实验室)

专题命中 指令微调 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 SHIFT-LLM是一种无需训练的剪枝后校正框架,通过插入线性残差适配器缓解深度剪枝大语言模型的分布偏移,可在低样本无梯度下恢复准确率,在Llama-3.1-8B-Instruct上增益达15.7个点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24988 2026-08-27 cs.CL cs.AI cs.LG 新提交 91%

Does Fine-Tuning Undo Activation Steering? Behavioural Recovery Without Weight-Edit Reversal

微调会撤销激活引导吗?无需权重编辑反转的行为恢复

Philipp E. Glass, Allan Tucker, Yongmin Li, Alina Miron

机构 * Brunel University of London(布鲁内尔伦敦大学)

专题命中 指令微调 :SFT(summary_cn,abstract);RLHF(summary_cn,abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文研究语言模型嵌入的激活引导在SFT、RLHF微调后的稳定性,发现其机制耐久但功能脆弱,需下游训练后重新验证行为。

Comments Accepted at EMNLP 2026 Main. Earlier version at ICLR 2026 Re^4-Align Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25579 2026-08-27 cs.CL 新提交 89%

Cross-Dataset Stability of Expert-Informed Skill Prompting and Fine-Tuning for Chinese Metaphor Identification

面向中文隐喻识别的专家指导型技能提示与微调的跨数据集稳定性

Yufeng Wu, Meichun Liu

机构 * City University of Hong Kong(香港城市大学)

专题命中 指令微调 :prompting(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本研究比较四种方法在中文隐喻识别中的跨数据集表现,发现专家指导型技能提示可提升跨数据集稳定性,微调则在原生数据集上更具优势。

Comments 6 pages, 1 figure, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25428 2026-08-27 cs.CL cs.AI 新提交 87%

DCGC: Draft-Conditioned Global Correction for Complex Reasoning with Masked Diffusion Models

DCGC:基于草稿条件的全局修正,用于带掩码扩散模型的复杂推理

Minhae Oh, Nakyung Lee, Jungwoo Lee

机构 * Seoul National University(首尔大学)

专题命中 指令微调 :SFT(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 DCGC是结合SFT与动态双CFG机制的MDM框架,用于修正LLMs推理错误,在多推理基准中优于现有方法,可作为无验证器的全局修正模块。

Comments 21 pages, 3 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25243 2026-08-27 cs.CL cs.LG 新提交 87%

From Memorization to Absorption: Mixed-Policy RL for Continual Knowledge Injection

从记忆到吸收:用于持续知识注入的混合策略强化学习

Zhibo Hou, Fan Zhao, Zhiyu An, Wan Du

机构 * University of California, Merced(加州大学默塞德分校)

专题命中 指令微调 :SFT(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 针对大语言模型持续知识注入中监督微调泛化不足的问题,提出三阶段自学习框架GRIN,其核心为混合策略RL算法Golden-GRPO,引入两个基准验证,结果表明GRIN性能优于SFT及混合策略RL基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25605 2026-08-27 cs.CL 新提交 84%

From Specialization to Generalization: Instruction-tuned LLMs for Robust Harmful Content Mitigation

从专业化到通用化:用于稳健有害内容缓解的指令调优大语言模型

Lukas Edman, Daryna Dementieva, Alexander Fraser

机构 * School of Computation, Information and Technology, TU Munich(慕尼黑工业大学计算、信息与技术学院) Munich Center for Machine Learning(慕尼黑机器学习中心) Munich Data Science Institute(慕尼黑数据科学研究所)

专题命中 指令微调 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);instruction tuning(abstract)

AI总结 该研究针对LLMs在仇恨言论检测等敏感领域表现不佳的问题,基于Qwen3,通过统一36个英语仇恨言论数据集进行指令调优,提升了模型在有害内容缓解上的跨域、跨语言泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25429 2026-08-27 cs.AI cs.LG 新提交 84%

Distance Is Not Enough: Forget-Retain Alignment Gap Predicts LLM Relearning Robustness

距离并不足够:遗忘-保留对齐间隙可预测大语言模型的再学习鲁棒性

Yi Chen, Hanna Hsieh, Shuhong Liu, Chuanbo Hua, Zihan Ma, Kun Wang, Joo-Young Kim

机构 * The University of Tokyo(东京大学) KAIST(韩国科学技术院)

专题命中 指令微调 :LLM(title,summary_cn);分类 cs.AI、cs.LG

AI总结 该研究提出FRAG预测器,基于权重选择性而非距离,结合FRP方法提升LLM再学习鲁棒性,揭示权重选择性对鲁棒性的解释力优于单独距离。

Comments Accepted to EMNLP 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25826 2026-08-27 cs.CL cs.AI cs.LG 新提交 83%

Unfolding Scientific Papers into Multi-Turn Generation Trajectories for Continued Pre-Training

将科学论文展开为多轮生成轨迹用于持续预训练

Qiankai Xu, Qiguang Chen, Zixin Su, Wenhao Huang, Yue Gao, Jiaheng Liu, Ge Zhang

专题命中 指令微调 :SFT(summary_cn,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究提出将科学论文展开为多轮生成轨迹的流程构建CPT语料库,经CPT后微调可提升写作性能与长文档阅读能力,混合SFT数据可进一步优化学术写作表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24901 2026-08-27 cs.CL cs.HC cs.LG 新提交 82%

Detection != Reliable Control: Decodable Empathy Directions Yield at Most Partial Shifts in Automated Empathy Scores

检测≠可靠控制:可解码的共情方向在自动共情评分中仅产生最多部分偏移

Haoran Jisun

机构 * University of Southern California(南加州大学)

专题命中 指令微调 :LLM(summary_cn,abstract);分类 cs.CL、cs.LG

AI总结 本研究针对EPITOME的认知与情感共情维度,在三个指令微调LLM中发现,可解码的共情方向仅能部分控制自动共情评分,认知维度的控制不可靠,需对认知共情主张做测量敏感性检验。

Comments Under review at BlackboxNLP 2026 (EMNLP). 8 pages body, 10 figures/tables, plus appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25580 2026-08-27 cs.CV cs.AI 新提交 81%

V-Rubrics: Visual Faithfulness via Rubric-Based Reinforcement Learning

V-Rubrics:基于评分规则的强化学习实现视觉忠实性

Shulin Tian, Minglun Li, Yuhao Dong, Hao Ding, Jiarui Yao, Haiwen Diao, Jingkang Yang, Hongyuan Zhu, Ziwei Liu

机构 * S-Lab, Nanyang Technological University(新加坡南洋理工大学S-Lab) UIUC(伊利诺伊大学厄巴纳-香槟分校) A*STAR(新加坡科技研究局)

专题命中 指令微调 :SFT(abstract,abstract_cn);language model(abstract);post-training(abstract);分类 cs.AI

AI总结 该研究针对视觉-语言模型回答缺乏视觉依据的问题,提出基于评分规则的强化学习方法V-Rubrics,通过分解响应为原子命题并从三方面评分,训练的模型在相关推理基准上性能优于基线。

Comments Proj page: this https URL (https://shulin16.github.io/v-rubrics/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26044 2026-08-27 math.AC 新提交 80%

Polynomial extensions do not preserve the strong finite type property

多项式扩张不保持强有限型性质

Viet-Hoang Tran, Phan Thanh Toan, Thieu N. Vo, Tan M. Nguyen

专题命中 指令微调 :SFT(summary_cn,abstract)

AI总结 该研究针对多项式扩张是否保持强有限型(SFT)性质这一公开问题,构造出SFT环R但R[X]非SFT,给出了否定解答。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25048 2026-08-27 cs.SI 新提交 78%

Tabular Foundation Models for Multi-View Information Cascade Popularity Prediction

面向多视图信息级联流行度预测的表格基础模型

Wenting Zhu, Chenghua Gong, Sanchuan Guo, Chaozhuo Li, Yueyue Zhang, Xi Zhang

专题命中 指令微调 :foundation model(title,abstract)

AI总结 该研究针对信息级联流行度预测的现有局限,提出双分支设计的TFM4POP框架,结合表格基础模型与神经ODE编码器,通过参数高效微调实现多视图建模,在多数据集上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26013 2026-08-27 cs.CL 新提交 70%

VISA: Agentic Self-Evolving Data Synthesis for Multimodal Instruction Following

VISA:用于多模态指令遵循的智能体式自进化数据合成

Min Zeng, Guanxin Tan, Libin Cen, Yawei Wen, Rui Hu, Liuyang Bian, Xiaolong Chen, Xiaoxin Chen

机构 * vivo AI Lab(vivo AI实验室)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 VISA是一种智能体式自进化数据合成框架,通过自进化循环优化多模态指令合成,在MM-IFEval等基准上提升了多模态指令遵循性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25677 2026-08-27 cs.CL cs.AI cs.LG 新提交 67%

Learning New Facts with QLoRA: An Acquisition-Retention Frontier

用QLoRA学习新事实:获取-保留前沿

Estelle Zheng, Sébastien Warichet, Emmanuel Helbert, Christophe Cerisara

机构 * LORIA, CNRS(洛林信息学与应用实验室,法国国家科学研究中心) Alcatel-Lucent Enterprise(阿尔卡特朗讯企业通信)

专题命中 指令微调 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究以Qwen3-4B为对象,对比FFT与不同秩的QLoRA,发现秩会形成事实获取与保留的前沿,该效应在需安装新事实关联时更显著。

Comments accepted EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25529 2026-08-27 cs.CV 新提交 67%

Video-IFBench: Evaluating Instruction Following of Multimodal LLMs in Video Understanding Scenarios

Video-IFBench:评估多模态大语言模型在视频理解场景中的指令遵循能力

Hongbo Liu, Peixian Chen, Sihan Liu, Peiyuan Zhang, Kai Zou, Dian Zheng, Xiaoxing Hu, Yuhao Dong, Mengdan Zhang, Yunhang Shen, Haoyu Cao, Wei Liu, Weibo Gu, Xing Sun, Shengjie Zhao

机构 * TJU(天津大学) Tencent Youtu Lab(腾讯优图实验室) SJTU(上海交通大学) Tencent Hunyuan(腾讯混元) CUHK(香港中文大学) NTU(南洋理工大学)

专题命中 指令微调 :large language model(abstract);language model(abstract)

AI总结 本文推出Video-IFBench基准,构建含四类模板的指令分类体系与半自动数据 pipeline,评估20余种MLLMs的视频指令遵循能力,发现当前模型在复杂指令上仍具挑战,推动相关研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25927 2026-08-27 cs.CV cs.AI cs.CL 新提交 62%

Code World Model: Coding Agent as World Brain

代码世界模型:作为世界大脑的编码智能体

Yiwen Chen, Guosheng Lin, Chi Zhang

机构 * Westlake AGI Lab(西湖AGI实验室)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出Code World Model框架,以编码智能体为世界大脑生成可执行代码维持世界状态,结合视频模型实现视觉渲染,在游戏数据微调后取得良好效果,为开放式世界模型提供新路径。

Comments Project Page: this https URL (https://buaacyw.github.io/cwm/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25390 2026-08-27 cs.LG cs.AI cs.CR 新提交 62%

Refusal geometry reflects refusal training: diverse refusal prefixes can raise stable rank and weaken refusal vector ablation attacks

弃权几何反映弃权训练:多样的弃权前缀可提升稳定秩并削弱弃权向量消融攻击

Andrey Labunets

机构 * UC San Diego(加州大学圣迭戈分校)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究以OLMo-2-0425-1B-Instruct为对象,揭示弃权几何与弃权训练的关联,发现多样弃权起始可提升梯度稳定秩,削弱弃权向量消融攻击,为提升AI模型弃权鲁棒性提供新视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25037 2026-08-27 cs.AI cs.CL cs.DB cs.IR 新提交 62%

Retrieve, Match, Escalate: Accurate and Scalable Product Linking with VLM-Distilled Cross-Encoders and Agentic VLMs

检索、匹配、升级:基于VLM蒸馏的交叉编码器与智能体VLMs的准确且可扩展的商品链接

Jian Wang, Steven Xu, Sanjyot Thete, Maryam Barouti, Tom Tang, Elaine Wu, Charu Sareen, Kyle MacDonald

机构 * DoorDash Inc.(DoorDash公司)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究针对大规模商品链接的成本与精度矛盾,提出“检索-匹配-升级”级联框架,用VLM蒸馏的交叉编码器处理多数简单案例,智能体VLM解决模糊案例,提升了链接覆盖率且降低成本。

Comments 9 pages, 3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26060 2026-08-27 cs.CL stat.ML 新提交 57%

Fine-Tuning Whisper for Automatic Speech Recognition in Baniwa: A Preliminary Study

微调Whisper以实现巴尼瓦语的自动语音识别:一项初步研究

Leonardo Duart, Tiago Fonseca, Thiago Chacón

机构 * University of Brasilia(巴西利亚大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.CL

AI总结 本研究对Whisper Small进行微调,构建巴尼瓦语ASR初始基准,证实多语言基础模型可适配资源匮乏的土著语言,为后续相关研究提供支撑。

Comments 12 pages, 3 tables. Preliminary study

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25707 2026-08-27 cs.LG 新提交 57%

Fairness-Aware Test-Time Prompt Tuning

感知公平性的测试时提示调优

Yoann Launay, Parameswaran Kamalaruban, Tom Kempton, Stuart Burrell, David Sutton

机构 * University of Cambridge(剑桥大学) Visa Inc.(维萨公司) University of Manchester(曼彻斯特大学)

专题命中 指令微调 :language model(abstract);分类 cs.LG

AI总结 本文针对分布偏移下视觉-语言模型的公平性问题,提出了感知公平性的情节式测试时自适应方法FairTPT,通过软提示调优联合优化熵,实现公平性提升并优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25038 2026-08-27 cs.CL 新提交 57%

Padamitra: Grounded Glossary Generation for Classical Sanskrit

Padamitra:基于 grounded 术语表生成的古典梵语研究

Manoj Balaji Jagadeeshan, Sai Pragnaan Marala, Pawan Goyal

专题命中 指令微调 :prompting(abstract);分类 cs.CL

AI总结 该研究提出 grounded 术语表生成任务,构建含31316个三元组的梵语基准,发现指令微调及显式分词可提升性能,指出形态建模是梵词语法分解的关键瓶颈。

Comments Accepted in the Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏