arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-15 至 2026-01-15 共收录 18 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 18 篇

2601.05302 2026-01-15 cs.AI 89%

Effects of personality steering on cooperative behavior in Large Language Model agents

人格引导对大型语言模型代理合作行为的影响

Mizuki Sakai, Mizuki Yokoyama, Wakaba Tateishi, Genki Ichinose

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本研究通过囚徒困境实验发现,宜人性是促进大型语言模型合作的主要因素,而其他人格特质影响有限,且显式人格信息可能增加被利用的风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09264 2026-01-15 cs.AI 89%

Coordinated Pandemic Control with Large Language Model Agents as Policymaking Assistants

利用大语言模型代理进行协调的流行病防控

Ziyi Shi, Xusen Guo, Hongliang Lu, Mingxing Peng, Haotian Wang, Zheng Zhu, Zhenning Li, Yuxuan Liang, Xinhu Zheng, Hai Yang

机构 * The Hong Kong University of Science and Technology, Hong Kong(香港科学与技术大学) The Hong Kong University of Science and Technology (Guangzhou), China(香港科学与技术大学(广州)) Zhejiang University, China(浙江大学) University of Macau, Macau(澳门大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出利用大语言模型多代理系统进行协调流行病防控,通过模拟和闭环过程减少感染和死亡率。

Comments 20pages, 6 figures, a 60-page supporting material pdf file

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09141 2026-01-15 cs.CL 87%

Identity-Robust Language Model Generation via Content Integrity Preservation

通过内容完整性保护实现身份鲁棒的语言模型生成

Miao Zhang, Kelly Chen, Md Mehrab Tanjim, Rumi Chunara

机构 * New York University(纽约大学) Adobe Research(Adobe研究)

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

AI总结 本文提出了一种轻量级、无需训练的框架,通过保留语义关键属性并中和非关键身份信息,实现身份鲁棒的语言模型生成,有效减少身份依赖性偏见。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09692 2026-01-15 cs.CL cs.AI cs.LG 87%

Routing with Generated Data: Annotation-Free LLM Skill Estimation and Expert Selection

基于生成数据的路由:无标注LLM技能估计与专家选择

Tianyi Niu, Justin Chih-Yao Chen, Genta Indra Winata, Shi-Xiong Zhang, Supriyo Chakraborty, Sambit Sahu, Yue Zhang, Elias Stengel-Eskin, Mohit Bansal

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) Capital One(Capital One公司) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出CASCAL,一种通过共识投票和层次聚类提升LLM路由性能的查询-only路由器,在弱生成器数据下表现更优。

Comments Code: https://github.com/tianyiniu/RoutingGenData

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20634 2026-01-15 econ.EM cs.AI econ.GN q-fin.EC stat.ME 85%

Recidivism and Peer Influence with LLM Text Embeddings in Low Security Correctional Facilities

再犯与同伴影响:在低安全矫正设施中使用LLM文本嵌入

Shanjukta Nath, Jiwon Hong, Jae Ho Chang, Keith Warren, Subhadeep Paul

机构 * Department of Agricultural and Applied Economics, University of Georgia(农业与应用经济学系,佐治亚大学) Department of Statistics, The Ohio State University(统计系,俄亥俄州立大学) College of Social Work, The Ohio State University(社会工作学院,俄亥俄州立大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文利用LLM文本嵌入分析低安全矫正设施居民的语言数据,发现其能更准确预测再犯率,揭示同伴效应在语言特征中的显著影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05603 2026-01-15 cs.IR 85%

Revisiting Human-vs-LLM judgments using the TREC Podcast Track

重新审视人类与大语言模型的判断使用TREC播客赛道

Watheq Mansour, J. Shane Culpepper, Joel Mackenzie, Andrew Yates

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文通过TREC播客赛道分析LLM与人类专家的一致性,发现人类更倾向于与LLM一致,支持单一评估者导致低一致性的结论。

Comments Version 2: The paper has been accepted to appear at ECIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09182 2026-01-15 cs.AI cs.CY cs.HC 79%

Position on LLM-Assisted Peer Review: Addressing Reviewer Gap through Mentoring and Feedback

LLM辅助同行评审的位置:通过指导与反馈解决评审缺口

JungMin Yun, JuneHyoung Kwon, MiHyeon Kim, YoungBin Kim

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文提出通过LLM辅助指导和反馈系统解决评审缺口问题,旨在提升评审质量并促进学术生态可持续发展。

Comments Accepted to AAAI 2026 Workshop on AI for Scientific Research (AI4Research)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08871 2026-01-15 cs.SD cs.AI eess.AS 79%

Semantic visually-guided acoustic highlighting with large vision-language models

语义视觉引导的音频突出与大型视觉-语言模型

Junhua Huang, Chao Huang, Chenliang Xu

机构 * University of Rochester(罗切斯特大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.AI

AI总结 本文提出利用大型视觉-语言模型提取视觉-语义特征,以提升音频混音质量,发现摄像机焦点、语气和场景背景对感知混音质量提升最显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09041 2026-01-15 cs.CL cs.AI 73%

Can LLMs interpret figurative language as humans do?: surface-level vs representational similarity

LLMs能否像人类一样解读隐喻语言?:表层相似性与表征相似性

Samhita Bollepally, Aurora Sloman-Moll, Takashi Yamauchi

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了LLM在解读隐喻性语言方面是否能像人类一样,发现GPT-4在表征层面最接近人类,但所有模型在处理讽刺、俚语和隐喻时均表现不佳。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04495 2026-01-15 cs.CL cs.AI 73%

OUNLP at TSAR 2025 Shared Task: Multi-Round Text Simplifier via Code Generation

OUNLP在TSAR 2025共享任务中的表现:通过代码生成的多轮文本简化

Cuong Huynh, Jie Cao

机构 * School of Computer Science University of Oklahoma(计算机科学学院俄克拉荷马大学)

专题命中 其他LLM :LLM(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 OUNLP通过代码生成在TSAR 2025共享任务中提出多轮文本简化方法,利用基于规则和LLM的联合简化技术提升可读性控制的文本简化性能。

Comments Accepted to TSAR 2025 Workshop at EMNLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09680 2026-01-15 cs.AI 70%

Automating Supply Chain Disruption Monitoring via an Agentic AI Approach

通过代理AI方法自动化供应链中断监控

Sara AlMahri, Liming Xu, Alexandra Brintrup

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 通过代理AI方法,实现对供应链中断的自动化监控与响应,提升供应链的主动韧性和抗风险能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09000 2026-01-15 cs.LG 70%

Universal Dynamics of Warmup Stable Decay: understanding WSD beyond Transformers

Warmup Stable Decay 的普遍动态:在 Transformer 之外理解 WSD

Annalisa Belloni, Lorenzo Noci, Antonio Orvieto

机构 * MPI-IS Tübingen, Germany, ETH Zürich, Switzerland and Politecnico di Torino, Italy(马克斯·普朗克研究所(MPI-IS)图宾根,德国,瑞士苏黎世联邦理工学院(ETH Zürich)和意大利托里诺理工大学(Politecnico di Torino)) ETH Zürich, Switzerland(瑞士苏黎世联邦理工学院(ETH Zürich)) MPI-IS, ELLIS Institute Tübingen, Tübingen AI Center, Germany(马克斯·普朗克研究所(MPI-IS)图宾根,德国,图宾根人工智能中心(Tübingen AI Center))

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本研究通过比较 Transformer 和 CNN 在 WSD 调度下的训练动态,揭示了非凸优化问题中损失景观的共同几何特征。

Comments Accepted at the 2025 HiLD and MOSS Workshops at ICML

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09575 2026-01-15 cs.CV 67%

OpenVoxel: Training-Free Grouping and Captioning Voxels for Open-Vocabulary 3D Scene Understanding

OpenVoxel: 一种无需训练的稀疏体素分组与标注算法用于开放词汇3D场景理解

Sheng-Yu Huang, Jaesung Choe, Yu-Chiang Frank Wang, Cheng Sun

机构 * NVIDIA National Taiwan University(国立台湾大学)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 OpenVoxel通过无需训练的多模态大语言模型实现稀疏体素的分组与标注,提升开放词汇3D场景理解的性能。

Comments project page: https://peterjohnsonhuang.github.io/openvoxel-pages/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08959 2026-01-15 cs.CR cs.SE 67%

Integrating APK Image and Text Data for Enhanced Threat Detection: A Multimodal Deep Learning Approach to Android Malware

整合APK图像和文本数据以增强威胁检测:一种多模态深度学习方法用于Android恶意软件

Md Mashrur Arifin, Maqsudur Rahman, Nasir U. Eisty

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出一种多模态深度学习方法,通过整合APK图像和文本数据提升Android恶意软件检测效果,系统评估不同图像类型和分辨率,并利用CLIP模型增强分析能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09428 2026-01-15 cs.LG cs.GR 57%

Draw it like Euclid: Teaching transformer models to generate CAD profiles using ruler and compass construction steps

用欧几里得的方式绘制:教变换器模型生成CAD轮廓使用直尺和圆规的构造步骤

Siyi Li, Joseph G. Lambourne, Longfei Zhang, Pradeep Kumar Jayaraman, Karl. D. D. Willis

机构 * Autodesk Research(Autodesk研究院)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 本文提出通过直尺和圆规构造步骤生成CAD轮廓的方法,结合强化学习提升生成质量,并实现参数化编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04299 2026-01-15 cs.LG math.OC stat.ML 57%

When do spectral gradient updates help in deep learning?

何时谱梯度更新有助于深度学习?

Damek Davis, Dmitriy Drusvyatskiy

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 本文提出一个分层条件,用于预测谱梯度更新在深度学习中优于欧几里得梯度的方法,通过分析激活矩阵的稳定秩和梯度的核范数比值,揭示了谱方法在训练深度网络中的有效条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09543 2026-01-15 cs.IR 50%

Examining DOM Coordinate Effectiveness For Page Segmentation

检验DOM坐标在页面分割中的有效性

Jason Carpenter, Faaiq Bilal, Eman Ramadan, Zhi-Li Zhang

专题命中 其他LLM :LLM(abstract)

AI总结 研究通过检验DOM坐标在页面分割中的有效性,发现DOM坐标比视觉坐标更优,且简单向量在分割精度上表现更好,提出通过DOM坐标聚类优化页面分割的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26285 2026-01-15 cond-mat.mes-hall 50%

Néel vector and Rashba SOC effects on RKKY interaction in 2D $d$-wave altermagnets

反铁磁矢量和 Rashba 自旋轨道耦合对二维 d-波反铁磁体 RKKY 作用的影响

Hou-Jian Duan, Miao-Sheng Fang, Ming-Xun Deng, Ruiqiang Wang

专题命中 其他LLM :prompting(abstract)

AI总结 研究揭示了反铁磁矢量和Rashba SOC对二维d-波反铁磁体RKKY相互作用的影响,发现新的DM成分及五种机制调控的自旋模型。

详情

展开后加载摘要…

URL PDF HTML 收藏