arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-23 至 2026-01-23 共收录 14 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 14 篇

2503.20062 2026-01-23 cs.CL 90%

Poor Alignment and Steerability of Large Language Models: Evidence from College Admission Essays

大语言模型的对齐性和操控性不足:来自大学录取文书的证据

Jinsook Lee, AJ Alvero, Thorsten Joachims, René Kizilcec

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 本研究通过分析大学录取文书发现,大语言模型在对齐和操控性方面存在不足,提示信息未能有效改变模型输出的语言模式。

Comments 48 pages, 10 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15437 2026-01-23 cs.HC 90%

Exploring Implicit Perspectives on Autism in Large Language Models Through Multi-Agent Simulations

通过多智能体模拟探索大型语言模型中对自闭症的隐含视角

Sohyeon Park, Jesus Armando Beltran, Aehong Min, Anamara Ritt-Olson, Gillian R. Hayes

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 通过多智能体模拟研究大型语言模型对自闭症的隐含视角,揭示其偏见并提出双重共情问题以改进与自闭症人群的互动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15312 2026-01-23 cs.GT cs.AI cs.CL cs.CY cs.HC econ.GN q-fin.EC 88%

Do people expect different behavior from large language models acting on their behalf? Evidence from norm elicitations in two canonical economic games

人们是否对由其代理的大型语言模型表现出不同行为期望?来自两种经典经济游戏中的规范引出证据

Paweł Niszczota, Elia Antoniou

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究发现人们在机器代理决策时应用不同规范,但不反对机器执行规范。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15698 2026-01-23 cs.CV cs.AI 88%

Beyond Visual Safety: Jailbreaking Multimodal Large Language Models for Harmful Image Generation via Semantic-Agnostic Inputs

超越视觉安全:通过语义无关输入对多模态大语言模型进行有害图像生成的劫持

Mingyu Yu, Lana Liu, Zhehao Zhao, Wei Wang, Sujuan Qin

机构 * State Key Laboratory of Networking and Switching Technology, Beijing University of Posts and Telecommunications(网络与交换技术国家重点实验室,北京邮电大学) School of Cyberspace Security, Beijing University of Posts and Telecommunications(网络安全学院,北京邮电大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出BVS框架,通过语义无关输入对多模态大语言模型进行有害图像生成的劫持,揭示其视觉安全边界的脆弱性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16087 2026-01-23 cs.AI cs.CL 86%

Controlling Long-Horizon Behavior in Language Model Agents with Explicit State Dynamics

通过显式状态动力学控制语言模型代理的长周期行为

Sukesh Subaharan

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出通过显式情感动力学控制语言模型代理的长周期行为,通过引入持续的情感状态并结合一阶和二阶更新规则,提升对话的连贯性和响应稳定性。

Comments Supplementary materials can be found here: https://github.com/drsukeshs/agent-behavior-ext-dynamics

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15209 2026-01-23 cs.HC cs.AI 85%

Deaf and Hard of Hearing Access to Intelligent Personal Assistants: Comparison of Voice-Based Options with an LLM-Powered Touch Interface

聋人和听觉障碍者使用智能个人助手:语音基于选项与LLM驱动触控界面的比较

Paige S. DeVries, Michaela Okosi, Ming Li, Nora Dunphy, Gidey Gezae, Dante Conway, Abraham Glasser, Raja Kushalnagar, Christian Vogler

机构 * Gallaudet University(加拉维特大学) University of California, Berkeley(加州大学伯克利分校) Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究比较了语音识别与LLM驱动触控界面在聋人和听力障碍者使用智能个人助手中的可用性,发现两者无显著差异,但需改进对聋人语音的识别能力。

Comments Accepted for publication in ACM CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15351 2026-01-23 astro-ph.IM cs.AI 79%

OmniSpectra: A Unified Foundation Model for Native Resolution Astronomical Spectra

OmniSpectra:一种用于原分辨率天体光谱的统一基础模型

Md Khairul Islam, Judy Fox

专题命中 其他LLM :foundation model(title,abstract);分类 cs.AI

AI总结 OmniSpectra是一种能够处理任意长度光谱的统一基础模型,通过自适应架构和多尺度学习,在天文学任务中展现卓越的迁移学习能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15773 2026-01-23 cs.LG 77%

Next Generation Active Learning: Mixture of LLMs in the Loop

下一代主动学习:循环中的LLM混合

Yuanyuan Qi, Xiaohao Yang, Jueqing Lu, Guoxiang Guo, Joanne Enticott, Gang Liu, Lan Du

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出一种基于混合LLM的主动学习框架,通过聚合多个LLM的优势提升标注鲁棒性,并通过标注差异和负学习提高学习效果,实验证明其性能优于单个LLM和集合方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15493 2026-01-23 cs.SE 75%

Testing Deep Learning Libraries via Neurosymbolic Constraint Learning

通过神经符号约束学习测试深度学习库

M M Abid Naziri, Shinhae Kim, Feiran Qin, Marcelo d'Amorim, Saikat Dutta

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 Centaur通过神经符号约束学习技术,利用动态学习输入约束来测试深度学习库,提高了测试效率和覆盖率,发现多个新错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10637 2026-01-23 cs.HC cs.CY 75%

LLMs Homogenize Values in Constructive Arguments on Value-Laden Topics

LLMs在价值性话题的建设性辩论中同质化价值观

Farhana Shahid, Stella Zhang, Aditya Vashistha

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 LLMs在价值性话题的建设性辩论中同质化价值观,削弱保守观点,提升亲社会价值观,影响在线讨论动态。

Journal ref CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15348 2026-01-23 cs.SD cs.AI cs.CL 73%

Abusive music and song transformation using GenAI and LLMs

利用生成式人工智能和大语言模型进行滥用音乐和歌曲转换

Jiyang Choi, Rohitash Chandra

机构 * Transitional Artificial Intelligence Research Group, School of Mathematics and Statistics, UNSW Sydney, Australia(过渡人工智能研究组,数学与统计学学院) Centre for Artificial Intelligence and Innovation, Pingla Institute, Sydney, Australia(人工智能与创新中心,Pingla研究所)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究利用生成式人工智能和大语言模型转换音乐中的虐待性内容,降低攻击性并保持音乐连贯性,提供更安全的听觉体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06247 2026-01-23 cs.SE cs.AI cs.AR 70%

DUET: Agentic Design Understanding via Experimentation and Testing

DUET:通过实验和测试进行代理设计理解

Gus Henry Smith, Sandesh Adhikary, Vineet Thumuluri, Karthik Suresh, Vivek Pandit, Kartik Hegde, Hamid Shojaei, Chandra Bhagavatula

机构 * Southmountain Research(Southmountain研究机构) ChipStack

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 DUET通过实验和测试提升AI代理在硬件设计验证中的性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15687 2026-01-23 cs.SE cs.AI 57%

FARM: Field-Aware Resolution Model for Intelligent Trigger-Action Automation

FARM:面向智能触发-动作自动化的场感知分辨率模型

Khusrav Badalov, Young Yoon

机构 * Neouly Co., Ltd.(Neouly公司) Hongik University(弘国大学)

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 FARM通过双阶段架构实现智能触发-动作自动化,生成具有正确字段绑定的可执行小应用,提升自动化配置效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15412 2026-01-23 cs.HC cs.AI cs.CY 57%

A Checklist for Trustworthy, Safe, and User-Friendly Mental Health Chatbots

可信、安全且用户友好的心理健康聊天机器人清单

Shreya Haran, Samiha Thatikonda, Dong Whi Yoo, Koustuv Saha

机构 * University of Illinois Urbana-Champaign, Urbana, United States(伊利诺伊大学厄巴纳-香槟分校) Indiana University Indianapolis, Indianapolis, United States(印第安纳大学印第安纳波利斯分校)

专题命中 其他LLM :prompting(abstract);分类 cs.AI

AI总结 本文提出了一套操作清单,旨在指导开发更可信、安全且用户友好的心理健康聊天机器人,以促进伦理和有效的设计实践。

Journal ref In 28th International Conference on Human-Computer Interaction, Springer LNCS, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏