Pseudo-OOD training for robust language models
专题命中 其他LLM :language model(title);分类 cs.CL
Comments Work in progress
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 其他LLM :language model(title);分类 cs.CL
Comments Work in progress
专题命中 其他LLM :language model(title);分类 cs.CL
专题命中 其他LLM :language model(title);分类 cs.CL
Comments ICLR 2022 Main Conference
专题命中 其他LLM :language model(title);分类 cs.AI
专题命中 其他LLM :language model(title);分类 cs.CL
专题命中 其他LLM :language model(title);分类 cs.CL
Comments Accepted at EMNLP 2021
专题命中 其他LLM :language model(title);分类 cs.CL
Comments 5 pages. Accepted at the 2nd Workshop on Social Affective Multimodal Interaction for Health (SAMIH) at ICMI 2021
专题命中 其他LLM :language model(title);分类 cs.CL
Comments Accepted in EMNLP 2021
专题命中 其他LLM :language model(title);分类 cs.CL
Comments Accepted by ACL 2021
专题命中 其他LLM :language model(title);分类 cs.CL
Comments Submitted to ICANN2021
专题命中 其他LLM :language model(title);分类 cs.CL
专题命中 其他LLM :language model(title);分类 cs.CL
Comments accepted for publication at MWE-LEX 2020 Workshop at COLING
专题命中 其他LLM :language model(title);分类 cs.CL
Comments Interspeech 2020
专题命中 其他LLM :language model(title);分类 cs.CL
专题命中 其他LLM :language model(title);分类 cs.CL
Comments 5 pages + 3 pages SI
Journal ref Phys. Rev. Lett. 122, 128301 (2019)
专题命中 其他LLM :language model(title);分类 cs.CL
Comments Best paper award at the IJCAI workshop on NLP Meets Journalism; 5 pages, 2 figures; data and other info available at http://www.cs.cornell.edu/~liye/tennis.html
专题命中 其他LLM :language model(title);分类 cs.CL
Comments 8 pages, 2 tables
Journal ref Psychology of Language and Communication. 2009, vol. 13, no. 2, pp. 35-44
专题命中 其他LLM :language model(title);分类 cs.CL
Comments 12 pages, uses iwpt97.sty
Journal ref Proceedings of the Fifth International Workshop on Parsing Technologies, MIT, Boston MA, 1997
withhold the Completing Chunk: 面向流式大语言模型输出的确定性配对完成护栏
专题命中 其他LLM :LLM(summary_cn);分类 cs.CL、cs.AI
AI总结 本研究提出流式LLM输出的确定性配对完成护栏,通过扫描前缀扣留配对完成块,实验验证其效果,表明它是小型固定策略的精确发布边界后盾。
Comments 9 pages, 2 figures, 4 tables. Substantially revised version
一种用于缓解医疗查询中患者上下文歧义的知识引导智能体框架
专题命中 其他LLM :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI
AI总结 该研究提出知识引导智能体框架,通过解析医疗查询、构建假设、识别缺失上下文并提问,缓解患者上下文歧义,在诊断检索和饮食安全分类任务中显著提升了多种语言模型的性能。
Comments 48 pages, 3 figures, 6 tables, journal
对话式AI能否弱化“我们与他们”的界限?共同、双重及分离身份框架对支持移民的群体间帮助的影响
专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI
AI总结 该研究通过与GPT-4o开展五轮对话的预先注册实验,发现强调共同或双重身份的AI对话可弱化群体间界限,提升行动意愿,且效应在各调节变量中基本一致。
查询时机在大型语言模型(LLMs)与人类之间产生相反的位置偏差
机构 * Princeton University(普林斯顿大学)
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究探究查询时机对LLMs和人类位置偏差的影响,发现二者存在差异,且新LLMs的位置偏差比前代更显著。
Comments Entropic Award (Top 3 Paper), ICBINB @ ICLR 2026
揭示AI多智能体系统中的对话偏见
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究针对AI多智能体系统的对话偏见检测空白,提出对话型LLMs多智能体系统偏见量化框架,发现现有问卷式方法无法检测到该场景下的偏见,呼吁开发更复杂的偏见检测与缓解工具包。
超越特征袋:稀疏自编码器中的集合级不稳定性
机构 * Heidelberg University(海德堡大学)
专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL、cs.LG
AI总结 该研究以稀疏自编码器(SAE)隐集合重叠度为相似度度量,发现SAE特征不通过简单特征袋语义组合,其激活集合与人类概念判断存在显著不匹配。
理论引导的欺骗检测:基于检索增强生成(RAG)的人工智能探索
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究基于欺骗理论开发7个RAG模型,对比4个大语言模型与基线模型的欺骗判断,发现RAG模型反应偏差更低但准确率无显著差异,理论引导AI判断当前参数下不可靠,优化后或有潜力。
基因型触发器:通过生成抗菌肽模型中宿主特定后门暴露药物基因组学盲区
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究提出基因型触发器后门攻击,操控抗菌肽生成模型使其针对特定HLA等位基因携带者生成高免疫原性风险肽,同时保留抗菌效力与低毒性,以暴露药物基因组学盲区。
重新评估用于矩阵分解的Muon优化器
机构 * Halicioğlu Data Science Institute, UC San Diego(加州大学圣地亚哥分校哈利西奥卢数据科学研究所) ; Department of Mathematics, UC San Diego(加州大学圣地亚哥分校数学系)
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 研究在低秩矩阵分解问题上重新评估Muon优化器,通过与精心调整的自适应基线对比,发现Muon在此设置下不始终优于AdamW,一些优势对超参数选择敏感,更细致地展现谱感知正交化何时有益,主张在受控问题上评估优化器。
AROpt: 一种用于自回归时间序列预测的优化方法
机构 * Department of Computer Science(计算机科学系) ; New York Institute of Technology(纽约理工学院)
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 本文提出一种新方法,通过强制预测误差随预测时间增加而增长,提升自回归时间序列预测的准确性与灵活性,实验表明在多个基准上取得新突破。
Comments 16 pages, 5 figures, 6 tables
由人工智能驱动的针对患有注意力缺陷多动障碍、阅读障碍和注意力持续时间短的学生的快速阅读工具
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 针对阅读障碍、多动症及注意力不集中学生,提出用云托管大语言模型与自适应排版结合的人工智能工具,通过向Gemini API请求实时生成摘要,接受多种文件输入,优化可读性,经Flask框架部署,显著提升阅读速度与理解能力。
PEARL:基于自然语言的循环求解器交互式优化建模
专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 研究旨在解决优化建模问题,提出PEARL系统,通过在循环中使用Python执行和数学编程求解器,学习优化策略,在多轮工具集成设置下提升求解率,在优化建模任务中表现优于强大基线。