arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Conference on Empirical Methods in Natural Language Processing · 会议 · Natural Language Processing

2026-01-26 至 2026-01-26 共收录 3
2509.14558 2026-01-26 cs.CR cs.AI cs.CL

LLM Jailbreak Detection for (Almost) Free!

几乎免费的LLM劫持检测

Guorui Chen, Yifan Xia, Xiaojun Jia, Zhijiang Li, Philip Torr, Jindong Gu

机构 * School of Information Management, Wuhan University(武汉大学信息管理学院) Nanyang Technological University(南洋理工大学) Torr Vision Group, University of Oxford(牛津大学Torr视觉组)

AI总结 本文提出了一种几乎免费的LLM劫持检测方法,通过调整输入指令和logits温度来提高检测性能,无需额外计算成本。

Comments EMNLP 2025 (Findings) https://aclanthology.org/2025.findings-emnlp.309/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22928 2026-01-26 cs.AI cs.CL

Enhancing Study-Level Inference from Clinical Trial Papers via Reinforcement Learning-Based Numeric Reasoning

通过基于强化学习的数值推理增强临床试验论文的论文级别推断

Massimiliano Pronesti, Michela Lorandi, Paul Flanagan, Oisin Redmond, Anya Belz, Yufang Hou

机构 * IBM Research Europe - Ireland(IBM欧洲研究院-爱尔兰) Dublin City University(都柏林城市大学) IT:U Interdisciplinary Transformation University Austria(IT:U跨学科转型大学奥地利)

AI总结 本研究通过强化学习和数值推理提升临床试验论文的论文级别推断,实现更准确的系统评价自动化。

Comments Accepted at EMNLP 2025 Main Conference. This revision corrects a minor typo in the camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12819 2026-01-26 cs.CL cs.AI cs.LG

Comparing Specialised Small and General Large Language Models on Text Classification: 100 Labelled Samples to Achieve Break-Even Performance

比较专门化的小型模型和通用的大型模型在文本分类中的表现:100个标注样本实现平衡性能

Branislav Pecher, Ivan Srba, Maria Bielikova

机构 * Faculty of Information Technology, Brno University of Technology(信息技术学院,布拉格技术大学) Kempelen Institute of Intelligent Technologies(智能技术研究所)

AI总结 研究比较了专门化小型模型与通用大型模型在文本分类中的表现,发现平均100个标注样本即可实现平衡性能,且样本需求受任务特征和方差影响显著。

Comments Accepted to the EMNLP 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏