Eliciting Least-to-Most Reasoning for Phishing URL Detection
诱发最小到最大推理以检测钓鱼网址
机构 * University of Sydney(悉尼大学)
专题命中 仓库级理解 :repository(abstract);分类 cs.AI
AI总结 本文提出了一种最小到最大提示框架,通过引入答案敏感性机制提升钓鱼网址检测的推理能力和准确性,优于一次性方法和监督模型。
AI 大模型
代码生成、软件工程智能体、程序修复、测试生成和开发者工具。
诱发最小到最大推理以检测钓鱼网址
机构 * University of Sydney(悉尼大学)
专题命中 仓库级理解 :repository(abstract);分类 cs.AI
AI总结 本文提出了一种最小到最大提示框架,通过引入答案敏感性机制提升钓鱼网址检测的推理能力和准确性,优于一次性方法和监督模型。
理解 npm 开发者的行为、挑战及安全包开发的建议
专题命中 仓库级理解 :repository(abstract);分类 cs.SE
AI总结 本研究通过调查75名npm开发者,探讨其在安全包开发中的实践、挑战及改进建议,揭示了安全工具不足、依赖项弃用等问题。
Comments The 19th IEEE/ACM International Conference on Cooperative and Human Aspects of Software Engineering - Research Track
你忘记fork了吗?通过全球历史分析检测开源fork中的单日漏洞
专题命中 仓库级理解 :repository(abstract);分类 cs.SE
AI总结 本文提出一种全球历史分析方法,用于检测开源fork中的单日漏洞,通过传播漏洞信息和自动化影响分析,发现135个高严重性漏洞。
语言模型的不确定性量化:一套黑盒、白盒、LLM评判者和集成评分器
机构 * CVS Health(CVS健康公司)
专题命中 仓库级理解 :分类 cs.CL、cs.AI、cs.LG;repository(comments)
AI总结 本文提出了一种灵活的框架,利用黑盒、白盒、LLM评判者和集成评分器来检测语言模型的幻觉问题,通过可调节的集成方法提升检测性能。
Comments Accepted by TMLR; UQLM repository: https://github.com/cvs-health/uqlm
Journal ref Transactions on Machine Learning Research, 2025
单目标定位中视觉变量的可定位性与可定位性鲁棒性
专题命中 仓库级理解 :repository(abstract)
AI总结 本文研究了单目标定位中视觉变量的可定位性与鲁棒性,通过实验证明不同视觉变量在对象数量、目标位置和布局上的表现差异。
AI辅助编程通过增加技术债务和维护负担降低了有经验开发者的生产力
专题命中 仓库级理解 :repository(abstract)
AI总结 AI辅助编程虽提升短期生产力,但增加技术债务和维护负担,尤其加重核心开发者的负担。
Comments Presented at WITS 2025, CIST 2025, SCECR 2025, INFORMS 2024