CEE: An Inference-Time Jailbreak Defense for Embodied Intelligence via Subspace Concept Rotation
CEE: 通过子空间概念旋转实现体智能中的推断时间劫持防御
Jirui Yang, Zheyu Lin, Zhihui Lu, Yinggui Wang, Lei Wang, Tao Wei, Qiang Duan, Xin Du, Shuhan Yang
机构
*
Fudan University(复旦大学)
;
Dalian University of Technology(大连理工大学)
;
Ant Group(蚂蚁集团)
;
Pennsylvania State University(宾夕法尼亚州立大学)
;
Zhejiang University(浙江大学)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.LG
Towards LLM-enabled autonomous combustion research: A literature-aware agent for self-corrective modeling workflows
迈向基于大语言模型的自主燃烧研究:一种文献感知的代理用于自修正建模工作流
Ke Xiao, Haoze Zhang, Runze Mao, Han Li, Zhi X. Chen
机构
*
State Key Laboratory of Turbulence and Complex Systems, School of Mechanics and Engineering Science, Peking University(湍流与复杂系统国家重点实验室,力学与工程科学学院,北京大学)
;
AI for Science Institute (AISI)(人工智能科学研究院(AISI))
专题命中
领域大模型
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG
Can Legislation Be Made Machine-Readable in PROLEG?
在PROLEG中如何使立法变得机器可读?
May-Myo Zin, Sabine Wehnert, Yuntao Kong, Ha-Thanh Nguyen, Wachara Fungwacharakorn, Jieying Xue, Michał Araszkiewicz, Randy Goebel, Ken Satoh, Le-Minh Nguyen
机构
*
Center for Juris-Informatics, ROIS-DS, Tokyo, Japan(法律信息中心)
;
Ruhr-University Bochum(波鸿鲁尔大学)
;
Research and Development Center for Large Language Models, NII, Tokyo, Japan(大型语言模型研究开发中心)
;
Uniwersytet Jagielloński w Krakowie(克拉科夫雅盖隆大学)
;
University of Alberta(阿尔伯塔大学)
;
Japan Advanced Institute of Science and Technology, Ishikawa, Japan(日本先进科学技術研究所)
专题命中
领域大模型
:LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)
Mind the Gap: Continuous Magnification Sampling for Pathology Foundation Models
注意间隙:连续放大采样用于病理基础模型
Alexander Möllers, Julius Hense, Florian Schulz, Timo Milbich, Maximilian Alber, Lukas Ruff
机构
*
Berlin Institute for the Foundations of Learning and Data (BIFOLD)(柏林学习与数据基础研究所)
;
Machine Learning Group, Technische Universität Berlin(柏林技术大学机器学习小组)
;
Aignostics(Aignostics公司)
;
Charité, Universitätsmedizin Berlin(柏林夏里特大学医学院)
Detecting Proxy Gaming in RL and LLM Alignment via Evaluator Stress Tests
通过评估者压力测试检测强化学习和大语言模型对齐中的代理游戏
Ibne Farabi Shihab, Sanjeda Akter, Anuj Sharma
机构
*
Department of Computer Science, Iowa State University(计算机科学系,爱荷华州立大学)
;
Department of Civil, Construction & Environmental Engineering, Iowa State University(土木、建设与环境工程系,爱荷华州立大学)