A Lightweight Multi-Agent Framework for Automated Concrete Barrier Design
一种用于自动混凝土护栏设计的轻量级多智能体框架
Wanting Wang, Xiye Ma, Yuyang He, Minghui Cheng, Ran Cao
机构
*
College of Civil Engineering, Hunan University(湖南大学土木工程学院)
;
Department of Civil and Architectural Engineering, University of Miami(迈阿密大学土木与建筑系)
;
School of Architecture, University of Miami(迈阿密大学建筑学院)
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.AI
HKVM-RAG: Key-Value-Separated Hypergraph Evidence Organization for Multi-Hop RAG
HKVM-RAG:用于多跳RAG的键值分离超图证据组织
Mingyu Zhang, Ying Ma
机构
*
Faculty of Computing, Harbin Institute of Technology(哈尔滨工业大学计算机学院)
;
School of Computer and Information Engineering, Henan University(河南大学计算机与信息工程学院)
Improving Adversarial Transferability on Vision-Language Pre-training Models via Surrogate-Specific Bias Correction
通过代理特定偏差校正提高视觉-语言预训练模型上的对抗迁移性
Lijia Yu, Jiuxin Cao, Yuchen Qiang, Changhao Chen, Yifei Huang, Bo Liu
机构
*
School of Cyber Science and Engineering, Southeast University(东南大学网络空间安全学院)
;
Purple Mountain Laboratories(紫金山实验室)
;
School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院)
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.AI
STAGE-Claw: Automated State-based Agent Benchmarking for Realistic Scenarios
STAGE-Claw:面向真实场景的基于状态的智能体自动化基准测试
Sirui Liang, Bohan Yu, Peiyu Wang, Shiguang Guo, Wenxing Hu, Pengfei Cao, Jian Zhao, Cao Liu, Ke Zeng, Xunliang Cai, Kang Liu
机构
*
The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation(中国科学院自动化研究所复杂系统认知与决策智能重点实验室)
;
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学前沿交叉科学学院)
;
Chinese Academy of Sciences(中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Zhongguancun Academy(中关村学院)
;
Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院)
;
Meituan(美团)
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.AI
Now You (Still) See Me: Detecting Evasive Steganographic Payloads in LLMs
现在你(仍然)能看到我:检测大语言模型中的隐蔽隐写载荷
Charles Westphal, Timothy Douglas, Keivan Navaie, Tiago Pimentel, Fernando E. Rosas
机构
*
UCL Centre for AI(UCL人工智能中心)
;
University College London(伦敦大学学院)
;
ML Alignment Theory Scholars(机器学习对齐理论学者)
;
Department of Computer Science(计算机科学系)
;
School of Computing and Communications(计算与通讯学院)
;
ETH Zürich(苏黎世联邦理工学院)
;
University of Sussex(Sussex大学)
;
Imperial College London & University of Oxford(伦敦帝国学院与牛津大学)
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.LG
Beyond Goodhart's Law: A Dynamic Benchmark for Evaluating Compliance in Multi-Agent Systems
超越古德哈特定律:多智能体系统中合规性评估的动态基准
Yiyang Zhao, Zhuo Zhang, Qingxuan Le, Lizhen Qu, Zenglin Xu
机构
*
Fudan University(复旦大学)
;
Shanghai Academy of AI for Science(上海人工智能科学研究院)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Monash University(莫纳什大学)
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.AI