AuditAgent: Expert-Guided Multi-Agent Reasoning for Cross-Document Fraudulent Evidence Discovery
Songran Bai, Bingzhe Wu, Yiwei Zhang, Chengke Wu, Xiaolong Zheng, Yaze Yuan, Ke Wu, Jianqiang Li
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Shenzhen University(深圳大学)
;
Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究所)
;
Peking University(北京大学)
;
Southern University of Science and Technology(南方科技大学)
机构
*
The Chinese University of Hong Kong(香港中文大学)
;
HUAWEI Noah’s Ark Lab(华为诺亚实验室)
;
Southeast University(东南大学)
;
HUAWEI Hong Kong Research Center(华为香港研究中心)
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
Peking University(北京大学)
;
The University of Sydney(悉尼大学)
;
Beihang University(北航大学)
OIG-Bench: A Multi-Agent Annotated Benchmark for Multimodal One-Image Guides Understanding
Jiancong Xie, Wenjin Wang, Zhuomeng Zhang, Zihan Liu, Qi Liu, Ke Feng, Zixun Sun, Yuedong Yang
机构
*
School of Computer Science and Engineering, Sun Yat-sen University, China(中山大学计算机科学与工程学院)
;
Interactive Entertainment Group, Tencent Inc, China(腾讯互动娱乐集团)
;
Key Laboratory of Machine Intelligence and Advanced Computing (MOE), China(机器智能与先进计算重点实验室)
TAMA: Tool-Augmented Multimodal Agent for Procedural Activity Understanding
Kimihiro Hasegawa, Wiradee Imrattanatrai, Masaki Asada, Ken Fukuda, Teruko Mitamura
机构
*
Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所)
;
National Institute of Advanced Industrial Science and Technology (AIST)(国家先进工业科学与技术研究院)
机构
*
Nanyang Technological University(南洋理工大学)
;
Nanjing University of Information Science and Technology(南京信息工程大学)
;
Zhejiang University(浙江大学)
;
South China Normal University(华南师范大学)
;
Alibaba DAMO Academy(阿里巴巴达摩院)
;
City University of Hong Kong(香港城市大学)
Metaphor identification using large language models: A comparison of RAG, prompt engineering, and fine-tuning
Matteo Fuoli, Weihang Huang, Jeannette Littlemore, Sarah Turner, Ellen Wilding
机构
*
Department of Linguistics and Communication(语言学与传播学系)
;
University of Birmingham(伯明翰大学)
;
Centre for Arts, Memory & Communities(艺术、记忆与社区中心)
;
Coventry University(考文垂大学)
GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents
Run Luo, Lu Wang, Wanwei He, Longze Chen, Jiaming Li, Xiaobo Xia
机构
*
Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
National University of Singapore(新加坡国立大学)
Steffen Meinert, Philipp Schlinge, Nils Strodthoff, Martin Atzmueller
机构
*
AI4Health Division, Faculty VI Carl von Ossietzky Universität Oldenburg(AI4Health部门,第六学院卡尔·冯·奥西特齐克大学)
;
Semantic Information Systems Group Osnabrück University(语义信息系统小组奥尔纳布里克大学)