Evidence-Bounded Mental Health Reasoning from Heterogeneous Speech Protocols
基于异构语音协议的证据受限心理健康推理
Chengyuan Gao, Jiang Wu, Tao Lu, Jiayan Guo, Mingkun Xu, Tianyi Zang, Shangyang Li
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Renyixun Health Technology Co., Ltd.(仁医讯健康科技有限公司)
;
GDIIST(广东省智能制造研究所)
;
Tencent(腾讯)
机构
*
School of Advanced Technology, Xi’an Jiaotong-Liverpool University(西交利物浦大学先进技术学院)
;
University of Liverpool(利物浦大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Hithink Research(海天瑞声研究院)
;
Digital Innovation Research Center, Duke Kunshan University(昆山杜克大学数字创新研究中心)
Comments31 pages, 1 figure. Preregistered on OSF (https://osf.io/ns49b, DOI 10.17605/OSF.IO/NS49B); release materials and dated provider-documentation snapshots in the study component (https://osf.io/9nsvr)
Textual Acoustic Grounding for Generalizable LLM-Based Deepfake Voice Detection
面向通用型大语言模型的深度伪造语音检测的文本声学接地
Yassine El Kheir, Xin Wang, Wanqing Ge, Tim Polzehl, Sebastian Moeller, Junichi Yamagishi
机构
*
German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心)
;
National Institute of Informatics(情报信息学研究所)
;
Technical University of Berlin(柏林工业大学)
TAKE 85: Testing Audiovisual filmmaKer's intEnt across 85 Hours of Film
TAKE 85:基于85小时电影时长的电影创作者意图测试基准
Kaishuu Shinozaki-Conefrey, Olivier Pascaud, Robin Courant, Xi Wang, Dimitris Samaras, Vicky Kalogeiton
机构
*
LIX, Ecole Polytechnique, IP Paris(巴黎综合理工学院LIX实验室、巴黎IP大学)
;
New York University(纽约大学)
;
Ecole nationale supérieure Louis-Lumière(路易卢米耶高等国家学院)
;
Stony Brook University(石溪大学)
Phantom-Insight: Adaptive Multi-cue Fusion for Video Camouflaged Object Detection with Multimodal LLM
Phantom-Insight:基于多模态大语言模型的视频伪装目标自适应多线索融合检测方法
Hua Zhang, Changjiang Luo
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
Multi-Modal Fusion of In-Situ Video Data and Process Parameters for Online Forecasting of Cookie Drying Readiness
Shichen Li, Chenhui Shao
机构
*
Department of Mechanical Science and Engineering, University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校机械科学与工程系)
;
Department of Mechanical Engineering, University of Michigan(密歇根大学机械工程系)
Cross-Modal Visuo-Tactile Representation Learning with Action Chunking Transformers for Contact-Rich Manipulation
一种低成本的基于视觉的触觉夹具,用于接触丰富的操作
Yaohua Liu, Rong Fu, Amir H. Gandomi, Simon Fong, Hengjun Zhang
机构
*
Guangdong Institute of Intelligence Science and Technology(广东智能科学与技术研究院)
;
Innovation and Research and Development Department, BoardWare Information System Company Ltd.(创新与研发部,BoardWare信息系统有限公司)
;
School of Artificial Intelligence, Nanjing Agricultural University(人工智能学院,南京农业大学)
;
School of Computing, National University of Singapore(计算机学院,新加坡国立大学)
;
School of Electronic Engineering and Automation, Guilin University of Electronic Technology(电子工程与自动化学院,桂林电子科技大学)
机构
*
AAII, University of Technology Sydney(悉尼科技大学AAII(先进人工智能研究所))
;
Northeastern University(东北大学)
;
Fudan University(复旦大学)
;
University of Liverpool(利物浦大学)