Corpora deduplication or duplication in Natural Language Processing of few resourced languages ? A case of study: The Mexico's Nahuatl
语料去重或重复在自然语言处理中少数资源语言的应用?一个案例研究:墨西哥的纳瓦特尔语
Juan-José Guzman-Landa, Juan-Manuel Torres-Moreno, Graham Ranger, Miguel Figueroa-Saavedra, Martha-Lorena Avendaño-Garrido, Elvys Linhares-Pontes, Luis-Gil Moreno-Jiménez
机构
*
LIFAT, Université de Tours(图尔大学计算机科学、人工智能与图像处理实验室)
;
Instituto de Investigaciones en Educación, Universidad Veracruzana(韦拉克鲁斯大学教育研究所)
;
Trading Central(Trading Central公司)
;
Independent Researcher(独立研究员)
专题命中
预训练与数据
:large language model(abstract);language model(abstract);分类 cs.CL
Predicting Neuromodulation Outcome for Parkinson's Disease with Generative Virtual Brain Model
利用生成虚拟脑模型预测帕金森病的神经调制疗效
Siyuan Du, Siyi Li, Shuwei Bai, Ang Li, Haolin Li, Mingqing Xiao, Yang Pan, Dongsheng Li, Weidi Xie, Yanfeng Wang, Ya Zhang, Chencheng Zhang, Jiangchao Yao
机构
*
College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与技术学院)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
University of Science and Technology of China(中国科学技术大学)
;
Ruijin Hospital, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属瑞金医院)
;
Microsoft Research Asia(微软亚洲研究院)
;
Zhongnan Hospital of Wuhan University(武汉大学中南医院)
;
School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)
;
Institute of Artificial Intelligence for Medicine, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院人工智能医学研究所)
;
Cooperative Medianet Innovation Center, Shanghai Jiao Tong University(上海交通大学协同媒体创新中心)
Greater accessibility can amplify discrimination in generative AI
更大的可及性可能放大生成AI中的歧视
Carolin Holtermann, Minh Duc Bui, Kaitlyn Zhou, Valentin Hofmann, Katharina von der Wense, Anne Lauscher
机构
*
Trustworthy AI Lab, University of Hamburg(可信AI实验室,汉堡大学)
;
NALA Group, JGU Mainz(NALA集团,吉森大学)
;
Cornell University(康奈尔大学)
;
Together AI
;
Allen Institute for AI(人工智能研究院)
;
CU Boulder(博尔德大学)
专题命中
预训练与数据
:large language model(abstract);language model(abstract);分类 cs.CL
Holistic Scaling Laws for Optimal Mixture-of-Experts Architecture Optimization
整体缩放定律用于最优专家混合架构优化
Weilin Wan, Jingtao Han, Weizhong Zhang, Cheng Jin
机构
*
College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院)
;
Hi Lab, Xiaohongshu Inc.(小红书公司Hi实验室)
;
Project Numina(项目Numina)
;
School of Data Science, Fudan University(复旦大学数据科学学院)
专题命中
预训练与数据
:large language model(abstract);language model(abstract);分类 cs.LG
Patho-R1: A Multimodal Reinforcement Learning-Based Pathology Expert Reasoner
Patho-R1: 基于多模态强化学习的病理专家推理器
Wenchuan Zhang, Penghao Zhang, Jingru Guo, Tao Cheng, Jie Chen, Shuwan Zhang, Zhang Zhang, Yuhao Yi, Hong Bu
机构
*
Department of Pathology, West China Hospital, Sichuan University(四川大学华西医院病理科部门)
;
Institute of Clinical Pathology, West China Hospital, Sichuan University(四川大学华西医院临床病理科研究所)
;
University of Toronto(多伦多大学)
;
Business School, Sichuan University(四川大学商学院)
;
Department of Pathology, Shengjing Hospital of China Medical University(中国医科大学盛京医院病理科部门)
Automated stance detection in complex topics and small languages: the challenging case of immigration in polarizing news media
复杂主题和小语言中的自动化立场检测:极化新闻媒体中移民问题的挑战性案例
Mark Mets, Andres Karjus, Indrek Ibrus, Maximilian Schich
机构
*
School of Humanities, Tallinn University, Estonia(塔林大学人文学科学院,爱沙尼亚)
;
Baltic Film, Media and Arts School, Tallinn University, Estonia(巴尔蒂克电影、媒体与艺术学院,塔林大学,爱沙尼亚)
;
ERA Chair for Cultural Data Analytics, Tallinn University, Estonia(塔林大学文化数据分析埃拉教席,爱沙尼亚)
专题命中
预训练与数据
:large language model(abstract);language model(abstract);分类 cs.CL
Time Tracker: Mixture-of-Experts-Enhanced Foundation Time Series Forecasting Model with Decoupled Training Pipelines
时间追踪:混合专家增强的基础时间序列预测模型与解耦训练流水线
Aobo Liang, Yan Sun, Xiaohou Shi, Ke Li
机构
*
School of Computer Science (National Pilot Software Engineering School)(计算机学院(国家级试点软件工程学院))
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
China Telecom Research Institute(中国电信研究院)
Towards the Vision-Sound-Language-Action Paradigm: The HEAR Framework for Sound-Centric Manipulation
迈向视觉-声音-语言-动作范式:用于以声音为中心的操作的HEAR框架
Chang Nie, Tianchen Deng, Guangming Wang, Zhe Liu, Hesheng Wang
机构
*
School of Automation and Intelligent Sensing, Shanghai Jiao Tong University and Shanghai Key Laboratory of Navigation and Location Based Services(自动化与智能感知学院,上海交通大学,导航与基于位置的服务重点实验室)
;
Department of Engineering, Cambridge University(工程系,剑桥大学)
POLAR:A Per-User Association Test in Embedding Space
POLAR:嵌入空间中的用户级关联测试
Pedro Bento, Arthur Buzelin, Arthur Chagas, Yan Aquino, Victoria Estanislau, Samira Malaquias, Pedro Robles Dutenhefner, Gisele L. Pappa, Virgilio Almeida, Wagner MeiraJr
LLMs as Repositories of Factual Knowledge: Limitations and Solutions
大型语言模型作为事实知识库:局限性与解决方案
Seyed Mahed Mousavi, Simone Alghisi, Giuseppe Riccardi
机构
*
Signals and Interactive Systems Lab, Department of Information Engineering and Computer Science, University of Trento(信号与交互系统实验室,信息工程与计算机科学系,特伦托大学)
专题命中
预训练与数据
:large language model(abstract);language model(abstract);分类 cs.CL
The Impact of Ideological Discourses in RAG: A Case Study with COVID-19 Treatments
检索增强生成中意识形态话语的影响:以新冠治疗方案为例
Elmira Salari, Maria Claudia Nunes Delfino, Hazem Amamou, José Victor de Souza, Shruti Kshirsagar, Alan Davoust, Anderson Avila
机构
*
Wichita State University(威斯康星州立大学)
;
Pontifícia Universidade Católica de São Paulo(圣保罗天主教大学)
;
Institut national de la recherche scientifique(国家科学研究中心)
;
Université du Québec en Outaouais(魁北克大学Outaouais)
专题命中
预训练与数据
:large language model(abstract);language model(abstract);分类 cs.CL