机构
*
Technical University of Munich, Germany(慕尼黑技术大学,德国)
;
Helmholtz Munich, Munich Center for Machine Learning, Germany(海德堡慕尼黑,慕尼黑机器学习中心,德国)
;
University of Tübingen, Tübingen AI Center, Germany(图宾根大学,图宾根人工智能中心,德国)
;
University of Trento, Italy(特伦托大学,意大利)
;
Beijing University of Posts and Telecommunications, China(北京邮电大学,中国)
专题命中
效率与部署
:large language model(title,abstract);language model(title,abstract);small language model(abstract);分类 cs.CL
LUT Tensor Core: A Software-Hardware Co-Design for LUT-Based Low-Bit LLM Inference
Zhiwen Mo, Lei Wang, Jianyu Wei, Zhichen Zeng, Shijie Cao, Lingxiao Ma, Naifeng Jing, Ting Cao, Jilong Xue, Fan Yang, Mao Yang
机构
*
Imperial College London(帝国理工学院伦敦分校)
;
Microsoft Research London, UK(微软研究院伦敦, UK)
;
Peking University(北京大学)
;
Microsoft Research Beijing, China(微软研究院北京, China)
;
University of Science(科学大学)
;
University of Washington(华盛顿大学)
;
Microsoft Research Seattle, USA(微软研究院西雅图, USA)
;
Shanghai Jiao Tong University Shanghai, China(上海交通大学上海, China)
;
Microsoft Research(微软研究院)
;
Shanghai Jiao Tong University(上海交通大学)
专题命中
效率与部署
:LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
CommentsConference Version (ISCA'25). Fixed a typo
DeltaLLM: A Training-Free Framework Exploiting Temporal Sparsity for Efficient Edge LLM Inference
Jiawen Qi, Chang Gao, Zhaochun Ren, Qinyu Chen
机构
*
Leiden Institute of Advanced Computer Science (LIACS), Leiden University(莱顿先进计算机科学研究所(LIACS)、莱顿大学)
;
Department of Microelectronics, Delft University of Technology(电子系、代尔夫特理工大学)
专题命中
效率与部署
:LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
机构
*
Institute for Artificial Intelligence, Peking University, Beijing, China(人工智能研究院,北京大学,北京)
;
School of Integrated Circuits, Peking University, Beijing, China(集成电路学院,北京大学,北京)
;
School of Software and Microelectronics, Peking University, Beijing, China(软件与微电子学院,北京大学,北京)
;
Institute of Electronic Design Automation, Peking University, Wuxi, China(电子设计自动化研究院,北京大学,无锡)
;
Beijing Advanced Innovation Center for Integrated Circuits, Beijing, China(北京集成电路先进创新中心,北京)
专题命中
效率与部署
:LLM(title,abstract);large language model(abstract);language model(abstract)
CommentsAccepted by Design Automation Conference (DAC) 2025
Rui-Jie Zhu, Yu Zhang, Steven Abreu, Ethan Sifferman, Tyler Sheaves, Yiqiao Wang, Dustin Richmond, Sumit Bam Shrestha, Peng Zhou, Jason K. Eshraghian
机构
*
University of California, Santa Cruz(加州大学圣克ruz分校)
;
Soochow University(苏州大学)
;
University of Groningen(格罗宁根大学)
;
LuxiTech(LuxiTech公司)
;
Intel Labs(英特尔实验室)
专题命中
效率与部署
:language model(title,abstract);large language model(abstract);分类 cs.CL
Speaking in Words, Thinking in Logic: A Dual-Process Framework in QA Systems
Tuan Bui, Trong Le, Phat Thai, Sang Nguyen, Minh Hua, Ngan Pham, Thang Bui, Tho Quan
机构
*
Ho Chi Minh City University of Technology (HCMUT)(胡志明市技术大学)
专题命中
效率与部署
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Comments8 pages, 3 figures. Accepted at the International Joint Conference on Neural Networks (IJCNN) 2025, Workshop on Trustworthiness and Reliability in Neuro-Symbolic AI. https://2025.ijcnn.org
机构
*
College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机科学与软件工程学院)
;
School of Artificial Intelligence, Shenzhen University(深圳大学人工智能学院)
;
Graduate School of Information Science and Technology, Osaka University(大阪大学信息科学与技术研究生院)
专题命中
效率与部署
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG
Security Challenges in AI Agent Deployment: Insights from a Large Scale Public Competition
Andy Zou, Maxwell Lin, Eliot Jones, Micha Nowak, Mateusz Dziemian, Nick Winter, Alexander Grattan, Valent Nathanael, Ayla Croft, Xander Davies, Jai Patel, Robert Kirk, Nate Burnikell, Yarin Gal, Dan Hendrycks, J. Zico Kolter, Matt Fredrikson
NeuroVoxel-LM: Language-Aligned 3D Perception via Dynamic Voxelization and Meta-Embedding
Shiyu Liu, Lianlei Shan
机构
*
School of Electrical and Electronic Engineering(电气与电子工程学院)
;
Nanyang Technological University(南洋理工大学)
;
School of Computer Science and Technology(计算机科学与技术学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
Towards Inclusive NLP: Assessing Compressed Multilingual Transformers across Diverse Language Benchmarks
Maitha Alshehhi, Ahmed Sharshar, Mohsen Guizani
机构
*
Mohamed bin Zayed University of Artificial Intelligence(Mohamed bin Zayed人工智能大学)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.CL
CommentsPublished in the 3rd International Workshop on Generalizing from Limited Resources in the Open World. Workshop at International Joint Conference on Artificial Intelligence (IJCAI) 2025