arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Cornell University(康奈尔大学)

2026-01-30 至 2026-01-30 共收录 3
2601.21109 2026-01-30 cs.CL

ChunkWise LoRA: Adaptive Sequence Partitioning for Memory-Efficient Low-Rank Adaptation and Accelerated LLM Inference

ChunkWise LoRA: 适应性序列分块用于内存高效低秩适应和加速大语言模型推理

Ketan Thakkar, Maitreyi Chatterjee, Ramasubramanian Balasubramanian, Achyuthan Jootoo, Rajendra Ugrani

机构 * Bentley University USA(伯克利大学) Cornell University USA(康奈尔大学) University of California Berkeley USA(加州大学伯克利分校) George Mason University USA(乔治·马歇尔大学) Georgia Institute of Technology USA(佐治亚理工学院)

AI总结 ChunkWise LoRA通过动态分块和适应性配置提升LLM推理效率,实现更低延迟和内存消耗的同时保持性能。

Comments Presented at 13th IEEE International Conference on Intelligent Systems and Embedded Design

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21105 2026-01-30 cs.IR cs.AI cs.CL cs.HC

SteerEval: A Framework for Evaluating Steerability with Natural Language Profiles for Recommendation

SteerEval: 一个用于通过自然语言配置文件评估可操控性的框架用于推荐

Joyce Zhou, Weijie Zhou, Doug Turnbull, Thorsten Joachims

机构 * Cornell University(康奈尔大学) Ithaca College(伊萨卡学院)

AI总结 SteerEval通过自然语言配置文件评估推荐系统的可操控性,分析不同干预措施对操控效果的影响,并提出设计建议。

Comments 10 pages, 2 figures, 8 tables. Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21096 2026-01-30 cs.AI cs.LG cs.PL

Magellan: Autonomous Discovery of Novel Compiler Optimization Heuristics with AlphaEvolve

Magellan:利用AlphaEvolve自主发现新型编译器优化启发式方法

Hongzheng Chen, Alexander Novikov, Ngân Vũ, Hanna Alam, Zhiru Zhang, Aiden Grossman, Mircea Trofin, Amir Yazdanbakhsh

机构 * Google(谷歌) Google DeepMind(谷歌DeepMind) Cornell University(康奈尔大学)

AI总结 Magellan通过AlphaEvolve自主发现新型编译器优化启发式方法,提升编译器优化效率与性能。

Comments Accepted to C4ML@CGO'26

详情

展开后加载摘要…

URL PDF HTML 收藏