PulseAugur
实时 21:49:24
English(EN) Reverse-Engineering the RK3588 NPU: Building an Open Compiler to Run GPT-2 at 36 tok/s

开源编译器使 GPT-2 能够在 Rockchip RK3588 NPU 上运行

一位开发者成功逆向工程了 Rockchip RK3588 的神经网络处理单元 (NPU),并创建了一个开源编译器和运行时。这使得 GPT-2 和 SigLIP 等模型可以直接从 PyTorch、ONNX 和 JAX 等框架运行,而无需依赖专有的供应商 SDK。该项目在 RK3588 NPU 上实现了 GPT-2 每秒 36 个 token 的性能。 AI

影响 实现更广泛的硬件兼容性,并优化在专用处理器上运行 AI 模型。

排序理由 该项目详细介绍了硬件的逆向工程以及用于运行 AI 模型的开源编译器的创建,这属于研究与开发范畴。 [lever_c_demoted from research: ic=1 ai=1.0]

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

开源编译器使 GPT-2 能够在 Rockchip RK3588 NPU 上运行

报道来源 [1]

  1. r/LocalLLaMA TIER_1 English(EN) · /u/one_does_not_just ·

    逆向工程 RK3588 NPU:构建开放编译器以 36 tok/s 运行 GPT-2

    <!-- SC_OFF --><div class="md"><blockquote> <p>Last year I posted about hacking the RK3588 NPU to run one vision encoder (<a href="https://www.reddit.com/r/LocalLLaMA/comments/1pkhzf0/reverseengineering_the_rk3588_npu_hacking_memory/">previous post</a>). This year I opened the wh…