一位开发者成功逆向工程了 Rockchip RK3588 的神经网络处理单元 (NPU),并创建了一个开源编译器和运行时。这使得 GPT-2 和 SigLIP 等模型可以直接从 PyTorch、ONNX 和 JAX 等框架运行,而无需依赖专有的供应商 SDK。该项目在 RK3588 NPU 上实现了 GPT-2 每秒 36 个 token 的性能。 AI
影响 实现更广泛的硬件兼容性,并优化在专用处理器上运行 AI 模型。
排序理由 该项目详细介绍了硬件的逆向工程以及用于运行 AI 模型的开源编译器的创建,这属于研究与开发范畴。 [lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →