一个名为 jitLLM 的新 Java 框架已被开发出来,它可以将 Java 字节码直接编译为 CUDA,从而在 NVIDIA GPU 上进行 LLM 推理,而无需 Python 或 C++ 辅助程序。jitLLM 由曼彻斯特大学的 TornadoVM 团队与 Red Hat 合作开发,声称性能可达到 llama.cpp 的约 90%。该框架支持 Llama 3、Mistral 和 Qwen 等多种模型,并使用 TornadoVM 的 JIT 编译器在运行时将 Java 方法转换为 GPU 内核,有望简化 AI 推理到现有 Java 应用程序的集成。 AI
影响 通过消除 Python/C++ 依赖,可能简化了 Java 开发人员的 LLM 集成。
排序理由 一篇 dev.to 博文描述的新框架,将 Java 编译为 CUDA 以进行 LLM 推理,并声称具有高性能。[lever_c_demoted from research: ic=1 ai=0.7]
- CUDA
- Devstral 2
- IBM Granite
- Java
- jitLLM
- Llama 3
- llama.cpp
- Nvidia
- Phi 3
- Qwen 2.5
- Qwen 3
- Red Hat
- TornadoVM
- University of Manchester
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →