PulseAugur
实时 00:09:44
English(EN) Got a 27B model running locally on a Jetson Orin NX 16GB (1-bit). still kind of amazed it works

27B 人工智能模型在 Jetson Orin NX 16GB 上本地运行

一位用户成功地在 Jetson Orin NX 16GB 设备上本地运行了 Bonsai 27B 语言模型,尽管硬件有限,但仍实现了可用的单用户应用程序性能。该设置涉及 PrismMLllama.cpp 分支的自定义构建,以支持该模型独特的 1 位量化格式,因为 Ollama 等标准工具不支持。虽然英语推理表现尚可,但该模型在非英语语言方面遇到了困难,这表明极端的压缩会影响多语言能力。 AI

影响 证明了在低功耗边缘设备上运行大型语言模型的可行性,可能为新的本地人工智能应用带来可能。

排序理由 用户成功在消费级硬件上运行了特定的 LLM,详细介绍了技术挑战和局限性。

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

27B 人工智能模型在 Jetson Orin NX 16GB 上本地运行

报道来源 [1]

  1. r/LocalLLaMA TIER_1 English(EN) · /u/Clean-Mention6543 ·

    在 Jetson Orin NX 16GB 上本地运行了一个 27B 模型(1比特),仍然有点惊讶它能工作

    <table> <tr><td> <a href="https://www.reddit.com/r/LocalLLaMA/comments/1v6evbe/got_a_27b_model_running_locally_on_a_jetson_orin/"> <img alt="Got a 27B model running locally on a Jetson Orin NX 16GB (1-bit). still kind of amazed it works" src="https://preview.redd.it/8ymdojzuxefh1…