PulseAugur
实时 09:20:13
English(EN) Ling-3.0-tiny is a very interesting model. Run on NVIDIA Orin Nano Super 8GB at 128K context with IQ4_NL quant.

Ling-3.0-tiny 模型在 8GB NVIDIA Orin Nano 上运行,支持 128K 上下文

一位用户已成功在 NVIDIA Orin Nano Super 8GB 设备上运行 Ling-3.0-tiny 模型,实现了 128K 上下文窗口和 IQ4_NL 量化。该模型采用混合 KDA+MLA 推理 MoE 架构,能够容纳 8GB 统一内存,并展示了在其硬件类别中具有前景的性能。尽管在最大上下文长度下检索精度有所下降,但该设置被认为对于托管代理和处理简单任务是可行的。 AI

影响 展示了在低功耗边缘设备上运行具有大上下文窗口的高级 LLM 的可行性。

排序理由 用户成功在消费级硬件上运行特定模型,展示了其能力和局限性。

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Ling-3.0-tiny 模型在 8GB NVIDIA Orin Nano 上运行,支持 128K 上下文

报道来源 [1]

  1. r/LocalLLaMA TIER_1 English(EN) · /u/Puzzleheaded_Base302 ·

    Ling-3.0-tiny是一个非常有趣的模型。在NVIDIA Orin Nano Super 8GB上以128K上下文和IQ4_NL量化运行。

    <!-- SC_OFF --><div class="md"><p>I have been searching for suitable model to run on my 8GB RAM toy, NVIDIA Orin Nano Super 8GB. This little toy was priced at $249 earlier this year (not any more), and pulls very little power when idle. It was an interesting device that suitable …