PulseAugur
中
实时 00:51:49
实体 16GB GPU

16GB GPU

PulseAugur coverage of 16GB GPU — every cluster mentioning 16GB GPU across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_222642 ·

    Qwen 3.8 27B 模型在 16GB GPU 上实现 100k-200k 上下文

    用户已成功优化 Qwen 3.8 27B 模型,在消费级硬件上实现了显著更大的上下文窗口。一位用户通过使用 beellama.cpp 推理引擎和特定的 KV 缓存量化 (kvarn5/kvarn4) 在 16GB GPU 上实现了 100,000 token 的上下文窗口,生成速度为 47-50 tokens/秒。另一位用户报告称,在使用不同的量化方法 (UD-IQ3_XXS) 的类似 16GB 显存设置上,实现了超过 200,000…

  2. TOOL · CL_208707 ·

    Mistral 发布自托管 3B 审核模型 Shieldstral 1.0

    Mistral 发布了 Shieldstral 1.0,这是一款拥有 30 亿参数、专为自托管文本和图像内容审核设计的模型。该模型在 Apache 2.0 许可下提供,并包含完整权重,可在单块 16GB GPU 上运行,并可与常见的推理栈集成。其主要特点是“策略自适应”审核,允许用户通过自然语言提示定义审核规则,而无需重新训练。尽管 Mistral 报告了强劲的基准分数,但这些分数尚未得到独立验证,且该模型专注于审核而非通用任务。