实体
Nvidia 4070
Nvidia 4070
PulseAugur coverage of Nvidia 4070 — every cluster mentioning Nvidia 4070 across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
用户在消费级硬件上对 Gemma 和 Qwen 等大语言模型进行基准测试
用户正在尝试在消费级硬件上运行 Gemma 和 Qwen 等大型语言模型。一位用户报告称,在配备 NVIDIA 4070 的联想电脑上,Gemma4:12b-it-qat 的运行速度达到了每秒 70 个 token,而 Qwen3.8:27b 的运行速度较慢,为每秒 6 个 token。另一位用户讽刺地指出 Qwen3.8 在高端 GPU 上的性能为每秒 37 个 token,质疑此类实验的实际价值。
-
Gemma 4:26b-a4b-it-qat 模型在消费级 GPU 上实现每秒 15 个 token 的性能
一位用户报告称,gemma4:26b-a4b-it-qat 模型在配备 8GB 显存和 16GB 内存的 Nvidia 4070 GPU 上达到了每秒 15 个 token 的速度。该性能在 Windows 11 上运行,被认为几乎与 12B 模型一样快,其效率令用户感到惊讶。