Reddit r/LocalLLaMA 版块的一名用户正在寻求其他用户关于在 Tesla V100 GPU 上运行 Qwen3.6 27B 模型经验的信息。该用户分享了他们的具体配置,包括 128K 上下文长度,以及使用 llama.cpp 并为 Qwen3.6 及其相关的多模态投影模型设置了特定的模型预设。他们正在寻找使用类似硬件配置的其他用户的性能对比数据。 AI
影响 N/A
排序理由 用户生成内容,寻求特定硬件-模型组合的性能数据。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →