在本地运行大语言模型会产生电费,而这笔费用常常被低估。决定这些费用的主要因素包括:GPU在生成过程中的功耗、每千瓦时的电价以及模型每秒生成的令牌数。虽然在高功率GPU(如RTX 4090)上持续生成可能每小时花费约0.072美元,但实际的每日成本很大程度上受空闲功耗的影响,在较低的使用率下,空闲功耗可能超过生成成本。此外,冷却费用,尤其是在空调环境下,会使总电费账单增加相当大的比例。 AI
影响 了解本地大语言模型推理的真实耗电量对于优化硬件使用和管理运营成本至关重要。
排序理由 文章对运行本地大语言模型的硬件和电力使用情况进行了技术分解和成本分析。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →