通过使用 WebGPU(一种利用设备图形处理单元 (GPU) 进行计算的 Web 标准),直接在 Web 浏览器中运行大语言模型 (LLM) 正在成为可能。像 @mlc-ai/web-llm 这样的库通过优化 LLM 在 WebGPU 上的执行来促进这一点,使得 Qwen3.5-2B-q4f16_1-MLC 等模型能够本地运行。这种方法通过将数据保留在用户设备上增强了隐私性,尽管在硬件限制和针对消费级 GPU 的模型优化方面仍存在挑战。 AI
影响 通过实现本地数据处理,增强了 AI 应用的隐私性和控制力,但性能受限于消费级硬件。
排序理由 该项目讨论了一个支持 LLM 在浏览器中本地运行的库和 Web 标准,这是一项工具方面的进步,而不是前沿发布或重要的行业事件。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →