WebLLM 是一个新项目,它允许大型语言模型直接在 Web 浏览器中运行,并使用 WebGPU 进行硬件加速。这种客户端执行通过将所有 AI 计算保留在用户设备上,增强了用户隐私并降低了服务器成本。开发人员可以利用熟悉的 OpenAI API 调用以及 Llama 3 和 Phi 3 等各种开源模型,并支持流式传输和 JSON 模式等功能。 AI
影响 使 AI 能够直接集成到 Web 应用程序中,实现私密且经济高效的 AI 集成,无需依赖服务器。
排序理由 这是一个新的软件工具/项目发布,它允许 AI 模型在客户端运行。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →