PulseAugur
中
实时 00:04:50
English(EN) 50B+ MoEs with few active parameters, what's the sweet spot for intelligence, agent speed, and affordable fine-tuning?

AI开发者寻求用于法律代理的最佳MoE模型

一位用户正在寻求关于选择大型语言模型的建议,特别是具有超过500亿总参数但激活参数很少的混合专家(MoE)模型。他们正在为波兰的法律AI项目寻找一个能够平衡智能、代理速度和微调及推理成本效益的模型。用户对模型大小、架构与任务完成速度和推理可靠性等性能指标之间的实际权衡感兴趣,而不仅仅是基准分数。 AI

影响 开发人员正在探索MoE架构以提高代理性能和专业应用中的成本效益。

排序理由 用户正在寻求关于模型选择和权衡的建议,而不是报告新版本或事件。

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

AI开发者寻求用于法律代理的最佳MoE模型

报道来源 [1]

  1. r/LocalLLaMA TIER_1 English(EN) · /u/SignificantZebra5883 ·

    50B+ MoEs 激活参数少,智能、智能体速度和经济高效微调的最佳平衡点在哪里?

    <!-- SC_OFF --><div class="md"><p>I’m building a Polish General purpose legal Model that drafts documents, answers questions using legal sources, and has enough coding ability to handle some automation. The workflow is very tool-heavy:</p> <p><strong>Question → many sequential to…