PulseAugur
中
实时 05:01:30
实体 Modelfile

Modelfile

PulseAugur coverage of Modelfile — every cluster mentioning Modelfile across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
4
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 4 条
  1. TOOL · CL_285229 ·

    Ollama 错误应用 Gemma 4 提示模板的错误

    Ollama 0.35.1 版本出现了一个细微的错误,它错误地为 Gemma 4 模型选择了提示模板。该软件默认使用“small”模板,而实际上应使用“large”模板,这尤其会影响源自基础 Gemma 4 12B 模型或模型名称缺乏明确大小指示符的模型。当禁用“思考”时,这种差异可能导致模型输出中缺少“思考块”,尽管对生成答案的影响很小。用户可以在其 Modelfile 中手动指定正确的“large”模板以确保准确渲染。

  2. COMMENTARY · CL_244143 ·

    Flash AI shell作者因Ollama基础设施限制而放弃微调

    Flash AI shell的作者决定因基础设施限制而放弃微调其自定义Onyx模型。Flash依赖Ollama的云端模型来服务没有强大本地硬件的用户,但这种设置不允许部署自定义权重或LoRA适配器。作者没有进行传统微调,而是专注于改进Modelfile中的系统提示和其他参数,在无需专用GPU资源的情况下取得了显著成果。

  3. TOOL · CL_199485 ·

    Ollama 的上下文长度默认设置令人困惑,并且会默默地截断对话

    Ollama 的默认上下文长度在不同配置中的文档记录和应用不一致。文档中至少显示了三个相互冲突的默认值:Modelfile 参考中的 2048,基于可用 VRAM 的可变长度(4k、32k、256k),以及嵌入在模型镜像本身中的值。最具体的设置,例如在模型 Modelfile 或单个请求的选项中定义的设置,会覆盖更广泛的默认设置,如环境变量或基于 VRAM 的分层。一个严重的问题是,当提示超过有效的上下文窗口时,Ollama 会默默地…

  4. TOOL · CL_199486 ·

    Ollama create:深入了解构建自定义 LLM

    Ollama 的 `create` 命令充当模型编译器,接收 Modelfile 来构建自定义语言模型。它解析基础模型,将指令处理成内容寻址层,并生成清单。这种基于层的处理方式可以实现高效重建,因为只需要重新处理更改的参数。该命令支持各种自定义标志,包括指定 Modelfile、将模型量化为 Q8_0 或 Q4_K 等格式,以及用于 Safetensors 的实验性功能。