PulseAugur
实时 02:03:28
English(EN) Scaffold CoT: A CoT dataset built around the failures of small model (>5B Params) free form thinking. Hope its useful to you guys!

新的 Scaffold CoT 数据集旨在改进小型 LLM 的推理能力

一个名为 Scaffold CoT 的新数据集已发布,包含约 400 万个示例和 30 亿个 token。该数据集旨在通过提供结构化的思维框架来提高小型语言模型(50 亿参数以下)的推理和响应准确性。该框架包含三个一致的部分:“Inventory”(清单)、“Interaction”(交互)和“Execution”(执行),这有助于模型专注于内容而非格式,从而减少错误并提高连贯性。Scaffold CoT 还包括多样化的类别和深度层级,以增强特定主题的性能和适应性推理。 AI

影响 旨在提高小型语言模型的推理能力,使其在特定任务上更易于访问和更可靠。

排序理由 发布用于 LLM 训练的新数据集。[lever_c_demoted from research: ic=1 ai=1.0]

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

新的 Scaffold CoT 数据集旨在改进小型 LLM 的推理能力

报道来源 [1]

  1. r/LocalLLaMA TIER_1 English(EN) · /u/Saraozte01 ·

    Scaffold CoT:一个围绕小型模型(>5B 参数)自由形式思维的失败构建的 CoT 数据集。希望对大家有用!

    <!-- SC_OFF --><div class="md"><p><strong>TL;DR</strong> - A ~4M example, ~3B token CoT dataset designed around helping small models think more concisely, accurately and reliably.</p> <p>Hi all!</p> <p>For the past few months I have been working on a dataset designed around impro…