实体
BanglaMATH
BanglaMATH
PulseAugur coverage of BanglaMATH — every cluster mentioning BanglaMATH across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
孟加拉语数学推理研究:思维链监督的益处因模型强度而异
一项新研究“MathShikkha”调查了思维链(CoT)监督在提高小型语言模型(SLMs)孟加拉语数学推理方面的有效性。该研究使用GPT-5.4生成的推理构建了一个数据集,发现虽然CoT监督并未显著提高较强SLMs的领域内推理准确性,但它显著增强了一个较弱的4B模型。然而,在一个更大的基准测试中,CoT在所有模型上都显著优于仅答案微调,并保持或提高了领域外准确性。
-
LLM中的孟加拉语数学推理:思维链监督效果喜忧参半
一项名为MathShikkha的新研究,调查了思维链(CoT)监督对于提高在孟加拉语上训练的小型语言模型数学推理能力的有效性。该研究使用GPT-5.4生成的推理过程构建了一个孟加拉语数学推理数据集,并对四种参数量从4B到7B不等的模型进行了微调。结果表明,CoT监督在较大的BanglaMATH基准测试中带来了显著的好处,所有模型的性能提高了20.1-28.1个百分点,而仅答案的微调有时会降低性能。然而,一项人类研究发现CoT在推理有效…