一项新研究系统评估了训练后量化对孟加拉语(一种低资源语言)大型语言模型(LLM)的影响。研究人员在五个孟加拉语自然语言理解基准测试中,测试了Qwen-2.5-7B、LLaMA-3.1-8B和GPT-OSS-20B这三个模型系列在全精度和各种量化格式下的表现。研究结果表明,量化对不同模型架构的影响差异很大,GPT-OSS在推理任务上准确性损失显著,而Qwen和LLaMA表现出韧性,有时甚至优于全精度版本。这项研究表明,虽然量化对于在资源受限的硬件上部署孟加拉语LLM可能有效,但仔细考虑模型架构和量化方法至关重要。 AI
影响 量化选择对低资源语言的LLM性能有显著影响,影响了资源受限硬件的部署策略。
排序理由 该集群包含一篇评估LLM在特定语言任务上性能的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
在 Hugging Face Daily Papers 阅读 →
- Bangla
- Bangla MMLU
- BoolQ-BN
- CommonsenseQA-BN
- GGUF-W8A16
- GPT-OSS-20B
- GPTQ-Int8
- LLaMA-3.1-8B
- OpenBookQA-BN
- PIQA-BN
- Qwen-2.5-7B
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →