实体
Ascend 910B
Ascend 910B
PulseAugur coverage of Ascend 910B — every cluster mentioning Ascend 910B across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
明玢FX100存储加速AI推理,助力国产替代
明玢的FX100存储解决方案为AI推理提供了显著的性能提升,特别是在信创环境下的国产替代努力中。通过专注于存储协议和数据路径,而非直接取代GPU,明玢的技术在DeepSeek 70B和32B等大模型上,于AMD MI308X和Ascend 910B等平台上进行测试时,实现了高达40%的吞吐量提升和32%的首个token时间(TTFT)缩减。该方法利用了NVMe-oF和RoCEv2等成熟的开放标准,降低了技术风险,并在AI推理存储方面提…
-
新型1.58位大语言模型家族推理内存减少6倍
新一代大语言模型BitCPM-CANN家族采用了一种新颖的1.58位三元量化技术。这些模型参数量从0.5B到8B不等,显著减少了推理内存占用,约为全精度模型的六分之一。在华为Ascend NPU上进行的训练过程引入的开销极小,吞吐量仅下降5%。