实体
DSv4-Flash
DSv4-Flash
PulseAugur coverage of DSv4-Flash — every cluster mentioning DSv4-Flash across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
GLM-5.3 在 Terminal Bench v4 中领先,超越 Kimi-K3 及其他模型
Terminal Bench v4 基准测试结果显示,GLM-5.3 是表现最佳的开源模型,显著优于同类其他模型。GLM-5.3-Flash 在闪速模型中也处于领先地位,而 Kimi-K3 的表现与其规模相比不佳。Qwen3.8-27B 被认为是唯一能够在此基准上获得分数的模型。
-
DSv4-Flash 优化提升 NVIDIA GH200 上的 LLM 推理速度
一种名为 DSv4-Flash 的新优化技术已被开发出来,可显著提高 NVIDIA GH200 硬件上大型语言模型推理的速度。当与 vLLM 和 SGLang 结合使用时,该优化可以在文本生成方面实现每秒超过 300 个 token,并在 192 GB HBM 内支持高达 100 万个 token 的上下文长度。改进细节包含在文章中,其中提供了具体的配置步骤和性能指标。