PulseAugur
中
实时 23:33:29
实体 qwen3.5:0.8b(on)

qwen3.5:0.8b(on)

PulseAugur coverage of qwen3.5:0.8b(on) — every cluster mentioning qwen3.5:0.8b(on) across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. RESEARCH · CL_268835 ·

    消费级GPU上大语言模型的能效因架构而异,而非仅取决于大小

    一篇新论文对本地部署的大语言模型(LLMs)在消费级硬件上的能效进行了基准测试,结果表明,除了参数数量之外,模型架构和量化等因素也显著影响能耗。研究发现,qwen2.5:0.5b和tinyllama:1.1b等小型模型能效最高,而像7B-Mistral这样的大型模型每token消耗的功耗则要高得多。该研究还强调了区分不同token生成模式的重要性,因为有些模型由于内部推理时间过长而表现出异常高的能耗。