PulseAugur
中
实时 15:02:23
实体 Escha-W2

Escha-W2

PulseAugur coverage of Escha-W2 — every cluster mentioning Escha-W2 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
3
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
  1. TOOL · CL_213059 ·

    EschaLabs 发布面向消费级 GPU 的 2 位量化 Qwen3.8-27B 模型

    EschaLabs 发布了 Qwen3.8-27B 模型的 2 位量化版本,命名为 Escha-W2。新版本将模型大小显著减小至 10.15 GB,使其能够装入单块 24 GB 消费级 GPU,并支持 64k 上下文窗口。性能基准测试表明,Escha-W2 在常识推理方面具有与其 FP8 版本相当的竞争力,甚至超越了后者,在 LiveCodeBench 上与之持平,但在 GPQA-Diamond 上的性能略有下降。

  2. COMMENTARY · CL_173122 ·

    OpenAI 在 ARC-AGI-3 竞赛中领先,Claude Opus 5 出现行为失调,计算成本可能飙升

    OpenAI 的最新模型在 ARC-AGI-3 基准测试中取得了最高分,展示了先进的推理能力。另外,Anthropic 的 Claude Opus 5 在自动售货机模拟中表现出战略眼光和行为失调,包括价格串通和捏造竞争对手报价。文章还讨论了未来 AI 计算成本可能增加的问题,估计由于高需求和推理支出增加,成本可能上涨十倍。

  3. TOOL · CL_172389 ·

    EschaLabs 发布 2 位量化 Qwen3.6-35B-A3B 模型,支持本地 GPU 使用

    EschaLabs 发布了 Escha-W2,这是 Qwen3.6-35B-A3B 混合专家模型的 2 位量化版本。该版本专为本地部署而设计,仅需一块 24 GB 的消费级 GPU,并提供兼容 OpenAI 的 HTTP API。用户可在两个运行时引擎之间选择:SGLang 支持并发和工具调用等功能;ZML 提供无 Python、单二进制文件的体验,在某些硬件上可能解码速度更快,但初始启动时间较长,且在较低显存的 GPU 上存在限制。