Atomic Chat
PulseAugur coverage of Atomic Chat — every cluster mentioning Atomic Chat across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
Edge0发布35B MoE LLM以支持低内存设备
Edge0发布了其Edge0-35B-A3B模型的预览版,这是一个拥有350亿参数的稀疏专家混合(MoE)大型语言模型,专为在内存有限的设备上高效运行而设计。该模型通过按需流式传输专家,所需的活动RAM低于3 GiB,能够实现每秒15个token的交互速度。提供了将此模型与MLX、LM Studio和Hermes Agent等各种库和应用程序集成的说明,使其可以在Raspberry Pi等设备上本地使用。
-
阿里巴巴的 Qwen3.8-27B 模型通过新的量化技术在笔记本电脑上运行
阿里巴巴的 Qwen 团队发布了 Qwen3.8-27B 模型,该模型能够在 MacBook Air 等消费级硬件上运行。这是通过开发 Atomic Dynamic GGUF 量化技术实现的,该技术显著减小了模型的大小。例如,AD-IQ3_S 变体可以在 16GB MacBook Air 上运行,并且与原始的 BF16 版本相比,保持了高精度。
-
unofficial Qwen3.8-27B 衍生模型发布,抑制了拒绝行为
PocketAI Model Lab 发布了一系列 unofficial 的 Qwen/Qwen3.8-27B 模型的 MLX 衍生版本。这些变体包括 2 位 AWQ、4 位、6 位、8 位和 BF16 版本,经过修改以抑制学习到的拒绝行为,可能导致更具危害性或冒犯性的内容。模型已进行行为评估和功能验证,大多数变体通过了质量和工具调用检查,但 2 位 AWQ 版本被标记为实验性且存在局限性。
-
Atomic Chat 为本地 Qwen 模型在多个操作系统上发布 DFlash
Atomic Chat 发布了 DFlash,一种用于本地 Qwen 模型的新型投机解码模式。此功能适用于 macOS、Windows 和 Linux 操作系统。