PulseAugur
实时 19:32:18
实体 llmfan46

llmfan46

PulseAugur coverage of llmfan46 — every cluster mentioning llmfan46 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 5
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 5 条
  1. TOOL · CL_86487 ·

    Gemma 4 模型变体发布,包含未审查选项

    一位 Reddit 用户宣布发布了 Gemma 模型的四个新版本,包括 12B、12B QAT、26B-A4B QAT 和 31B QAT 未审查变体。这些模型有多种格式可供选择,例如 Safetensors、GGUF、NVFP4 和 GPTQ-Int4,并提供了直接链接到 Hugging Face 存储库以下载。

  2. TOOL · CL_61829 ·

    Gemma 4 E2B变体显示出改进的安全性和部分推理能力的提升

    对Google的Gemma 4 E2B模型的13个修改版本的全面分析显示,虽然所有变体都通过提高拒绝率显著提高了安全性,但其中一些也增强了推理能力。具体而言,coder3101和llmfan46这两个变体在GSM8K数学基准测试中表现优于基础模型。然而,更激进的修改导致语言建模性能和推理效率明显下降,一些变体显示出显著更高的困惑度(perplexity)和空响应。

  3. TOOL · CL_55600 ·

    Gemma-4-Harmonia-31B-Uncensored-Heretic模型发布

    一款新的微调模型Gemma-4-Harmonia-31B-Uncensored-Heretic已发布。该模型是多个Gemma-4-31B-it微调模型的合并,旨在实现深度神经巩固,最大限度地减少回归并放大独特的能力。它提供Safetensors和GGUF格式,并附带了基准测试结果。

  4. RESEARCH · CL_51822 ·

    Qwen3.5 27B和35B未审查模型已发布

    用户LLMFan46发布了Qwen3.5模型的两个未审查版本:一个27B参数模型和一个名为A3B的35B参数模型。这些模型有多种格式可供选择,包括Safetensors、GGUFs、NVFP4和GPTQ-Int4。用户澄清说,虽然Qwen3.5和Qwen3.6共享相同的架构,但Qwen3.5针对通用AI助手进行了优化,而Qwen3.6则面向代理和编码任务。

  5. TOOL · CL_48200 ·

    BeeLlama、ByteShape 提升消费级硬件上的本地 LLM 推理速度

    本地 LLM 推理的新进展正在提升消费级硬件上的性能。BeeLlama v0.2.0 版本利用 DFlash 更新,显著提高了 Qwen 和 Gemma 等模型在 RTX 3090 等 GPU 上的令牌生成速度,速度提升高达 5 倍。此外,ByteShape 量化正在改善 Qwen 模型在显存有限的笔记本电脑上的性能,提供了显著的速度提升。这些进展旨在使更大、更强大的开放权重模型在日常本地使用中变得实用。