0xSero
PulseAugur coverage of 0xSero — every cluster mentioning 0xSero across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
新 AI 模型 Cyber-Tiel-Coder 和 GLM-5.3-Flash 在本地展示
Mastodon 上重点介绍了两个独立的 AI 模型发布。第一个是 Cyber-Tiel-Coder-35B-A3B,一个拥有 350 亿参数的专家混合(MoE)模型,专为编码任务设计,可通过 GGUF 和 llama.cpp 在本地运行。第二个是 GLM-5.3-Flash,它在单块 3090 GPU 和 120GB DDR4 内存上高效运行,展示了快速推理能力。
-
DeepSeek-V4 Flash模型在Ascent GX10上实现了长上下文性能的一致性
一位用户已成功在Ascent GX10系统上部署了REAP-pruned NVFP4版本的DeepSeek-V4 Flash模型。该设置使用单个Apache Spark实例,并在长上下文长度下展示了稳定的吞吐量。用户还开发了一个Grafana仪表板来监控Spark服务器的性能,该服务器以262k的上下文长度和VLLM提供服务。
-
llmff v1.1 发布:用于LLM推理管道的类FFmpeg工具
一款名为llmff的新工具,旨在像FFmpeg一样用于大型语言模型(LLM)推理,已发布1.1版本。这款可组合的管道工具允许用户通过链接不同的推理阶段(如加载、推理、检索、验证、修复和路由)来创建复杂的推理工作流。最新更新引入了对有限迭代循环、显式终止条件和详细检查功能的本地支持,使其适用于构建AI应用的精炼、重复和自我纠正循环。
-
Local.ai 发布,旨在为所有用户带来设备端AI
Local.ai 已发布,旨在让每个人都能在本地使用AI。该产品对于对设备端和私有AI推理感兴趣的开发者和用户尤其具有相关性。然而,关于其具体功能和实际影响的详细信息尚未公布。