DSv4
PulseAugur coverage of DSv4 — every cluster mentioning DSv4 across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
llama.cpp 增强测试套件以实现更广泛的模型兼容性
llama.cpp 项目发布了更新 b10666,其中包含对其测试套件的重大改进。一项关键的变更是将 `test-save-load-state` 功能扩展到覆盖指定目录中的所有架构和模型,而不仅仅是单个模型。此次更新还解决了 `deepseek4`、`gemma2`、`minimax-01` 和 `dsv4` 等不同模型架构中的各种问题,以确保兼容性和正确的状态保存/加载。此外,还对 dummy DSA 索引器进行了优化,以更好地与…
-
DSv4 模型本地部署需要高端硬件
在 r/LocalLLaMA 子版块,用户们正在讨论运行 DSv4 模型所需的高昂硬件配置。一位用户分享了他们尝试使用双 3090 GPU 和 50GB RAM 运行该模型的经历,这表明对计算资源的需求很高。这次讨论凸显了在本地部署先进 AI 模型所面临的挑战。
-
用户在使用 llama.cpp Vulkan 时遇到 DSv4 Flash 模型循环
Reddit 的 r/LocalLLaMA 版块的一位用户在使用 Q8 量化和 llama.cpp Vulkan 实现时,遇到了 DSv4 Flash 模型出现的“毁灭循环”。该模型陷入重复输出循环,无法生成有意义的文本。用户正在寻求建议,询问是否需要直接从 GitHub 构建最新版本,因为他们目前使用的是 AUR 的旧版本。他们提供了启动命令和系统规格,包括双 7900XTX GPU(48GB 显存)、9800X3D CPU 和 1…
-
Together AI 推出 DeepSeek V4 Flash,以更低成本实现前沿代理性能
Together AI 宣布推出 DeepSeek V4 Flash,该模型旨在显著降低运行前沿代理性能的成本。此次集成通过高吞吐量的生产环境为开发人员提供了支持,可用于编码、工具利用和长期代理工作负载等任务。DeepSeek V4 Flash 具有增强的编码能力、改进的自动化工具使用功能,并支持不同的推理工作量,同时采用 DSpark 投机解码以实现更快的生成速度。
-
Together AI发布DeepSeek V4 Pro,采用新颖的KV缓存架构
Together AI发布了DeepSeek V4 Pro,这是一个开源模型,其KV缓存架构与之前的DeepSeek模型相比有了显著不同。这种新架构采用了滑动窗口注意力、索引器和压缩状态来增强缓存重用。为了优化性能,Together AI实现了融合注意力设置内核、更快的稀疏注意力内核、改进的内核重叠和图级优化。
-
LocalLLaMA 用户就运行更高级模型的 GPU 升级寻求建议
一位 r/LocalLLaMA 上的用户正在就从四块 NVIDIA 3090 GPU 升级硬件配置寻求建议。他们目前正在运行 Qwen 3.6 27B 模型,并正在考虑八块 3090 GPU 的配置或 RTX B5000 等选项,权衡显存容量和成本效益。该用户有兴趣运行更高级的模型,并想了解模型提供商是否正针对未来发布的模型设定 192GB 显存等硬件层级。