PulseAugur
实时 10:10:27
实体 DigitalOcean

DigitalOcean

PulseAugur coverage of DigitalOcean — every cluster mentioning DigitalOcean across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
6
90 天内 16
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

5 天有情绪数据

最近 · 第 1/1 页 · 共 16 条
  1. FRONTIER RELEASE · CL_200880 ·

    阿里巴巴的Qwen3.8-2.4T-A95B模型在多个平台上线

    阿里巴巴的Qwen团队发布了其Qwen3.8-2.4T-A95B模型,这是一款拥有2.4万亿总参数和950亿激活参数的大型稀疏混合专家模型。该模型现已通过多个平台提供,包括DeepInfra、DigitalOcean Serverless Inference、Modal和Nebius Token Factory,合作伙伴强调开发者可即日使用。Qwen3.8-Max版本拥有100万个token的上下文窗口,非常适合长时程编码和复杂推理任务。

  2. SIGNIFICANT · CL_195507 ·

    Kimi K3大模型自托管成本为89.52美元/小时,提供100万上下文

    Moonshot AI开发的大语言模型Kimi K3,在其自身运行环境中提供了性能报告。该模型运行在八个NVIDIA B300 SXM6 GPU上,总计拥有2.2 TB的VRAM,其上下文窗口超过100万个token。虽然为单个用户提供了近乎即时的响应时间和快速的长上下文预填充速度,但自托管这一前沿模型的成本相当可观,估计每小时为89.52美元,这使得其每个token的成本远高于高级API提供商。

  3. TOOL · CL_194800 ·

    将 OpenAI GPT 模型集成到应用程序的指南

    本文提供了一份技术指南,介绍如何将 OpenAI 的 GPT 模型集成到应用程序中,重点关注 Chat Completions API。文章详细介绍了必要的设置,包括使用 Node.js 和 Express 进行环境配置,并解释了如何使用消息角色(system、user、assistant)来管理对话历史。该指南强调了 GPT-4 Turbo 和 GPT-3.5 Turbo 之间的区别,建议用户根据其对上下文窗口、准确性和成本的具体需…

  4. TOOL · CL_172783 ·

    Bun运行时使用64个AI代理在11天内用Rust重写

    Jarred Sumner的团队在短短11天内成功将Bun JavaScript运行时的核心Zig代码库重写为Rust。这次雄心勃勃的迁移涉及64个并行AI代理,处理了780亿个token,耗资约16.5万美元。重写后的运行时已准备好投入生产,通过了所有测试和CI检查,这对于大多数开发团队来说通常需要更长的时间和大量的资源才能完成。Bun是数百万用户使用的关键工具,为Claude Code等应用程序提供支持,并为Vercel等托管平台提供服务。

  5. SIGNIFICANT · CL_169426 ·

    Anthropic 的 Claude Opus 5 在 DigitalOcean AI 推理云上推出

    Anthropic 最新的旗舰模型 Claude Opus 5 现已在 DigitalOcean 的 AI 推理云上可用。该模型专为密集型代理工作流设计,在软件工程、科学研究和企业自动化方面提供高级功能。Claude Opus 5 的性能与 Claude Fable 5 相当,但价格减半,使其成为开发人员和企业的经济高效选择。

  6. TOOL · CL_153970 ·

    Bun 运行时在 11 天内用 AI 辅助从 Zig 重写为 Rust

    Bun 运行时(runtime)的创建者 Jarred Sumner 详细介绍了他的团队如何在短短十一天内,主要借助 Anthropic 的 Claude Fable 5 模型,将超过五十万行代码从 Zig 重写为 Rust。这项意义重大的任务源于 Bun 复杂架构带来的稳定性问题,该架构混合了 JavaScript 的垃圾回收和 Zig 的手动内存管理。Rust 的安全特性,特别是其编译时检查和通过 Drop 机制实现的自动内存管理…

  7. TOOL · CL_146958 ·

    MiniMax AI、DigitalOcean、AMD、Weaviate 将联合主办 Advancing AI 活动

    MiniMax AI 将与 DigitalOcean、AMD、Weaviate、RadixArk 以及大型模型系统组织 (LMSYS) 一同主办 7 月 21 日的 Advancing AI 启动活动。活动将包括闪电演讲、现场演示以及 MiniMax AI 关于原生多模态的演讲,随后是交流环节。

  8. SIGNIFICANT · CL_102157 ·

    Milvus 2.5 向量数据库发布,支持 GPU 加速处理超过 100 亿向量

    Zilliz 推出的开源向量数据库 Milvus 2.5 已发布,其处理海量数据集的能力得到增强。新版本具备 GPU 加速索引、分布式架构和分层存储,能够以毫秒级延迟处理高达 100 亿个向量。该数据库专为可扩展的相似性搜索而设计,支持多种索引类型,包括通过 NVIDIA RAFT 优化的 GPU 索引,显著加快了索引构建和查询吞吐量。Milvus 可从简单的 Docker 单机部署扩展到生产级的 Kubernetes 集群,其商业版…

  9. TOOL · CL_98238 ·

    ZenML 0.80.0 发布,旨在解决 ML 流水线可复现性问题

    ZenML 是一个开源的 MLOps 框架,已发布 0.80.0 版本,旨在解决机器学习流水线中可复现性的重大挑战。该框架将实验跟踪器和编排器等 20 多种不同工具连接到一个统一的系统中,使用户能够构建和管理生产就绪的 ML 流水线。此版本强调基于 Python 的方法,抽象化基础设施的复杂性,并实现从本地开发到云部署的无缝过渡。

  10. TOOL · CL_97352 ·

    xAI与DigitalOcean合作,实现Grok Build一键部署

    xAI已与DigitalOcean合作,提供预先配置的虚拟机,其中预装了其Grok Build编码代理。此次集成允许用户在DigitalOcean的Serverless Inference平台上通过单击即可部署该代理。此次合作旨在简化xAI编码代理在开发任务中的使用流程。

  11. TOOL · CL_67218 ·

    用户详述在 DigitalOcean VPS 上使用 Claude Code 设置远程开发环境

    一位用户详细介绍了一种在 DigitalOcean 虚拟机私有服务器 (VPS) 上建立远程开发环境的方法。该设置利用 VS Code 的 Remote SSH 功能连接到服务器,并在服务器上安装和运行 Claude Code。用户的本地机器随后仅作为此远程开发设置的显示界面。

  12. TOOL · CL_57945 ·

    OpenCode 集成 DigitalOcean 的成本感知型 AI 模型路由器

    OpenCode 已与 DigitalOcean 的推理路由器集成,实现了智能且经济高效的 AI 模型请求路由。此功能可确保查询被定向到最合适的模型,而不是默认选择最昂贵的选项。该集成现已上线,可通过“Run /connect”命令访问。

  13. TOOL · CL_54810 ·

    Go LLM 网关使用 Redis Lua 实现速度和原子性

    一位开发者开源了一个名为 llm0-gateway 的 LLM 网关,该网关用 Go 构建,旨在为包括 OpenAI、Anthropic、Gemini 和本地 Ollama 实例在内的各种 LLM 提供商提供统一的 OpenAI 兼容端点。该网关优先考虑速度和效率,通过利用 Redis 内的原子 Lua 脚本进行 API 密钥认证、速率限制和支出上限执行等关键操作,实现了低延迟和高吞吐量。这种方法避免了在朴素的串行请求处理中常见的性能…

  14. TOOL · CL_46135 ·

    百度、Novita、StreamLake 等调整 LLM 定价 · 追踪 10 个来源

    包括百度、Novita、StreamLake、Io Net、GMICloud、CoreWeave、Wafer 和 Ambient 在内的多家 LLM 提供商近期更新了其定价结构。提供的文章中并未详述这些变动的具体细节,但多篇帖子均已注意到这些更新。

  15. TOOL · CL_33172 ·

    Zero-Port Exposure:无需打开防火墙即可通过云虚拟机路由本地流量

    本文详细介绍了一种无需打开防火墙端口即可将本地Kubernetes集群暴露给公共互联网的方法。该技术被称为“Zero-Port Exposure”,利用Fast Reverse Proxy (FRP)从集群创建到云虚拟机的出站隧道。该云虚拟机运行Nginx Proxy Manager和FRP服务器,负责处理TLS终止并将流量转发到集群。这种方法为需要公共HTTPS端点的初创公司提供了一种经济高效的解决方案,同时通过从不暴露集群的直接I…

  16. RESEARCH · CL_47635 ·

    Character.ai、DigitalOcean、AMD 将 AI 推理性能提升 2 倍

    Character.ai 与 DigitalOcean 和 AMD 合作,在其 AI 娱乐平台上实现了生产推理性能的两倍提升。通过对 AMD Instinct MI300X 和 MI325X GPU 平台进行深度技术优化,利用专家混合模型并行化和高效 FP8 执行等先进技术,实现了这一显著改进。此次合作促成了与 DigitalOcean 为期多年、年达八位数的 GPU 基础设施协议,使 Character.ai 能够以可预测且具成本效…