DigitalOcean
PulseAugur coverage of DigitalOcean — every cluster mentioning DigitalOcean across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
DigitalOcean 在公开预览中推出 Managed Agents
DigitalOcean 推出了 DigitalOcean Managed Agents,这是一项现已进入公开预览的新服务。该产品旨在增强用户 AI Agent 的能力和管理。
-
AMD Instinct MI300X GPU 细节,附带自定义 Python 管理工具
本文详细介绍了在 AMD Developer Cloud 上盘点和测量 AMD Instinct MI300X GPU 的过程。作者开发了一套名为“MCP”的 Python 工具集,用于管理和交互 GPU 实例。这些工具提供了列出实例、检查状态、启动、停止和重启实例以及运行命令和扫描硬件等功能。文章强调了工具报告的硬件规格与 AMD 公布的数据之间存在的差异,并强调了解析原始输出而非信任状态指示器的重要性。
-
OpenAI 发布 Agents API,用于自主云端智能体
OpenAI 已推出其 Agents API 公共测试版,为开发者提供对其驱动 Codex 和 ChatGPT 的底层基础设施的访问。这个新 API 允许创建能够长时间运行、执行代码和管理子智能体的自主云端智能体。开发者可以使用 OpenAI 托管的沙箱、自己的基础设施或来自 Cloudflare 和 Oracle 等公司的合作伙伴环境来进行智能体计算。该服务旨在通过处理上下文管理和长时间运行会话等复杂任务来简化智能体开发,成本主要与…
-
DHH 的 Omarchy 作为首个“代理操作系统”上线,内置 13 个 AI 代理
Omarchy 是由 DHH 开发的一个有主见的 Arch Linux 发行版,现已上线,预装了 13 个 AI 代理,目标是成为首个主流的“代理操作系统”。用户可以在首次启动时选择一个默认代理,例如将崩溃通知路由给代理进行诊断。该系统的核心创新在于其集成了 AI 代理来管理和可能自我修复操作系统。然而,文章强调了这种方法一个重要但常被忽视的成本:每次交互时将工具目录和模式发送给 AI 代理会产生大量的 token 使用量,这会增加运营费用。
-
OpenAI API 通过 JSON Schema 强制执行结构化输出
OpenAI 为其 API 推出了一项新功能,该功能强制执行结构化输出,使开发人员能够可靠地以 JSON 等格式提取数据。这是通过提供一个特定的 schema 来实现的,API 然后使用该 schema 来约束模型的输出,防止出现诸如对话式前导语或无效格式等常见错误。开发人员可以通过结合使用 Pydantic 等 Python 库和 OpenAI SDK 来定义数据模型,从而利用此功能,确保提取的信息符合严格的类型和结构要求,以便在自…
-
MiniMax AI的H3模型在Ray峰会上整合文本、图像、视频和音频
MiniMax AI的H3模型,一个能够处理文本、图像、视频和音频的33B开源模型,在旧金山的Ray峰会上进行了展示。演示详细介绍了H3如何将多种模态整合到单一上下文中。此外,讨论还涵盖了开发人员如何对H3进行微调、评估和部署,并提到了与Anyscale、DigitalOcean、NVIDIA、Infact和Nous Research的合作。
-
提示工程、RAG 和微调:选择正确的人工智能方法
提示工程、微调和检索增强生成 (RAG) 是使大型语言模型 (LLM) 对特定业务需求更有用的三种关键方法。提示工程涉及为现有模型创建指令,作为原型和需要对语气或格式进行指导的任务的起点。RAG 将 LLM 连接到外部知识源以进行实时信息检索,非常适合经常变化的数据并减少幻觉。微调在特定领域的数据上进一步训练预训练模型,以调整其内部参数以完成专业任务或实现一致的行为。
-
阿里巴巴的Qwen3.8-2.4T-A95B模型在多个平台上线
阿里巴巴的Qwen团队发布了其Qwen3.8-2.4T-A95B模型,这是一款拥有2.4万亿总参数和950亿激活参数的大型稀疏混合专家模型。该模型现已通过多个平台提供,包括DeepInfra、DigitalOcean Serverless Inference、Modal和Nebius Token Factory,合作伙伴强调开发者可即日使用。Qwen3.8-Max版本拥有100万个token的上下文窗口,非常适合长时程编码和复杂推理任务。
-
Kimi K3大模型自托管成本为89.52美元/小时,提供100万上下文
Moonshot AI开发的大语言模型Kimi K3,在其自身运行环境中提供了性能报告。该模型运行在八个NVIDIA B300 SXM6 GPU上,总计拥有2.2 TB的VRAM,其上下文窗口超过100万个token。虽然为单个用户提供了近乎即时的响应时间和快速的长上下文预填充速度,但自托管这一前沿模型的成本相当可观,估计每小时为89.52美元,这使得其每个token的成本远高于高级API提供商。
-
将 OpenAI GPT 模型集成到应用程序的指南
本文提供了一份技术指南,介绍如何将 OpenAI 的 GPT 模型集成到应用程序中,重点关注 Chat Completions API。文章详细介绍了必要的设置,包括使用 Node.js 和 Express 进行环境配置,并解释了如何使用消息角色(system、user、assistant)来管理对话历史。该指南强调了 GPT-4 Turbo 和 GPT-3.5 Turbo 之间的区别,建议用户根据其对上下文窗口、准确性和成本的具体需…
-
Bun运行时使用64个AI代理在11天内用Rust重写
Jarred Sumner的团队在短短11天内成功将Bun JavaScript运行时的核心Zig代码库重写为Rust。这次雄心勃勃的迁移涉及64个并行AI代理,处理了780亿个token,耗资约16.5万美元。重写后的运行时已准备好投入生产,通过了所有测试和CI检查,这对于大多数开发团队来说通常需要更长的时间和大量的资源才能完成。Bun是数百万用户使用的关键工具,为Claude Code等应用程序提供支持,并为Vercel等托管平台提供服务。
-
Anthropic 的 Claude Opus 5 在 DigitalOcean AI 推理云上推出
Anthropic 最新的旗舰模型 Claude Opus 5 现已在 DigitalOcean 的 AI 推理云上可用。该模型专为密集型代理工作流设计,在软件工程、科学研究和企业自动化方面提供高级功能。Claude Opus 5 的性能与 Claude Fable 5 相当,但价格减半,使其成为开发人员和企业的经济高效选择。
-
Bun 运行时在 11 天内用 AI 辅助从 Zig 重写为 Rust
Bun 运行时(runtime)的创建者 Jarred Sumner 详细介绍了他的团队如何在短短十一天内,主要借助 Anthropic 的 Claude Fable 5 模型,将超过五十万行代码从 Zig 重写为 Rust。这项意义重大的任务源于 Bun 复杂架构带来的稳定性问题,该架构混合了 JavaScript 的垃圾回收和 Zig 的手动内存管理。Rust 的安全特性,特别是其编译时检查和通过 Drop 机制实现的自动内存管理…
-
MiniMax AI、DigitalOcean、AMD、Weaviate 将联合主办 Advancing AI 活动
MiniMax AI 将与 DigitalOcean、AMD、Weaviate、RadixArk 以及大型模型系统组织 (LMSYS) 一同主办 7 月 21 日的 Advancing AI 启动活动。活动将包括闪电演讲、现场演示以及 MiniMax AI 关于原生多模态的演讲,随后是交流环节。
-
Milvus 2.5 向量数据库发布,支持 GPU 加速处理超过 100 亿向量
Zilliz 推出的开源向量数据库 Milvus 2.5 已发布,其处理海量数据集的能力得到增强。新版本具备 GPU 加速索引、分布式架构和分层存储,能够以毫秒级延迟处理高达 100 亿个向量。该数据库专为可扩展的相似性搜索而设计,支持多种索引类型,包括通过 NVIDIA RAFT 优化的 GPU 索引,显著加快了索引构建和查询吞吐量。Milvus 可从简单的 Docker 单机部署扩展到生产级的 Kubernetes 集群,其商业版…
-
ZenML 0.80.0 发布,旨在解决 ML 流水线可复现性问题
ZenML 是一个开源的 MLOps 框架,已发布 0.80.0 版本,旨在解决机器学习流水线中可复现性的重大挑战。该框架将实验跟踪器和编排器等 20 多种不同工具连接到一个统一的系统中,使用户能够构建和管理生产就绪的 ML 流水线。此版本强调基于 Python 的方法,抽象化基础设施的复杂性,并实现从本地开发到云部署的无缝过渡。
-
xAI与DigitalOcean合作,实现Grok Build一键部署
xAI已与DigitalOcean合作,提供预先配置的虚拟机,其中预装了其Grok Build编码代理。此次集成允许用户在DigitalOcean的Serverless Inference平台上通过单击即可部署该代理。此次合作旨在简化xAI编码代理在开发任务中的使用流程。
-
用户详述在 DigitalOcean VPS 上使用 Claude Code 设置远程开发环境
一位用户详细介绍了一种在 DigitalOcean 虚拟机私有服务器 (VPS) 上建立远程开发环境的方法。该设置利用 VS Code 的 Remote SSH 功能连接到服务器,并在服务器上安装和运行 Claude Code。用户的本地机器随后仅作为此远程开发设置的显示界面。
-
OpenCode 集成 DigitalOcean 的成本感知型 AI 模型路由器
OpenCode 已与 DigitalOcean 的推理路由器集成,实现了智能且经济高效的 AI 模型请求路由。此功能可确保查询被定向到最合适的模型,而不是默认选择最昂贵的选项。该集成现已上线,可通过“Run /connect”命令访问。
-
Go LLM 网关使用 Redis Lua 实现速度和原子性
一位开发者开源了一个名为 llm0-gateway 的 LLM 网关,该网关用 Go 构建,旨在为包括 OpenAI、Anthropic、Gemini 和本地 Ollama 实例在内的各种 LLM 提供商提供统一的 OpenAI 兼容端点。该网关优先考虑速度和效率,通过利用 Redis 内的原子 Lua 脚本进行 API 密钥认证、速率限制和支出上限执行等关键操作,实现了低延迟和高吞吐量。这种方法避免了在朴素的串行请求处理中常见的性能…