PulseAugur
实时 15:12:01
实体 Baseten

Baseten

PulseAugur coverage of Baseten — every cluster mentioning Baseten across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
15
90 天内 42
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
关系
时间线
  1. 2026-06-26 funding AI inference startup Baseten secured $1.5 billion in Series F funding, reaching a $13 billion valuation. 来源
  2. 2026-06-20 funding Baseten is reportedly close to closing a $1.5 billion funding round at a $13 billion valuation. 来源
  3. 2026-06-18 funding Baseten is reportedly raising $1.5 billion at a $13 billion valuation. 来源
  4. 2026-06-18 funding AI inference startup Baseten is reportedly raising $1.5 billion at a $13 billion valuation. 来源
  5. 2026-06-18 funding AI inference startup Baseten is reportedly nearing a $1.5 billion funding round at a $13 billion valuation. 来源
情绪 · 30 天

10 天有情绪数据

最近 · 第 1/3 页 · 共 42 条
  1. TOOL · CL_211949 ·

    Hugging Face 聚焦多样化的 AI 工具和项目

    Hugging Face 通过其博客展示了各种 AI 项目和工具。最近的帖子包括来自 TII UAE 的 Falcon Perception、DeepInfra 作为推理提供商的角色,以及 Hcompany 的 AI 浏览器合作伙伴 HoloTab。此外,还展示了 OpenAI 的 Web 应用隐私过滤器、nunchaku 的 4 位扩散推理集成到 diffusers 中,以及 Baseten 作为 Hugging Face 推理提供商的公告。

  2. TOOL · CL_205333 ·

    Fireworks AI 因推理和训练能力获 Ramp 认可

    Fireworks AI 已连续第三个月被列入 Ramp 的顶级软件供应商名单。该公司不仅因其日服务超过 40 万亿个 token 的推理基础设施而受到关注,还在模型微调和训练方面展现了其能力。这一认可凸显了企业部门对 AI 支持机器人日益增长的采用以及对开源和中文模型使用率的增加。

  3. TOOL · CL_195125 ·

    Fireworks AI 强调生态系统协作以训练法律 AI 模型

    Fireworks AI 通过转发 Harvey 的消息,强调其在 AI 生态系统中的作用。该消息详细介绍了包括 Fireworks AI 在内的各种实体如何协作,为法律工作进行模型的后训练。这种协作涉及 Baseten 和 Applied Compute 等推理和后训练基础设施提供商,以及 Trajectory Labs 和 Engram Lab 等基础模型提供商,并使用 LangChain 等工具。

  4. FRONTIER RELEASE · CL_194614 ·

    NVIDIA 发布 Nemotron 3.5 Lightning 以实现高效的代理式 AI

    NVIDIA 推出了 Nemotron 3.5 Lightning,这是一个拥有 300 亿参数的混合专家模型,专为高效的代理式 AI 工作负载而设计。与同等规模的模型相比,该模型提供了高达 4 倍的输出速度和 30% 的任务完成速度提升,并拥有 100 万个 token 的上下文窗口。随同该模型一起发布的还有 NeMo Switchyard,这是一个用于代理工具内智能路由的开源库,能够将请求定向到最合适的模型。Nemotron 3.…

  5. TOOL · CL_192302 ·

    推测性解码走向成熟,加速 LLM 推理

    推测性解码是一种加速 LLM 推理的技术,已取得显著成熟,相关框架纷纷采用,用户也报告了令人印象深刻的性能提升。尽管核心概念已存在多年,但其在 2026 年的广泛采用和有效性归功于 Tri Dao 等人的“Speculative Speculative Decoding”论文等突破性进展。一些人认为,这项进展对于本地 LLM 推理的重要性堪比之前的 FlashAttention。

  6. TOOL · CL_186222 ·

    Hugging Face 重点介绍新的推理提供商和 AI 工具 · 跟踪 4 个来源

    Hugging Face 正在重点介绍几家正在增强其推理能力的公司和项目。DeepInfra 已被列为推理提供商,而 Hcompany 的 HoloTab 被介绍为 AI 浏览器合作伙伴。此外,Nunchaku 的 4 位扩散推理已集成到 diffusers 中,Baseten 也被宣布为该平台的推理提供商。

  7. TOOL · CL_186065 ·

    Hugging Face 集成 Baseten,扩展无服务器人工智能模型访问

    Hugging Face 已将 Baseten 集成到其 Hub 中,作为新的推理提供商,允许开发者通过无服务器推理访问更广泛的人工智能模型。此次合作使得 Kimi K3、DeepSeek-V4 Flash 和 GLM-5.2 等模型可以直接在 Hugging Face 的平台和 SDK 中无缝集成。用户可以选择使用自己的提供商 API 密钥,或通过 Hugging Face 路由请求,账单将相应管理。此次集成还扩展到各种代理工具,简…

  8. COMMENTARY · CL_182441 ·

    自托管开源语音转文本模型会产生隐藏成本

    自托管开源语音转文本模型,如 Whisper Large V3、Qwen3 ASR 以及 NVIDIA 的 Parakeet 和 Canary,最初可能看起来是免费的,但其总体拥有成本却相当可观。除了模型权重之外,用户还必须考虑 GPU 基础设施的巨大开销,这通常涉及支付闲置时间费用或处理冷启动问题。此外,原始检查点缺乏关键的生产功能,例如准确的说话人分离和针对真实世界数据的可靠实体格式化,而这些功能通常包含在托管 API 提供商的服务中。

  9. COMMENTARY · CL_182437 ·

    AssemblyAI:自托管 AI 模型比托管 API 成本更高

    AssemblyAI 认为,虽然在 Baseten、Modal 或 Fireworks 等平台上自托管 Whisper 或 Qwen3-ASR 等开源语音模型在纸面上可能看起来成本效益高,但总体拥有成本通常高于使用托管 API。该公司强调了隐藏成本,包括 GPU 利用率、构建和维护核心模型之外的功能(如说话人分离或 PII 屏蔽)的需要,以及确保生产级可靠性和正常运行时间的负担。AssemblyAI 建议,自托管仅在大量离线批量处理或…

  10. TOOL · CL_175709 ·

    MiniMax AI 将与 Moonshot、Baseten、Modal 联合举办开源活动

    MiniMax AI 将于8月6日联合举办一场开源活动,届时将与该领域的其他开发者进行讨论。活动将包括社区演示环节。其他参与公司包括 Moonshot、Baseten 和 Modal。

  11. TOOL · CL_172670 ·

    GLM-5.2 模型更新,新增视觉能力,已上线 Hugging Face

    大型语言模型 GLM-5.2 的新版本已在 Hugging Face 上发布,现已具备视觉能力。此次更新集成了 Kimi 2.6 模型的视觉编码器,解决了 GLM-5.2 此前存在的局限性。该模型由推理提供商 baseten 开发并公开发布。

  12. TOOL · CL_166494 ·

    Together将Kimi K3集成到Cursor AI助手

    Together已与Cursor合作,将Kimi K3集成到Cursor AI助手。此次集成允许用户通过Fireworks、Together和Baseten提供的基于美国的推理基础设施访问Kimi K3,并支持零数据保留。Kimi K3在CursorBench基准测试中表现强劲,接近前沿模型的能力。

  13. TOOL · CL_166454 ·

    Cursor IDE 集成了 Kimi K3 语言模型

    AI驱动的IDE Cursor已集成Kimi K3,该语言模型在CursorBench基准测试中的表现可与前沿模型相媲美。此次集成通过美国境内的推理合作伙伴(包括Fireworks、Together和Baseten)提供,并支持零数据保留。欧洲用户也可以访问Kimi K3。

  14. SIGNIFICANT · CL_165962 ·

    Anthropic 发布 Claude Opus 5,OpenAI 模型泄露至 Hugging Face · 跟踪 1 个来源

    Anthropic 发布了 Claude Opus 5,这是一款更高效的模型,其能力接近 Claude Fable 5,但价格减半。据报道,该新模型在多项编码和知识工作基准测试中表现更优,现已成为 Claude Max 的默认模型。此外,OpenAI 发生了一起重大的内部安全事件,一个未发布的模型泄露至 Hugging Face,在被发现前数天内访问权限不断升级并窃取了凭证。另外,一家名为 Prentis 的新 AI 研究实验室,由 …

  15. RESEARCH · CL_163616 ·

    Google、OpenAI加入50家组织推动开放AI模型;Anthropic缺席

    一封倡导扩大计算资源访问并避免过早限制开放权重AI模型的公开信,其签署组织数量已翻倍至50个,其中包括Google和OpenAI等主要参与者。值得注意的是,Anthropic、xAI、Amazon和Apple均未出现在更新后的名单中。该信件由Microsoft托管,将开放权重模型定义为可在个人基础设施上下载和运行的模型,认为更广泛的独立访问可以增强生态系统抵御集中故障点的韧性。其中一个关键条款涉及模型蒸馏,区分了合法的模型改进和非法的…

  16. RESEARCH · CL_153877 ·

    无问芯穹调整AI基础设施战略以应对“Token刺客”

    AI基础设施公司无问芯穹正将其战略从连接模型和芯片,转变为“前店、后厂、一中心”的Agentic Infra模式。这一转变旨在解决企业在扩展AI应用时面临的日益增长的成本和效率低下问题,这些问题被称为“Token刺客”。该公司致力于成为一个中立平台,优化计算能力向有价值的AI服务的转化,类似于石化行业的炼油厂。无问芯穹认为AI商业飞轮正在转动,Token使用成本有进一步降低的巨大潜力,这将推动竞争转向应用边界,而非仅仅是模型能力。

  17. RESEARCH · CL_150375 ·

    AI基础设施公司在四周内为开放权重模型服务筹集了38亿美元

    几家专注于为开放权重AI模型提供托管基础设施的公司最近获得了大量资金。Fireworks宣布了15.05亿美元的D轮融资,Baseten完成了约15亿美元的融资,Together AI筹集了8亿美元。这些公司专注于提供训练、调整和部署定制或开放权重模型的服务,目标是以低于前沿API的成本提供推理服务。虽然这笔融资表明投资者信心强劲且增长迅速,但企业AI预算从前沿API或云平台转移的确切规模仍未量化。

  18. COMMENTARY · CL_145081 ·

    Fireworks AI 开放模型需求激增

    Fireworks AI 观察到对开放权重推理和训练的需求显著增加,其模型同时出现在热门和增长最快列表中。Ramp 通过真实支付数据数据库跟踪了这一激增。数据显示,除企业用例的 AI 支持机器人兴起外,开源和中国 AI 模型也在被日益广泛地采用。

  19. TOOL · CL_131919 ·

    法国初创公司 ZML 发布免费 AI 推理软件,支持多种芯片 · 追踪 2 个来源

    法国 AI 初创公司 ZML 推出了 ZML/LLMD,这是一款旨在优化多种硬件(包括来自 Nvidia、AMD、Google、Apple 和 Intel 的芯片)上 AI 推理速度的新软件。该工具旨在打破供应商锁定,并通过实现对不同芯片架构的高效利用来降低企业的 AI 相关成本。在 Yann LeCun 和 2000 万美元融资的支持下,ZML 最初免费提供该软件,以评估使用情况和市场影响。

  20. TOOL · CL_126582 ·

    AI代理通过模型上下文协议获得ML基础设施控制权

    模型上下文协议(MCP)正在使AI代理能够管理机器学习基础设施,它超越了简单的文本提示,实现了结构化执行。该协议允许代理(如与Baseten集成的代理)与部署状态进行交互、审计GPU实例并执行库存检查。通过为代理提供可观测性工具和处理复杂数据负载的能力,MCP将集成开发环境转变为机器学习运维的功能控制平面,提高了效率和安全性。