Google Cloud Storage
PulseAugur coverage of Google Cloud Storage — every cluster mentioning Google Cloud Storage across labs, papers, and developer communities, ranked by signal.
5 天有情绪数据
-
Google's Gemma 4 models repacked for enhanced performance on single TPU v5e
一份技术指南详细介绍了如何重新打包Google的量化感知训练(QAT)Gemma 4模型,以提高在单个Google Cloud TPU v5e芯片上的性能。重新打包后的模型,特别是12B参数版本,与bfloat16版本相比,在吞吐量和准确性方面具有竞争力,其中12B模型成为能装入该芯片的最大模型。这种优化允许在单个TPU v5e上部署各种大小的Gemma 4模型,从E2B到26B,为高效部署这些模型提供了一种实用的方法。
-
Databricks Unity Catalog 强调用户对数据存储的控制权
Databricks 详细介绍了其在 Unity Catalog 中管理数据存储的策略,强调用户控制和开放格式。该平台允许用户将托管表数据存储在他们自己的云存储账户中,例如 Amazon S3、ADLs 或 Google Cloud Storage,从而确保数据所有权和可见性。Unity Catalog 支持 Iceberg 和 Delta 格式,可自动进行数据布局、调优和清理,同时允许 Apache Spark、Flink、Trin…
-
僵尸工作负载耗尽数据中心效率,云支出高达30%
僵尸工作负载,即被遗弃的计算资源,如作业、实例和存储卷,严重消耗数据中心的效率和云支出。这些“孤儿”或“流浪”资产可能消耗高达13%的云使用量,一些估计将整体云浪费推高至25-30%。虽然 FinOps 工具和按需缩减配置有助于管理这些资源,但 GPU 密集型 AI 和微服务架构的兴起给识别和消除这些昂贵的低效问题带来了新的挑战。
-
MCP Python SDK 从 1.x 更新至 2.x,需要服务器迁移
MCP Python SDK 已从 1.x 版本(FastMCP)更新至 2.x 版本(MCPServer),现有 Python MCP 服务器需要进行迁移。此次更新包括将 FastMCP 重命名为 MCPServer,并对 API 进行更改,涉及传输机制和依赖项。开发者需要更新代码以使用新 SDK,或将项目固定到旧版本以保持兼容性。迁移过程涉及识别受这些更改影响的代码(如工具定义和传输协议),并调整依赖项(如将 httpx 更改为 …
-
指南:在 Cloud Run 上使用 NVIDIA L4 GPU 部署 Gemma 4 模型
本文详细介绍了在 Google Cloud Run 上部署 Gemma 4 E2B 模型的分步指南,利用 NVIDIA L4 GPU。部署由 Python MCP 服务器管理,该服务器已更新为使用 MCP SDK 2.x。此设置允许自动暂存模型权重、部署服务、健康检查和基准测试,Cloud Run 提供了一个无服务器环境,在空闲时可扩展至零。
-
人口普查局面临政治干预;MacBook 备份工具受关注
据报道,美国人口普查局正经历政治干预,损害了美国的统计系统。另外,用户可以使用 MacBook 的内置备份工具 Time Machine,作为付费云存储解决方案的替代方案。
-
Google DeepMind 发布 WeatherNext 3 AI,实现超高精度每小时天气预报 · 跟踪 8 个来源
Google DeepMind 推出了 WeatherNext 3,这是一个用于全球天气预报的先进人工智能模型。该新模型通过直接从实时卫星观测中学习,绕过了传统的基于物理的模拟及其固有的数据延迟,从而显著提高了准确性和分辨率。WeatherNext 3 以 5 公里的分辨率生成每小时预报,比其前代产品提高了五倍,并正在集成到包括 Search、Gemini 和 Maps 在内的各种 Google 产品中。
-
RAG 详解:LLM 如何访问和使用特定数据来生成答案
检索增强生成(RAG)是 LLM 应用中用于让模型访问其训练集之外的特定、最新数据的一项技术。RAG 流程包括一个检索器从文档中查找相关文本块,然后将这些文本块作为上下文供 LLM 生成答案。生产系统通常包含额外的步骤,如解析、分块、嵌入生成、索引、重排序和构建最终上下文,以提高答案的质量和准确性。
-
AI代理将使用“查询后变更”来进行基础设施变更
提出了一种新的方法,称为“查询后变更”,用于AI代理如何与基础设施即代码(IaC)工具进行交互。该方法强调在进行任何更改之前读取实时云状态,这与依赖缓存快照的Terraform等传统IaC工具形成对比。该模式包括查询当前基础设施状态,将其与定义的策略进行比较,然后仅变更不符合这些策略的部分,最后进行验证。这确保了代理能够使用最新信息进行操作并遵守安全限制,使其适合在动态环境中持续运行。
-
KubeRay v1.6 和 v1.7 通过 History Server 和安全性增强 Kubernetes 上的 Ray
Anyscale 发布了 KubeRay 1.6 和 1.7 版本,为在 Kubernetes 上运行 Ray 框架带来了重大增强。这些更新包括 History Server 的 Beta 版本,用于访问已删除 Ray 集群的日志和事件;改进的安全功能,如 NetworkPolicy 支持和自动 mTLS 证书管理;以及 RayService 在增量升级和回滚能力方面的进步。这些版本还为 RayJob 和 RayCluster 带来了…
-
开放表格式:Iceberg、Delta Lake 和 Hudi 详解
开放表格式,如 Apache Iceberg、Delta Lake 和 Apache Hudi,对于数据湖至关重要,它们支持在对象存储中存储的数据上进行 ACID 事务、模式演进和时间旅行。这些格式将文件集合转化为可查询的表,弥合了数据湖和数据仓库之间的差距。Apache Iceberg 源自 Netflix,专注于大型、不断演进的表的高效元数据管理。Delta Lake 由 Databricks 开发,使用事务日志来实现 ACID …
-
Google 向瑞典大学学生提供免费 AI 服务和云存储
Google 通过向瑞典大学学生提供一年免费 AI 服务和额外云存储,大力投资教育领域。该计划还包括旨在简化教学和学习过程的工具。
-
Gemini 代理钩子在错误时未能阻止工具调用
Gemini 代理钩子由 Google 于 2026 年 7 月推出,旨在允许自定义脚本拦截并可能阻止托管代理发起的工具调用。然而,该实现存在一个严重缺陷:钩子脚本中的任何失败,包括崩溃、超时或格式错误的响应,都会导致工具调用继续执行。这意味着钩子更多地起到审计和提示机制的作用,而不是强大的安全边界。建议开发人员实施严格的网络规则并使用令牌限制作为主要的安保控制措施,将钩子视为第二层防御。
-
Google Cloud 的无边界湖仓一体整合 AWS、Databricks、Snowflake 的数据
Google Cloud 推出了新的“无边界湖仓一体”计划,旨在消除跨不同云平台复制数据的需求。该服务目前处于预览阶段,允许数据管道和代理通过 Iceberg REST 目录直接访问位于 AWS Glue、Databricks Unity Catalog 和 Snowflake Horizon 中的数据。此外,Google 还为跨云数据传输提供统一费率定价层,并发布了一个开源 Data Agent Kit,该套件与 Model Con…
-
AI模型在蒙娜丽莎绘画挑战中竞争 · 跟踪4个来源
一项比较研究评估了四种领先的AI模型——GPT-5.6、Claude Fable 5、Grok 4.5 和 Gemini 3.6 Flash——使用模拟彩色铅笔工具集绘制蒙娜丽莎的能力。实验包括重现目标图像和响应开放式提示,评估输出质量、成本和工具使用情况。虽然所有模型都展示了生成图像的能力,但 Claude Fable 5 在此特定任务上花费的时间明显更长,成本更高,但结果相对较差。
-
xAI 的 Grok CLI 泄露用户代码;推出新的私有 AI 服务器 Lemonade
据报道,xAI 的 Grok Build CLI 工具已将整个用户源代码存储库上传到 Google Cloud Storage 服务器,可能暴露敏感数据。此问题现已修复,意味着 xAI 和 Google 都可以访问代码。另外,一款名为 Lemonade 的新本地 AI 服务器已发布,它通过本地硬件提供私有且免费的云 API 能力,用于聊天、编码和图像生成。
-
xAI的Grok Build代理泄露了敏感用户数据,马斯克承诺删除
一位安全研究员发现,xAI的Grok Build编码代理(特别是0.2.93版本)上传了超出给定任务所需约27,800倍的大量数据。这些数据包括整个代码库、SSH密钥和密码管理器数据库等敏感信息,并被发送到一个之前未披露的Google Cloud Storage存储桶。埃隆·马斯克表示,在某个时间点之前上传的所有用户数据都将被删除。
-
AI视觉模型的类人注视模式通过新的去偏度量进行评估
一篇新的研究论文介绍了一种方法,可以更好地评估AI视觉模型模仿人类眼动轨迹的程度。研究强调,由于数据集偏差(例如倾向于固定在图像中心),常用度量可能具有误导性。研究人员提出了一种新的度量标准——注视一致性得分(GCS),该度量标准可以消除这些度量的偏差,并结合运动统计数据,以识别AI模型中类人扫描路径更准确的“最佳点”。
-
xAI 原样上传代码,Cognition 优化 Fable 5,新 AI 研究涌现 · 跟踪 1 个来源
xAI 的 Grok Build CLI 被发现将整个代码仓库原样上传到 Google Cloud Storage 存储桶,引发了隐私担忧。另外,据报道 Cognition 通过优化其架构,使其 Fable 5 模型比 Opus 4.8 更便宜、性能更好。在研究方面,Sakana AI 开发了“智能细胞积木”,利用局部通信和神经网络实现物理形状的集体智能;DeepMind 的研究人员则将视频生成模型重新用作名为 GenCeption …
-
xAI 的 Grok Build CLI 上传整个 Git 代码库,包括密钥
xAI 的 Grok Build CLI 工具被发现会上传整个 Git 代码库,包括完整的提交历史和 .env 密钥等敏感文件,至 xAI 的 Google Cloud Storage。研究人员捕获了这一行为,表明该工具会发送所有跟踪的文件,而不管任务是什么或是否有明确指示不访问某些数据。即使在用户选择退出模型改进的情况下,上传功能仍然存在,这引发了重大的隐私和安全担忧。