PulseAugur
实时 11:04:52
实体 Vertex AI

Vertex AI

PulseAugur coverage of Vertex AI — every cluster mentioning Vertex AI across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
25
90 天内 81
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 7
层级分布 · 90 天
主题
关系
情绪 · 30 天

15 天有情绪数据

最近 · 第 1/5 页 · 共 81 条
  1. TOOL · CL_213413 ·

    xAI 的 Grok 4.6 模型现已在 Google Cloud Vertex AI 上可用

    xAI 已宣布其最新的旗舰模型 Grok 4.6 现已在 Google Cloud 的 Vertex AI 平台上可用。该模型专为扩展的代理任务以及复杂的交互式和视觉应用程序而设计,拥有 500,000 个 token 的上下文窗口和可调节的推理能力。开发者现在可以通过 Vertex Model Garden 使用 Grok 4.6,并提供了输入和输出 token 的定价详情。

  2. TOOL · CL_208709 ·

    AI艺术导师Atelier使用OpenCV和Gemini Flash教授几何学

    一款名为Atelier的新艺术工作室导师已被开发出来,用于协助远程艺术学生学习几何和透视绘画。该系统使用OpenCV进行精确的几何测量,并在Vertex AI上使用Gemini Flash进行富有同情心的教学式批评,旨在防止常见的LLM数值数据幻觉。Atelier通过一个协作循环运行,询问学生关于他们的实践,通过有针对性的练习指导他们,并捕获反馈以调整其方法。

  3. TOOL · CL_208062 ·

    Claude Code 与 AI 网关集成需要特定配置

    一篇技术指南详细介绍了如何配置 Claude Code 以便与 AI 网关协同工作,解决了在使用标准 OpenAI 兼容端点时出现的各种问题。文章解释说,Claude Code 需要一个原生的 Anthropic Messages API 端点,而不仅仅是 OpenAI 的聊天补全代理,才能正确处理工具使用和提示缓存。它提供了正确网关集成所需的四个特定环境变量,其中包括两个未公开的变量,用于禁用实验性功能和交错思考,这可能导致与 Be…

  4. SIGNIFICANT · CL_204942 ·

    Anthropic 的 Claude 3.5 Sonnet 在基准测试中超越 Opus,成为构建者的默认选择

    Anthropic 发布了 Claude 3.5 Sonnet,这是一款新的中端模型,在推理和编码基准测试中超越了其前旗舰 Claude 3 Opus。此次发布显著提高了成本效益比,使 Sonnet 3.5 成为生产环境中 AI 应用的推荐选择,尤其是在涉及智能体编码任务时。该模型比其前代产品更快、更便宜、更智能,在视觉能力和图像文本转录方面取得了显著进步。

  5. TOOL · CL_202684 ·

    Node.js 开发者构建模型交换测试以获得可靠的 AI 输出

    一位 Node.js 开发者创建了一个一致性测试框架,以确保文本分类任务中模型交换的可靠性。该系统专注于验证结构化输出的正确性,特别是在集成新模型之前检查模式有效性和确切标签一致性。这种方法旨在防止 JSON 输出中的细微错误导致下游自动化失败,例如在 CRM 中错误地分类交易阶段。开发者强调了 OpenRouter、Amazon Bedrock、Vertex AI 和 Infrai 等服务作为 OpenAI、Claude 和 Gem…

  6. TOOL · CL_199564 ·

    Pulumi 指导 Vertex AI 端点配置,支持自定义和预训练模型

    本文详细介绍了如何使用 Pulumi 配置 Vertex AI 端点,重点介绍了两种主要方法。第一种方法是使用 `gcp.vertex.AiEndpointWithModelGardenDeployment` 资源来部署 Model Garden 或 Hugging Face 中的模型,该资源同时处理端点创建和模型部署。第二种方法适用于自定义训练的模型,需要一个多步过程:使用 `gcp.vertex.AiEndpoint` 声明式地创…

  7. TOOL · CL_199565 ·

    Pulumi Stacks 支持分离开发和生产 LLM 模型端点

    本文介绍了如何使用 Pulumi stacks 来为 LLM 模型端点创建分离的开发和生产环境。通过使用不同的 stacks,每个 stacks 都有自己的状态文件和配置,用户可以确保开发环境中的更改不会影响生产环境。该指南详细说明了如何初始化和选择 stacks、配置特定于环境的设置(如副本计数和机器类型)以及管理密钥。它还提供了一个代码示例,演示如何根据所选的 stack 动态命名云资源和应用标签,以实现更好的隔离和成本归属。

  8. TOOL · CL_197651 ·

    Google Cloud Vertex AI:设置预算提醒详解

    本文介绍了如何在 Google Cloud 上为 Vertex AI 支出设置预算提醒,并强调这些提醒仅作为通知而非支出上限。文章指出,预算提醒并非熔断机制,且可能存在报告延迟,这意味着实际成本可能在触发提醒前就已超过阈值。此外,文章还指导用户如何从 Cloud Billing Catalog API 获取 Vertex AI 的正确服务 ID,并提供了一个 `gcloud` 命令示例,用于创建具有特定阈值和通知规则的预算。

  9. TOOL · CL_197652 ·

    如何使用GCP账单导出准确跟踪Vertex AI支出

    本文详细介绍了如何通过分析账单导出数据来准确跟踪Google Cloud的Vertex AI支出。文章强调了使用详细的使用成本导出`gcp_billing_export_resource_v1`的重要性,该导出包含关键的资源级信息。指南解释了常见的陷阱,例如仅按SKU描述进行过滤而低估支出,以及在未考虑信用额度、承诺使用折扣或促销赠金的情况下误解“成本”列。文章提供了具体的BigQuery SQL查询,以正确计算净成本并将支出归因于各…

  10. SIGNIFICANT · CL_197608 ·

    Anthropic 因欧盟《人工智能法案》在 Claude 文本中嵌入全局水印

    Anthropic 已开始在其 Claude 模型(于 2026 年 8 月 2 日或之后推出)生成的所有文本中嵌入不可见的统计水印。此项更改受欧盟《人工智能法案》第 50 条驱动,将全球适用,而非仅限于特定区域。该水印旨在通过复制粘贴和部分编辑后仍能保留,从而能够检测到 Claude 的参与,尽管 Anthropic 澄清它证明的是模型接触过该文本,而非完全由其撰写。

  11. TOOL · CL_197458 ·

    BigQuery ML 集成 Vertex AI 进行文本生成,并详细说明成本

    BigQuery ML 用户现在可以创建引用 Vertex AI 端点的远程模型,从而直接在 BigQuery 中实现文本生成功能。此设置涉及创建一个充当中介进行授权的连接对象,从而防止分析师拥有直接的 IAM 角色。这些远程模型调用的定价在 BigQuery 的数据扫描成本和 Vertex AI 的令牌处理费用之间分配,其中 Vertex AI 成本通常在文本生成任务中占主导地位。

  12. TOOL · CL_191563 ·

    新的代理工具增强了 Gemini LLM 的追踪和监控

    一款名为 Traced LLM MCP Proxy 的新工具已被开发出来,以增强对 Gemini LLM completions 的可见性,特别是那些托管在 Vertex AI 上的。该代理充当中介,用 OpenTelemetry trace spans 包装 Gemini 调用,以帮助开发人员监控性能、识别延迟瓶颈并将 LLM 交互与其他系统操作相关联。该工具支持通过 MCP 的 streamable-http 接口或 Agent-…

  13. TOOL · CL_190963 ·

    Google Gemini 将视频生成切换至 Omni Flash,影响消费者体验

    Google 已在其消费者 Gemini 应用中悄悄地将 Veo 3.1 替换为 Gemini Omni Flash 进行视频生成,这一变化发生在 2026 年 5 月 19 日左右。虽然 Veo 3.1 仍可通过 API 获得更高质量的 4K 输出,但面向消费者的模型现在具有不那么透明的使用限制,并且在多轮编辑中的一致性有所降低。建议用户调整其针对 Omni Flash 的提示策略,专注于场景含义和风格,而不是技术摄像机细节,并由于…

  14. TOOL · CL_190123 ·

    Google AI Studio在俄罗斯的访问受限,Pro模型已从免费套餐中移除

    Google AI Studio在俄罗斯的可访问性变得复杂,用户报告称无需VPN即可间歇性访问,但创建新账户通常仍需要VPN。该服务的官方文档未将俄罗斯列为支持地区,这可能导致“访问受限”错误。此外,自2026年4月1日起,Google已将其Pro模型Gemini 3.1 Pro Preview和Gemini 2.5 Pro从免费套餐中移除,只能通过付费的Vertex AI平台访问。

  15. TOOL · CL_190014 ·

    虚假的Veo 3.1 AI工具传播恶意软件,冒充Google的服务

    诈骗者正在创建虚假的网站和APK,冒充Google的Veo 3.1 AI视频生成工具,承诺无限使用和高级功能。这些恶意网站通常通过搜索引擎结果找到,旨在诱骗用户下载可能窃取密码和加密钱包数据等敏感信息的恶意软件。虽然Google官方通过Gemini API和Google AI Studio等平台提供Veo的访问权限,但没有独立的下载应用程序。这种趋势与之前使用虚假AI工具传播恶意软件的攻击类似,凸显了AI领域冒充风险的日益增长。

  16. COMMENTARY · CL_184306 ·

    Google CEO 概述产品AI整合新阶段

    Google CEO Sundar Pichai 宣布了公司AI发展的下一阶段,强调将AI整合到所有Google产品和服务中。这一新篇章将侧重于利用Google的AI模型,包括Gemini和Palm,来提升Search、YouTube和Google Cloud的用户体验。该公司还通过Google DeepMind及其云平台Vertex AI,展示了其在AI研究方面的进展。

  17. TOOL · CL_183927 ·

    Google 的 Nano Banana 图像模型因缺乏官方域名而面临仿冒网站的困扰

    Nano Banana 并非独立产品,而是集成在 Google Gemini 及其他 Google 服务中的图像生成模型套件。由于缺乏专门的 Nano Banana 网站,导致第三方仿冒网站泛滥,这些网站通过包装公开 API 向用户收费。官方入口可通过 Google Gemini、AI Studio 和 Google API 访问,其中 Nano Banana 2(优化速度)和 Nano Banana Pro(注重事实准确性)等不同模…

  18. TOOL · CL_182835 ·

    AI代理需要仔细选择API操作以实现安全有效的利用

    AI代理与API交互的能力取决于仔细选择其可访问的操作。虽然将代理连接到API在技术上很简单,但关键的挑战在于定义适当的权限。这需要考虑各种因素,以确保代理能够有效且安全地使用API。

  19. TOOL · CL_178756 ·

    新的 JWT 门控代理通过 LangChain 保护 Gemini LLM 访问

    开发了一个新的代理,即已认证的 MCP JWT 代理,用于保护对 LLM 网关的访问,特别是针对 Gemini 模型。该代理充当中介,使用 JWT 在用户与 LLM 交互之前进行身份验证,通过 LangChain 和 Vertex AI 进行交互。它通过实施 bcrypt 进行密码哈希和 python-jose 进行 JWT 处理等安全措施,解决了未经授权访问、潜在滥用和集成简化等问题。

  20. TOOL · CL_173739 ·

    Veo API 用户体验必须管理延迟和错误以进行视频生成

    Veo API 可通过 Gemini API 和 Vertex AI 访问,其异步视频生成过程需要以用户为中心的方法。开发者必须设计用户界面,清晰地传达视频生成的状态,包括潜在的延迟、错误或内容过滤,而不是仅仅依赖简单的加载指示器。该 API 的异步性质意味着用户必须轮询操作状态,并且文档表明等待时间可能从几秒钟到几分钟不等。此外,生成的视频仅存储两天,这一细节必须清楚地传达给用户,以管理他们对长期访问的期望。