PulseAugur
实时 19:13:50
实体 GeneBench-Pro

GeneBench-Pro

PulseAugur coverage of GeneBench-Pro — every cluster mentioning GeneBench-Pro across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 6
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
时间线
  1. 2026-06-30 product_launch OpenAI launched GeneBench-Pro, a new benchmark for AI performance in genomics and biology. 来源
最近 · 第 1/1 页 · 共 6 条
  1. TOOL · CL_128062 ·

    OpenAI 发布 GeneBench-Pro 以测试人工智能在计算生物学中的“感知”能力

    OpenAI 推出了 GeneBench-Pro,这是一个旨在评估人工智能模型在计算生物学研究中“感知”能力的新基准。该基准旨在衡量人工智能理解和推理复杂生物数据和过程领域的能力。

  2. COMMENTARY · CL_126566 ·

    OpenAI 发布 Science 计划和 GeneBench-Pro;Anthropic 推出 Claude Sonnet 5

    OpenAI 在重置周期间,发布了其新的 Science 计划和 GeneBench-Pro 工具。Anthropic 推出了 Claude Sonnet 5 并重新推出了 Claude Fable 5。

  3. RESEARCH · CL_121361 ·

    AI 巨头 Anthropic、OpenAI、Google DeepMind 争夺 AI4S 生态主导权

    Anthropic 和 OpenAI 都已进入人工智能科学(AI4S)市场,将焦点从模型能力转向生态系统整合。Anthropic 推出了 Claude Science,一个用于科学工作流程编排现有 AI 工具和数据库的工作台,强调数据隐私和模块化。OpenAI 推出了 GeneBench-Pro,一个用于评估科学任务中 AI 的基准测试,以及专门的 GPT-Rosalind 模型,旨在为研究中的 AI 设定标准。Google Deep…

  4. FRONTIER RELEASE · CL_119169 ·

    Anthropic 的 Fable 5 模型在解除美国出口管制禁令后重新上线 · 已追踪 10 个来源

    Anthropic 的 Fable 5 模型在因美国出口管制而暂时下线后已恢复。该模型最初于 6 月 12 日下线,原因是担心存在“越狱”漏洞,导致其在全球范围内被暂停。于 7 月 1 日重新上线后,Fable 5 包含了增强的网络安全分类器和新的服务条款,要求 Anthropic 向美国政府报告检测到的恶意活动。虽然一些用户报告称 Fable 5 的表现符合预期,但其他用户指出,对于某些任务,特别是编码,它可能仍然会重定向到 Opu…

  5. RESEARCH · CL_118680 ·

    OpenAI 发布 GeneBench-Pro,用于人工智能基因组学和生物学研究

    OpenAI 推出了 GeneBench-Pro,这是一个旨在评估人工智能模型在基因组学、生物学和科学研究领域能力的新基准测试。该基准测试利用复杂的真实世界数据集,为这些专业领域的人工智能性能提供更准确的评估。该举措旨在推动人工智能在科学发现和研究中的应用。

  6. RESEARCH · CL_00819 ·

    OpenAI 在科学和安全领域推进 AI 代理;Google DeepMind 资助多智能体研究

    OpenAI 正通过多项举措推进科学计算和 AI 安全。该公司发布了一个新的基准 GeneBench-Pro,以评估 AI 代理处理复杂生物数据的能力。OpenAI 还在欧洲为可信赖 AI 的共享标准制定做出贡献,并与伦敦证券交易所集团等组织合作,将 AI 整合到业务运营中。与此同时,Google DeepMind 正在向多智能体 AI 安全研究投资 1000 万美元,旨在理解和减轻与交互式 AI 系统相关的风险。