PulseAugur
中
实时 21:29:39
实体 Kina

Kina

PulseAugur coverage of Kina — every cluster mentioning Kina across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
4
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
时间线
  1. 2026-06-04 research_milestone Researchers introduced the KINA benchmark to evaluate LLMs across 261 disciplines, with Gemini-3.1-Pro-Preview achieving the highest score. 来源
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 4 条
  1. COMMENTARY · CL_278179 ·

    俄乌战争中俄罗斯快速创新无人机技术,适应速度超预期

    前Google首席执行官Eric Schmidt承认,他低估了俄罗斯对Shahed无人机进行喷气式发动机改造的适应能力,这凸显了乌克兰冲突中创新的快速步伐。这场战争已成为一场学习与适应的竞赛,任何一方的技术优势都无法持久。乌克兰大幅增加了无人机产量,但俄罗斯也在快速创新并扩大其自身无人机能力,据报道得到了中国的支持。

  2. RESEARCH · CL_170542 ·

    习近平呼吁全球人工智能合作,对抗美国科技限制

    中国国家主席习近平在上海举行的世界人工智能大会上发表讲话,倡导全球人工智能合作和开源发展。他宣布为发展中国家提供培训机会,并成立世界人工智能合作组织(WAICO),标志着迈向更具包容性的人工智能生态系统。此举似乎是中国对美国出口管制的回应,中国正利用其在定价、开放模型权重和基础设施可及性方面的优势在全球人工智能领域展开竞争。

  3. COMMENTARY · CL_138307 ·

    开源AI模型提供教育潜力,但欧洲落后

    文章讨论了开源语言模型在教育用途方面的潜力,建议学校可以将这些模型托管在本地服务器上以保护学生数据。文章强调了中国和美国在开发领先的开放模型方面的当前主导地位,以及欧洲显著的贡献缺失。作者探讨了学生不仅消费AI,而且利用AI进行构建的想法,可能为学术目的创建网站或代理等项目。

  4. RESEARCH · CL_70254 ·

    新的KINA基准测试显示Gemini 3.1 Pro排名最高,超越Claude和GPT-5

    一项名为KINA的新基准测试被引入,用于评估大型语言模型在261个细粒度学科上的表现,解决了规模驱动设计和标注质量的问题。该基准测试包含899个项目,用于评估来自13个不同实验室的42个模型。Gemini-3.1-Pro-Preview以53.17%的得分成为表现最佳的模型,其次是Claude-Opus-4.6和GPT-5.4,这表明所有模型都有很大的改进空间。