PulseAugur
实时 19:40:09
实体 Cognition AI

Cognition AI

PulseAugur coverage of Cognition AI — every cluster mentioning Cognition AI across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 11
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
关系
时间线
  1. 2026-05-30 funding Cognition AI raised over $1 billion at a $26 billion valuation. 来源
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 11 条
  1. TOOL · CL_132458 ·

    Cognition AI 的 SWE-1.7 接近 GPT 5.5 和 Opus Intelligence 的性能

    Cognition AI 发布了其 AI 编码助手的新版本 SWE-1.7。此次更新在编码基准测试中展示了接近 OpenAI 的 GPT 5.5 和 Anthropic 的 Opus Intelligence 等领先模型的性能。该公司强调了 SWE-1.7 处理复杂编码任务的能力及其显著提高开发人员生产力的潜力。

  2. TOOL · CL_127058 ·

    AI代理需要护栏:结构化输出和持久化内存解决LLM不可靠问题

    两位开发者描述了两种不同的方法来缓解AI代理中大型语言模型(LLM)的不可靠性。一位开发者实现了一个管道,强制LLM输出结构化数据,根据错误成本使用分级模型,并在最终确定任何输出之前包含一个起草和代码检查阶段。另一位开发者创建了一个名为Selvedge的工具,它充当AI代理的本地内存,存储决策背后的推理,以防止代理重复过去的错误或引入已撤销的更改,从而保留会话结束后会丢失的关键上下文。

  3. COMMENTARY · CL_125449 ·

    编码代理规则获得关注,凸显 AI 开发挑战

    一份包含四条编码代理行为规则的 markdown 文件获得了极大的关注,在 GitHub 上获得了 91,000 颗星。这种广泛的兴趣凸显了开发有效 AI 编码代理的当前挑战和失败之处。文章认为,虽然 ChatGPT 和 GitHub Copilot 等工具很有用,但它们并不代表代理进步的最佳途径,与更复杂但不太容易获得的 Devin 等代理形成了对比。

  4. TOOL · CL_125039 ·

    AI 编码代理从提示工程转向自主循环 · 跟踪 1 个来源

    精心设计用于编码任务的 AI 提示的时代正在消退,取而代之的是代理工作流,其中 AI 代理自主执行计划-编辑-测试-修复循环。这些代理可以管理代码迁移、更新管道或实现新功能等任务,最终以供人类审查的拉取请求告终。Claude Code、GitHub Copilot Coding Agent、Cursor Agent Mode、Google 的 Gemini Code Assist 和 Jules 以及 Devin 等工具正在引领这一转…

  5. TOOL · CL_108404 ·

    AI 软件工程师 Devin 在日本发布,旨在变革开发模式

    Cognition AI 正在将其 AI 软件工程师 Devin 扩展到日本市场。此举旨在利用 AI 彻底改变软件开发。Devin 旨在处理复杂的编码任务,有望为日本开发团队简化工作流程并提高效率。

  6. TOOL · CL_78920 ·

    Cognition AI 发布 FrontierCode 基准测试,用于评估 AI 代码质量

    Cognition AI 推出了 FrontierCode,这是一个旨在评估 AI 生成代码质量的新基准测试,超越了单纯的正确性。该基准测试的开发得到了 20 多名开源开发者的意见反馈,重点关注代码是否会被接受到实际的生产代码库中。早期结果显示,即使是 Anthropic 的 Claude Opus 4.8 等顶级模型也面临挑战,在最具挑战性的子集上得分仅为 13.4%,这表明在生成高质量、可维护的代码方面存在显著差距。

  7. SIGNIFICANT · CL_78788 ·

    Cognition AI 发布 FrontierCode 以提供编码辅助

    Cognition AI 发布了新的人工智能模型 FrontierCode。该模型旨在辅助编码任务,可通过博客文章公告获取。预计将有更多关于其功能和架构的细节。

  8. RESEARCH · CL_78804 ·

    新的 UOJ-Bench 评估 LLM 的代码修复和错误检测能力

    一个名为 UOJ-Bench 的新基准已被开发出来,用于评估大型语言模型 (LLM) 在代码生成、黑客攻击和修复任务方面的能力,超越了简单的解决问题。初步测试表明,即使是顶级模型在识别人类编写代码中的错误方面也存在困难,在一次性评估中的成功率低于 50%。虽然测试时扩展可以显著提高性能,但会产生巨大的计算成本,限制了实际部署。然而,最好的模型仍然可以在一小部分满分提交中识别出错误,这表明 LLM 有潜力为现有的评判系统提供补充见解。

  9. RESEARCH · CL_61443 ·

    Cognition AI 融资10亿美元,估值260亿美元,Devin 收入激增

    Cognition AI 已获得超过10亿美元的融资,公司估值达到260亿美元。这笔巨额投资是在其AI编码助手Devin据报道创造近4.92亿美元收入之际完成的。该公司是AI编码市场的关键参与者,Devin旨在彻底改变软件开发。

  10. TOOL · CL_60770 ·

    Devin AI估值260亿美元;Robinhood集成AI代理

    据报道,Cognition Labs的AI编码助手Devin的估值已达260亿美元。与此同时,Robinhood正在将其AI代理集成到其交易平台,以实现自动化交易策略。摘要还涉及人形机器人领域的进展。

  11. RESEARCH · CL_55125 ·

    AI公司Pace以3.75亿美元估值完成4600万美元B轮融资

    专注于自动化保险运营的AI公司Pace,已获得由Thrive和Sequoia领投的4600万美元B轮融资,估值达到3.75亿美元。本轮融资凸显了AI领域的重大活动,包括Robinhood使用AI代理推出的新自主交易功能,以及内存芯片制造商Micron和SK Hynix因AI需求达到的主要市值里程碑。此外,Cognition AI以260亿美元的估值筹集了10亿美元,ElevenLabs发布了其Music v2模型。