PulseAugur
中
实时 01:09:30
实体 Agent Extensibility Protocol

Agent Extensibility Protocol

PulseAugur coverage of Agent Extensibility Protocol — every cluster mentioning Agent Extensibility Protocol across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
10
90 天内 10
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

4 天有情绪数据

最近 · 第 1/1 页 · 共 10 条
  1. COMMENTARY · CL_277807 ·

    SemiAnalysis 讨论 GPU 经济学、InferenceX 和新硬件

    SemiAnalysis 讨论了 GPU 的经济学,其中 InferenceX 团队分享了关于 Engram 内存卸载和 AgentX 利润计算器的见解。对话还涉及 TPU v7,Vera Rubin 与 Blackwell 架构的比较,以及更快的 token 处理的价值。此外,还强调了 TileRT 在推动 NVIDIA GPU 方面的进展,并讨论了专用芯片。

  2. COMMENTARY · CL_256721 ·

    SemiAnalysis 批评 GTC VR 性能,强调 AI Infra Summit 上的 AgentX

    SemiAnalysis 声称 Jensen 在 Nvidia GTC 上展示了误导性的虚拟现实性能指标,并将其与 Ian Buck 即将在加州圣克拉拉举行的 AI Infra Summit 上展示 AgentX 的情况进行了对比。该帖子强调了 Vera Rubin NVL72 相对于 GB300 的单位美元吞吐量优势。

  3. TOOL · CL_253763 ·

    Vera Rubin NVL72 Agentic Inference System 声称性能提升 67 倍

    SemiAnalysis 报道了 Vera Rubin NVL72,一个声称在每美元性能上提供 67 倍提升的 agentic inference 系统。该系统还声称每兆瓦年利润翻倍,并且其模型中购买力增加会导致收益增加。提到的关键组件包括 AgentX、InferenceX 和 Extreme Co-Design,这表明其专注于用户驱动的开发和优化。

  4. RESEARCH · CL_235247 ·

    AMD MI355x硬件在AgentX的token效率方面优于B300 · 跟踪2个来源

    AMD MI355x硬件的一项新提交显示,在总拥有成本(TCO)的输出总token数方面,其性能优于B300,尤其是在AgentX框架内的低交互性范围内。SemiAnalysis强调了这一成就,并特别表彰了vLLM、AMD和LMCache的工程团队所做的贡献。高吞吐量配置中使用的分离式设置被认为是实现这一性能提升的关键因素。

  5. RESEARCH · CL_234776 ·

    vLLM团队实现代理工作负载优化,提升Kimi推理吞吐量

    SemiAnalysis 强调了 vLLM 团队所做的重大优化,特别是针对代理工作负载。这些改进包括一个新的 AgentX 基准测试,旨在发现长上下文、多轮任务中的问题。这些优化已使 Kimi 推理的高并发吞吐量提高了 6 倍以上,并通过允许在不遗忘状态的情况下进行跨机器服务拆分,提高了效率。

  6. TOOL · CL_228041 ·

    NVIDIA LPU通过分解式处理增强AI推理

    NVIDIA的新款LPU(语言处理单元)旨在通过支持三种不同的分解式推理方法来增强AI推理。这些方法利用Rubin GPU进行预填充和解码阶段,LPU负责处理流程的特定部分,以针对不同的交互级别进行优化。该公司预计这些进步将特别有利于AgentX等开源代理基准。

  7. COMMENTARY · CL_226491 ·

    AMD的软件性能落后于NVIDIA,阻碍了代理工作负载的潜力

    SemiAnalysis报道称,尽管AMD在硬件方面具有代理工作负载的理论优势,但其软件性能目前是瓶颈。据报道,该公司工程师正在努力工作,以AgentX作为基准,但领导层缺乏内部研发GPU能力和稳定的QA集群阻碍了进展。AMD正向Meta和OpenAI等主要参与者提供公平的返利,表明其战略重点在于这些合作伙伴关系。

  8. TOOL · CL_215630 ·

    SemiAnalysis 发布 AgentX 数据集以用于代理推理

    SemiAnalysis 发布了 AgentX,这是一个开源数据集,专为代理推理设计,具有 100 万个 token 的上下文长度和多轮对话能力。该数据集旨在测试 CUDA 在代理推理场景中的主导地位的韧性。它还强调了 GB300 NVL72、MI355 和 Nvidia B200 等硬件配置,表明这些对于此类高级推理任务是相关的。

  9. TOOL · CL_112934 ·

    AI 代理安全防火墙阻止高风险操作,暂停高成本操作

    一位开发者为 AI 代理实现了一个操作防火墙,以防止灾难性故障,特别是涉及财务支出的故障。该系统区分了永不合法的操作(例如大规模网络扫描,这些操作会被确定性地阻止)和可能合法但有风险的操作(例如配置云基础设施,这些操作会暂停等待人工批准)。这种方法旨在通过阻止可以覆盖的操作并承认无法覆盖的操作来提供对代理安全的诚实覆盖,确保代理不会产生过高的成本或执行未经授权的操作。

  10. RESEARCH · CL_111499 ·

    新的智能体系统自动化工业推荐系统演进 · 跟踪3个来源

    两篇新的研究论文介绍了先进的基于智能体的系统,旨在自动化和加速工业推荐系统的迭代。AgentX 和 NOVA 被提出作为解决人工生成假设、修改代码和进行 A/B 测试的人类工程师瓶颈的方案。这些系统旨在创建自进化的开发引擎,能够以前所未有的规模和速度自主生成、实施、评估和学习推荐实验,从而显著提高系统性能和业务指标。