AI agent systems
PulseAugur coverage of AI agent systems — every cluster mentioning AI agent systems across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
新的ChainWatch框架可检测AI代理上的多步攻击
一个名为ChainWatch的新框架已被开发出来,用于检测针对使用模型上下文协议(MCP)的AI代理系统的多步攻击。ChainWatch采用六阶段攻击链模型和隐马尔可夫模型(HMM)来分析工具调用序列,识别绕过传统单次调用安全措施的恶意进展。该框架旨在通过从工具交互中提取行为信号来对抗直接顺序攻击、间接提示注入链和混合多阶段攻击。
-
AI 代理可受益于类人记忆,期待 Gemini Pro 更新
一位 Mastodon 用户建议,类人记忆结构可能对 AI 代理系统是重要的进步,尤其是在维持长期上下文和状态方面。另一位用户则对即将发布的 Gemini Omni Pro 表示期待,希望其具备最先进的视频生成和编辑能力,并提高图像生成质量。
-
新调查将代码视为人工智能代理的核心基础设施
一篇新的调查论文提出了“代码即代理的约束”的概念,认为代码应被视为人工智能代理系统的基本基础设施。这一观点将研究组织为三个层次:连接代理与推理和行动的约束接口,用于执行的规划和记忆等约束机制,以及将这些约束扩展到多代理协调。该论文强调了跨不同领域的应用,并概述了评估、验证和安全等领域的开放性挑战。
-
OpenAI与苹果合作,Google DeepMind研究智能体扩展
OpenAI宣布与苹果公司合作,将ChatGPT集成到iOS、iPadOS和macOS中,利用GPT-4o的能力增强Siri和系统级写作工具。Google DeepMind发布了关于AI智能体系统扩展的研究,发现多智能体协调可以改善并行任务,但可能降低顺序任务的效率,并开发了一个预测模型来优化智能体架构。此外,OpenAI还发布了关于提示基础知识的资源,并分享了Netomi关于在企业环境中扩展智能体系统的见解,强调了使用GPT-4.1…