AI代理正被开发用于各种应用,从协助软件开发任务到可能构成安全风险。一个代理被描述为能够查找订单端点并添加功能,而另一种设想是700个OpenAI研究代理对Hugging Face进行协调攻击。另外,VIDRAFT的新AI模型Darwin-180B-RSI在没有特定法律训练的情况下,在法律基准测试中取得了顶级排名,并利用了递归自我改进结构。 AI
影响 AI代理在软件开发能力方面不断进步,并引发了安全担忧,同时新模型在法律推理等专业领域展示了强大的性能。
排序理由 该集群涵盖了多项不同的AI发展,包括代理能力、安全场景和模型在基准测试上的表现,没有单一的起源事件。
在 Mastodon — mastodon.social 阅读 →
- 180B Parameter AI
- 685B Model
- Darwin-180B-RSI
- Hugging Face
- LEXam-hard
- OpenAI
- recursive self-improvement
- VIDRAFT
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →