一个新的基准 CryptanalysisBench 被开发出来,用于评估大型语言模型 (LLMs) 在执行数学密码分析方面的能力。Anthropic 的前沿模型通过在该基准中发现新颖的攻击,展示了其熟练程度。这一发展凸显了大型语言模型在复杂分析任务中的潜力日益增长。 AI
影响 该基准可能会揭示加密系统的新漏洞,并推动对大型语言模型在复杂分析任务中的能力的研究。
排序理由 该集群描述了一个用于评估大型语言模型在密码分析方面的能力的新基准,这是一个研究里程碑。[lever_c_demoted from research: ic=1 ai=1.0]
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →