PulseAugur
中
实时 03:44:09
实体 Simple Attention Network

Simple Attention Network

PulseAugur coverage of Simple Attention Network — every cluster mentioning Simple Attention Network across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
5
90 天内 5
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
关系
最近 · 第 1/1 页 · 共 5 条
  1. TOOL · CL_226305 ·

    Needle 2 AI 模型使用简单注意力网络实现高效工具调用

    Needle 2 是一款新颖的 AI 模型,它不同于传统的 LLM 架构,采用了仅有 4500 万个参数的简单注意力网络 (SAN)。它针对工具调用、设备集成和处理结构化数据进行了优化,在旧硬件上表现出色。在测试中,Needle 2 成功检索了天气数据和系统信息,在十年前的处理器上以最少的内存高效运行,速度约为每秒 16 个 token。

  2. SIGNIFICANT · CL_199839 ·

    Cactus Compute 发布 Needle 2,一款面向边缘设备的 14MB 工具调用 AI 模型

    Cactus Compute 推出了 Needle 2,这是一款紧凑型的 4500 万参数模型,专为工具调用和结构化数据提取而设计。该模型以其极小的占用空间而闻名,打包为 14MB 的二进制文件,运行仅需 28MB RAM,使其适用于没有专用 AI 硬件(如 GPU 或 NPU)的设备。Needle 2 实现了令人印象深刻的速度,在 Raspberry Pi 5 上每秒可处理多达 500 个 token,并在各种移动和混合现实设备上提供高效性能。

  3. TOOL · CL_192498 ·

    Needle 2: 14MB 代理 LLM 针对低功耗硬件上的设备端 AI · 跟踪 4 个来源

    Cactus 发布了 Needle 2,这是一款紧凑型 14MB 代理 LLM,专为设备端 AI 应用而设计。该模型拥有 4500 万个参数,压缩至 2 位精度,可在智能手机、可穿戴设备和微控制器等低功耗硬件上高效运行,仅需 28MB RAM。Needle 2 在工具调用和结构化提取任务方面表现出竞争力,可与更大的模型相媲美,同时消耗的功耗和内存却显著减少。该模型在 Apache 2.0 许可下开源,权重可在 Hugging Face…

  4. SIGNIFICANT · CL_196904 ·

    Cactus Compute 发布微型 4500 万参数 Needle 2 模型,适用于设备

    Cactus Compute 发布了 Needle 2,这是一款紧凑型、拥有 4500 万参数的开源模型,专为工具调用、设备集成和结构化数据提取而设计。该模型体积小巧,仅需 28MB RAM,且可容纳在 14MB 的二进制文件中,使其能够运行在微控制器和各种消费类设备上。Needle 2 采用了 Simple Attention Network 架构,即使在 Raspberry Pi 5 等低功耗硬件上也能实现令人印象深刻的速度。

  5. TOOL · CL_53249 ·

    Cactus Hybrid Router 将任务路由到云端或本地模型

    Cactus Hybrid Router 是一个拥有 65,000 个参数的新模型,旨在通过智能路由任务来优化 AI 推理。通过将 15-55% 的任务发送到云端模型,同时在本地处理其余任务,它可以匹配 Gemini-3.1-Flash-Lite 的性能。这种方法旨在减少对昂贵的云基础设施的依赖,以处理更简单的查询,并为文本、视觉和音频提示提供灵活性。