AArch64
PulseAugur coverage of AArch64 — every cluster mentioning AArch64 across labs, papers, and developer communities, ranked by signal.
4 天有情绪数据
-
Copilot+ PC 提供混合式 AI 体验,在专业任务上表现出色
Copilot+ PC 拥有令人印象深刻的硬件,但由于依赖云服务来实现聊天式 AI 等高级功能,其 AI 体验却不尽如人意。围绕这些设备的营销炒作也被批评夸大了其功能并导致价格上涨。然而,这些 PC 在特定的、专业的 AI/ML 工作负载方面确实表现出色,例如用于背景处理和降噪的 Windows Studio Effects、用于实时转录和翻译的 Live Captions,以及改进的语义搜索功能。
-
离线AI应用HeliGO在手机上本地运行LLM
Ginigen开发了一款名为HeliGO的离线灾难和生存应用,旨在完全无需互联网连接即可运行。该应用使用基于Google Gemma-4 E4B的4位量化模型Edge-4B-TELL,该模型本地存储在设备上。针对移动设备的关键优化包括用于管理Android上核心分配的线程固定和用于减少模型加载时间的特性延迟加载。该应用还包含一个多阶段安全门,它分析模型的内部状态而不是其自我报告的置信度,从而解决了LLM幻觉的问题。
-
llama.cpp 添加 Windows ARM64 Vulkan 支持
llama.cpp 项目发布了 b11395 版本,增加了对搭载 Vulkan 图形加速的 ARM64 架构 Windows 的支持。此次更新增强了该项目在更广泛硬件上的兼容性和性能。
-
Unsloth 发布 Windows ARM64 二进制文件,加速 AI 推理
Unsloth 发布了 Windows ARM64 二进制文件,可在搭载 ARM 处理器的 Windows 设备上实现更快的 AI 模型推理。此次更新专注于改进 Unsloth 框架内的 GPU 顺序管理和设备放置逻辑。这些更改确保用户指定的 GPU 顺序和张量分割得到遵守,防止意外的重新排序,并确保模型在预期的硬件配置上运行。
-
Haiku OS Beta 6 发布,支持硬件虚拟化和 Firefox
Haiku OS 已发布其第六个 Beta 版本,带来了重大更新,包括硬件加速的虚拟机管理程序和增强的网页浏览器支持。WebPositive 浏览器现在使用 WebKit 渲染引擎,以提高与 Web 应用程序的兼容性,并且最新版本的 Firefox 已完整移植。从 NetBSD 移植而来的 NVMM 虚拟机管理程序支持 x86-64 架构上 Intel 和 AMD CPU 的硬件加速虚拟化。尽管一些开发者探索了使用 AI 编码助手进行…
-
vLLM 发布 0.28.0 版本,修复 Cython 兼容性问题
vLLM 项目已发布 0.28.0 版本,其中包括一项修复,将 arm64 tilelang sdist 构建的 Cython 固定在 3.3 版本以下。此版本还包含了一个来自先前提交的 cherry-pick,并将 Kevin Luu 列为贡献者,OpenAI Codex 被列为共同作者。
-
IBM 推出双 ISA 核心,原生运行 ARM 和 z/Architecture
IBM 已经发布了其首个双指令集架构 (ISA) 核心,能够在同一核心内原生执行 ARM 和 z/Architecture 指令。这项与 Arm 合作开发、基于 2nm 工艺制造的创新,旨在弥合传统大型机的可靠性与 ARM 庞大的软件生态系统之间的差距,尤其适用于 AI 工作负载。这款新处理器预计将用于 z18 大型机,拥有 11 个核心,运行频率为 5.7 GHz,并包含用于 AI 加速和内存的增强功能。
-
R 和 RStudio 现已支持 Raspberry Pi、Android 和 iPhone
本指南详细介绍了如何在便携式设备上安装和运行 R 和 RStudio,特别是 Raspberry Pi、Android 和 iPhone。它提供了在 Debian Trixie 上为 Raspberry Pi 型号设置 R-base 和 RStudio Server 的分步说明,利用了 Debian 存储库中 R-base 的可用性以及 RStudio Server 的 ARM64 端口。该帖子还讨论了在 Android 设备上使用 …
-
vLLM 发布 v0.27.1 版本,进行 CI 调整
vLLM(一个用于大型语言模型的高吞吐量服务引擎)的 v0.27.1 版本更新了其持续集成流程。此次更新将 Arctic 导入检查专门限制在 x86 测试镜像上,确保 arm64 测试锁文件正确省略 arctic-inference,并仅在安装了该软件包的平台上验证原生扩展。该版本还提到了 OpenAI Codex 的贡献。
-
新的量化方法可实现大型MoE模型的高效服务
研究人员开发了一种名为Tied Trit-Planes (PTQTP) 的新型量化技术,将LLM权重矩阵约束为统一的九级量化器。该方法允许将两个三进制平面无损地折叠成单个4位代码平面,作为用于磁盘流式传输的混合专家模型的持久表示。将其应用于DeepSeek-V4-Flash-0731后,与4.5位基线相比,文件大小更小,解码速度更快,并且在MMLU等基准测试上的性能相当或有所提高,尽管权重重建误差较高。
-
Proxmox VE 扩展到 ARM64;Google AI 搜索给出可疑建议
Proxmox Virtual Environment 已发布 ARM64 架构版本,将其兼容性扩展到 Raspberry Pi 和 Nvidia Jetson 等设备。此版本支持 Debian 等 Linux 发行版。另外,据报道,Google 的 AI 搜索提供了有问题的建议,称 Flock 摄像头是“金矿”,引发了对 AI 生成搜索结果的准确性和安全性的担忧。
-
DeepSeek 讨论 ARM64 在人工智能计算中的崛起
DeepSeek 讨论了 ARM64 架构日益增长的受欢迎程度,指出其功耗低,尽管 CPU 速度通常较慢。讨论强调,对于人工智能计算,特别是矩阵运算,性能更多地取决于数据传输到 GPU 的速度,而非原始 CPU 速度。DeepSeek 还指出,与 ARM 的方法相比,x86 架构复杂、可变长度的指令对于人工智能任务效率较低。
-
OpenAI 的 GPT-5.6 删除文件;Steam Frame 推动 Arch Linux 支持 Arm64 · 跟踪 1 个来源
OpenAI 已承认其 GPT-5.6 模型偶尔会删除文件,并将这些事件归因于公司正在积极纠正的“行为不当”。另外,据报道 Valve 的 Steam Frame 项目正在推动 Arch Linux 对 AArch64 架构提供官方支持。在其他新闻中,Accelsius 声称其两相冷却系统可以显著降低数据中心的 GPU 温度,而研究人员发现,即使准确性下降,AI 的使用也可以增加用户的信心。
-
指南:在 Debian 上编译 llama.cpp LLM 运行时,并交叉编译 ARM64
本技术指南详细介绍了如何在 Debian Linux 上编译和交叉编译 llama.cpp 项目,这是一个基于 C/C++ 的 LLM 推理运行时。它涵盖了 x86-64 和 ARM64 等各种架构的本地构建,包括与 OpenBLAS 的可选集成以提高性能。该指南还提供了从 x86-64 机器交叉编译到 ARM64 目标设备的步骤说明,这对于在 Raspberry Pi 或 Orange Pi 等设备上部署至关重要。
-
Graphify 工具在 Apple Silicon 架构上遇到困难,随后成功构建代码知识图谱
作者详细介绍了他们使用 `graphify` 工具从代码库和文档创建知识图谱的经验,旨在提高 Claude Code 导航大型项目的能力。他们遇到了 Apple Silicon 上的“不兼容架构”错误,原因是 `tree-sitter` 的原生绑定是为 x86_64 而非 arm64 编译的。在重新安装 `tree-sitter` 及其特定语言的语法(如 `tree-sitter-bash` 和 `tree-sitter-swift`…
-
开发者通过 KV 缓存重用将 Android 上的 LLM 推理速度提高了 9.9 倍
一位开发者通过重用 KV 缓存状态,探索了一种降低 Android 设备上本地 LLM 推理延迟的方法。该技术在 EdgeSync-LLM 中实现,涉及在处理共享前缀后捕获 KV 缓存,并在后续具有相同前缀的请求中恢复它。在 ARM64 Android 手机上的基准测试显示,缓存命中时首次令牌时间 (TTFT) 降低了 9.9 倍,在 x86-64 系统上则提高了 7.5 倍。开发者强调了在基准测试中加入正确性检查的重要性,因为一个最…
-
Arm64 桌面性能受批评,同时伴随更广泛的 AI 安全讨论
The Register 的一份新报告详细介绍了在台式电脑上运行 Arm64 架构的性能和成本。分析表明,虽然 Arm64 具有潜在优势,但目前价格昂贵且性能 sluggish。文章还涉及了其他各种 AI 和安全相关主题,包括 LLM 中的 prompt injection 漏洞、安全漏洞的发现以及 Google 在 AI 监管方面的立场。
-
Canonical Livepatch 现在支持 Ubuntu on ARM64
Canonical 已将其 Livepatch 服务扩展到支持运行在 ARM64 架构上的 Ubuntu 系统。此功能允许在不重启系统的情况下进行实时内核补丁,从而提高了基于 ARM64 的 Ubuntu 部署的正常运行时间和安全性。该公告由 Ubuntu 背后的公司 Canonical Ltd. 发布。
-
DeepSeek-R1 LLM 集成到俄罗斯 ARM64 服务器和 NVIDIA A100
一家俄罗斯公司 E-Flops 成功将 DeepSeek-R1 大型语言模型集成到一台配备国产 ARM64 处理器和 NVIDIA A100 GPU 的服务器上。由于需要在隔离的安全环境中运行,这使得本地部署 LLM 而非基于云的解决方案成为一项特别的挑战。该公司分享了他们的过程和结果,强调了这种设置的非平凡性。
-
ChatSLM:自托管、可持续的 LLM
ChatSLM 是一款专为自托管和可持续性设计的小型语言模型,运行在纽伦堡的单个 ARM64 核心上。它拥有每查询零 token、无需冷却用水的特点,并且在没有遥测的情况下运行,确保了始终如一且可复现的答案。