Apple M1
PulseAugur coverage of Apple M1 — every cluster mentioning Apple M1 across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
MoFlux 准入控制显示 LLM 推理中的容量恢复延迟
MoFlux,一个用于 LLM 推理引擎的准入控制层,已对其容量恢复能力进行了评估。在 Apple M1 设置上使用 vLLM 和 Qwen2.5-1.5B-Instruct 模型进行的测试表明,虽然 MoFlux 允许交互式请求在 1 秒内重新进入,但借用容量的批量请求需要更长时间才能完成,长提示的完成时间长达 20 秒。引擎对返回的交互式请求的调度也引入了延迟,一种设计在拨款恢复后导致 3.6 到 4.0 秒的等待时间。这些容量恢…
-
Ollama、vLLM 和 llama.cpp:选择合适的本地 LLM 引擎
本文比较了三个本地 LLM 引擎:Ollama、vLLM 和 llama.cpp,重点关注它们在不同用例下的性能。对于笔记本电脑上的单用户,推荐 Ollama 和 llama.cpp,因为它们易于使用且资源需求较低。vLLM 因其 PagedAttention 和连续批处理等高级功能可实现更高吞吐量,是处理大量并发用户的 GPU 服务器的更优选择。在 Apple M1 上的基准测试显示,默认情况下 Ollama 处理单个请求更快,但 …
-
科技传闻:索尼耳机控制应用和苹果 iPhone 的 Edge Light 功能
两条独立的科技传闻正在流传:一条暗示正在开发非官方的索尼应用程序,允许用户从 PC 控制他们的耳机,而无需智能手机。另一条传闻表明,苹果可能会将其在 macOS 26.2 中为 M1 芯片及更新机型引入的 Mac Edge Light 功能带到 iPhone。
-
Go语言构建的LLM代理VMR简化了编码代理连接
一款名为VMR的新LLM代理已被开发出来,为编码代理提供极简、高效的连接。VMR使用Go语言构建,是一个单二进制应用程序,专为无人值守操作设计,注重可靠性和低开销。它旨在简化将代理流量路由到Anthropic和DeepSeek等各种LLM提供商的过程,并提供会话粘性缓存和字节级保真度等功能,以确保兼容性并降低成本。
-
Leascope 应用揭示直线前进的目的地
Leascope 是一款新的 iPad 应用程序,用户可以通过它发现如果直线前进会到达的地理目的地。该应用利用了 André Ourednik 的 Historical Basemaps 项目的历史地图数据。Leascope 由 Ben Gross 开发,适用于 iOS、iPadOS、macOS 和 visionOS,其隐私惯例表明开发者不收集任何数据。
-
George Hotz的tiny corp推出1.5万美元AI电脑和基于RISC的tinygrad框架
George Hotz的公司tiny corp发布了tinybox,一款售价1.5万美元的个人AI电脑,专为本地模型训练和推理设计。tinybox拥有738 FP16 TFLOPS和144 GB GPU内存,能够直接运行65B LLaMA模型。Hotz通过tinygrad框架采用RISC理念以提高效率,并避免图灵完备内核,旨在通过专注于开发者体验和优化现成硬件来与NVIDIA等成熟厂商竞争。