Apple M2
PulseAugur coverage of Apple M2 — every cluster mentioning Apple M2 across labs, papers, and developer communities, ranked by signal.
-
较旧的 LLM 量化格式在 Apple M2 上优于较新的格式
最近在 Apple M2 笔记本电脑上对两个本地大型语言模型 (LLM) 进行的测试显示,较旧的 Q4_K_M 量化格式的表现优于较新的 MXFP4 格式。Q4_K_M 格式实现了每秒 4.7 个 token,在 44 秒内完成了 200 个 token 的生成,而 MXFP4 仅达到每秒 2.6 个 token,完成相同任务耗时 71 秒。作者推测,MXFP4 在 M2 芯片上的性能受到反量化成本以及其依赖的硬件功能 M2 不完全支…
-
OpenAI 的 GPT OSS 20B 在 Mac 上的速度和编码基准测试中领先
在配备 24GB 内存的 Apple M2 机器上,对三款开源大模型——OpenAI 的 GPT OSS 20B、阿里巴巴的 Qwen3 14B 和 Mistral AI 的 Mistral-Small 24B——进行了比较。GPT OSS 20B 速度最快,比 Qwen3 14B 快三到四倍,并在 GSM8K 和 HumanEval+ 基准测试中取得了满分。然而,Qwen3 14B 在原始知识方面表现最佳,MMLU 得分为 82%,…
-
面向实时性能的设备端字幕翻译优化
研究人员开发了一种优化设备端字幕翻译的方法,特别针对台湾地区的英译繁体中文。通过使用领域特定的分词器和微调来调整LMT-60-0.6B模型,他们在与GPT-4o进行成对评判时,相对于Google Translate取得了59.2%的胜率。在配备Metal的Apple M2上的初步测试显示,优化后的模型比基线模型速度提升了1.63倍。
-
StreamSplit 使边缘设备上的高效连续音频学习成为可能
研究人员开发了 StreamSplit,一个旨在使对比学习在资源约束波动的边缘设备上变得实用的新框架。该系统使用一种基于分布的方法将表示质量与局部批次大小解耦,并采用混合损失(Hybrid Loss)来保证稀疏更新的保真度。一个由强化学习策略驱动的、不确定性引导的自适应分割器(Uncertainty-Guided Adaptive Splitter)通过整合实时资源监控和嵌入模糊性,动态地划分计算,以优化准确性和延迟。
-
《R-Type Dimensions III》移植版因不准确的 2D 模式而受到批评
经典 SNES 游戏《R-Type III》的最新移植版《R-Type Dimensions III》已在包括 Switch 2 在内的多个平台发布。该游戏包含 2D 和 3D 模式,但评测强调了与原始 SNES 版本相比,2D 版本在准确性方面存在严重问题。问题包括碰撞检测的改变、武器效果的减弱以及动画帧数的减少,导致体验不那么忠实且更具挑战性。
-
George Hotz的tiny corp推出1.5万美元AI电脑和基于RISC的tinygrad框架
George Hotz的公司tiny corp发布了tinybox,一款售价1.5万美元的个人AI电脑,专为本地模型训练和推理设计。tinybox拥有738 FP16 TFLOPS和144 GB GPU内存,能够直接运行65B LLaMA模型。Hotz通过tinygrad框架采用RISC理念以提高效率,并避免图灵完备内核,旨在通过专注于开发者体验和优化现成硬件来与NVIDIA等成熟厂商竞争。