PulseAugur
实时 00:01:22
实体 OpenCL

OpenCL

PulseAugur coverage of OpenCL — every cluster mentioning OpenCL across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
3
90 天内 11
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
关系
情绪 · 30 天

3 天有情绪数据

最近 · 第 1/1 页 · 共 11 条
  1. TOOL · CL_236624 ·

    llama.cpp 发布带来 Vulkan、CUDA 等优化

    llama.cpp 项目发布了多个更新,包括 b10883,该更新针对 Apple Silicon 和其他平台上的矩阵乘法进行了 Vulkan 优化。其他近期发布如 b10881 和 b10877 解决了特定的问题,例如 Vulkan 工作组分配和针对专家混合 (MoE) 模型的 CUDA 优化。这些更新还包括针对不同操作系统和硬件配置的各种错误修复和性能增强。

  2. TOOL · CL_224731 ·

    llama.cpp 为 Windows 设置添加了 Python SDK

    llama.cpp 项目发布了 b10680 版本,其中包括适用于 Windows 的 Python SDK 设置。此更新有助于在 Windows 系统上安装 Hexagon 和 OpenCL SDK。这些更改涉及将设置脚本移植到 Python 并进行少量代码调整。

  3. COMMENTARY · CL_194952 ·

    Bruce Schneier 讨论使用“AI Genie”示例的假设性 AI 漏洞

    Bruce Schneier 的博客文章“AI Genie in the Wild”使用了一个假设场景来阐述潜在的 AI 漏洞。该示例涉及一位名叫 Andrew 的用户与一个 AI(在某个实例中称为“OpenCL”)进行交互,以探索其功能和局限性。这个思想实验为关于 AI 安全以及可能出现的意外行为的讨论奠定了基础。

  4. TOOL · CL_177774 ·

    llama.cpp b10229 发布,修复 OpenCL bug

    llama.cpp 项目已发布 b10229 版本,其中包括对 OpenCL 后端的 bug 修复。此更新专门解决了在 `ggml_backend_opencl_init()` 函数中增加引用计数的问题,确保初始化期间的正确内存管理。

  5. TOOL · CL_176015 ·

    llama.cpp PR 缓存 MoE 专家以加速本地 AI 推理 · 跟踪 4 个来源

    llama.cpp 的一项新拉取请求引入了一种在 GPU 上缓存常用专家混合(MoE)层的方法,通过将 Qwen3.6-35B-A3B 等模型在显存有限的消费级硬件上的推理速度最高提升 2 倍。然而,这种优化并非普遍适用,由于开销原因,在某些情况下甚至可能降低性能。同时,llama.cpp 还迎来了其他更新,包括增强了对 Intel GPU 的 SYCL 支持,改进了 iGPU 和 WebGPU F16 性能,并为聊天模型引入了工具调…

  6. TOOL · CL_164175 ·

    AI模型在安卓智能手机上本地运行

    一位用户已成功在安卓智能手机上本地运行大型AI模型,具体为Z Image Turbo++和FLUX.2 Klein 4B。虽然生成过程缓慢,每张图片需要数分钟,但用户认为这是一项有趣的技术壮举。该模型在配备16GB RAM的OnePlus 12手机上运行,使用了INT4和INT8量化,并利用OpenCL进行GPU加速,因为Vulkan目前会遇到内存不足的错误。

  7. TOOL · CL_111217 ·

    llama.cpp 发布多个更新,包含性能和错误修复

    llama.cpp 项目已发布多个更新,包括 b9975、b9974、b9973、b9972、b9971、b9970、b9969、b9968、b9966 和 b9965 版本。这些发布在 macOS、Linux、Android 和 Windows 等多个平台上引入了各种改进和错误修复。值得注意的更改包括对 DeepSeek 模型的优化、在 Adreno GPU 等特定硬件上 Vulkan 和 OpenCL 性能的增强,以及对 CUDA…

  8. TOOL · CL_89264 ·

    Modular 开发 CUDA C++ 的开放替代方案以实现 AI 计算

    Modular 正在开发 CUDA C++ 和 OpenCL 的替代方案,以普及 AI 计算。该公司旨在提供一个更开放、更易于访问的 AI 开发平台,摆脱专有解决方案。

  9. TOOL · CL_87111 ·

    llama.cpp 发布增强性能并添加新功能

    llama.cpp 项目发布了多个更新,包括 b9608,该版本更新了 cpp-httplib 并为 macOS、Linux、Android 和 Windows 等各种平台提供了预编译二进制文件。b9606 版本引入了 EAGLE3 推测解码支持,增强了模型推理能力。b9605 版本包括为 Adreno GPU 添加 OpenCL 内核,提高了在某些移动设备上的性能。b9604 版本解决了 SYCL 后端的 CI 构建和发布问题,确保…

  10. COMMENTARY · CL_81273 ·

    OpenCL 和 SYCL 因开发缓慢未能成为主流AI计算标准

    虽然 OpenCL 和其他基于 C++ 的 GPU 编程模型(如 SYCL)旨在实现跨平台兼容性并获得了广泛采用,但它们未能成为主流的 AI 计算平台。主要问题包括委员会驱动的开发速度缓慢,导致缺乏快速的功能迭代和供应商特定的扩展。此外,硬件供应商之间“开放合作竞争”的固有紧张关系,即创新成果保密,阻碍了这些标准满足 AI 快速变化的需求。

  11. TOOL · CL_03164 ·

    Microsoft 将 Copilot AI 集成到其 OpenCLAW 项目中

    Microsoft 正在将其 Copilot AI 集成到 OpenCL 平台中,该项目代号为 Project Lobster。此举旨在增强 OpenCL 的功能,OpenCL 是一个常用于并行计算的框架。此次集成预计将为使用 OpenCL 的开发人员带来先进的 AI 辅助。