Vulkan
PulseAugur coverage of Vulkan — every cluster mentioning Vulkan across labs, papers, and developer communities, ranked by signal.
11 天有情绪数据
-
SteadySplats 方法增强了 3D 高斯泼溅渲染质量
研究人员开发了 SteadySplats,一种提高 3D 高斯泼溅模型随机渲染保真度的新方法。该方法通过实施基于历史的空间重采样方案以加快图像收敛速度,并通过时间重要性重采样以实现连贯性,从而解决了可见噪声问题。此外,在训练过程中使用颜色正则化器来降低视线方差,即使在低样本计数下也能显著提高 PSNR 并获得高质量输出。
-
原版 Xbox 模拟器通过 XPSemu 端口登陆已越狱的 PS5
一位 Modder 已成功移植了 Xemu 模拟器,使得原版 Xbox 游戏可以在已越狱的 PlayStation 5 主机上运行。该端口名为 XPSemu,通过将 Xbox 的 CPU 和 GPU 翻译成能在 PS5 硬件上运行,从而允许玩家玩 Halo 2 和 Forza Motorsport 等游戏。虽然该模拟器使用 Vulkan 渲染器来支持现代 GPU,并包含控制器友好仪表板等自定义功能,但目前性能受到模拟 Xbox CPU…
-
llama.cpp 项目发布预发布更新,包含性能优化
llama.cpp 项目发布了多个预发布更新,包括对 MoE expert 的 GPU 缓存管理改进、针对 Apple Silicon 的各种量化类型的优化,以及对 Metal fusion 操作的修复。这些更新还解决了 temperature-zero chains 的采样逻辑,并引入了新的词汇 token。这些发布涵盖了 macOS、iOS、Linux、Android 和 Windows 等广泛平台,并针对 Apple Silic…
-
Reddit用户寻求支持Vulkan的经济型GPU以运行AI模型
一位Reddit用户正在整理一份支持Vulkan的经济型GPU列表,用于运行AI模型,旨在帮助资源有限的用户。该用户正在寻找那些不再受最新CUDA或ROCm版本官方支持但仍能通过Vulkan运行的GPU。帖子中包含表格,详细列出了符合至少8GB显存和256GB/s或更高内存带宽等标准的NVIDIA GeForce GTX系列和数据中心GPU。
-
llama.cpp 添加 Windows ARM64 Vulkan 支持
llama.cpp 项目发布了 b11395 版本,增加了对搭载 Vulkan 图形加速的 ARM64 架构 Windows 的支持。此次更新增强了该项目在更广泛硬件上的兼容性和性能。
-
OpenDLSS-NR 以位级精度复制 NVIDIA 的 DLSS 5
一个名为 OpenDLSS-NR 的项目已成功使用 Vulkan 重新实现了 NVIDIA 的 DLSS 5 技术。此次重新实现达到了与原始 DLSS 5 位对位的精度,表明对 NVIDIA 专有的画面增强算法进行了高度准确的复制。
-
旧PC通过Whisper、Stable Diffusion和LLMs用于本地AI任务
一台配备Core i5-650处理器、8GB内存和RX 570显卡的旧电脑已被重新用于AI任务。用户成功集成了Whisper(一个开源语音转文本模型),利用whisper.cpp和Vulkan实现了实时转录速度。该设置现在支持三项本地AI工作负载,包括使用stable-diffusion.cpp进行图像生成和使用llama.cpp进行LLM,证明即使是配置不高、较旧的硬件,通过合适的软件也能执行有用的AI功能。
-
Apex Compute 为新硬件开发开源 Mesa Vulkan 驱动
Apex Compute 正在为其即将推出的硬件开发一款开源 Mesa Vulkan 驱动。该计划旨在为其专有芯片提供强大的图形和计算能力,该驱动预计将集成到 Mesa 图形堆栈中。
-
AI行话大杂烩:Vulkan上的GGUF模型被包装成‘尖端技术’
一篇Mastodon帖子幽默地批评了试图通过在Vulkan上运行GGUF模型来让AI听起来很先进的做法,认为这不过是一个用行话包装的API路由器。该帖子强调了项目中使用的Go语言,并将其描绘成一种缺乏新意的AI技术方法。
-
Janus Go 二进制文件通过 Vulkan 在 AMD、Intel、Nvidia GPU 上启用 GGUF 模型
一个名为 Janus 的新 Go 二进制文件已发布,它通过 Vulkan 在 AMD、Intel 和 Nvidia 的一系列 GPU 上启用 GGUF 模型的执行。该项目由 Vibra-Ingenn 开发,旨在为运行这些模型提供跨平台解决方案。
-
llama.cpp 发布引入 ZDNN 后端、Vulkan 调优和 Hexagon 支持
llama.cpp 项目发布了多项更新,包括添加 ZDNN 后端构建和各种 CI 改进的版本 b11269。其他近期版本侧重于特定优化和错误修复,例如改进 Adreno GPU 的 OpenCL 内核、为 Intel 硬件调优 Vulkan 着色器,以及增强 AVX512-FP16 的 FP32 点积累加。这些更新还包括对 PLaMo 模型词汇处理的调整,以及对 Hexagon 处理器上 FP32 GELU_ERF 和 GEGLU_E…
-
PS5 模拟器 KytyPS5 使 Demon's Souls Remake 达到 40-50 FPS
KytyPS5 模拟器已实现一项重要里程碑,使 PlayStation 5 游戏 Demon's Souls Remake 能够以准确的图形运行,帧率为 40-50 FPS。这比三周前 1-2 FPS 的状态有了显著的进步。这种快速进展归因于 PlayStation 5 的架构与 PC 相似,开发人员专注于控制台操作系统和驱动程序的兼容性层,包括将着色器转换为 Vulkan 的 SPIR-V 语言。
-
NobodyWho 和 Cactus:设备端 LLM 引擎比较
一项技术比较重点介绍了两个设备端 LLM 推理引擎 NobodyWho 和 Cactus,详细说明了它们在引擎设计、模型格式、硬件加速和许可方面的差异。NobodyWho 利用 llama.cpp 并直接支持现有的 GGUF 模型格式,提供广泛的兼容性。Cactus 采用专有的量化格式 (CQ) 和自己的引擎,针对具有特定 ARM NEON SIMD 和 Metal 支持的移动处理器进行了优化,但计划支持 NPU。虽然 NobodyW…
-
llama.cpp 发布带来 OpenVINO 更新、Vulkan、GGUF 和 SYCL 改进
llama.cpp 项目发布了多个更新,包括 b11024 版本,该版本更新了 OpenVINO 2026.4 并修复了各种编译器警告。其他近期版本,如 b11022 和 b11020,分别改进了 Vulkan 支持和 DeepSeek 模型的消息分隔符解析。b11019 版本解决了 GGUF 文件对齐和 LoRA 加载问题,而 b11013 解决了 Vulkan 着色器中的缓冲区对齐问题。早期的更新,如 b11017 和 b1101…
-
新型“woma”基础模型树立内窥镜检查实时标准
研究人员开发了“woma”,一种用于胃肠内窥镜检查的实时基础模型,该模型在约一百万帧内窥镜图像上进行了无标签训练。该模型可以针对特定任务进行微调,例如息肉检测和病变标记。“woma”模型表现出高水平的性能,以高精度发现了 96% 的息肉,并在 92% 的帧中正确命名了解剖学标志。值得注意的是,它在单个工作站 GPU 上运行速度约为每秒 100 帧,在速度和效率方面均优于 PyTorch、ONNX Runtime 和 TensorRT 等流行框架。
-
ROCm 对比 Vulkan:选择 AMD GPU 加速器进行本地 LLM 托管
本指南比较了 ROCm 和 Vulkan 在加速 AMD GPU 进行本地 LLM 托管方面的作用,并强调了它们各自的独特之处。ROCm 作为 AMD 的计算平台,支持 PyTorch 等框架以及 vLLM 和 SGLang 等引擎,需要兼容的驱动程序和库堆栈。而 Vulkan 是一种便携式 GPU API,被 llama.cpp 等引擎使用,可在各种硬件上运行量化模型,无需特定厂商的机器学习堆栈。两者之间的选择取决于具体的 LLM …
-
GPU内存写入操作的技术深度解析
这篇技术文章深入探讨了GPU如何管理内存写入的复杂性,探讨了GDDR6和HBM2等不同内存类型之间的差异。它考察了PCI Express等接口以及CUDA和OpenCL等编程模型在此过程中的作用。文章还涉及了DirectX和Vulkan等图形API,强调了它们如何与GPU内存交互。
-
任天堂因关税退款纠纷面临诉讼;NVIDIA 发布 Linux 驱动程序更新
任天堂美国公司因涉嫌扣留关税退款给客户而面临集体诉讼。作为回应,该公司发起了“客户答谢促销”以鼓励消费。此外,NVIDIA 发布了其 615.71.09 Linux 图形驱动程序,该驱动程序增强了对 Vulkan 原生游戏、NVIDIA Smooth Motion 的支持,并包含 Wayland 的修复程序。
-
Unsloth 发布重大性能提升和错误修复
Unsloth 发布了重要的更新,重点关注跨平台的性能增强和错误修复。最新版本在 Apple Silicon 上为扩散模型提供了显著的速度提升,加快了提示处理速度,并减少了 MLX KV 缓存的内存使用。此外,Unsloth 通过默认使用 Vulkan 提高了 AMD GPU 的性能,通过签名二进制文件增强了 Windows 兼容性,并简化了 RAG 和 API 功能。软件包大小也已减小,并提供新的 Docker 镜像以提高可访问性。
-
Ollama 0.32.10 回归性错误导致 Linux 集成显卡模型加载超时
Ollama 版本 0.32.10 及更高版本中的一个回归性错误导致模型加载超时,尤其是在使用 Vulkan 后端的集成显卡(iGPU)的 Linux 系统上,通过容器(Podman 或 Docker)运行时。此问题源于默认加载模式从 'mmap' 更改为 'none',这要求在将模型交给 GPU 之前,整个模型必须先加载到 CPU 内存中。在内存有限的系统上,这可能导致内存使用过量和磁盘颠簸,从而使加载时间超过默认的 5 分钟超时限…