SageAttention
PulseAugur coverage of SageAttention — every cluster mentioning SageAttention across labs, papers, and developer communities, ranked by signal.
4 天有情绪数据
-
RDNA4 用户在 ComfyUI 中获得更快的 SageAttention
一位开发者为 AMD 的 RDNA4 显卡创建了一个优化的 SageAttention 构建,专门针对 Windows 上的 RX 9070 和 9070 XT。这个自定义构建使用了用 HIP 编写的 fp8 attention kernel,与现有的移植版本和 PyTorch 的 Scaled Dot-Product Attention (SDPA) 相比,实现了更快的性能。虽然 kernel 级别的提升很显著,但对 ComfyUI…
-
新研究推动表格基础模型实现高效和鲁棒性
多篇研究论文探讨了表格基础模型(TFMs)的进展,重点关注提高其效率、鲁棒性和适应性。知识蒸馏等技术正被用于从大型TFM创建更小、更快的学生模型,而RelICL和VIP-COP等新方法则解决了关系学习和上下文优化中的挑战。此外,研究正在探索架构选择和参数高效适应策略,以增强TFM在亚群体偏移和大规模数据集等各种数据条件下的性能。
-
Vidu S2 发布实时交互和可编辑的 AI 视频生成功能
Shengshu Technology 发布了 Vidu S2,这是一款先进的 AI 视频生成模型,提供实时交互式虚拟形象和视频编辑功能。该模型允许用户实时修改视频,包括更改服装、角色、背景和艺术风格,同时还能实现更具动态性和响应性的数字人交互。Vidu S2 可以生成用于 VR 体验的空间视频,并在各种基准测试中展示了最先进的性能。
-
SOL-H3结合SageAttention,将Apple Silicon图像生成速度提升高达2.5倍
一种名为SOL-H3的新型SOL Attention实现已为Apple Silicon开发,与原始H3相比,处理速度提升高达2.5倍。此优化集成到Vpipe平台中,并由SageAttention增强,与VDN等替代方法相比,它能更精确地保持原始的注意力行为。SOL Attention技术使用代理分数选择性地计算注意力块,近似其他块的贡献,从而在不引入图像和视频生成中明显可见的瑕疵的情况下,获得显著的性能提升。
-
MiniMax H3用户寻求VAE优化以加快视频生成速度
Reddit的r/StableDiffusion板块的一位用户正寻求优化MiniMax H3(一款视频生成模型)的生成速度。性能分析表明,变分自编码器(VAE)解码过程占总生成时间的约43%,在高端RTX 4090 GPU上,每15秒视频的生成时间约为5.5分钟。用户已尝试了几种优化方法,包括使用fp8mix VAE和不同的时间分块策略,但改进甚微。他们正在询问是否有可能使用与WanGP设置兼容的更快的VAE,更新CUDA和PyTor…
-
SageAttention 2.2 对比 Comfy Kitchen:缩放质量测试显示差异甚微
一位Reddit用户在RTX 5090上使用相同的提示词、种子和设置,对SageAttention 2.2和Comfy Kitchen Attention with MiniMax H3进行了并排比较。测试重点关注深度缩放过程中图像质量,特别是主体远离时面部细节和身份的保持情况。生成时间相似,SageAttention耗时3分51秒,Comfy Kitchen耗时3分59秒,但用户发现两种注意力后端之间的显著质量差异难以辨别。
-
H3 上的 SageAttention 将 StableDiffusion 的生成速度提高了 28%
一位 Reddit 用户分享了一个技巧,通过在 H3 上使用 SageAttention 来提高 StableDiffusion 的图像生成速度。该用户声称这种组合可将生成速度提高约 28%,且输出质量没有明显差异。他们提供了一个比较来展示最小的视觉影响。
-
MinMax H3 Turbo LoRA 以早期成果给 Stable Diffusion 用户留下深刻印象
Reddit 用户正在分享他们对新的 MinMax H3 Turbo LoRA 的体验和成果,该工具旨在增强 Stable Diffusion 中的视频生成能力。尽管该 LoRA 仍处于早期开发阶段,并被标记为实验性,但它已经产生了“惊人”和“出色”的效果,用户强调了它在生成的片段中创造平滑、自然运动的能力。一些用户分享了 ComfyUI(Stable Diffusion 的一个流行界面)的兼容版本和设置,这表明了社区的快速采纳和发展。
-
ComfyUI 用户升级至 CUDA 13 以加速 MiniMax H3 生成
一位 Reddit 用户分享了将 ComfyUI 升级到支持 CUDA 13 (cu130+) 的说明,以提高 MiniMax H3 模型的性能。据报道,此升级显著缩短了特定设置下的生成时间,从超过 12 分钟降至约 4 分钟。用户强调这是一个高级修改,用户应自行承担风险,并确保他们了解升级 CUDA 和相关库(如 PyTorch 和 SageAttention)的过程。
-
ComfyUI-KJNodes 补丁增强 Krea 2 和 Krea 2 Turbo 的安全性
一位用户为 ComfyUI-KJNodes 开发了一个补丁包,以增强 SageAttention 节点在使用 Krea 2 和 Krea 2 Turbo 工作流时的安全性。该补丁旨在通过检测 Krea 2 模型修补程序并选择性地将 SageAttention 应用于允许列表中的扩散注意力路径来防止意外修改。它包括对不支持的配置的回退机制,并避免干扰潜在的文本融合/Qwen 注意力路径,同时增加了日志记录和验证功能。
-
用户寻求 Forge Neo 中 SageAttention 的帮助以生成视频
一位用户正在寻求关于在 Forge Neo 软件中使用 SageAttention 功能的故障排除帮助,特别是在使用带有 GGUF 权重的 Wan-2.2 I2V A-14B 模型时。用户报告称,尽管在生成过程中预览看起来正常,但必须禁用 SageAttention 才能避免生成黑屏视频。他们正在询问是否存在版本兼容性问题或 SageAttention 需要正确运行的特定配置。
-
SageAttention 针对 Stable Diffusion 的优化已发布
SageAttention 的新实现已发布,这是一种用于 Stable Diffusion 的优化技术。此版本包含自动调整的块大小,开发者认为通过为特定输入维度定制块大小可以提高性能。鼓励用户测试此新实现,以将其速度与原始 SageAttention 进行比较。
-
LongCat Image Edit 和 SageAttention 提升 AI 图像生成速度和真实感
Meituan 开发的新模型 LongCat Image Edit 2026 在 Stable Diffusion 工作流中展示了卓越的面部修复能力,速度提升 30%,且无伪影。该模型拥有 60 亿参数,提供自然的真实感和效率,在图像编辑任务中优于 Stable Diffusion。此外,SageAttention 核心将 Blackwell GPU 上的 AI 推理速度提升高达 35%,优化了图像和视频模型的注意力操作。