PulseAugur
实时 14:27:34
English(EN) EVOKE 14B - a 3-step, CFG-free interactive world model

EVOKE 14B:交互式世界模型生成持久、可重新提示的视频

EVOKE 14B 是一种新颖的交互式世界模型,专为生成持久、连贯的视频而设计。它采用三步流程,无需分类器自由引导,能够以每秒 24 帧的速度快速生成 384x640 的视频。该模型将世界状态与生成过程解耦,使其能够保持连贯性,并在扩展会话中响应用户指令,据称可达数小时。 AI

影响 支持更长、更具交互性和连贯性的视频生成会话。

排序理由 发布了带有权重和论文的新模型,但并非来自一线前沿实验室。[lever_c_research降级:ic=1 ai=1.0]

在 r/StableDiffusion 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

EVOKE 14B:交互式世界模型生成持久、可重新提示的视频

报道来源 [1]

  1. r/StableDiffusion TIER_2 English(EN) · /u/Crazy-Repeat-2006 ·

    EVOKE 14B - 一个三步、无CFG的交互式世界模型

    <table> <tr><td> <a href="https://www.reddit.com/r/StableDiffusion/comments/1vpw1z4/evoke_14b_a_3step_cfgfree_interactive_world_model/"> <img alt="EVOKE 14B - a 3-step, CFG-free interactive world model" src="https://external-preview.redd.it/ZnoxYnJpdGhmcWpoMZfEeKDjYYs6jl-UXwoq76A…