PulseAugur
实时 16:15:16
实体 CogVLM

CogVLM

PulseAugur coverage of CogVLM — every cluster mentioning CogVLM across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
  1. COMMENTARY · CL_116021 ·

    智谱AI就GLM-5.3征求用户意见,视觉能力需求居首 · 追踪6个来源

    智谱AI正在为其下一代GLM模型征求用户反馈,并高度重视整合视觉能力。目前,其旗舰文本模型缺乏此功能,但竞争对手如Fable-5和Gemini 3已具备。尽管智谱AI此前已开发过多模态模型,但将其顶级产品排除视觉功能一直是用户和开发者争论的焦点。用户对GLM旗舰模型视觉理解的需求,凸显了开发者实际需求与AI研究者对核心智能理论关注点之间的分歧。

  2. TOOL · CL_102257 ·

    RTX 6000 Pro 用户寻求最佳开源图像视觉模型

    一位 Reddit 用户正在为可在 RTX 6000 Pro 显卡上运行的最佳开源图像视觉模型寻求推荐。他们希望对历史文档执行 OCR 和分类,并已成功使用 Gemma 4 31B,指出其性能优于 Qwen 3.6 模型中的视觉编码器。该用户正在询问除已测试过的模型之外的其他可用选项。

  3. RESEARCH · CL_40904 ·

    新框架通过关键帧、运动控制和推理增强视频生成

    研究人员推出了几个用于高级视频生成的新框架,重点关注增强的控制和真实感。SmartDirector 利用多个关键帧来指导电影式视频创作,改进叙事结构和时间节奏。MotiMotion 通过整合视觉推理来优化轨迹和预测次级效应,解决了运动控制视频的局限性,旨在获得更自然、更可信的结果。PostCam 提供了一种通过精确的相机编辑进行新视角视频生成的简化方法,而 CamC2V 则整合了 3D 约束和多图像条件以进行上下文感知生成。CoMoG…