PulseAugur
实时 17:40:30
实体 modelscope

modelscope

PulseAugur coverage of modelscope — every cluster mentioning modelscope across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
9
90 天内 21
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 3
层级分布 · 90 天
主题
情绪 · 30 天

7 天有情绪数据

最近 · 第 1/2 页 · 共 21 条
  1. SIGNIFICANT · CL_224154 ·

    Z.ai发布开源GLM-5.3模型,可与GPT-5.6 Sol匹敌

    中国AI公司Z.ai已将其GLM-5.3模型作为开源模型发布,可供下载和定制。该模型拥有令人印象深刻的性能,据报道在某些测试中,尤其是在智能体编码和网络防御能力方面,其表现超越了Claude Fable 5和GPT-5.6 Sol等模型的基准。虽然完整模型需要大量的计算资源,但也有一个量化版本可用于要求较低的硬件,并且还发布了一个较小的变体GLM-5.3-Flash。

  2. SIGNIFICANT · CL_221847 ·

    Z.ai 和阿里巴巴通过发布高效新模型将 AI 模型成本降低 10 倍 · 跟踪 1 个来源

    本周,两家主要的人工智能实验室 Z.ai 和阿里巴巴发布了新的前沿模型,显著降低了访问高性能人工智能功能的成本。Z.ai 的 GLM-5.3-Flash 和阿里巴巴的 Qwen3.8-Flash-Next 都提供了与更昂贵模型相当的性能,但价格却低得多,输入 token 每百万成本约为 0.15 美元。这些发布利用了先进的架构设计,如混合专家模型(Mixture-of-Experts)和稀疏注意力机制,以实现更高的效率和更低的部署成本…

  3. FRONTIER RELEASE · CL_219545 ·

    阿里巴巴推出 Qwen3.8-Flash 模型,获广泛合作伙伴支持

    阿里巴巴的 Qwen 推出了其 Qwen3.8-Flash 模型,可在 Qwen Cloud 上使用,API 使用价格具有竞争力。该模型也可通过 OpenRouter 访问,支持编码助手和代理工作流等各种应用。此外,Qwen3.8-Flash-Next 已获得 SGLang 和 vLLM 等关键合作伙伴的零日支持,并已在 NVIDIA 和 AMD 硬件上确认兼容。这种新架构旨在实现极致的成本效益,也可通过 Ollama 获取。

  4. FRONTIER RELEASE · CL_196955 ·

    阿里巴巴发布Qwen3.8开源模型,在排行榜上获得关注

    阿里巴巴的Qwen发布了其Qwen3.8系列开源模型,包括Qwen3.8-27B和Qwen3.8-2.4T-A95B。Qwen3.8-27B模型拥有262K的原生上下文窗口,通过YaRN可扩展至1M token,并在Hugging Face等平台上获得了显著关注,其量化版本下载量达数百万次。此次发布使Qwen成为本地部署和代理开发的有力竞争选项,其中Qwen3.8-Max在前端代码排行榜上显著优于Claude Fable-5。

  5. SIGNIFICANT · CL_192496 ·

    inclusionAI 发布轻量级 Ling-3.0-tiny MoE 模型以支持本地部署

    inclusionAI 发布了 Ling-3.0-tiny,这是一款新的混合推理专家混合(MoE)模型,总参数为 79 亿,每个 token 激活参数为 13 亿。该模型专为高效的本地部署和资源受限环境而设计,提供强大的推理和代理能力。它采用了新颖的 Kimi Delta Attention (KDA) 和 Multi-Head Latent Attention (MLA) 架构,支持快速响应和多步推理,并在 Apple Silico…

  6. RESEARCH · CL_193912 ·

    RynnValue 模型利用时间距离扩展机器人学习 · 跟踪 2 个来源

    研究人员推出 RynnValue,这是一种用于机器人操作的开源价值基础模型,它利用时间距离作为监督目标。这种方法允许模型扩展到超过 7000 小时的数据,而无需偏好或进度注释。RynnValue 在 RBM-EVAL-OOD 基准测试上达到了 0.675 的 Kendall's tau_a,优于现有的最先进方法。当转换为密集奖励时,RynnValue 显著提高了现实世界策略的成功率,证明了时间距离对于通用机器人策略的有效性。

  7. TOOL · CL_183478 ·

    新的T2VAttack方法揭示了文本到视频扩散模型的漏洞

    研究人员开发了T2VAttack,一种探测文本到视频扩散模型漏洞的新方法。该攻击侧重于视频生成的语义和时间两个方面,旨在降低生成视频与其文本提示之间的对齐度,以及视频本身的时间连贯性。T2VAttack采用同义词替换和优化词语插入等策略来扰乱提示,证明即使是微小的改动也会显著损害包括ModelScope和Open-Sora在内的几款领先模型的视频质量和时间动态。

  8. TOOL · CL_174631 ·

    POCKET LLM 在 CPU 上运行 35B 模型,无需 GPU

    POCKET 是一款新的设备端 LLM,旨在无需 GPU 即可在标准 CPU 上运行 35B 参数模型,利用 llama.cpp 推理栈。此方法旨在克服本地和边缘部署中 GPU 稀缺和成本的障碍。虽然其吞吐量约为设备端基线 Bonsai 的 3.4 倍,但其性能和输出质量,尤其是在韩语生成方面,在很大程度上取决于量化级别,建议使用 Q4 或更高版本以获得可用结果。

  9. SIGNIFICANT · CL_174446 ·

    MiniMax H3开源模型发布,用户询问其能力 · 追踪2个来源

    开源模型MiniMax H3已发布,其可用性在专注于本地LLM和Stable Diffusion的Reddit论坛上公布。用户正在询问其能力,特别是其在动画生成中间帧方面的潜力。发布日期通过ModelScope的官方X账号确认是8月3日午夜UTC。

  10. TOOL · CL_164160 ·

    ModelScope 发布 ms-swift 用于开源模型微调

    ModelScope 发布了 ms-swift,一个开源工具,用于微调和部署各种语言和视觉-语言模型。该工具旨在简化处理众多 AI 模型的开发人员的工作流程。

  11. MEME · CL_151303 ·

    AI爱好者担心可访问性问题而囤积开源模型 · 跟踪到1个来源

    Reddit 的 r/LocalLLaMA 子版块上的一场讨论探讨了用户购买大容量硬盘来存储开源 AI 模型这一想法。这次对话源于对 Hugging Face 等平台上托管的模型长期可用性和可访问性的担忧。参与者分享了替代的模型存储库,并讨论了保存对这些宝贵 AI 资源访问权的策略。

  12. TOOL · CL_140540 ·

    Wan Dancer 14B:新的开源视频模型发布

    一款名为Wan Dancer 14B的新型开源视频生成模型已发布。该模型能够生成长达三分钟的视频,并展现出令人鼓舞的结果。该模型可在ModelScope上获取。

  13. TOOL · CL_142085 ·

    Wan-Dancer框架从音乐生成分钟级连贯舞蹈视频

    研究人员推出了一种名为Wan-Dancer的新型框架,该框架能够根据音乐生成长时间、高质量的舞蹈视频。该方法通过将过程分解为全局关键帧规划和局部时间细化,并利用全曲音乐上下文,来确保时间连续性和全局结构。模型权重和推理代码已发布,用户可以在Hugging Face和ModelScope等平台上进行实验。

  14. SIGNIFICANT · CL_134288 ·

    Robbyant发布LingBot-Video,一款开源MoE视频生成模型

    Robbyant发布了LingBot-Video,这是一款开源的混合专家(MoE)视频生成模型,专为具身智能设计。该模型在包含网络视频和具身数据的海量数据集上进行训练,采用高效的MoE架构,推理速度比以往模型快约三倍。LingBot-Video集成了多奖励系统,优先考虑输出的美学质量、物理合理性和任务完成度。

  15. TOOL · CL_130526 ·

    媒体合成博物馆提供对旧AI图像生成模型的访问

    媒体合成博物馆(Media Synthesis Museum)可在Hugging Face上访问,允许用户使用旧的AI模型生成图像。该平台托管了ModelScope、DALL-E Mini和VQGAN+CLIP等模型,为实验图像生成基础技术提供了一种方式。

  16. TOOL · CL_118589 ·

    ModelScope 发布 Agents-A1,一款用于长期任务的 35B MoE 模型

    ModelScope 推出了 Agents-A1,一个拥有 350 亿参数的专家混合(MoE)模型,专为搜索和工程等长期任务设计。该模型通过 Mastodon 上的转推宣布。

  17. TOOL · CL_94930 ·

    WeiboAI 发布 VibeThinker-3B 以应对高级推理任务

    WeiboAI 发布了 VibeThinker-3B,这是一个拥有30亿参数的模型,专为数学、编码和STEM等具有挑战性的推理任务而设计。该模型采用了优化的训练后流程,在AIME、HMMT和LeetCode竞赛等基准测试中取得了与领先前沿模型相当的性能。开发者提出了参数压缩覆盖假设,认为可验证的推理依赖于多步推理和自我纠正等参数密集型能力。

  18. FRONTIER RELEASE · CL_87714 ·

    MiniMax AI 发布开放权重多模态 M3 模型

    MiniMax AI 发布了其 MiniMax M3 模型,该模型具有开放权重,总参数约 4280 亿,激活参数 230 亿。该模型专为智能体时代设计,支持文本、图像和视频的原生多模态,上下文窗口高达 100 万 token。此次发布还包括更新的许可条款,年收入低于 2000 万美元的个人或公司可免费商用,只需通知。

  19. TOOL · CL_54150 ·

    在 ModelScope AI 库中发现关键远程代码执行漏洞

    在 ModelScope AI 库中发现了一个关键的远程代码执行漏洞,标识为 CVE-2025-51427。此漏洞可能允许攻击者控制运行使用该库的项目。建议波兰数据科学团队审计他们在 ModelScope 中使用的模型,以减轻潜在风险。

  20. FRONTIER RELEASE · CL_52895 ·

    OpenBMB发布MiniCPM5-1B,10亿参数模型表现超越更大模型

    OpenBMB发布了MiniCPM5-1B,这是一款拥有十亿参数的小型语言模型,其性能表现可与更大模型相媲美。该模型旨在本地运行,加速边缘AI的实际应用。在20亿参数以下模型的人工分析指数中,它已超越Qwen3.5-2B等竞争对手,位居榜首。此外,OpenBMB还推出了桌面AI宠物应用“MiniCPM Desk Pet”,利用该模型的轻量化能力实现设备端交互。