PulseAugur
实时 21:19:04
实体 lmsysorg

lmsysorg

PulseAugur coverage of lmsysorg — every cluster mentioning lmsysorg across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
5
90 天内 11
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
关系
情绪 · 30 天

3 天有情绪数据

最近 · 第 1/1 页 · 共 11 条
  1. SIGNIFICANT · CL_216221 ·

    Ornith-1.5-397B 模型发布,具备先进的自我改进能力

    Ornith-1.5-397B 模型已发布,通过端到端的自我改进,代表了基础模型开发的一项重大进展。该模型通过将任务生成、脚手架构建和解决方案推出整合到持续优化过程中,在前代版本的基础上进行了扩展。提供了将 Ornith-1.5-397B 与 Hugging Face Transformers 等流行库以及 vLLM 和 SGLang 等推理引擎集成,并通过 Docker 进行部署的说明和代码示例。

  2. TOOL · CL_204808 ·

    Empero AI 发布 Qwen3.8-9B 模型,支持广泛的框架兼容性

    Empero AI 在 Hugging Face 上发布了其 Qwen3.8-9B 模型的多个版本,包括基础版、蒸馏版和量化版。这些模型旨在兼容 llama.cpp、vLLM、Ollama 和 Transformers 等多种流行的推理框架。此次发布提供了详细的说明和代码片段,用于将这些模型集成到不同的开发环境中,从本地应用程序到云端笔记本。

  3. SIGNIFICANT · CL_178151 ·

    MiniMax AI 发布支持 vLLM 和 SGLang 的开源 H3 多模态模型

    MiniMax AI 发布了其 H3 模型的开放权重,该模型支持包括文本、图像和视频在内的多模态输入,并能生成带音频的视频。该模型现在可以在 vLLM-Omni 和 lmsysorg 的 SGLang Diffusion 等平台上获得 Day 0 支持。此举旨在使该模型更易于部署和构建,可在 NVIDIA 和 AMD 硬件上运行,并被定位为在快速发展的开源模型领域中的一个有竞争力的选择。

  4. SIGNIFICANT · CL_169894 ·

    Microsoft 发布 Mage-VL 以实现高效的视频和图像流处理

    Microsoft 发布了 Mage-VL,这是一款新推出的多模态基础模型,旨在实现图像和视频理解的高效流处理。与处理均匀采样帧的传统模型不同,Mage-VL 利用视频编解码器结构,仅处理必要的预测帧块,从而显著降低了计算负荷。这种方法旨在提高实时感知能力,使流处理应用的运行速度更快、计算量更少。

  5. SIGNIFICANT · CL_172072 ·

    Macaron-V1-Tall 多模态模型在 Hugging Face 上发布

    Macaron-V1-Tall 模型,一个基于 Qwen3.6-35B-A3B 构建的 LoRA 混合(MoL)模型,已发布并在 Hugging Face 上可用。该模型专为个人智能、工具使用、编码和生成式 UI 应用而设计。它集成了四个专门的 LoRA 模型,分别用于聊天、代理任务、编码和 GenUI,并配有一个路由器来选择合适的专家。

  6. SIGNIFICANT · CL_153600 ·

    Motif Technologies发布具有256K上下文的Motif-3-Beta MoE模型

    Motif Technologies发布了其大规模混合专家(MoE)语言模型Motif-3-Beta的测试版。该模型为内部开发,拥有约3140亿总参数,每个token有130亿活跃参数,并支持256,000个token的原生上下文长度。该模型采用稀疏路由机制,拥有384个专家,每个token激活8个专家加上一个共享专家。提供了与Transformers等流行库以及vLLM和SGLang等推理引擎集成的指令和代码,并支持Docker部署。

  7. SIGNIFICANT · CL_138273 ·

    Empero AI 发布 Qwythos-9B-v2,修复循环行为并保留推理能力

    Empero AI 发布了其 Qwythos 模型的更新版本 Qwythos-9B-v2。新版本解决了先前版本中存在的循环行为问题,将其发生率从 6.7% 降低到 0%,同时不损害推理能力。该模型保留了其深度思维链、无审查的研究立场和 1M token 上下文窗口,并恢复了其原生多 token 预测模块。

  8. RESEARCH · CL_143412 ·

    MiniCPM5-1B-Claude-Opus-Fable5 模型发布,增强了编码和工具使用能力

    MiniCPM5-1B-Claude-Opus-Fable5 的两个版本已在 Hugging Face 上发布,提供了增强的编码和指令遵循能力。第一个版本 GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF 针对使用 llama.cpp、vLLM 和 Ollama 等各种库和推理提供商进行本地部署进行了优化。第二个版本 GnLOLot/MiniCPM5-1B-Claude-O…

  9. TOOL · CL_106731 ·

    Jackrong/Qwopus3.6-27B-Coder-Compat-MTP-GGUF 模型在 Hugging Face 上发布,并附带集成指南

    Jackrong/Qwopus3.6-27B-Coder-Compat-MTP-GGUF 模型现已在 Hugging Face 上提供,为用户提供与各种库和推理提供商集成的说明。该模型可与 Transformers、vLLM 和 SGLang 等工具一起使用,并为每种工具提供了详细指南。此外,用户还可以通过 Google Colab 和 Kaggle 上的笔记本,或通过本地应用程序和 Docker 镜像来访问该模型。

  10. TOOL · CL_94545 ·

    开源权重代码模型 Qwable-v1 在 Hugging Face 上发布

    “lordx64/Qwable-v1”模型,一个开源权重的智能体代码模型,已在 Hugging Face 上发布。该模型是 Qwen3.6-35B-A3B 的蒸馏版本,融合了 Claude Opus 4.7 的推理轨迹和 Claude Fable-5 的智能体工具使用行为。它旨在执行链式蒸馏,通过 XML 格式的工具使用来实现显式的思维链和类似智能体的行为,用于文件编辑和 shell 命令等操作。

  11. TOOL · CL_03524 ·

    Together AI 为 AI 实验室和企业提供基础设施支持

    Together AI 已宣布其平台现已在 NVIDIA Cloud 上可用。