PulseAugur
实时 23:55:31
实体 PP-OCRv6

PP-OCRv6

PulseAugur coverage of PP-OCRv6 — every cluster mentioning PP-OCRv6 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
3
90 天内 9
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
时间线
  1. 2026-08-04 product_launch PaddlePaddle released PP-OCRv6, a multilingual OCR model. 来源
  2. 2026-07-21 product_launch PaddlePaddle released the PP-OCRv6 model, supporting 50 languages and available on Hugging Face. 来源
  3. 2026-07-06 product_launch PaddlePaddle has released PP-OCRv6, a new OCR model supporting 50 languages. 来源
  4. 2026-06-22 product_launch PaddleOCR has launched PP-OCRv6, a new generation of universal OCR models. 来源
  5. 2026-06-22 product_launch PaddleOCR has launched PP-OCRv6, a new generation of its universal OCR model family, now available on Hugging Face. 来源
情绪 · 30 天

3 天有情绪数据

最近 · 第 1/1 页 · 共 9 条
  1. TOOL · CL_182509 ·

    PaddlePaddle 发布支持 50 种语言的 PP-OCRv6 OCR 模型

    PaddlePaddle 发布了 PP-OCRv6,这是一个光学字符识别模型,能够处理 50 种语言,参数量从 150 万到 3450 万不等。新版本旨在处理图像,包括 hugging faces 的图像,并可在 Hugging Face 上获取。此次发布凸显了多语言 OCR 能力的进步。

  2. TOOL · CL_154908 ·

    PaddlePaddle 发布支持 50 种语言的 PP-OCRv6

    PaddlePaddle 发布了 PP-OCRv6,一个能够处理 50 种语言的光学字符识别(OCR)模型。该模型提供从 150 万到 3450 万不等的参数规模,为部署提供了灵活性。此次发布可在 Hugging Face 上获取,为开发者提供了一个访问和使用 OCR 技术的平台。

  3. TOOL · CL_128001 ·

    PaddlePaddle 发布支持 50 种语言的 OCR 模型 PP-OCRv6

    PaddlePaddle 发布了 PP-OCRv6,这是一个能够处理 50 种语言的光学字符识别模型。该模型提供从 150 万到 3450 万的参数量,支持可扩展性。此次发布可在 Hugging Face 上获取,为各种应用提供了其功能。

  4. TOOL · CL_104376 ·

    Hugging Face 发布新的 OCR 和 3D 运动模型,以及 AI 网站克隆器

    Hugging Face 发布了两个新的开源多模态模型:PP-OCRv6 支持 50 种语言的高级 OCR,MolmoMotion 支持语言引导的 3D 运动预测。这些模型旨在易于访问,PP-OCRv6 提供适用于消费级 GPU 和嵌入式设备的版本,MolmoMotion 可实现对 3D 环境的直观控制。此外,一个热门的 GitHub 模板允许开发人员使用可配置的 AI 编码代理来克隆网站,用于本地开发。

  5. RESEARCH · CL_103811 ·

    PaddleOCR 在 Hugging Face 上发布支持 50 种语言的 PP-OCRv6

    PaddleOCR 已在 Hugging Face 上发布了 PP-OCRv6,这是一套更新的通用 OCR 模型。新一代模型提高了文本检测和识别的准确性,模型参数量从 150 万到 3450 万不等。小型和中型模型支持包括中文、英文和日文在内的 50 种语言,旨在为多语言 OCR 任务提供统一的解决方案。PP-OCRv6 专注于以高效的模型尺寸提供准确、结构化的文本输出,适用于各种部署场景。

  6. SIGNIFICANT · CL_91830 ·

    百度PP-OCRv6实现97毫秒推理,引领全球OCR基准

    百度文心正式发布全新OCR模型PP-OCRv6,提供Tiny、Small和Medium版本,支持50多种语言,并可部署于浏览器到服务器的各种场景。Tiny模型仅重1.5MB,可在浏览器内实现低至97毫秒的OCR识别,增强了隐私性并降低了部署门槛。PP-OCRv6在OCR性能方面树立了新的基准,在专业OCR任务上超越了主流多模态模型,巩固了PaddleOCR作为领先的开源OCR项目的地位。

  7. RESEARCH · CL_86882 ·

    PP-OCRv6 轻量级OCR系统性能超越大型VLMs

    新开发的OCR系统PP-OCRv6提供了多种模型层级,适用于从服务器到边缘设备的各种部署场景。该系统采用统一的MetaFormer风格构建块和以数据为中心的优化来提升性能。PP-OCRv6在准确性和检测指标上优于其前代产品PP-OCRv5,并且在参数量远少于Qwen3 VL 235B、GPT-5.5和Gemini 3.1 Pro等大型视觉语言模型(VLMs)的情况下,性能显著超越了它们。此外,PP-OCRv6的一个较小层级在标准CPU…

  8. RESEARCH · CL_83786 ·

    Hugging Face Transformers 添加 MiniMax-M3-VL、DeepSeek-V3.2 和 DiffusionGemma

    Hugging Face Transformers 库已发布 5.12.0 版本,引入了 MiniMax-M3-VL 等新模型,这是一个具有 CLIP 式视觉塔和稀疏专家混合解码器的视觉语言模型。此次更新还包括对 PP-OCRv6(一个高效的 OCR 系统)和 Parakeet-RNNT(一个带有 RNN-T 解码器的快速 Conformer 编码器)的改进。此外,5.11.0 版本添加了 DiffusionGemma(一个用于更快文…

  9. TOOL · CL_92705 ·

    PaddleOCR发布PP-OCRv6模型,OCR性能超越大型语言模型

    PaddleOCR发布了PP-OCRv6,一套新的轻量级OCR模型,采用统一的MetaFormer风格构建块。PP-OCRv6_medium模型拥有1550万个参数,与前代相比提高了检测和识别准确性。这种新架构设计用于可扩展性,提供从服务器到边缘部署的层级,并支持48种语言,据报道在OCR任务上超越了Qwen3 VL 235B、GPT-5.5和Gemini-3.1-Pro等大型模型。