PulseAugur
实时 17:36:12
日本語(JA) スマホで動く視覚言語モデル「LFM2.5-VL-3B」が登場、日本語対応でUI認識やOCRに活用できる https:// fed.brid.gy/r/https://gigazine .net/news/20260813-lfm2-5-vl-3b/

Liquid AI 发布 LFM2.5-VL-3B,一款兼容智能手机的视觉语言模型

Liquid AI 发布了 LFM2.5-VL-3B,这是一款专为在智能手机上运行而设计的轻量级视觉语言模型。该开源模型拥有 31 亿个参数,内存使用量低于 3.3GB,支持 OCR、UI 识别以及包括日语在内的多种语言。基准测试显示,LFM2.5-VL-3B 在包括移动设备在内的各种处理器上,其性能优于 Gemma-4-E4B-itQwen3.5-4B 等大型模型,在 Galaxy S26 Ultra 上的解码速度达到 20 tokens/sec。 AI

影响 实现了设备端视觉语言任务,可能加速移动 AI 应用并减少对云处理的依赖。

排序理由 前沿实验室模型发布,附带系统卡 [lever_c_demoted from frontier_release: ic=1 ai=1.0]

在 Mastodon — mastodon.social 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Liquid AI 发布 LFM2.5-VL-3B,一款兼容智能手机的视觉语言模型

报道来源 [1]

  1. Mastodon — mastodon.social TIER_1 日本語(JA) · [email protected] ·

    可在智能手机上运行的视觉语言模型“LFM2.5-VL-3B”已问世,可用于UI识别和OCR,并支持日语

    スマホで動く視覚言語モデル「LFM2.5-VL-3B」が登場、日本語対応でUI認識やOCRに活用できる https:// fed.brid.gy/r/https://gigazine .net/news/20260813-lfm2-5-vl-3b/