スマホで動く視覚言語モデル「LFM2.5-VL-3B」が登場、日本語対応でUI認識やOCRに活用できる

AI要約
アメリカのAI企業Liquid AIが、スマートフォンでも動作可能な軽量視覚言語モデル「LFM2.5-VL-3B」を発表しました。このモデルは日本語対応で、文書のOCRやUI認識に活用でき、オープンモデルとして無償公開されています。パラメーター数は31億で、主要なプロセッサーに対応し、スマートフォンやノートPCでの実行が可能です。性能面では、同規模やそれ以上の大型モデルと比較して高いスコアを記録し、処理速度やメモリ使用量の面でも優れています。
元記事を読む →AI NEWS JAPAN ANALYSIS
AI NEWSジャパン独自の分析
この記事の独自分析は準備中です。
AI評価
80点 / 100点YANSU AI VIEW
やんすAIの視点
AI NEWS ジャパン独自の視点から、このニュースをひとこと解説します。

やんすAI
AI NEWS ジャパン
「AIやテクノロジーの動き、これからも目が離せないでやんす🤖」
PICK UP
この記事に関連するサービス
この記事の内容に関連した、読者に役立つサービスをご紹介します。
※広告・アフィリエイトリンクを含みます
関連記事

ビデオ通話で参加者の48%が人間だと誤認したAIモデル「Griffin」が登場、1枚の画像から顔や体の動きを映像で再現
Tavus社が開発したAIモデル「Griffin」は、1枚の画像からリアルタイムで顔や体の動きを生成し、映像と音声を連動させて双方向の自然なビデオ通話を実現する。映像生成の遅延は平均0.43秒と高速で、NVIDIAのベンチマークでは高い会話能力と状況理解能力を示した。実験では参加者の48%がAIを人間と誤認した。

無料で国のミッションクリティカル作業のために構築された主権AIモデル「Kolibri」、公共行政・産業・航空宇宙などの規制分野での使用が前提でオープンソースなだけでなく構築過程も透明化
ドイツのAIスタートアップAleph Alphaは、780億パラメータの主権AIモデル「Kolibri」を発表しました。公共行政や産業、航空宇宙などの規制分野向けに設計され、ドイツ語と英語に対応し、高効率かつ高性能な処理を実現しています。モデルの構築過程は透明化され、主権とコンプライアンスを重視。オープンソースで提供され、ドイツとフィンランドのインフラで欧州法に準拠してトレーニングされています。

125Bの「Qwen3.8-Flash-Next」の量子化版をゲーミングPCで高速ローカル実行可能にするAI実行アプリ「Strata」
「Strata」は1250億パラメーターの大規模AIモデル「Qwen3.8-Flash-Next」の量子化版を、ハイエンドゲーミングPCで高速にローカル実行可能にするアプリである。VRAMやRAM容量に応じて異なる量子化版を実行でき、NVIDIAやAMDのGPU環境での動作報告もあるが、量子化による性能低下の課題も指摘されている。
