LLM推論初出 8/13 16:31
スマホで動く視覚言語モデル「LFM2.5-VL-3B」が登場、日本語対応でUI認識やOCRに活用できる
https://gigazine.net/news/rss_2.0/2026/8/13
AI要約
スマートフォンで動作する軽量な視覚言語モデル「LFM2.5-VL-3B」が登場。文書のOCRやUI認識が可能で、オープンモデルとして無償公開されています。日本語にも対応しています。
AI要点
- スマートフォンで動作する視覚言語モデル「LFM2.5-VL-3B」が登場した。
- このモデルは日本語に対応しており、UI認識やOCR(光学文字認識)に活用できる。
- ウェブサイトへのアクセスにおいて、ボットによるトラフィックが人間によるものを大幅に上回る状況が報告されている。
- AIクローラーが短時間に大量のページを読み込む問題が指摘されており、サーバー運営に負荷がかかっている。
- AIクローラーによる過剰なアクセスを防ぐための対策として、IPアドレスの遮断や認証チャレンジなどが実施されている。
なぜ重要か
スマートフォンで動作する日本語対応の視覚言語モデル登場は、モバイルデバイス上での高度なAI活用を可能にする一方、ウェブサイト運営者はAIクローラーによる過剰なアクセスという新たな課題に直面しており、その対策が急務となっている。