Tag
LLMランキング 2026:ベンチマーク、速度、価格で比較するトップAIモデル
2026年のLLM(大規模言語モデル)は、トップクラスに5つのプロバイダーが登場し、オープンウェイトモデルが独自モデルに挑戦する状況。GPQA DiamondやHumanEvalなどのベンチマークに加え、価格やコンテキストウィンドウサイズといった実用性も評価されている。「LLM Stats Score」は、推論、コーディング、ユーザー評価、コスト効率を重視し、幻覚率を減点するランキングシステム。Chatbot ArenaのEloレーティングは、実際の会話性能を反映する。
iPhone 17 Proで270億パラメータのAI「Qwen3.6-27B」が動作、AppleはPrismMLと圧縮技術の活用を協議か
AI開発企業のPrismMLは、270億パラメータを持つ大規模言語モデル「Qwen3.6-27B」を圧縮し、iPhone 17 Pro単体で動作させることに成功したと主張。Appleはこの技術についてPrismMLと協議していると報じられている。
日本HPが自社ノートPCに「Rakuten AI」を採用、オンデバイスとクラウドのハイブリッド - AI Watch
日本HPは、楽天が開発したAIツール「Rakuten AI for Desktop」を自社ノートPCにプリインストールして提供開始しました。このツールは、インターネット接続なしでPC上でAI処理を実行する「オンデバイスAI」と、クラウドAIを切り替えて利用できるハイブリッド型です。楽天独自の日本語LLM「Rakuten AI 7B」の特別版がオンデバイスで動作し、要約や翻訳、文章リライトなどの生成AI機能をオフライン環境で低遅延かつプライバシーに配慮して利用できます。クラウドモードでは、楽天エコシステムとの連携も可能です。
インテリジェントな Android アプリを構築する: オンデバイス推論 | Android Developers' Blog
Android Developers' Blogは、Gemini NanoやML Kitの生成AI APIを活用したオンデバイス推論によるインテリジェントなAndroidアプリ開発について解説しています。記事では、旅程の要約や領収書の解析、ローカル音声処理など、プライバシーを重視した機能の実装方法を具体的に紹介しています。特に、Gemini Nano 4のプロンプトAPIを用いた機能プロトタイピングや、ML Kit GenAI Speech Recognition APIによるオンデバイス音声認識について詳細に説明しており、開発者が手軽に高度なAI機能をAndroidアプリに組み込める方法を示しています。
2026年ライティング向けLLM:クリエイティブ、コピーライティング、コンテンツ - EVY
2026年7月20日発表のEVYのレポートによると、LLMのライティング能力評価にはEQ-Bench Creative WritingやLMArena Textなどが用いられています。特にEQ-Bench Creative Writingでは、Kimi K3が1300〜2380のEloスケールで2377という高評価を得て、Claude Fable 5(2091)、Claude Opus 4.7(2047)を上回りました。これは、物語の質、感情的な深み、文体、キャラクターボイスなどを評価する専門的なベンチマークです。
最高のオープンソースLLM:2026年7月リーダーボード(更新)
7月19日時点の最新情報によると、GLM-5.2がエージェントコーディングと推論においてオープンソースLLMリーダーボードのトップに躍り出た。Kimi K3は、7月27日にウェイトが公開される予定だが、生能力では僅差で2位につけている。DeepSeek V4とQwen3.6がフロンティア近辺のティアを形成している。GLM-5.2は、SWE-bench Proで62.1%、Terminal-Bench 2.1で81.0%のスコアを達成し、Claude Opus 4.8に迫る性能を示している。Kimi K3は、SWE Marathonでトップとなり、ArenaのFrontend CodeリーダーボードでもClaude Fable 5を上回った。しかし、ウェイト公開は7月27日まで待つ必要がある。
中国製AIモデル、ClaudeやChatGPTに匹敵する能力で米テック業界を驚かせる
中国のスタートアップMoonshotが開発したKimi K3モデルは、AnthropicのClaudeやOpenAIのChatGPTといった米国の最先端AIモデルに匹敵する能力を示し、米国テック業界に衝撃を与えています。特に、AIシステムの評価プラットフォームArenaでは、「フロントエンドコーディング能力」においてKimi K3がトップクラスの評価を獲得しており、オープンソースの中国製AIモデルが、クローズドな米国製モデルを凌駕する可能性が示唆されています。これは、米国の技術的制限が中国のAI技術開発を加速させている現状を浮き彫りにしています。