エッジAIラボ
エッジAIラボ
EDGE AI ECOSYSTEM

エッジAI最新リソース

モデル・フレームワークから新技術・月間GitHubトレンドまで

初回公開: ページ最終更新:

各カードの公開日・情報確認日・当サイトの実機確認状況・根拠種別・出典を分けて表示しています。「公式情報・公称値」は掲載元の発表値で、当サイトの実機計測値ではありません。

ブラウザAIフレームワーク比較

用途に応じた最適なフレームワークの選び方

LiteRT.js

  • ブラウザ内ローカル推論
  • Wasm/XNNPACK
  • WebGPU対応
  • WebNNは実験的
TFLite資産のWeb展開TFLite
公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Google LiteRT.js公式発表

TensorFlow.js

  • ブラウザ + Node.js
  • WebGL/WebGPU加速
  • トレーニング可能
  • 豊富な事前学習モデル
画像認識・物体検出TF / TFLite
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: TensorFlow.js公式

MediaPipe

  • Google製
  • WASM + GPU
  • 超高速推論
  • ビジョン特化
ポーズ推定・顔認識TFLite
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Google MediaPipe公式

Transformers.js

  • HuggingFace連携
  • 100+アーキテクチャ
  • WebGPU対応
  • 多様なタスク
NLP・音声認識ONNX
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Hugging Face Transformers.js公式

WebLLM

  • WebGPU必須
  • LLM特化
  • ストリーミング
  • OpenAI互換API
チャットAI・文章生成MLC
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: MLC WebLLM公式GitHub

エッジAIハードウェア動向

主要チップメーカーのAI処理性能と対応状況

Hailo-10H

40 TOPS (INT4) / 約2.5W

40 TOPS(INT4)・標準2.5Wという公称仕様で、LLM・VLMなど生成AIのエッジ実行を想定したアクセラレータ。

公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Hailo-10H公式製品情報

NVIDIA Jetson Thor

最大約2070 FP4 TFLOPS / 128GB

Blackwell世代のロボティクス向けエッジAI(2025-08提供)。大型VLM/VLAをエッジで実行可能に。

公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: NVIDIA Jetson Thor公式

Apple Neural Engine

M4: 38 TOPS

M4のNeural Engineは公称毎秒38兆回の演算に対応し、端末内のAIワークロードを加速。

公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Apple M4公式発表

Qualcomm AI Engine

Snapdragon X: 45 TOPS

Snapdragon Xシリーズは公称45 TOPSのNPUを備え、Copilot+ PCの端末内AI処理を支援。

公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Qualcomm Snapdragon X Elite公式製品情報

Google Coral Edge TPU

4 TOPS / 2W

公称4 TOPS・2WのEdge TPU。低消費電力の組み込み推論向け。

公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Google Coral公式データシート

NVIDIA Jetson Orin

40〜275 TOPS

ロボティクス・自動運転向け。フルNVIDIA GPUエコシステムをエッジで実現。

公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: NVIDIA Jetson Orin公式

🤗注目のエッジAIモデル

用途・対応ハードウェア・鮮度がひと目でわかるモデルカタログ

新着E2B(約2.3B実効)Pixel TPUネイティブマルチモーダル利用条件を要確認

Gemma 4 E2B for Pixel TPU

Google

7/13公開。Pixel 10シリーズのTensor TPUへ最適化したGemma 4 E2B。テキスト・画像・音声を端末内で処理し、Tensor SDK betaから利用する構成。

何に使える?

オフライン対話画像Q&A端末内文字起こしMobile Actions

動作する機材

Pixel 10Pixel 10 Pro / Pro XLPixel 10 Pro Fold
公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Google Developers Blog/公式モデル
新着33B総 / 3B実効 (MoE)MoE256K文脈INT4/FP8/NVFP4OpenMDW-1.1

Laguna XS 2.1

Poolside

7/2公開。256K文脈とツール間のinterleaved thinkingを備え、ローカルでの長時間コーディングを狙うMoE。公式カードは36GB RAMのMacで動作可能としている。

何に使える?

ローカル・コーディング長時間の修正タスクターミナル操作コードレビュー

動作する機材

36GB以上のApple Silicon MacGPUワークステーション複数GPUサーバー
公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Poolside公式モデルカード
新着2B (ASR)ASRArabic / EnglishオフラインApache 2.0

Cohere Transcribe Arabic 07-2026

Cohere Labs

7/7公開。アラビア語と英語に特化したFastConformer系ASR。Transformersでオフライン推論でき、長尺音声は自動分割に対応。自動言語判定・話者分離・タイムスタンプは非対応。

何に使える?

アラビア語文字起こし英語文字起こし長尺音声のローカル処理コール記録

動作する機材

GPU搭載PCローカルワークステーションvLLMサーバー
公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Cohere Labs公式モデルカード
新着8BEmbodied AI単眼RGB提供条件は要問い合わせ

Robostral Navigate

Mistral AI

7/8発表。単一RGBカメラと自然言語の指示から、LiDAR・深度カメラなしで移動ロボットを誘導するembodied navigationモデル。提供・実行条件は問い合わせが必要。

何に使える?

屋内ロボット誘導指示追従ナビゲーション単眼カメラでの経路判断

動作する機材

移動ロボット(要統合)単眼RGBカメラ実行環境は要問い合わせ
公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Mistral AI公式発表
最近3BReasoning3B64K学習文脈MIT

VibeThinker-3B

WeiboAI

6/15公開。数学・競技プログラミング・STEMなど検証可能な推論に特化した小型モデル。公式カードはツール呼び出しや自律コーディング用途を非推奨としている。

何に使える?

数学推論競技プログラミングSTEM問題小型推論モデルの評価

動作する機材

GPU搭載PCApple Silicon Mac量子化対応ローカルランナー
公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: WeiboAI公式モデルカード
最近230M超小型オンデバイスLFM Open License

LFM2.5-230M

Liquid AI

6/25公開。32K文脈の超小型モデルで、データ抽出とツール呼び出しを端末内で実行。Liquid AI公称でPi 5は42 tok/s、Galaxy S25 Ultraは213 tok/s。

何に使える?

端末内エージェントJSON抽出ツール呼び出し家庭内自動化

動作する機材

Raspberry Pi 5スマートフォンJetson Orin NanoRTX搭載PC
公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Liquid AI公式モデルカード
定番Tiny 27M / Base 61M (ASR)ASRリアルタイムMIT

Moonshine

Useful Sensors

ストリーミングに向く省リソースASR。ONNXでRaspberry PiなどのCPUにも載せやすく、端末内のリアルタイム音声UIで引き続き有力。

何に使える?

リアルタイム字幕音声コマンドオフライン文字起こし低遅延音声UI

動作する機材

Raspberry Pi 5ブラウザ(WASM)スマートフォンJetson Orin Nano
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Useful Sensors公式モデルカード

新技術・研究ウォッチ

モデルやフレームワークの外側で進む、エッジAIの次の選択肢

ブラウザAI実装公開

LiteRT.js:ブラウザをエッジAIの配布先に

.tfliteモデルをJavaScriptから読み込み、Wasm/XNNPACK、WebGPU、実験的WebNNでローカル推論するGoogleのWebランタイム。

新規性
TFLiteのモデル資産をWeb専用形式へ変換せず、CPU・GPU・将来のNPUまで同じブラウザAPIの下で扱う構成。
エッジAIへの影響
通信遅延・サーバー費用・データ送信を抑えたAI機能を、URLだけで配布できる範囲が広がる。性能値はGoogleの管理下テストによる公称値。
.tfliteWebGPUWebNNWasm/XNNPACK
公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Google Developers Blog
Physical AI実装公開

LeRobot v0.6:予測して改善するPhysical AI

world model policy、reward model API、6つのシミュレーション環境、human-in-the-loop rolloutを一つのOSS基盤に統合。

新規性
模倣学習用データを集めるだけでなく、環境を予測し、報酬で評価し、ロールアウトから改善する閉ループを標準機能へ寄せた。
エッジAIへの影響
実機データが少ないロボット開発で、シミュレーションと実機の反復を共通パイプラインに載せやすくなる。実機性能は構成ごとの検証が必要。
ロボティクスWorld ModelReward ModelHITL
公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Hugging Face公式ブログ/リリース
ヘテロジニアス推論研究発表

HeteroMosaic:CPU・iGPU・NPUの協調推論

依存関係を保ったマイクロバッチをCPU、内蔵GPU、NPUへ割り当て、DVFSと共有メモリ競合も考慮するスケジューラ。

新規性
NPUだけを選ぶのではなく、PC内の異種プロセッサを同時に働かせ、ワークロードに応じて配置を変える。
エッジAIへの影響
著者らはAMD Ryzen AI 3機種でllama.cpp比最大2.05倍、エネルギー最大45.3%削減を報告。査読前であり、他環境での再現確認が必要。
NPUiGPUDVFSプレプリント
公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 一次論文・著者報告出典: HeteroMosaic論文(arXiv、査読前)
分散エッジ研究発表

Voltron:複数端末を束ねる弾力的LLM推論

スマートフォン、タブレット、IoT端末をローカル無線クラスタにし、prefill/decode別の計画と混合精度でLLMを分散実行。

新規性
1台に収まるモデルを選ぶのではなく、手元の異種端末を一つの推論資源として扱い、端末離脱や通信変動にも再計画で対応する。
エッジAIへの影響
著者らはQoS制約下で、単体端末向けモデルより平均10.2%、最大16.5%高い精度を報告。プレプリント段階で実装条件の確認が必要。
分散推論混合精度ローカル無線プレプリント
公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 一次論文・著者報告出典: Voltron論文(arXiv、査読前)
エージェントセキュリティ研究発表

HalluSquatting:AIエージェント時代の名前乗っ取り

エージェントが存在しないリポジトリ、パッケージ、スキル名を生成する前に、その名前を攻撃者が取得して誘導するサプライチェーン攻撃。

新規性
人がタイプミスするtyposquattingではなく、AIがもっともらしい識別子を“幻覚”する確率そのものを攻撃面に変えた。
エッジAIへの影響
ローカルエージェントでも外部コードやスキルを導入する瞬間が境界になる。名称だけでなく、発行元・署名・固定ハッシュの検証が必要。報告値は著者実験。
AI AgentSupply Chain署名検証プレプリント
公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 一次論文・著者報告出典: HalluSquatting論文(arXiv、査読前)
標準化業界動向

MIPI Physical AI BoF:ロボット部品の標準化準備

ヒューマノイド・ロボティクス向けに、カメラ、センサー、I3C、チップ間接続、セキュリティ等の共通課題を検討する新グループ。

新規性
Physical AIをモデルだけでなく、センサーから演算・表示までの相互接続問題として捉え、既存MIPI仕様の適用範囲を整理する。
エッジAIへの影響
完成規格ではなく検討開始の段階。ただし、部品ごとの独自接続が統合コストになるロボット市場で、相互運用性の議論が早期に始まった意味は大きい。
標準化ヒューマノイドセンサー相互運用性
公開日:
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: MIPI Alliance公式ブログ

2026年7月に注目が集まったGitHubプロジェクト

累計スター数と「今月なぜ伸びたか」を分けて確認

累計 Stars31,796

コードを永続的な知識グラフへ索引化し、AIコーディングエージェントへ構造検索を提供するC製MCPサーバー。単一バイナリでローカル処理。

今月の勢い
+28,030 stars / 月
なぜ今注目されたか
エージェントが大量のファイルを毎回読み直すコストへの関心が高まり、コード理解をローカル索引へ切り出す設計が支持を集めた。性能値は作者ベンチマーク。
トレンド根拠: GitHub Trending(月間)
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: DeusData公式GitHub
🚀 急上昇Rust

Zackriya-Solutions/meetily

累計 Stars24,922

録音、リアルタイム文字起こし、要約をローカル環境で行うRust製のプライバシーファースト会議アシスタント。Ollama等を選択可能。

今月の勢い
+11,875 stars / 月
なぜ今注目されたか
会議データをクラウドへ送らない需要と、ローカルASR・LLMが実用速度へ近づいた流れが重なり、具体的なデスクトップ用途として注目された。
トレンド根拠: GitHub Trending(月間)
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Meetily公式GitHub
🚀 急上昇TypeScript

alibaba/page-agent

累計 Stars26,729

Webページへスクリプトを組み込み、自然言語でそのページのGUIを操作できるTypeScript製in-page agent。

今月の勢い
+8,181 stars / 月
なぜ今注目されたか
汎用ブラウザ自動化に加え、ページ提供者自身が制御範囲を持つ“埋め込み型GUIエージェント”という実装単位が評価された。
トレンド根拠: GitHub Trending(月間)
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Alibaba公式GitHub
🚀 急上昇Rust

n0-computer/iroh

累計 Stars11,740

IPアドレスではなく公開鍵で相手を指定し、QUICとNAT traversalをアプリへ追加するRust製P2Pライブラリ。

今月の勢い
+3,034 stars / 月
なぜ今注目されたか
複数端末のローカル協調やエッジ同期で、変動するIPとNATを隠蔽する接続層が必要になり、AI以外の基盤技術として月間トレンド入りした。
トレンド根拠: GitHub Trending(月間)
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: n0-computer公式GitHub

定番のGitHubプロジェクト(継続ウォッチ)

長期的に活用されている定番OSSを、具体的な用途アイデア付きで継続ウォッチ。

👑 人気🔍 注目🚀 急上昇
👑 人気Go
175k+

Ollama

ローカルLLMをワンコマンドで取得・実行する定番ランナー。OpenAI互換API・モデル管理で人気。

こんな用途に使える

  • Raspberry Pi・ミニPCでオフラインチャットボットを常駐
  • 社内文書Q&Aをローカルサーバーで提供
  • 複数モデルを切替えて性能比較する開発環境
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Ollama 公式GitHub
👑 人気C / C++
119k+

llama.cpp

LLMの超高効率C/C++推論エンジン。GGUF量子化でCPUでも軽量に動き、多くのローカル実装の土台。

こんな用途に使える

  • Raspberry Pi上でオフラインチャットボット構築
  • 社内文書Q&Aシステムをローカルサーバーで運用
  • IoTゲートウェイでの音声コマンド処理
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: llama.cpp 公式GitHub
🔍 注目TypeScript
16k+

Transformers.js

HuggingFaceモデルをブラウザで直接実行。100以上のアーキテクチャ、WebGPU加速でサーバー不要。

こんな用途に使える

  • ブラウザ完結の音声文字起こしツール
  • クライアントサイドで動くテキスト感情分析
  • 画像自動タグ付けのWebアプリ
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Transformers.js 公式GitHub
🔍 注目TypeScript
18k+

WebLLM

WebGPUでLLMをブラウザ実行。Llama, Qwen, Phi, Gemma等に対応。OpenAI互換API。

こんな用途に使える

  • 社内チャットAIをサーバーレスで提供
  • プライバシー重視の相談チャットボット
  • オフライン環境での技術文書検索アシスタント
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: WebLLM 公式GitHub
👑 人気C++ / JS
21k+

ONNX Runtime

クロスプラットフォーム推論エンジン。WebGPU/WASM/WebNN対応でCPU/GPU/NPUを抽象化。

こんな用途に使える

  • Windowsアプリに DirectML推論を組み込み
  • React NativeアプリでオンデバイスAI
  • ブラウザとサーバーで同じモデルを共有運用
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: ONNX Runtime 公式GitHub
👑 人気C / C++
51k+

whisper.cpp

OpenAI WhisperのC/C++移植。CPUだけで高速に音声認識でき、オフライン/組み込みASRの定番。

こんな用途に使える

  • Raspberry Piで常時稼働の議事録ボット
  • オフラインで動く多言語字幕生成システム
  • スマートスピーカー自作キットのASRエンジン
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: whisper.cpp 公式GitHub
👑 人気Python
58k+

Ultralytics (YOLO)

最新YOLO。検出・セグメンテーション・ポーズ推定・分類をワンパッケージで。TFLite/ONNX export可。

こんな用途に使える

  • 工場ラインの製品検査を低コストで自動化
  • 農業用ドローンの害虫・病害検出
  • 駐車場の空き状況リアルタイムモニタリング
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: Ultralytics (YOLO) 公式GitHub
👑 人気C++ / JS
35k+

MediaPipe

Googleのオンデバイス推論FW。顔・手・ポーズ・セグメンテーション等をリアルタイム処理。

こんな用途に使える

  • 店舗カメラで来客数・動線をリアルタイム分析
  • リハビリ用のポーズ判定アプリ開発
  • ジェスチャーで操作するキオスク端末
公開日:
記録なし
情報確認日:
実機: 当サイト未実機確認根拠: 公式情報・公称値出典: MediaPipe 公式GitHub

バックナンバー

過去のリソースまとめをアーカイブとして公開しています

2026-07最新

2026年7月号

7/16時点の7月号。Pixel TPUネイティブのGemma 4 E2Bとブラウザ向けLiteRT.jsで、端末内AIの配布先がスマートフォンからWebまで広がった。今号からモデル/フレームワークに加え、新技術・研究と、月間で勢いが出たGitHubプロジェクトを独立して追う。

モデル 7件 / 新技術 6件 / 月間トレンド 4件 / 定番プロジェクト 8

2026-06

2026年6月号

Liquid AIが最小の「LFM2.5-230M」(6/25、Pi5で42 tok/s)を投入し、超小型でエージェント実用という路線が一段進んだ月。Cohereの30B-A3Bローカル・コーディングや、Microsoft Edgeの端末内AI拡張など「ブラウザ/端末で完結」の動きも加速した。

モデル 7件 / プロジェクト 9

2026-05

2026年5月号

フロンティア大型モデルが小休止し、アーキテクチャ(特にMoEと非Transformer)でエッジを攻める月に。ZyphraのZAYA1-8B(AMD学習・高密度MoE)とLiquid AIのLFM2.5-8B-A1B(オンデバイスMoE)が「実効1〜1.5Bで大型並み」という小型・高効率の潮流を象徴した。

モデル 7件 / プロジェクト 10

2026-04

2026年4月号

Google Gemma 4(E2B/E4B、この規模で初の音声入力対応・Apache 2.0)が4/2に登場し、月末にはIBM Granite 4.1(3B/8B+音声)とNVIDIA Nemotron 3 Nano Omni(4モーダル)が続いた。エッジが「オムニ多モーダル化」と「Apache 2.0での実務投入」へ同時シフトした月。

モデル 7件 / プロジェクト 10

2026-03

2026年3月号

Alibabaが「Qwen3.5 小型シリーズ(0.8B〜9B)」をApache 2.0で一挙投入し、端末で動く高品質SLMが一気に底上げ。Cohere初のオープンASR、Mistralの軽量TTS、Z.aiの0.9B OCRと、音声・視覚の軽量モデルが出そろった月。

モデル 7件 / プロジェクト 8

2026-02

2026年2月号

3B級の高性能化が鮮明(Nanbeige4.1-3B 2/13・Apache, Cohere Tiny Aya 2/17・70+言語)。超軽量オンデバイス音声(Moonshine v2 34M ブラウザASR, Kitten TTS mini-0.8 80M WASM, Voxtral-Mini-Realtime 日本語対応)が充実し、「$10ボード・256MBで1B LLM」のpicolmがトレンド入りした月。

モデル 8件 / プロジェクト 10

2026-01

2026年1月号

Liquid AI LFM2.5シリーズ(1.2B/日本語JP/VL-1.6B/Audio-1.5B, 1/5)とThinking(1/20)が集中投入。Raspberry Pi AI HAT+ 2(Hailo-10H・40 TOPS・8GB・$130, 1/15)でPi 5の生成AIが現実に。CES 2026で新シリコンも続出した月。

モデル 8件 / プロジェクト 9

2025-12

2025年12月号

Mistral 3(Ministral 3 3B/8B/14B・Apache 2.0・画像対応, 12/2)とZ.aiのGLM-ASR-Nano-2512(1.5B・Whisper-v3超え, 12/8)を筆頭に小型ASR/TTSが続々。ハード面では1GB版Raspberry Pi 5が$45で登場した月。

モデル 8件 / プロジェクト 10

2025-11

2025年11月号

「オンデバイス・エージェント」と「1B級OCR-VLM」が同時噴出。画面を見て操作するMicrosoft Fara-7B/H Company Holo2、1Bで完結するTencent HunyuanOCR、完全オープンなAi2 Olmo 3、表現力TTSのMaya1が出揃った。

モデル 7件 / プロジェクト 10

2025-10

2025年10月号

「超小型でもブラウザ/スマホで動く」オープンSLM・VLMが一気に出揃った月。IBM Granite 4.0(&Nano)、Qwen3-VL小型版(2B/4B/8B)、DeepSeek-OCR、Jamba Reasoning 3Bが相次ぎ、GoogleはRISC-VベースのエッジAI NPU「Coral NPU」をOSS化。

モデル 8件 / プロジェクト 10

2025-09

2025年9月号

「超スパースMoEの小型化」と「サブ1Bの実用特化モデル」が同時噴出。Qwenが活性3B級のMoEを連投する一方、Google EmbeddingGemma(308M)、Meta MobileLLM-R1(950M)、IBM Granite-Docling(258M)など端末で動く小型モデルが続々。

モデル 7件 / プロジェクト 10

2025-08

2025年8月号

OpenAI gpt-ossとGoogle Gemma 3 270Mで「オープン超小型LLM」が出揃い、Apple FastVLM・Meta DINOv3でオンデバイス視覚も刷新、NVIDIA Jetson Thor発売でエッジ計算の上限も跳ね上がった月。

モデル 8件 / プロジェクト 10

2025-07

2025年7月号

SmolLM3-3B・LFM2・Phi-4-mini-flashなど3B級以下の高性能LLM/推論モデルに、Voxtral(ASR)やKyutai TTSの開放重み音声モデル、Hailo-10Hの一般販売が重なり、エッジでの生成AI実行が現実解になった月。

モデル 7件 / プロジェクト 9

2025-06

2025年6月号

端末内マルチモーダルのGemma 3nが正式公開。Qwen3 Embedding/Rerankerでエッジ向けRAG部品が出そろい、ERNIE 4.5の0.3BやKyutai STTなど小型OSSも相次いだ「オンデバイスAI充実」の月。

モデル 7件 / プロジェクト 10

2025-05

2025年5月号

Qwen3-0.6B、MedPsy-1.7B など超軽量LLMが続々登場。Gemma 4 Browser ExtensionでブラウザAIエージェントも現実に。

モデル 9件 / プロジェクト 10

更新履歴

2026-07-16
  • -7月号を公開。Gemma 4 E2B for Pixel TPU、LiteRT.js、Laguna XS 2.1、Cohere Transcribe Arabic、LeRobot v0.6.0を追加。
  • -モデル/フレームワークとは別に「新技術・研究ウォッチ」を新設し、HeteroMosaic、Voltron、HalluSquatting、Physical AI標準化などを掲載。
  • -「7月に注目が集まったGitHubプロジェクト」を新設。GitHub Trending(月間)の7/16スナップショットから、スター増加数と注目理由を定番OSSとは分けて掲載。
  • -一次論文の数値には査読前・著者報告であることを明記し、公式発表・公称値・当サイト実機確認を区別して表示。
2026-07-15
  • -Liquid AIが最小のLFM2.5-230M(6/25)を公開。Pi5で42 tok/s・S25 Ultraで213 tok/s、llama.cpp/MLX/vLLM/ONNX対応で端末完結エージェントを後押し。
  • -Cohereが初のエージェント型コーディングNorth Mini Code 1.0(6/9、30B総/実効3B MoE)をApache 2.0で公開。単一GPUで動作。
  • -Googleが拡散型テキスト生成DiffusionGemma 26B-A4B(6/10)を公開、非自己回帰の新生成パラダイムを提示(エッジ実装は今後)。経験則(要検証)。
  • -端末/ブラウザ基盤が前進:Microsoft EdgeがAion等の端末内SLMとWeb向けAI APIを拡張(6/2)、Ultralytics YOLO26もNMSなしE2E推論で更新継続。
2026-05
  • -ZyphraがZAYA1-8B(8.4B/実効760MのMoE、Apache 2.0)を5/6公開。AMD Instinctのみで一貫学習。
  • -Liquid AIが5/28にLFM2.5-8B-A1B(8.3B/実効1.5B、128K、10言語)を追加。GGUF/MLX版も同時公開。
  • -NVIDIAがエッジ推論ランタイムTensorRT-Edge-LLM(Jetson/DRIVE向け、C++)をOSS公開。
  • -HF春次レポート: 中国製モデルの月間DLが米国を逆転するなど、エッジ向け軽量モデルとAMD対応の拡大が鮮明に。経験則(要検証)。
2026-04
  • -Google Gemma 4(E2B/E4B/26B MoE/31B Dense)を4/2公開。E2B/E4Bはこの規模で初の音声入力対応マルチモーダルで、全サイズApache 2.0。
  • -IBM Granite 4.1(3B/8B+音声4.1/ビジョン)をApache 2.0で公開(4/29–30)。エッジ商用利用が明確で、日本語ASR/翻訳もカバー。
  • -NVIDIA Nemotron 3 Nano Omni(31B総/3B実効)が音声・映像・画像・テキストの4モーダルを統合(4/28)。
  • -Liquid AIが0.45BのLFM2.5-VL-450M(物体検出対応, 4/8)を投入。スマホ/Piで動く極小VLMが拡充。
2026-03
  • -Alibaba Qwen3.5 小型シリーズ(0.8B/2B/4B/9B)をApache 2.0で3/2公開。201言語・262K文脈・ネイティブマルチモーダルで、0.8BはRAM2〜3GBで動作。
  • -NVIDIA Nemotron 3 Nano 4B(3/16、Mamba-2/TransformerハイブリッドのGGUF)で端末ローカル実行が容易に。
  • -音声系が充実:Cohere初のオープンASR cohere-transcribe-03-2026(3/26、日本語含む14言語)とMistralの軽量TTS Voxtral-4B-TTS-2603(3/26)が登場。
  • -推論基盤が前進:llama.cppが3月に100K star突破、Ollama v0.19(3/30)がApple Silicon推論をMLX化。経験則(要検証)。
2026-02
  • -Nanbeige4.1-3B(3B/Apache, 2/13)とTiny Aya(3.35B/CC-BY-NC非商用, 2/17, 70+言語)を追加。
  • -超軽量ブラウザ音声: Moonshine v2(34-200M/MIT)、Kitten TTS mini-0.8(80M/Apache, WASM)。日本語対応のVoxtral-Mini-4B-Realtime・MioTTS-2.6Bも。
  • -機材: Raspberry Pi値上げ第2弾(2/2、Pi 5 16GB→$205)。新シリコンの大型発表はCESに前倒し。
  • -フレームワーク: ONNX Runtime 1.24.1(動的EPプラグイン)、OpenVINO 2026.0.0(NPU投機的デコード)、WebLLM 0.2.81。
2026-01
  • -LFM2.5ファミリー(Base/Instruct/JP/VL-1.6B/Audio-1.5B, 1/5)+Thinking(1/20)追加。日本語JP・Audio日本語版が当サイト向けに最重要。
  • -機材(CES 2026): NVIDIA Jetson T4000(Blackwell, 64GB, $1,999)、Qualcomm Dragonwing Q-8750(77 TOPS)、Raspberry Pi AI HAT+ 2($130, 1/15)。
  • -音声豊作: Qwen3-TTS/Qwen3-ASR 0.6B(日本語対応・約92-97ms)、Kyutai Pocket TTS(100M CPU専用)。
  • -フレームワーク: Ultralytics YOLO26(1/14)、HailoRT 5.2.0(Hailo-10H向けGenAI API)、ExecuTorch v1.1.0(1/27)。
2025-12
  • -Mistral 3 / Ministral 3(3B/8B/14B・Apache 2.0・画像対応, 12/2)追加。Transformers.js 3.8.1が即対応。
  • -小型ASR/TTSラッシュ: GLM-ASR-Nano-2512(1.5B/MIT)、Fun-ASR-Nano-2512(800M, 31言語)、VibeVoice-Realtime-0.5B、VoxCPM1.5(GitHub#1)。
  • -機材: Raspberry Pi 5 1GB=$45(12/1)。同時にLPDDR4不足で他SKUは値上げ。
  • -フレームワーク: llama.cpp ルーターモード(12/11)、OpenVINO 2025.4.0、vLLM 0.13.0(Whisper約3倍)。
2025-11
  • -完全オープンLLM Olmo 3(7B/32B、Base/Instruct/Think、Apache 2.0)追加。エッジ実機向けは7B Q4が現実的。
  • -オンデバイス・コンピュータ操作エージェントが台頭:Microsoft Fara-7B(11/24・MIT)とH Company Holo2-4B(11/13・Apache 2.0)。
  • -「1B級OCR-VLM」が本格化:Tencent HunyuanOCR(1B、11月)。10月のDeepSeek-OCR/PaddleOCR-VLに続く小型OCR競争の本命。
  • -音声系を強化:表現的TTSのMaya1(3B、11/11)と音声編集のStep-Audio-EditX(3B、11/12)。Baiduは ERNIE-4.5-VL-28B-A3B-Thinking も公開。
2025-10
  • -IBMが Granite 4.0(10/2、Mamba2ハイブリッド)と超小型 Granite 4.0 Nano(10/28、340M/1.5B、ブラウザ実行)を相次ぎ公開、いずれもApache 2.0。
  • -Qwen3-VLにエッジ向け小型dense版が追加(10/15に4B・8B、10/21に2B)、FP8版も同梱し小型VLMの選択肢が一気に拡大。
  • -小型OCR競争が過熱:DeepSeek-OCR(3B・MIT、10/20)、olmOCR 2、LightOnOCR-1B、PaddleOCR-VLが集中。LiquidもLFM2-VL-3Bを投入。
  • -ハードはGoogle Coral NPU(RISC-V・OSS、10/15)が目玉。AI21 Jamba Reasoning 3B・NeuTTS Air(CPUで声クローン)も登場。
2025-09
  • -Qwenが Qwen3-Next-80B-A3B(総80B/活性3B)と Qwen3-Omni-30B-A3B(音声・映像・テキストのオムニ、Apache 2.0)を一気に公開。MoE小型化が今月の主役。
  • -Googleが EmbeddingGemma(308M, 9/4)と VaultGemma(1B・差分プライバシー)を投入し、端末内埋め込みとプライバシーLLMを同時強化。
  • -Meta MobileLLM-R1(〜950M, 9/12)でサブ1B推論、IBM Granite-Docling-258M(9/17)で文書特化VLM、Apple FastVLMのブラウザ実機デモも話題化。
  • -ハードはQualcomm Snapdragon 8 Elite Gen 5(9/24・Hexagon NPU 37%高速化)。Moondream 3 preview(有効2BのVLM)も登場。
2025-08
  • -OpenAIが初のオープンウェイトgpt-oss-20b/120bをApache 2.0で公開(8/5)、MXFP4量子化で16GB級でも動作可能に。
  • -Google Gemma 3 270M(8/14)とNVIDIA Nemotron Nano 9B v2(8/18)で超小型〜小型の特化/推論系LLMが拡充。
  • -Meta DINOv3(8/13)とApple FastVLM/MobileCLIP2(8月)でオンデバイス視覚(バックボーン・VLM・画像埋め込み)が一斉更新。
  • -Kitten TTS(15M)やJan-v1-4B(ローカルWeb検索)など軽量プロジェクトが急増、NVIDIA Jetson Thorも発売(8/25)。
2025-07
  • -SmolLM3-3B(7/8)が学習データ混合・設定込みで公開、128K・6言語・思考モードを搭載。
  • -Mistral Voxtral(Mini 3B/Small 24B, 7/15)でWhisper超えの開放重みASRが登場、Devstral Small 1.1も更新。
  • -Liquid AI LFM2(350M/700M/1.2B, 7/10)とPhi-4-mini-flash-reasoning(3.8B, 7/9)でオンデバイスLLM/推論が高速化。
  • -Kyutai TTS+Unmute(7/3)がOSS化、Hailo-10H(7/22)一般販売でエッジ生成AIのソフト/ハード両面が前進。
2025-06
  • -Gemma 3n E2B/E4B を6/26フル公開: テキスト/画像/音声/動画の端末内マルチモーダル、約2〜3GBで動作。
  • -Qwen3-Embedding/Reranker(0.6B/4B/8B)を6/5公開: エッジRAGの埋め込み・再ランク部品、Apache 2.0。
  • -Baidu ERNIE 4.5 を6/30オープンソース化: 0.3B〜424Bの10モデル、Apache 2.0で商用可。
  • -Jan-nano(4B)・Kyutai STT(英仏ASR)・FLUX.1 Kontext [dev](12B画像編集)など小型OSSが続々。
2025-05
  • -Qwen3-0.6B、MedPsy-1.7B、DeepSeek-R1-Distill-Qwen-1.5B を新規追加
  • -Gemma 4 Browser Extension を急上昇に追加
  • -Phi-4-mini、Gemma 3-1B の情報を更新
  • -ハードウェア動向にQualcomm AI Engine(Snapdragon X)を追加