中量モデル(50〜200MB)
追加モデル容量が50〜200MBの区分です。実際の取得時間、キャッシュ方式、2回目以降の起動時間はデモとブラウザによって異なります。
公開中デモ
ロボットAI歩行シミュレーション
四足ロボットが強化学習で獲得した歩行ポリシー(ONNX)をブラウザ内で推論してAI歩行。Unitree Go1が実際に歩き、前進・旋回など速度も操作可。Go2のPD起立、DEEP Robotics Lynx M20(ホイール脚)も切替できるMuJoCo物理デモ
申し送り音声→介護記録
口頭の申し送りをブラウザ内Whisperで文字起こし→ブラウザAIで介護記録の様式に整形。音声は端末から出ない介護DX
書類の個人情報マスキング
書類の写真からAIが電話/メール/番号などの個人情報を自動検出して黒塗り。手動塗りも可。送信なし・端末内処理・無料
点検調書 音声ドラフト
現場の音声をブラウザ内のWhisperで文字起こしし、道路橋の点検項目を参考にした独自JSONの下書きへ構造化。正式様式への準拠を示すものではありません。オフライン確認は既存文字起こし結果の再構造化のみで、Whisper文字起こしの再実行は対象外です。判定は点検技術者が最終確認します。
AI音声合成
Kokoro AIモデルで高品質な音声を生成。88音声×9言語対応
奥行き推定
Depth Anything V2で画像から相対深度マップを生成し、端末内で比較・保存
物体検出+相対深度
物体検出と相対深度推定を組み合わせ、各物体の画面内方向と相対深度帯を表示
写真の寸法概算
写真内の既知寸法を基準に、同一平面上の長さを比例推定。AI相対深度から奥行き差の暫定目安も表示
AI画像セグメンテーション
SAM 3 Trackerで画像のインタラクティブセグメンテーション。クリックで物体を選択
画像理解AI
Florence-2でキャプション生成・物体検出・OCRなどマルチタスク画像理解
環境音AI検出
Audio Spectrogram Transformer (AST) で527種類の環境音をリアルタイム分類。マイクの音をAIが即座に判定
リアルタイム映像字幕AI
カメラ映像にWhisperベースのAI字幕をリアルタイム重畳。会議・講演・バリアフリー対応に
屋外広告物 巡回・違反検知AI(台帳照合)
沿道・商店街の写真から看板をブラウザ内AI(ゼロショット物体検出)で抽出し、サンプル許可台帳と照合。無許可の疑い・許可期限切れ・規格不適合の疑い・適合を透明なルールで判定し、巡回記録と2026年4月新様式準拠の安全点検報告書ドラフトまで作成。写真と台帳は端末内で処理。
指差呼称チェッカー(研修・記録補助)
「見る→指す→呼称」のうち指す+呼称を、ブラウザ内のAI(MediaPipe+Whisper)で時系列採点する研修・記録補助ツール。模擬設備10シナリオで指差と発話の順序・内容を判定。映像・音声は端末外に送信されません。
端末内視覚メモリ
選んだ物を2段階追跡し、外観特徴と個体マーカーを併用。生映像を保存せず、個体ID・最後の相対位置・時刻と履歴管理情報を端末内に記録