AI推論ガイド
ウェブブラウザでの推論
ブラウザベースのAI推論
対応するモデルは、WebGPUまたはWebAssemblyを通じてブラウザ内で動かせます。これによりリモートへのデータ転送とAPIのコストを減らせるほか、テレメトリとリモートへのフォールバックを無効にしたうえで必要なアセットをすべてキャッシュすれば、オフラインでも動作します。デバイスのメモリ、起動時間、消費電力、モデルのライセンスは引き続き制約になります。
主な特徴
WebGPUによる高速化
OpenAI互換のAPI
ローカルで実行
ブラウザとデバイスごとにベンチマーク
npm install @mlc-ai/web-llm主な特徴
ローカル実行の選択肢
WebGPUによる高速化
推論APIが不要
アセットのキャッシュ後はオフライン対応
npm install @browserai/browserai主な特徴
ブラウザ横断で動作
WebAssembly SIMD
WebWorker対応
ハードウェアに依存するスループット
対応プラットフォームはベンダーのSDKドキュメントを参照互換性は実行時に確認するもの
ブラウザ、OS、GPU、ドライバ、セキュアコンテキスト、企業ポリシーの対応状況は変化します。ブラウザ名だけで利用可否を判断せず、対象となるデバイスの組み合わせを実際に試し、サーバーまたはCPUへのフォールバックを用意してください。
WebGPUの確認
実行時に navigator.gpuを確認し、アダプターとデバイスを要求し、デバイスのロストに対応し、リソースの上限を課します。
WebAssemblyの確認
SIMDとスレッドは機能検出で確認します。スレッド対応のランタイムは、クロスオリジン分離を必要とする場合もあります。