WebGPU

ブラウザAI・モデル配布

Transformers.jsのdtype・device・キャッシュを整理|モデル読込失敗を減らす

量子化方式、実行デバイス、キャッシュは別の設定です。役割を分けて安全な読込処理を作ります。
ブラウザAI・性能改善

ONNX Runtime Webの遅さを推測で直さない|CPU・WebGPUプロファイル入門

ブラウザAIが遅い原因を、モデル取得、セッション作成、初回推論、演算実行に分けて確認します。
WebGPU・性能計測

WebGPUのtimestamp-queryでGPU処理時間を測る|CPU時間との違いも解説

JavaScriptの待ち時間とGPUコマンドの実行時間を混同せず、対応端末だけで安全に計測します。
WebLLM

ブラウザだけで生成AIが動く「WebLLM」とは?仕組みとできることを解説

Webページを開くだけで、なぜ生成AIを動かせるのでしょうか。MLC-AIが開発するWebLLMの仕組みと、Webアプリ開発でできること、端末性能やプライバシー面の注意点を解説します。