ブラウザ内で動くAI

AIに質問する

日髙悠太について、なんでも聞いてください。ブラウザ内で動く小型AIモデルが答えます。モデルは初回だけ読み込み、以降はブラウザにキャッシュされて再ダウンロード不要です。ダウンロード不要で、LLMを使わず即答する「LLM利用なし」も選べます。

WebGPU で高速動作

仕組み

サーバーもAPIキーも使いません。すべてあなたのブラウザの中で動きます。

モデル(選択可)

TinySwallow 1.5B / Qwen2.5

Sakana AI / Alibaba ↗

日本語が得意な Sakana AI の TinySwallow-1.5B(約0.9GB・TAID蒸留・既定)か、軽量な Qwen2.5-0.5B を選べます。TinySwallow は WebGPU 対応の PC ブラウザ向けで、スマホ(iPhone Safari 等)では自動的に、llama.cpp で動く省メモリの Qwen2.5-0.5B(約0.4GB・GGUF)に切り替わります。モデルは初回だけ読み込み、以降はブラウザにキャッシュ。ダウンロード不要の「LLM利用なし」も選べます。

実行環境

transformers.js / WebLLM · WebGPU

Hugging Face · ONNX / MLC

モデルの重みは量子化済み(2〜4bit)。数GB級のモデルを約0.5〜0.9GBに抑えているので、これ以上の圧縮は効きません。1.5B級は WebLLM(MLC・WebGPU専用・Sakana 公式デモと同構成)、軽量版は transformers.js(ONNX)と wllama(llama.cpp WASM)で動作。初回だけ Hugging Face から読み込み、以降はブラウザにキャッシュ(再DL不要)。Web Worker 上なので UI は固まりません。

グラウンディング

検索 + 事実照合

RAG + verify

質問に関連する経歴データだけを検索して根拠に渡し、生成後は固有名詞・数値・学歴などを照合。裏づけの取れない記述は表示せず、経歴データそのものに差し替えます。

静的サイト(Astro)/サーバー送信なし/APIキーなし