WHISPER ENGINE ONLINE

CYBER TRANSCRIPTION REALTIME VOICE ENGINE

「サイバートランスクリプション」は、ブラウザだけで完結する次世代のリアルタイム音声文字起こしシステムです。
マイクの音声をWhisper large-v3-turboがその場で認識し、テキストへ変換。音声データは一切外部サーバーへ送信されず、Web Worker上でのローカル推論だけで処理が完結する、完全プライベートな文字起こしターミナルです。

Whisper v3-turbo ブラウザ内ONNX推論
Zero Upload 音声データ外部送信なし
No Login 登録不要・買い切り課金
16kHz MONO
WHISPER STT

SYSTEM FEATURES // 主な特徴

🎙️

ブラウザ完結のローカル音声認識

Whisper large-v3-turboをONNX形式でブラウザ内に展開し、Web Worker上で推論を実行。UIスレッドをブロックせず、マイクの音声データはデバイスの外に一切送信されません。

🧠

自然な発話区切りでの高精度認識

固定時間ではなく発話の「間(ポーズ)」を検知して音声をチャンク分割し、Whisperの30秒コンテキストに最適化。「ご視聴ありがとうございました」のような定番の空耳(ハルシネーション)も自動でフィルタリングします。

🔓

登録不要・買い切り課金

アカウント登録やサブスクリプションは一切なし。まずは無料で5回文字起こしを試せて、続けて使いたい場合のみStripe決済で¥100(税込)の買い切りライセンスを購入するだけのシンプル設計です。

MIC INPUT PREVIEW // 体験デモ端末

右側のプレビュー端末で、CyberTranscriptionの文字起こしの雰囲気を体験できます。 【MIC DEMO】ボタンをクリックすると、疑似波形エンジンがマイク入力を模したウェーブフォームを描き、Whisperエンジンが認識したテキストを1文字ずつ生成していきます。

  • 【MIC DEMO】ボタンをクリックしてエンジンを起動します。
  • 波形パネルがマイク入力を模してリアルタイムに変動します。
  • コンソールログに認識エンジンの進行状況が出力されます。
  • 実機では実際のマイク音声がWhisperでその場でテキスト化されます。
実機で無料文字起こしを試す(無料枠あり)
CYBER_TRANSCRIPTION_PREVIEW // PORT_04K
STATUS: READY
> CYBER TRANSCRIPTION // WHISPER ENGINE v1.0 STANDBY

「サイバートランスクリプション」プレビュー端末です。【MIC DEMO】を押すと疑似波形とともに文字起こしのデモが再生されます。

TECHNICAL SPEC // 技術構成

CyberTranscriptionはNext.js + React製のクライアントサイド・音声処理パイプラインと、Netlify Functionsによるサーバーレスな決済処理を組み合わせ、サーバーコストを抑えつつ音声データを一切サーバーに送らない構成で動作しています。

MIC CAPTURE
getUserMediaで音声取得し、自然な発話ポーズでチャンク分割。
RESAMPLE 16kHz
Whisperが要求する16kHzモノラルへリアルタイム変換。
WHISPER WORKER
large-v3-turboをWeb Worker上でONNX実行し、UIをブロックしない。
STRIPE CHECKOUT
Netlify Functionsがワンタイム決済セッションを発行・検証。

Next.js 16 + React 19 + Web Worker

録音・波形処理を担うUIコンポーネントと、Whisperモデルのロード・チャンク推論を行うロジックをWeb Workerとして明確に分離。すべての推論はブラウザ内で完結し、音声データが外部サーバーへ送信されることはありません。

Stripe + Netlify Functions

買い切りライセンスの決済はStripe Checkoutで処理し、Netlify Functions上のサーバーレス関数が決済セッションの発行・検証を担当。利用回数と購入状態はブラウザのlocalStorageに保存され、余計な個人情報を保持しません。

PRICING // ライセンス料金

フルアクセスライセンス
UNLIMITED TRANSCRIPTION ACCESS
¥100 (税込)
買い切り / 月額固定費なし
  • 無料利用(5回)の上限を完全に解除
  • 録音時間を気にせず何度でも文字起こし
  • ワンクリックでのテキストコピー機能
  • Stripeによる安全なワンタイム決済
アプリを起動してライセンスを購入する

FAQ // よくある質問

Q: 無料で何回使えますか?

ブラウザごとに5回まで無料で文字起こしできます。上限に達すると、¥100(税込)の買い切りライセンスを購入することで無制限に利用できるようになります。

Q: 録音した音声はサーバーに送信されますか?

いいえ。音声認識はすべてブラウザ内のWeb Worker上でWhisperモデルを実行することで完結しており、音声データが外部サーバーへ送信されることはありません。

Q: 日本語の認識精度はどのくらいですか?

軽量なwhisper-baseモデルは日本語の精度が不十分なため採用せず、large-v3のエンコーダをそのまま活かしつつデコーダを4層に軽量化した「whisper-large-v3-turbo」を採用しています。精度とブラウザ内での速度のバランスを重視した構成です。

Q: アカウント登録は必要ですか?

不要です。利用回数や購入状態はブラウザのlocalStorageに保存される仕組みのため、メールアドレスやパスワードの登録なしでそのまま利用できます。ブラウザや端末を変更すると無料利用回数はリセットされます。

Q: スマートフォンでも使えますか?

はい、Chrome や Safari などの標準的なモバイルブラウザで動作します。ただし初回はWhisperモデル(数百MB)のダウンロードが発生するため、Wi-Fi環境でのご利用を推奨します。