Audio to Text Converter Free — FreeAudioToText Pro LogoFreeAudioToText
全必須AIモデルを内蔵。データ漏洩リスクゼロ。

機密音声のためのエアギャップ AI 文字起こし

100% オンプレミス。音声データがネットワーク外に出ることはありません。実稼働環境に対応した文字起こしサーバーをご自身のインフラにデプロイ。インターネット接続は一切不要です。

21GBのDockerイメージ · アカウント登録不要 · 組み込みのデモモード付き(キーなしで1ファイルあたり最大3分まで文字起こし可能)。

View Deployment Guide
FreeAudioToText Enterprise UI with Speaker Diarization
REST API による統合

Integrate with Zero Cloud Dependencies

自社の内部ツールに文字起こし機能をすぐに追加できます。

Terminal
curl -X POST http://localhost:8000/api/upload \
-H "Authorization: Bearer YOUR_TOKEN" \

// Response (JSON)
{
"job_id": "job_9f8b2c1",
"status": "processing",
"estimated_time": 45
}

エアギャップ・アーキテクチャによるセキュリティ

外部ネットワーク通信なし

コンテナは推論のためにインターネットアクセスを必要としません。

全モデルのバンドル

必要なすべてのAIモデル (21GB) がイメージに含まれています。実行時のダウンロードはありません。

オフライン・アクティベーション

ライセンスのアクティベーションは、本番サーバーをインターネットに接続することなく完了できます。

      YOUR COMPANY NETWORK
┌──────────────────────────────┐
│                              │
│  Employee / Internal App     │
│      │                       │
│      ▼                       │
│  FreeAudioToText Docker      │
│      │                       │
│      ├── AI Models           │
│      ├── Speaker Diarization │
│      └── Local Processing    │
│                              │
│      NO INTERNET REQUIRED    │
│            ✕                 │
└──────────────────────────────┘

チームに必要なすべてを搭載

自動話者識別(ダイアライゼーション)

同じ録音内の複数の話者を検出し、分離します。最大10人の話者を含む録音で検証済み。

100% エアギャップ対応

すべての推論(AI処理)はインフラストラクチャ内で実行されます。外部APIへの依存やクラウドへのアップロードは一切ありません。

プロダクション環境向けに構築

Dockerがサポートされている環境ならどこでも動作します。本番環境でのデプロイにはLinuxを推奨します。NVIDIA CUDAまたはApple Siliconを自動的に利用して、高速な推論を実現します。

開発者向け REST API

OpenAPI/Swaggerドキュメント付きのREST API。文字起こしと話者データを既存の社内ワークフローに統合できます。

技術仕様(Technical Specifications)

デプロイ方式Docker コンテナ (Linux / macOS / Windows)
ネットワーク100% エアギャップ。推論のための外部インターネット通信は不要です。
AI モデルWhisper large-v3-turbo (音声認識) + CAM++ (話者識別) を内蔵
GPUNVIDIA CUDA (推奨) / Apple Silicon MPS
メモリ (RAM)最小 16GB、推奨 32GB
ストレージ最小 40GB (SSDを強く推奨)

ビジネス セルフホスト版

1回限りの支払いによるライセンス。月額料金や分単位の課金はありません。

$999/ one-time
  • 1台のプロダクションサーバー
  • 社内での利用人数・文字起こし無制限
  • 完全な話者識別 & REST API
  • 12ヶ月のアップデートと優先サポート
ビジネスライセンスを購入

🔒 即時ライセンス発行 · Stripe セキュア決済 · 銀行振込 / 請求書払い対応

エンタープライズ

複雑なコンプライアンス要件を持つ大組織向け。

営業にお問い合わせ
  • 複数サーバー構成 & HA(高可用性)
  • SLA および SSO 統合
  • カスタムデータ保持ポリシー & 監査ログ
  • セキュリティドキュメント & 調達サポート
Contact Sales

よくある質問

音声がクラウドに送信されることはありますか?

いいえ。すべての推論(AI処理)はお客様のハードウェア上で完全にローカルに行われます。Dockerコンテナは、サードパーティの文字起こしエンドポイントに対して外部ネットワークへの呼び出しを一切行いません。

サーバーには何人のユーザーがアクセスできますか?

ビジネスライセンスでは、社内の従業員が Web UI または社内アプリを通じてサーバーにアクセスする際の人数に制限はありません。

最初の1年を過ぎるとどうなりますか?

永久ライセンスの有効期限が切れることはありません。ソフトウェアを永久に使用し続けることができます。最初の12ヶ月以降も継続してアップデートとサポートを受けたい場合は、オプションとして年間$249で更新できます。

オフラインでのアクティベーションはどのように機能しますか?

ハードウェア指紋システムを使用しています。サーバー上でハードウェア指紋を生成し、インターネットに接続されたデバイスからアップロードすると、署名済みの license.key ファイルが送られてきます。これをエアギャップサーバーに配置します。

インストール後にサーバーはインターネット接続を必要としますか?

いいえ。Dockerイメージとライセンスがインストールされた後は、文字起こしと推論はインターネット接続なしで完全にオフラインで実行されます。

Ready to secure your company's audio data?

Take 100% control of your sensitive audio transcription. Deploy locally in minutes.

21GBのDockerイメージ · アカウント登録不要 · 組み込みのデモモード付き(キーなしで1ファイルあたり最大3分まで文字起こし可能)。