Speko
複数のプロバイダーにまたがる音声ベースの Agent を構築、ルーティング、運用するための音声 AI インフラプラットフォーム。
コミュニティ:
製品概要
Spekoとは?
Speko は、本番環境の音声 Agent 向けの開発者プラットフォームです。音声認識(STT)、言語モデル(LLM)、音声合成(TTS)のプロバイダーを単一 API に統合するホスト型ルーターを提供し、言語、レイテンシ、コスト、可用性に基づいてプロバイダーを選択します。さらに Speko は、ブラウザおよび電話向けのマネージド音声 Agent、プロバイダー直結ワークロード向けのオープンソース Gateway、TypeScript および Python の SDK、Agent 支援による開発・運用のための MCP ツールも提供します。
主な機能
マルチプロバイダー音声ルーティング
STT、LLM、TTS のリクエストを統一 API 経由でルーティングし、個別の統合を維持することなく複数の音声プロバイダーをアプリケーションで利用できるようにします。
ベンチマークに基づくモデル選択
言語ごとの精度、レイテンシ、料金のベンチマークを用いて、各ワークロードに適した音声・ボイスモデルを選択します。
自動フェイルオーバー
プライマリプロバイダーに障害が発生した場合、代替プロバイダーでリクエストを再試行し、サービス障害時にも音声アプリケーションの可用性を維持します。
マネージド音声 Agent
プロンプト、ボイス、ツール、ナレッジソース、ルーティング設定、デプロイ設定を備えた再利用可能な音声 Agent をチームが構成できるようにします。
ブラウザおよび電話への展開
ブラウザ上での会話に加え、着信・発信の電話通話でも同じ音声 Agent を実行できます。
開発者向け統合
TypeScript、Python、ブラウザ、LiveKit の SDK と MCP サポートを提供し、音声 Agent の構築、テスト、デプロイ、検証を行えます。
ユースケース
- カスタマーサポート音声 Agent : 顧客からの質問に答え、ナレッジソースにアクセスし、通話を転送し、対応結果を記録する電話またはウェブ音声アシスタントを構築します。
- 多言語音声プロダクト : 対象言語で優れた性能を発揮するモデルにリクエストをルーティングしながら、複数言語にまたがる音声体験を提供します。
- 音声プロバイダーの信頼性 : 対応プロバイダー間でのルーティングとフェイルオーバーを活用し、単一の STT・LLM・TTS ベンダーへの依存を軽減します。
- 音声 Agent のプロトタイピング : マネージド設定、SDK、事前構築済み統合を利用して、対話型音声 Agent を迅速に立ち上げ、評価します。
- プライベート音声インフラ : 認証情報とメディアフローの管理を保持しながら、Gateway を使ってプロバイダー直結のストリーミングワークロードを実行します。
- Agent 支援による音声開発 : MCP 対応のコーディングツールを使い、AI 開発環境から音声 Agent の作成、デプロイ、テスト、管理を行います。
よくある質問
Spekoの代替品
Layercode
マネージドリアルタイム音声パイプラインを通じて完全なバックエンド制御を提供する、低遅延音声AI Agentの構築・デプロイ用開発者プラットフォーム。
LiveKit
エンタープライズグレードインフラストラクチャを備えたリアルタイム音声、ビデオ、物理AIアプリケーション構築のためのオープンソースフレームワークとクラウドプラットフォーム。
Voiceflow
ノーコードでAI搭載の音声・チャットエージェントを設計・構築・展開できる、共同作業対応のプラットフォーム。高いカスタマイズ性とマルチプラットフォーム対応が特長です。
Bland AI
さまざまな業界向けに、超リアルで安全かつスケーラブルな電話自動化を実現するセルフホステッドAIコミュニケーションプラットフォームです。
Synthflow AI
ノーコードでカスタマイズ可能なAI音声エージェントを作成し、自然な会話で発信・受信通話を自動化するプラットフォームです。
Bolna AI
人間らしいVoice AIフロントデスクエージェントを迅速に構築し、電話対応や顧客対応を自動化できるオープンソースプラットフォームです。
Dograh
カスタマイズ可能な電話・リアルタイム音声ワークフローを構築・デプロイ・運用するためのオープンソース音声エージェントプラットフォーム。
Zoey OS
タスクを調整し、連携したツール全体で行動できる専門コンパニオンチームを構築するための、音声ファーストのワークスペースです。

