自動化された WhatsApp 音声通話ワークフローを構築し、テキストまたは音声で話し、着信通話を ElevenLabs 音声エージェントに接続します。

WhatsApp の自動化はメッセージだけに限定されなくなりました。 Impresiv AI の新しい WhatsApp Personal 呼び出しアクションを使用すると、メッセージやビジネス プロセスに既に使用しているものと同じビジュアル ビルダーを使用して、ワークフローで音声通話の発信、応答、管理を行うことができます。
生成されたテキストを話したり、オーディオ ファイルを再生したり、ElevenLabs 会話エージェントにライブ コールを接続したりできます。着信通話によってワークフローがトリガーされ、応答する前に AI エージェントに必要なコンテキストとツールが提供されることもあります。
WhatsApp 音声通話は現在実験中です。顧客との通話に使用する前に、接続されたデバイスでワークフローをテストします。
WhatsApp Personal ノードは以下をサポートするようになりました。
通話結果には、通話 ID、通話時間、完了状態、通話を終了した人、ElevenLabs 会話 ID、および会話トランスクリプトが含まれる場合があります。これらの出力は、ログ記録、フォローアップ メッセージ、CRM 更新、概要、ルーティングのために後のノードに渡すことができます。
最も単純な受信音声エージェント ワークフローでは、2 つのノードを使用します。
ワークフローが呼び出しを受け付けたときに呼び出しがまだ鳴っている必要があるため、アクションはトリガーの直後に実行する必要があります。
WhatsApp Personal ノードで ElevenLabs 会話エージェントを作成または選択します。信頼性の高い双方向音声を実現するには、次のようにエージェントを構成します。
最初のメッセージのオーバーライド、動的変数、最大通話時間を指定することもできます。動的変数は、顧客名、注文番号、予約の詳細、またはその他のワークフロー コンテキストを会話に渡すのに役立ちます。
たとえば、以前の CRM ノードは発信者を見つけて、通話が開始される前にそのプロファイルを音声エージェントに渡すことができます。
このアップデートは、アクションを起こすことができる会話向けに設計されています。音声エージェントをワークフローの残りの部分に接続して、次のことを行うことができます。
呼び出しはインターフェイスであり、ワークフローはその背後にあるメモリ、データ、アクションを提供します。
音声通話アクションの費用は 10 秒あたり 1 クレジット (切り上げ):
| 通話時間 | クレジット |
|---|---|
| 1~10秒 | 1 |
| 11~20秒 | 2 |
| 21~30秒 | 3 |
| 60秒 | 6 |
通話を設定する際、ノードにはこの価格が表示されます。ワークフロー ワーカーは、完了した通話時間から最終コストを計算します。
ワークフロー ビルダー を開き、WhatsApp Personal を追加し、新しい音声通話アクションの 1 つを選択します。着信通話の場合は、Incoming Voice Call トリガーから始めて、Accept Incoming Call with Voice Agent に直接接続します。
WhatsApp 番号では、返信以上のことができるようになりました。聞いて、話し、文脈を理解し、残りの自動化を通じて作業を続行できます。