Eclatira
Eclatiraは、ネイティブな音声対話、カメラによる視覚認識、OCR、リアルタイムの画面共有に対応したインタラクティブなエージェントを開発できる、音声・映像対話型AIプラットフォームです。
Eclatiraは、ネイティブな音声対話、カメラによる視覚認識、OCR、リアルタイムの画面共有に対応したインタラクティブなエージェントを開発できる、音声・映像対話型AIプラットフォームです。
製品の機能と公式な位置づけ
Eclatiraは、ネイティブな音声および視覚機能を備えた対話型人工知能エージェントを構築するためのインフラストラクチャおよび開発者向けプラットフォームを提供します。単一の双方向パイプラインを運用することで、エージェントは会話速度でのやり取り、割り込み処理、ならびに映像や画面共有の同時分析を実現します。
開発者は、自然言語によるビルダーまたはバージョニングされたREST APIを通じてエージェントを構築できます。プラットフォームはナレッジドキュメントのアップロード、カスタムツール定義、一括発信やブランド発信者IDなどの電話機能、さらには外部API、Model Context Protocol(MCP)、サードパーティ製アプリとの連携をサポートしています。
公式情報で確認できる活用例
対話型音声会話とライブカメラまたは画面共有を組み合わせ、視覚的なトラブルシューティングを案内しながら顧客をサポートします。
電話回線やWebウィジェット経由の組織宛ての着信通話を処理し、自動回答の提供や問い合わせの管理を行います。
リアルタイムの対話型音声会話を通じて見込み顧客とやり取りを行い、情報収集や条件の評価を実施します。
公式情報に記載された利用手順
ビジュアルビルダー内で自然言語を用いてエージェントの責務を記述するか、REST API経由でエージェントスキーマをプログラム定義します。
対話プロンプトの調整、参照ドキュメントのアップロード、エージェントの音声プロファイルの選択を行います。
機能ツールを定義し、エージェントを外部API、Model Context Protocol、またはサードパーティ製ソフトウェアアプリケーションに接続します。
Webウィジェット、電話接続、一括発信スケジュール、またはブランド発信者IDシステムを通じてエージェントを公開します。
Eclatiraは、個別の対話モデルやコンピュータビジョンモデルを別々に動かすのではなく、単一の双方向パイプラインを通じて音声と映像をストリーミングします。この統合アプローチにより、エージェントは映像フィード内の変化を認識し、会話の同期を保ったまま視覚情報について議論することが可能です。
映像エンジンは、800ミリ秒未満のレイテンシ予算内で、ライブカメラフィードと画面共有を最大毎秒30フレームで処理します。組み込みの光学式文字認識(OCR)によりラベル、画面、印刷ページから読み取り可能なテキストを抽出し、物体認識により物理的な製品やパッケージを検出します。
プラットフォームには2つの構成パスが用意されています。自然言語でプロンプトや音声を設計するインタラクティブなWebビルダーと、プログラムによるエージェント作成、ツール定義、ドキュメントアップロード向けに設計されたバージョニング対応のREST APIです。
エージェントは、開発者向けAPI、Model Context Protocol(MCP)、3,000以上のアプリケーションカタログを通じて外部システムと連携でき、電話接続やWebウィジェットでの展開において通話中の自動アクションを可能にします。
自分の素材とワークフローで確認したい項目
確認した情報源とその日時
情報源を確認した製品情報に基づく回答
Eclatiraは、単一の双方向セッション内でネイティブな音声対話、ライブカメラ映像、テキストチャット、およびリアルタイム画面共有をサポートしています。
音声と映像を単一の統合パイプラインで処理し、800ミリ秒未満のレイテンシ予算内で最大毎秒30フレームの視覚入力を解析して同期を維持します。
はい。光学式文字認識を用いてページ、画面、ラベルからテキストを読み取ることができ、画面内の物理的な物体、製品、パッケージも識別可能です。
エージェントビルダー内で自然言語を用いてタスクを記述して構築する方法と、バージョニング対応のREST APIを使用してプログラムから設定する方法があります。
Webウィジェット、電話チャネル、ブランド発信者ID、一括発信による展開をサポートし、外部APIやModel Context Protocol(MCP)との連携も提供します。