📺 Voice Agent observability with LangSmith
Google ADKとGemini Liveで構築した音声エージェントを対象に、LangSmithへトレースを設定して内部動作を可視化する手順を扱います。トレース設定と確認に焦点を当て、本番運用の全工程を扱うものではありません。Gemini Liveの音声処理の特徴を踏まえ、音声エージェントの可観測性の重要性を解説します。
■ Gemini Liveと音声エージェントの概要
- speech-to-speechで低遅延・自然な音声を実現
- Google ADKとGemini Liveで天気アシスタントを構築
- 時刻取得・天気取得の2ツールとプロンプトを設定
■ LangSmithによるトレース設定と確認内容
- ADK用LangSmithプラグインを定義しRunnerに登録
- ユーザー音声とエージェント音声を録音してトレースに付与
- 音声波形、文字起こし、ツール呼び出し、割り込み、コストを確認
音声エージェントの開発・運用に携わり、会話の可視化や評価に関心のある開発者向けです。トレース設定の流れと、LangSmith上で確認できる情報の概要を把握できます。
📄 このページの紹介文は AI が独自に生成したものであり、著作権をはじめとする他者の権利(商標権・名誉権・プライバシー等)を侵害しないよう配慮しています。動画の著作権は各作成者に帰属します。