GeeXai(東京都練馬区、秋元 博代表取締役)は9月30日、AIキャラクターとの対話プラットフォーム『Vtkool(ブイツクール)』で、双方向の音声対話の提供を始めた。OpenAIのリアルタイム音声モデル『GPT-Live-1』を新たに取り入れたもので、キャラクターが話している最中に利用者が口を挟んだり言い直したりしても、会話が途切れないのが特徴だ。Web接客や教育、ヒアリングでの活用を想定している。

『Vtkool』は、Live2DやVRM形式のアバターと生成AIを組み合わせ、Webサイト上で音声やテキストによる対話の場を提供してきた。ただ、音声認識、回答生成、音声合成を順に処理する方式には、いくつかの制約があった。利用者が話し終えるまでAIは応答できず、回答ができるまで無音の時間も生じるほか、キャラクターの反応が発話とずれることもあった。こうした点で、会話としての自然さに欠けることが課題だったという。
『GPT-Live-1』は、OpenAIが2026年9月10日にAPIで公開したリアルタイム音声モデルだ。このモデルを取り入れたことで、『Vtkool』のキャラクターは利用者が割り込むと話を止めて耳を傾け、聞いている間は「なるほど」などの短い反応を返す。トーンや話すペース、会話スタイルはキャラクターごとに調整でき、案内役や相談員、インタビュアーなど役割に合った話し方を設定できる。すぐに答えられない質問では、キャラクターが会話をつないでいる間にナレッジ検索(RAG)や外部ツールが回答を用意し、その結果をキャラクター自身の言葉で伝える。
こうした音声対話に、表情・モーション・リップシンクによるアバター表現と、『Vtkool Agent』による知識・シナリオ・ツールの連携を組み合わせている。専門知識がなくてもWebサイトに設置できるのも利点だ。
活用場面としては、FAQ検索では拾いにくいあいまいな購入相談への応対、問いかけで学習者の考えを引き出す学習支援、追加質問を重ねて本音や背景を聞き出すインタビューなどが挙げられる。Web接客や教育・研修の分野では、法人向けの実証実験も実施する方針だ。