9月24日木曜日の夜、Zoomの打ち合わせを終えた直後にこのニュースを読んだ
9月24日、木曜日の夜9時。福岡のクライアントとのZoom打ち合わせを終えて、コーヒーを一口飲んだところで、スマホに1本のニュースが流れてきた。「Googleが、顔を持つAIの受付を発表した」。読んだ瞬間に頭に浮かんだのは、さっきまで画面越しに話していた店主の顔だった。その店は電話とInstagramのDM、両方の対応に追われていて、打ち合わせの最後に「もう1人、受付だけしてくれる人がいたら」と漏らしていたばかりだった。
この記事で書くのは、2026年9月24日にGoogleが発表した「Gemini 3.8 Live with Live Avatar(ジェミニ・スリーテンエイト・ライブ・ウィズ・ライブ・アバター)」が何なのか、そして、これまでManyChat(マンチャット、Instagramの自動返信を組む仕組み)の構築を125社で重ねてきたSUICSが、この「顔のある接客」と、今使われている「文字の接客」をどう線引きして考えるかだ。結論から言うと、今日すぐに契約する話ではない。ただし、自分の店のどの部分を任せたいかを言葉にしておくことは、今日からできる。
その打ち合わせで話していた店主は、開店から2年、電話とInstagramのDMを1人で両方さばいてきた。忙しい時間帯は電話が鳴っている間にDMの返信が止まり、DMに気を取られている間に電話を逃す、という状態がずっと続いていた。「顔のあるAI受付」というニュースの見出しだけを見ると、この状態を一気に解決してくれそうに読める。だが、記事を読み進めるほど、今すぐの話ではないことが分かってきた。何が本当に発表されて、何がまだ先の話なのか、公式の発表元まで戻って確認する。
何が発表されたのか——顔と声を持つAIが、97の言語で受け答えする
Google公式ブログ(2026年9月24日付)とGoogle Cloud公式ブログによると、発表されたのは「Gemini 3.8 Live with Live Avatar」という仕組みで、企業向けのAI活用プラン「Gemini Enterprise(大企業がAIをまとめて契約できるGoogleのプラン)」の中で使えるようになった。画面に映る顔(アバター、人の代わりに話すCGのキャラクター)が、話す内容に合わせて口の動きと表情を合わせながら、その場で受け答えする。対応する言語は97言語で、会話の途中で言語が切り替わっても、映像が乱れずに自然に対応すると説明されている。
用意されている顔は2種類ある。Googleがあらかじめ用意した「既製の顔」は、企業がそのまま選んで使える。一方、自分の会社専用の顔を一から作る「カスタムの顔」は、公式ドキュメントに「現時点では許可制(allowlist)」とはっきり書かれていて、Googleの許可を受けた企業だけに限られている。想定する使い道として公式が挙げているのは、保険の請求受付、中古車販売サイトAutotraderでの車選びの相談、コールセンターでの電話対応(Equal AIという会社が1日100万件を超える電話をこの仕組みで処理していると紹介されている)、ホテルのチェックインのような複数の手続きが必要な場面だ。料金は公開されておらず、Googleの料金ページで個別に確認する形になっている。現時点ではアメリカとヨーロッパ向けの提供拠点から始まっており、日本国内での提供体制については今回の発表で明記されていない。なお、映像には「SynthID」という透かしが入っていて、本物の映像と見分けがつくようにする仕組みも同時に用意されている。
もう1つ、公式発表で見落とせない点がある。この仕組みは、顧客対応の管理に使う「Salesforce Agentforce」という大手企業向けの仕組みとつなげて使う例も紹介されている。つまり、今回の発表は「AIの顔だけ」を単体で売り出したものではなく、すでに大企業が使っている顧客管理の仕組みに、顔のある応対を後から足す形で組み込まれている。個人事業主が使っているLINE公式アカウントやManyChatのような、もっと軽い仕組みとは、今のところ土俵そのものが違う。
個人事業主が今日決めておく3つの線引き
発表の内容を見る限り、今回の主役はカスタマーサポートの担当者を何十人も抱える大企業だ。それでも、店主が今日決めておけることはある。以下の3つに分けて考える。
まず数えるのは、今日の会話の人数だ。
今日からできることは、契約ではなく言葉にすること
9月24日の発表は、保険の受付や車の販売店、コールセンターといった、担当者を大勢抱える企業向けのニュースだ。個人事業主の店にすぐ関係する話ではない。それでも、「文字」「音声」に続いて「顔」という3つ目の応対の形が現実になったこと自体は覚えておいていい。今日やるべきなのは、Gemini Enterpriseに申し込むことではなく、自分の店の接客のどの部分を、いずれ顔のある自動応対に任せたいのか、逆にどの部分は自分の声や言葉で対応し続けたいのかを、先に言葉にしておくことだ。福岡の美容室の例のように、まず数字を見る。その数字が見えてはじめて、次に来る仕組みをどう使うかの判断ができる。
Zoomで話していた店主にも、この3つの線引きをそのまま伝えた。「顔のAIを入れましょう」ではなく、「まず今月、電話とDMがそれぞれ何件来たか数えてみましょう」というところから始める提案だ。数える前は「電話がずっと鳴っている感覚」だったが、実際に数え始めると、鳴っている時間帯が朝の9時台と昼の12時台に偏っていることが見えてくるかもしれない。偏りが見えれば、その2つの時間帯だけ自動応対に任せる、という小さな一歩も選べるようになる。顔のあるAIを待つ前に、今の道具でもできることは意外と多い。