「消えていくコンピューター」とは何か?
今回のOff Topicは、AIや新しいデバイスが次々に登場するなかで、「次のインターフェースとは何か」を考える回です。宮武さんは、複数回にわたるテーマの初回として、まず「インビジブルコンピューター」という概念から話を始めます。
収録は事前に行われており、宮武さんは、この回が公開される頃にはAppleの新しいヘッドセットがおそらく発表されているだろうと話します。ただ、その内容は収録時点では含められないため、ヘッドセット抜きでインターフェースの話を進めるとしています。
「インビジブルコンピューター」の出発点は、テックジャーナリストのウォルト・モスバーグ ── アメリカの著名テックジャーナリスト。ウォール・ストリート・ジャーナルで長年個人向けテクノロジーのコラムを担当し、テック業界に大きな影響力を持ちましたさんが引退前に書いた最後の記事『The Disappearing Computer』です。モスバーグさんはウォール・ストリート・ジャーナルで書き、Recodeを創業し、The Vergeのエグゼクティブエディターも務めた人物だと紹介されます。
モスバーグさんの記事が書かれたのは2017年で、iPhoneの登場から10年が経ったタイミングでした。当時はAmazon、Google、Appleがスマートホームなどの領域でAIアシスタントの競争を始めていた時期でもあります。
モスバーグさんの予想は、テックデバイスがどんどん背景に退き、壁の一部のように生活に溶け込んでいくというものでした。人間がコマンドを出すと、周りの環境がそれに合わせて変化する、いわゆるアンビエント ── 「環境の」という意味。アンビエントコンピューティングは、機器を意識させずに周囲の環境そのものが人に応答するような技術のあり方を指します化の考え方です。
宮武さんは、この5、6年でその事例がいくつか出てきたと話します。脳でコンピューターを操作するBrain Machine Interfaceとして、イーロン・マスクさんのNeuralinkや、MetaのControlLabsが挙げられ、Snapchatのミラーワールドも似た概念だとされます。
iPhoneの登場
一般の人でも使いやすいインターフェースが広まる
AIアシスタント競争
Amazon、Google、Appleがスマートホームで競い始める
背景に退くデバイス
テックデバイスが壁の一部のように生活に溶け込む
環境が応答する
人間のコマンドに合わせて周囲の環境が変化する
直近では、AI商品がこの流れに大きく貢献するのではないかと宮武さんは見ています。その中でも「インビジブルコンピューター」を強く信じている会社として、Humaneが紹介されます。
元Apple出身者が集まるHumane、期待と不安の正体
Humaneについて、草野さんは立ち上がり当初から気にしていたといいます。2、3年前から、元Appleのデザイナーが立ち上げ、なかなか商品を見せないまま資金調達を重ねる「謎の会社」として注目していたそうです。
(Humaneは)元Appleのデザイナーの人が立ち上げた謎の会社で、調達も結構してるみたいな。なんかちょっとあれの匂いがするぞみたいな。
草野さんが思い浮かべたのは、Magic Leap ── 多額の資金を集めて注目されたAR(拡張現実)ヘッドセットの企業。期待の大きさに対して製品の普及が進まなかったことで知られますやQuibi ── 2020年に始まった短尺動画配信サービス。ハリウッドの大物が関わり巨額の資金を集めましたが、半年ほどでサービスを終了しましたのように、プロフェッショナルが集まって巨額の資金を集めたもののうまくいかなかった例です。全く違う事例だと断りつつも、どんな形でリリースするのかハードルが上がっていたと話します。
宮武さんによると、Humaneの創業者2人はともに元Apple出身で、結婚しているはずだといいます。社長のイムラン・チャウドリさんはAppleのヒューマンインターフェースチームの出身で、もう1人のベサニーさんはAppleのOS開発に関わっていた人物です。
Humaneの従業員は200人以上いて、そのうち4割弱が元Appleだと宮武さんは紹介します。iPhoneのオートコレクトを作ったケン・コシエンダさんのように、インターフェース業界で有名な人物も加わっているそうです。
完全にAppleの子会社みたいな感じになっちゃってますけど。
宮武さんは、Magic LeapやQuibi、さらに昔のGeneral Magicも、ほぼApple出身者が中心の会社だったと話し、Humaneにも若干似た感覚があるとしています。
TEDでのHumaneデモはどう見えたか?
HumaneはTEDで初めてプロダクトをデモしました。シャツのポケットに付けたデバイスにカメラがあり、手のひらに画面を映し出す仕組みです。
もうちょっと見たいって思いましたね。率直に言うと。
草野さんは、電話がかかってくる場面やAIと会話する場面が中心だったため、もっとユースケースを見たかったと話します。そのうえで、デバイスのコンセプトはすごく面白いとしています。
宮武さんも、コンセプトは面白い一方で、個人的には少しがっかりした部分もあったと率直に話します。ただ、まだデモであり、プロトタイプ段階の可能性が高いので、変に期待値を持つのも良くないとも考えています。
宮武さんの整理によると、Humaneのデモでは主に4つの機能が紹介されました。
一方で、宮武さんはデモの一部がかなり演出っぽく見えたとも話します。電話は録音ではないかという説があり、AI翻訳の声も本人の声ではなかったように思えたそうです。
AIの応答が遅い点については、裏でGPT-4を使っているなら仕方ない部分もあると宮武さんは見ています。また、Apple Watchでも似たことはできそうだと感じた部分もあったといいます。
デモに対しては「本当にこういうことはやっていない」「商品化されていないだろう」といったミスリードを指摘する批判も多く出たと紹介されます。草野さんは「厳しいですね」と受け止めています。
iPhone初披露の裏にあった「ゴールデンパス」
宮武さんは、Humaneのデモを批判しすぎるのは良くないと考えています。理由として挙げるのが、Appleに長くいたイムランさんがおそらく手本にしたであろう、Steve Jobsによる2007年のiPhone初披露のエピソードです。
伝説のプレゼンとして知られるiPhoneのお披露目ですが、当時のiPhoneはまだプロトタイプ段階でした。宮武さんによると、バグが起きまくっていたうえ、ほとんど生産されておらず、100台ほどしか存在しなかったiPhoneは品質もバラバラだったそうです。
うわぁ、ロシアンルーレット。まさに。
最終的にデモで使ったiPhoneにも、さまざまな問題がありました。
曲や動画を一部だけなら再生できるが、最後まで再生するとクラッシュする
メールを送ってからSafariを使えば問題ないが、Safariを開いてからメールを送るとクラッシュする
iPhoneチームは本番前に何時間もかけて、どのタスクをどの順番でやればクラッシュしないかを見つけました。チームはその手順を「ゴールデンパス」、つまり黄金の道と呼び、Steve Jobsはそれを最初から最後までたどってデモをやり遂げたといいます。
しかもあれ(デモ)一回失敗したら多分クビなんで、みんな。
草野さんは、もしあのデモが失敗していたら、今のテクノロジー業界は変わっていたかもしれないと話します。宮武さんも、iPhoneを買う人がいなかったかもしれないし、Jobs自身がiPhoneを諦めていたかもしれないと応じます。
だからこそ宮武さんは、デモの完成度よりも、Humaneが次のヒューマンコンピューターインターフェースについてどんな考えを持っているかのほうが重要だとしています。
画面をなくすことは「より人間的」になるのか?
Humaneのプレゼンでは、スマホやスマートウォッチに至るインターフェースの進化が語られました。そのうえでHumaneは、スマホは人間に負担をかけ、その瞬間を楽しめないようにしてしまうと主張しているといいます。
宮武さんが例に挙げるのは、iPhoneのカメラで写真を撮る場面です。1枚のスクリーンが間に入ることで、リアルな世界を味わえなくなるという考え方です。
草野さんは、Humaneが前年に出したコンセプト動画を思い出します。スクリーンを見つめる幽霊のような人々の中で、1人の女性が空を見上げる映像で、「アンチスクリーン」というコンセプトがよく伝わってきたといいます。
宮武さんは、この動画がAppleの有名な「1984」のCMに似ていると話します。大画面を見て洗脳されている大勢の人々を、1人の女性が壊しに行くという構図です。
ただ宮武さんは、「今を生きる」「より人間的な瞬間を作る」という概念自体が難しい議論だとも考えています。その瞬間を味わいたいからこそ写真を撮る、という見方もあるからです。
画面をなくし、カメラ、音声、AIを組み合わせたものが次のフォームファクター ── 製品の物理的な形状や大きさ、構成のこと。スマートフォン、腕時計型、眼鏡型など、デバイスの「かたち」を指す言葉ですになれるのかは、まだ議論の余地があると宮武さんは話します。場合によっては物足りない部分もあるかもしれません。
ここで草野さんがフォームファクターを「フォンファクター」、つまり電話の話だと聞き違え、宮武さんが「形」を意味するフォームだと訂正する一幕もありました。
Appleの箱が「スコッ」と開くのはなぜか?
宮武さんによると、Appleが気にしているフォームファクターはiPhoneの形だけではなく、パッケージにまで及びます。草野さんは、MacBookの箱を開けるときに蓋と底が密着していて、ゆっくり「スコッ」と上がる瞬間を挙げます。
(MacBookの箱は)パカって開かないんですよ。時間かかるんですよね。
宮武さんは、あの摩擦の作り方はAppleがとても気にしている部分で、期待値を上げるためのものだと説明します。最後に開けた瞬間が、ちょっとした感情の違いを生むといいます。
Appleにはパッケージングルームという場所があり、デザイン関連の従業員が何ヶ月もひたすら何百種類もの箱を開け、ちょうどいい摩擦の具合を確かめているそうです。
宮武さんは、毎日続けると感覚が鈍らないのかと疑問を口にします。草野さんは、キーボードの押し心地がずっと好きでいられるように、箱開けの「ペリペリ感」にもピンとくる感覚はありそうだと話します。
宮武さんは、Steve Jobsやジョニー・アイブさんのような人たちがこだわってきた非常に細かい部分こそ、インターフェースを作るうえで重要になると話します。
音が悪いスピーカーをジョブズが選んだ理由
宮武さんは、ある元Appleエンジニアが語ったSteve Jobsのエピソードを紹介します。デスクトップのMacを開発していたエンジニアが、スピーカーグリルの位置だけが違う2つのプロトタイプをJobsに見せたという話です。
本体正面の下部にスピーカーグリルがあり、音質が良い
本体の底面にスピーカーがあって下向きのため、音質が圧倒的に悪い
エンジニアはJobsが当然1台目を選ぶと考えていました。Jobsも2台目の音を聞いて「この音はやばいね」とコメントしたものの、どちらがいいかと聞かれると、音の悪いほうを選んだといいます。
(スティーブ・ジョブズが)「音は悪いけど、それを良くするのが君の仕事ですよね」っていう話をして。
Jobsが音の悪いほうを選んだ理由は、Appleのコア顧客である音楽好きの行動にありました。宮武さんの説明では、音楽好きの多くはデスクトップを外部スピーカーにつなぐため、正面にスピーカーグリルがあると「なぜここにあるのか」を気にしてしまいます。それを気にさせないために、スピーカーを下に置きたかったというわけです。
草野さんは映画で似た場面を見たことがあり、「スピーカーにこだわる人は別で買う」というセリフに納得したと振り返ります。宮武さんは、人がどう行動するかを読み取って判断していた点こそが重要だったと話します。
部屋の明るさとテーブルの形で、会話はどう変わる?
宮武さんは、フォームファクターを少し変えるだけで多くのことが変わる例として、The Guardianの古い記事を紹介します。部屋の明るさによって、人が話すトピックや話し方が変わるという内容です。
人は自分が何をしているかを話し合う
自分の気持ちや内面的なこと、より主観的な話をし、間も長くなる
草野さんはキャンプファイヤーがまさにそうだと応じ、宮武さんも明るさを変えるだけで人間の行動が変わるのは面白いと話します。
次に紹介されるのが、VCのBenchmark ── シリコンバレーの著名ベンチャーキャピタル。少数のパートナーによる運営で知られ、Uberなどへの初期投資で有名ですの事例です。Benchmarkは毎週チームでディナーを開き、ジェフ・ベゾスさんなどのゲストも招いて、3時間ほどさまざまなトピックについて話しているといいます。
Benchmarkは、ディナーの参加者全員が1つのトピックについて話せるようにしたいと考え、そのためのテーブルが必要だと考えました。
| 形 | 起きること | 会話への影響 |
|---|---|---|
| 四角いテーブル | 上座が生まれヒエラルキーができる | 一部の人が会話を乗っ取りやすい |
| 円テーブル | 真横の人と話しやすくなる | 全員で1つの会話になりにくい |
| 丸みのある三角形 | 横の会話も向かいに聞こえ、全員が中央を向く | 1つの会話になりやすい |
最終的にBenchmarkが選んだのは、丸みを帯びた三角形の、おにぎりのような形のテーブルでした。宮武さんは前回の話を引きながら、インターフェースも我々を形作るとまとめます。
話しやすさを生む、自分なりのインターフェース
草野さんは宮武さんに、話しやすさや物事の進めやすさのために気にしているインターフェースはあるかと尋ねます。
宮武さんが挙げたのは、Off Topicの収録でカメラをオンにしていないことです。声だけでやるほうが、宮武さんと草野さんにとってはやりやすいのではないかと話します。
対面で喋るのがちょっとそんなに得意じゃないので、横を向いて喋ったり、横並んで喋ったりとか、あと散歩しながら喋ったりとかの方が自分は話しやすいので。
草野さんは、横並びや散歩しながらの会話のほうが話しやすいと話しつつ、相手がそれを望んでいるかはわからないとも付け加えます。宮武さんは、人それぞれに合ったインターフェースがあり、引き出したい雰囲気に応じて場を形作ることが大事だと応じます。
宮武さんはさらに、ウィンストン・チャーチルさんが建物について語った言葉を紹介します。
「建物を我々は作るんですけど、その後に建物自体が我々を作ります」と。
チャーチルさんは、庶民院 ── イギリス議会の下院。議場は与党と野党の議員席が向かい合う長方形の配置になっていますの議場の形がイギリスの二大政党制 ── 2つの大きな政党が政権を争う政治の仕組み。イギリスでは保守党と労働党が中心ですを作ったのではないかと話していたといいます。宮武さんは、建物、アプリの設計、パッケージ、デバイスのフォームファクター、部屋の暗さまで、インターフェースはさまざまな形で人に影響していると話します。
Google検索のインターフェースはコンテンツをどう歪めたか?
宮武さんは、インターネット上のサービスもインターフェースとして人に強く影響していると話し、その例としてGoogle検索を挙げます。Google検索はコンテンツ制作のあり方そのものに影響してきたといいます。
宮武さんによると、今のサイトのほとんどは広告とSEOに最適化されています。タイトル、サマリー、いくつかの段落と続き、その間に広告が挟まる構成です。宮武さんは、そのやり方はユーザーにとって最適ではないと考えています。
ユーザーは検索してサイトに行くと、特定の文章だけを探し、コンテンツをほぼ全部読むことはまずありません。5秒から10秒ほどスクロールして目当ての部分を見つけようとします。
ユーザーの行動
サイトで特定の情報だけを探してスクロールする
Googleの評価
滞在時間が長いと高品質なコンテンツとみなし、ランキングを上げる
作り手の判断
いい回答を出すより、長く滞在させることを優先する
「あ、じゃあ滞在時間を長くすればいいんだ」と。いい回答を出すのではなくて。
草野さんの「そうじゃないのに」という反応に、宮武さんも同意し、こうした形でコンテンツがどんどん影響されていくと話します。
Google検索は古いインターフェースの「会話」だった?
宮武さんが次に紹介するのが、DeepMindの共同創業者やリード・ホフマンさんらが作ったInflection AIです。会話型AIの「Pi」を手がける同社は、Google検索のUIは1980年代のタウンページと同じだと指摘しているそうです。
ただしInflection AIは、Google検索を別の見方で捉えると「会話」でもあると考えているといいます。ChatGPTのような会話と似たものだという見方です。
いわゆるユーザーとGoogleの会話なんですね、これって。
草野さんは、Googleのシンプルさを初めて見たときの印象を振り返ります。Yahoo! JAPANやgooがカテゴリーの並ぶポータルだったのに対し、Googleは検索ボックスとロゴだけで、確かに今のChatGPTのようなUIだと話します。
宮武さんは、かつての競合Ask Jeeves ── 1996年に始まったアメリカの検索サービス。執事のキャラクターに自然な文章で質問する形式が特徴で、のちにAsk.comになりましたのほうが質問をする概念だったため、今のChatGPTに近いという見方もあると紹介します。そのうえで、Google検索は会話になっているのに、会話を成立させるインターフェースが古すぎるという問題意識を示します。
草野さんは、英語圏では検索を文章で行う点に触れます。日本では「カレー スパイス 作り方」のように単語を並べがちですが、英語では「How to make curry」のように会話に近い形になると話します。
デザイナーは「言語」を作っている
宮武さんは、検索だけでなくアプリも会話だと話し、Figmaの創業者ディラン・フィールドさんがTwitterで述べた考えを紹介します。デザイナーはプロダクトを作っているだけでなく、言語を作り、その言語でユーザーとスクリーン越しに会話しているという考えです。
ディラン・フィールドさんによれば、その会話はユーザーの最初のタップやクリックから始まり、すべてのインタラクションが会話になります。ただし言葉ではなく、クリックやスワイプ、体験、期待値、感情で伝え合っているといいます。
ボタンとかアイコンとかナビゲーションっていうのは全部単語でしかなくて、それをうまく組み合わせると一個のナラティブができますと。
宮武さんは、このナラティブをどう作り、今のテクノロジーやインターフェースに合っているかを考えることが重要だと話します。ディランさんやInflection AIの人たちが語っているのは、まさにこの点だといいます。
「魔法みたい」と感じるマジックモーメントの条件
宮武さんは、優れたコンシューマー向けアプリには、触った瞬間に魔法のように感じる「マジックモーメント」があると話し、草野さんにそうした体験を尋ねます。
草野さんが挙げたのはAppleのエコシステムです。Apple WatchはiPhoneをかざすだけで連携でき、AirPodsを付ければすぐにiPhoneが反応します。Apple Watchの連携時に流れる不思議な映像を読み取らせる演出も、文字で指示するだけでなくワクワクさせる伝え方だと話します。
宮武さんも、前年末に新しいMacへ買い替えた際、前のデバイスからシームレスに移行できたことに驚いたといいます。
宮武さんは続けて、よく語られるマジックモーメントの例を挙げます。
| サービス | マジックモーメント | 補足 |
|---|---|---|
| Uber | 初めて乗ったとき、支払いせずにそのまま降りられる | 草野さんは海外で話さずに済む点も挙げる |
| Spotify | 1曲ずつ買う必要がなくなった | ストリーミングによる変化 |
| Venmo | 割り勘が一発でできた | 海外の送金系サービスの例 |
宮武さんは、マジックモーメントは最初こそ驚きがあっても、やがて一般化して普通に感じてしまうと話します。今のマジックモーメントは生成AIだろうとしつつ、「魔法みたい」という言葉自体が大事だと考えています。
宮武さんの考えでは、「魔法」は期待値との差を示す言葉です。アプリが思った通りに動いても、それは期待通りなのでマジックモーメントにはなりません。
宮武さんはテスラを例に挙げます。テスラのマジックモーメントを聞かれると、多くの人は運転の感覚ではなく、ダッシュボードのイースターエッグ ── 製品やソフトウェアに隠された遊び心のある仕掛けのこと。復活祭の卵探しが語源ですや、クリスマス期間に音楽に合わせて車が「踊る」機能の話をするといいます。
(イースターエッグは)思ってなかったことをやってくれる。
アプリは「魔法の杖」から「呪文書」へ?
宮武さんは、これまでのマジックモーメントを作るアプリは「魔法の杖」に例えられると話します。アプリは世界を操作するためのインターフェースで、iPhoneをアプリで魔法の杖に変え、Uberなら2タップで車が来てどこにでも行け、Tinderなら好きな人に会えるというわけです。
一方で生成AIの時代には、魔法の杖ではなく、杖を使うための呪文が書かれた「魔術書」や「呪文書」を作るのかもしれないと宮武さんは考えます。プロンプトはまさに魔法の言葉であり、呪文によって杖から出る魔法が変わるという見立てです。
魔法の杖を作る。2タップでUberの車が来るように、決まった魔法を起こす
呪文書を作る。プロンプトという言葉しだいで起きる魔法が変わる
宮武さんは、Not Boringのパッキーさんが生成AIの流行以前に語っていた「魔法のノート」のコンセプトも紹介します。いつか紙に書いたことが現実になる世界が来るという話で、草野さんは「デスノートみたいな」と応じます。
宮武さんは、生成AIによってその世界はすでに半分始まっていると話します。Replit ── ブラウザ上でプログラムを書いて実行できる開発サービス。AIによるコード生成機能を備えていますでは、まだ複雑なものは作れないものの、「このアプリが欲しい」と伝えるとAIがアプリを作ってくれるといいます。
ユーザーが自分でインターフェースを作る時代
宮武さんは、これまでソフトウェア業界でインターフェースを作ってきたのはエンジニアだったと話します。それがようやく民主化され、エンドユーザーが自分たちのためにインターフェースを作る時代が来ているといいます。
草野さんに「作りたいですか」と聞かれた宮武さんは、一部は自分で作りたく、一部は調整してほしいと答えます。
例として挙げられたのが、収録当日に新機能を発表したブラウザのArcです。どのサイトでも色合いやフォントを変えられ、その設定を共有もできる機能だと紹介されます。
エンジニアが選ばない限り、アプリでダークモードは使えない
暗い場所にいるユーザーが望めば、自分でダークモードにできる
宮武さんは、この流れが進めば、将来は誰もが個人AIを持つ世界になると見ています。Humaneはまさにそれを目指し、仕事の領域ではLindyが同じような取り組みをしているといいます。
パーソナルAIは「1体」でなくてもいい?
宮武さんが個人AIに関連して注目しているのが、SnapchatがGPT-4を組み込んで出した「My AI」です。最近はグループチャットにも入れられるようになり、旅行の相談中に「いいところを探して」とAIに頼めるといいます。
宮武さんが重要だと感じたのは、個人AIやパーソナルアシスタントというと、多くの人がアイアンマンのジャーヴィスのような1体のAIを想像する点です。
場合によってはグループ専用のやつもあれば、(AIエージェントを)個人でもいっぱい持つんじゃないかっていう。
宮武さんは、性格や専門性の違うAIエージェント ── 人の指示を受けて、目的達成のために自律的に調べたり作業したりするAIのこと。単に質問に答えるだけでなく、タスクを実行する点が特徴ですを複数持つ未来を想像しています。旅行、恋愛、友達、医療、投資といったエージェントがいて、それらをまとめるエージェントがいるのではないかという考えです。
草野さんが秘書のようなものかと尋ねると、宮武さんは細かいタスクだけでなく相談にも乗ってくれる存在だと答えます。有名人にファイナンス担当やトレーナーなどのチームがいるように、その役割をAIが担うイメージです。
草野さんは、投資や旅行のように情報を集める分野とは特に相性が良さそうだと話します。宮武さんは、慣れるまで時間はかかりそうだとしつつ、今後起きてもおかしくないと考えています。
AIエージェントが「組織」になる
宮武さんによると、仕事用途ではすでに複数のAIエージェントが連携する仕組みが出始めています。例として、誰かが作ったマルチGPTが紹介されます。
うわぁ、(AIエージェントが)組織になってる、ちゃんと。
宮武さんは、同じことが個人のためにも起きるのではないかと考えています。そのとき個人的に疑問に思ったのは、自分のチーム内のAIどうしが話すのはいいとして、他人のAIエージェントとどう関わるかという点だったといいます。
他人のAIエージェントと話していいのか?
宮武さんが挙げる問いは、宮武さんのAIエージェントが宮武さんのメンタルヘルスを気にして、草野さんのAIエージェントに話しかけていいのか、というものです。
いや、でも(AIエージェントは)チーム宮武の常に味方でいるべきですよね。
宮武さんは、味方としてメンタルヘルスを気にかけた結果かもしれないものの、プライバシーの面で自分がそれをどう思うかはわからないと話します。人が人と話すのか、相手のエージェントと話すのか、自分のエージェントが相手のエージェントと話すのか、その会話の成り立ちが気になるといいます。
草野さんは、現実の世界でもエージェントどうしが代理で話すことはあると応じます。ただ、セラピストが飲みの席で他のセラピストに顧客のプライバシーを話すとしても、固有名詞を出すのはダメな気がすると話します。
宮武さんはさらに、抽象的なシナリオとして相談するのはいいのかと問いかけ、草野さんは自分のAIであることを隠すべきかもしれないと応じます。宮武さんの答えは「わかんないですね」でした。
宮武さんが続けて出すのは、ある人のAIエージェントが「もっと運動すべきだ」と判断し、その人の恋人に運動させるよう働きかけてもいいのか、という例です。
(運動させるよう恋人に頼むのは)リアルでそれやられたら、「あなたのためを思って言ったんだよ」って言われたら、ちょっと嫌じゃないですか。
宮武さんは、どこにNGを置くかを今後考えなければならないと話します。さらに、恋人に直接ではなく恋人のエージェントに伝え、そのエージェントが恋愛エージェントに相談し、関係を良くするために運動を勧めるよう恋人に助言する、という人間の見えない連鎖もありうると指摘します。
本人のエージェント
本人にもっと運動させたいと判断する
恋人のエージェント
本人のエージェントから相談を受ける
恋愛エージェント
2人の関係を良くするには運動させたほうがいいと助言する
恋人
エージェント経由で、本人に運動を勧めるよう仕向けられる
草野さんは、AIが最終的な目標を達成するためにどう動くかは議論が必要だとまとめます。宮武さんも、AIどうしが話し始めると、可視化されていても人間がすべてのやり取りを追えなくなるため、どこまで許すかを考える必要があると話します。
草野さんが、個人エージェントどうしが話す良さがあまり思い浮かばないと言うと、宮武さんは究極の例として、誰かが自殺しそうなときにそれを止めるためにAIエージェントが動くべきか、という問いを挙げます。草野さんは「ダイエットの話だったのに」と笑いつつ、確かに考えるべき問題だと受け止めます。
インターフェースはすべて「言語」なのか?
宮武さんは最後に、この回の話全体をまとめます。インビジブルインターフェースも、さまざまなフォームファクターも、サービスと人間、物と人間、人間と人間の間にある「言語」の話だったというのです。
宮武さんは、AIがすべての言語を学ぶチャンスを与えてくれると考えています。その根拠として紹介するのが、NVIDIAの社長が語った、構造を持つものはすべて言語だという考えです。
NVIDIAの社長の考えによれば、話し言葉や書き言葉だけでなく、科学、コンピューターサイエンス、数学も言語です。言語の組み合わせ方しだいでロケットが作られることもあります。
科学や数学などの言語を理解するには、長い時間がかかった
自然言語を通じて、これまでわからなかった言語を学び、理解できるようになる
宮武さんは、これがAIの時代が面白い理由の1つだと話します。次回は、AIがどういう言語なのか、メディアのインターフェースがAIでどう変わるのか、チャットボットがAIの最終的なインターフェースなのかを話す予定だと予告し、草野さんはスクリーンのないチャットボットもあるかもしれないと応じて回を締めくくります。
まとめ
この回では、Humaneのデモをきっかけに、パッケージ、スピーカーの位置、部屋の明るさ、テーブルの形、Google検索、AIエージェントまで、インターフェースが人の行動や会話を形づくる例が語られました。宮武さんは最後に、それらをすべて人と物、人と人をつなぐ「言語」として捉え、AIがその言語を誰にでも開く可能性を示しています。
- Humaneのデモには批判もあるが、iPhone初披露もプロトタイプでの綱渡りだったため、重要なのは背後にある考え方だと宮武さんは見ている
- Jobsのスピーカー選びやBenchmarkのテーブルのように、インターフェースは人がどう行動するかを読み取って設計されている
- Google検索やアプリの操作も会話の一種であり、ボタンやアイコンはその単語にあたるという見方が紹介された
- マジックモーメントは期待値を超えたときに生まれ、生成AIはユーザー自身がインターフェースを作る時代を開きつつある
- 複数のAIエージェントが連携する未来では、他人のエージェントとどこまで話してよいかという新しい問いが生まれる




