文章や映像を作り出せるところに、一種の知性を感じるものですが、
何かを作り出させるためのプロンプトを適切な言葉で表現しなければならないところが、案外大変なのですよね。
で、次に取り組まれているのが、与えられた映像を解釈できるようにすることでした。
簡単に言うと、写真や動画の中身について話せるようになることです。
文章だけでなく、写真や映像なども読み書きできるようにすることを、マルチモーダル化というのです。
ただ、こうやって言葉で言ってみても、うーんという感じですよね。
それが腑に落ちるものが、先週Googleから発表されました。
ジェミニーというAIです。
どんなことができるかを表現した動画があるのですが、僕はそれを見て結構驚きました。
そして、近いうちにそれが使えるようになるということにワクワクしました。
ジェミニーには、目と耳があるという感じ。
何かを人に説明するとき、文章だけでは難しいと思うときに、簡単な図を書いて見せたりしますよね。
ジェミニーには、そういう図のようなものを解釈する能力があります。
プレゼンなどで、ホワイトボードに図を書きながら話すことがあると思いますが、そういうものをジェミニーはきちんと解釈して会話をすることができます。
その会話をもとに、生成側の機能で何かを作ることができます。
生成側の機能で何かを作り出すこともできます。
Googleのジェミニーハンズオンの動画では、そういうことを実際にやってみているのです。
これは、かなり知性的に感じます。
なぜ知性的に感じるのかというと、実際に人と話しているように感じられるからです。
それもかなり賢い人と。
反面で、これは上手に使うのが結構大変だなぁとも感じました。
その大変さは、人とのコミュニケーションの効果です。
人とのコミュニケーションの効果です。
人とのコミュニケーションの大変さによく似ているのです。
人とのコミュニケーションの大変さによく似ているのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
何かを人に上手に説明できるという、結構難しいスキルを要求されるのです。
ということです。
事務処理のかなりの部分がAIに代替されることは、ある程度予想がつくと思いますが、
例えば、学校の先生の教えるという部分のかなりの部分も、AIに代替されるわけですね。
ということは、人間はもっと高度なことをやる必要があるということですよね。
そして、それに気づいた人から、どんどん先に進んでしまいます。
この変化は急速です
変化を嫌う人には辛い時代になるかもしれません
Googleのジェミニのハンズオン動画へのリンクを概要欄に置いておきます
書き起こしのノートの方にはワンプリックで見ることができるようにしておきますので
ぜひそちらも見てくださいね
ポッドキャストもノートもぜひフォローお願いします
今回はマルチモーダルなAIは衝撃的だった
Googleのジェミニという話をしました
今日はここまで
読書と編集ではITを特別なものではなく
常識的なリテラシーとして広める活動をしています
トワカでITリテラシーの基礎を学べるオンライン講座をやっています
詳しい内容については概要欄のリンクから見に行くことができます
コメントはリッスンで
文字で読みたい方はノートをどうぞ
どちらも概要欄にリンクがありますのでフォローいただけると嬉しいです
今日もワクワクする日でありますように
千葉直樹でした
ではまた