multimodal AI
/ˌmʌltiˈmoʊdəl ˌeɪˈaɪ/名詞
マルチモーダルAI
見て、聞いて、話す。文字だけじゃないAIの時代。
SUMMARY
ざっくり言うと
文章だけでなく、画像、音声、動画など複数の種類の情報をまとめて理解したり作り出したりできるAIのこと。スマートフォンのカメラに映った物をAIがその場で説明するような機能に使われている。1つのモデルで複数の種類の情報をまとめて扱える点が特徴。
EXAMPLES
例文
-
1
Multimodal AI can understand photos and voices.
マルチモーダルAIは写真や声を理解できる。
-
2
The company unveiled a multimodal AI assistant that can describe what a phone camera sees in real time.
同社は、スマホのカメラに映るものをリアルタイムで説明できるマルチモーダルAIアシスタントを発表した。
-
3
Multimodal AI could help visually impaired people read signs and menus.
マルチモーダルAIは、視覚障害のある人が標識やメニューを読む助けになるかもしれない。
COLLOCATIONS
よく一緒に使う表現
- multimodal modelマルチモーダルモデル
- multimodal capabilitiesマルチモーダル機能
SYNONYMS
ほかの言い方
読み込み中…
関連度は Datamuse API による英語コーパス上の近さです。
TRIVIA
豆知識
modal は mode(様式)の形容詞形で、ここでは文字・画像・音声といった『情報の種類』を指す。交通分野で複数の交通手段を組み合わせる multimodal transport(複合一貫輸送)とも同じ発想の語で、『いろいろな形式を扱える』という意味の広がりを持つ。文章しか扱えない従来型のAIは text-only と呼んで区別され、対比で語られることが多い。
QUIZ
1問チャレンジ
「multimodal AI」の意味はどれ?