生成AIとは
テキスト・画像・音楽を「生み出す」AI
生成 AI(Generative AI)とは、学習したデータをもとに、新しいテキスト・画像・音声・動画などを生成できる AI の総称です。2022 年以降の急速な進化により、創作・開発・業務の現場で広く使われるようになりました。
主な生成 AI の種類
| 種類 | 代表サービス | できること |
|---|---|---|
| テキスト生成(LLM) | ChatGPT、Claude、Gemini | 文章作成、要約、コード生成、対話 |
| 画像生成 | Stable Diffusion、DALL·E、Midjourney | テキストから画像を生成 |
| 音楽生成 | Suno、Udio | テキストから楽曲を生成 |
| 動画生成 | Sora、Runway | テキスト・画像から動画を生成 |
| 音声合成 | ElevenLabs、VOICEVOX | テキストからリアルな音声を生成 |
どうやって生成しているのか
生成 AI は大量のデータを学習し、「次に来るべき内容」を確率的に予測します。テキスト生成では「この文脈の次に来る単語は何か」を繰り返し計算することで、自然な文章を作り出します。
できることとできないこと
得意なこと
- 下書きや骨格の生成、アイデア出し
- 翻訳・要約・言い換え
- プログラムコードの補完・説明
注意が必要なこと
- 事実と異なる内容をもっともらしく出力する(ハルシネーション)
- 著作権・プライバシーの問題が伴う場合がある
- 最新情報を持たないことがある(学習データに時間的な上限がある)
まとめ
生成 AI は「作るための道具」です。出力は常に人間が確認し、目的に合わせて使うことが大切です。次の講座では、テキスト生成の中核技術である LLM を詳しく学びます。