Ai企業・銘柄と生成Aiの種類:画像や動画生成Ai
AI(人工知能)を開発する主要企業、用途に応じたAIの種類、そして利用可能な有名なAI(サービス・モデル名)について解説します。
1. 牽引する「AI企業」と「有名なAIの名前」
アメリカのテック巨頭やスタートアップ
OpenAI (オープンAI):
現在のAIブームの火付け役。
代表AI:ChatGPT(対話型AI)、GPT-4o(最新の頭脳となるモデル)、Sora(動画生成AI)。
Google (グーグル):
AIの基礎技術を数多く開発してきた巨人。
代表AI:Gemini(ジェミニ)(検索やビジネスツールと連携する対話型AI)。
Anthropic (アンソロピック):
元OpenAIのエンジニアが設立した、「安全性」と「高い文章処理能力」に定評がある企業。
代表AI:Claude(クロード)(長文読解や自然な日本語表現が非常に得意)。
Microsoft (マイクロソフト):
OpenAIとタッグを組み、自社製品にAIを組み込んだ。
代表AI:Copilot(コパイロット)(Word、Excel、Windowsなどに搭載された支援AI)。
Meta (メタ):
FacebookやInstagramの運営会社で、オープンソース(技術を無償公開する形)のAI開発に注力。
代表AI:Llama(ラマ)(世界中の開発者がこれをベースに独自のAIを作っています)。
日本の主要企業とAI名
Sakana AI (サカナAI): Googleの有名研究者が東京で創業した日本発のユニコーン企業。小さなAI同士を掛け合わせて賢くする独自の技術で世界から注目されています。
Preferred Networks (プリファード・ネットワークス): 日本最大級のAIベンチャー。自動運転やロボット、医療分野などのディープラーニング(深層学習)に強みを持っています。
NTT / NEC / 富士通: 国内の大手IT・通信企業も、日本語のビジネス業務に特化した独自のAI(例:NTTの「tsuzumi」など)を開発。
2. 用途で分ける「AIの種類」
現在主流となっているAIは、人間の指示(プロンプト)に応じて新しくコンテンツを生み出す「生成AI(ジェネレーティブAI)」が中心。
テキスト生成(対話型)AI:
質問への回答、文章の作成、要約、翻訳、プログラミングコードの執筆。
代表例:ChatGPT, Gemini, Claude
画像生成AI:
「〜の絵を描いて」と文字で指示するだけで、リアルな写真やイラストを数秒で生成。
代表例:Midjourney(ミッドジャーニー)、Stable Diffusion(ステーブル・ディフュージョン)
音声・音楽生成AI:
人間の声をリアルに再現してテキストを読み上げたり、指示通りの作詞・作曲を自動生成。
代表例:Suno(スノ)(音楽生成)、ElevenLab(リアルな音声合成)
動画生成AI:
テキストの指示や1枚の画像から、映画のような高品質なショート動画を生成。
代表例:Sora, Runway Gen-3
AIエージェント(次世代型):
単に答えるだけでなく、「代わりに旅行の予約をして」「データ分析をしてレポートを共有して」といった、複雑なタスクを自律的に実行。
3. 能力の段階による「AIの分類」
技術的な進化レベルで分けると、AIは以下の2つに分類されます。
特化型AI(弱いAI):
現在実用化されているすべてのAIがこれに当たります。チェス、画像認識、文章作成など、「特定の決められた任務」において人間以上の能力を発揮しますが、それ以外のことはできません。
汎用AI(AGI:強いAI):
人間と同じように、初めて直面した課題でも自ら考えて解決できる「何でもできるAI」。まだ地球上には存在しませんが、OpenAIやGoogleなどは数年以内の実現を目指して開発競争をしています。
有料・無料の状況
AIサービスは、「無料(機能制限あり)+有料(高機能・最新頭脳)」のフリーミアムモデルが一般的です。主要なAIの料金状況をまとめました。
1. テキスト・対話型AI
一般的な会話や要約は無料で十分使えますが、プログラミング、複雑なデータ分析、最新の賢い頭脳(LLM)を使う場合は有料プランが必要です。
ChatGPT (OpenAI)
無料: 基本的な会話、簡単な文章作成、旧世代モデルの利用が可能。
有料: 月額約20ドル(Plusプラン)。最新・最上位モデル(GPT-4oなど)の優先利用、画像生成(DALL-E 3)の利用
Gemini (Google)
無料: Googleアカウントがあれば制限が緩く、無料で多くの機能が使える。Google検索と連携した最新情報の収集が得意。
有料: 月額プラン(Gemini Advanced)。Googleの最上位モデルが利用でき、GoogleドライブやGmail内でのAIサポート、2TBのストレージ特典などが付属。
Claude (Anthropic)
無料: 最上位モデル(Claude 3.5 Sonnetなど)を無料で使えます。ただし、使える「回数(利用枠)」が非常に少なめに設定されています(例:混雑時は数回質問しただけで「あと4時間待ってください」とロックがかかります)。
有料: 月額20ドル(Proプラン)。最上位モデル(Claude 3.5 Sonnetなど)の利用枠(ロックがかかるまでの回数)が無料版の5倍になり、混雑時もたくさん質問できるようになりますが、有料プランでも完全な「無制限」ではなく、使いすぎると一時的に制限がかかります。
Copilot (Microsoft)
無料: Windowsやブラウザ(Edge)上で誰でも無料で利用可能。実質的にOpenAIの最新に近い技術が無料で使えるためお得。
有料: 月額プラン(Copilot Pro)。Word、Excel、PowerPointなどのOfficeアプリ内でAIを動かして資料作成を自動化できる。
2. 画像・動画生成AI
完全無料のサービスは少なく、枚数制限や有料サブスクリプションが基本。
Runway / Sora (動画生成)
有料ベース: 動画生成は最もコストがかかるため、無料版はごくわずかなお試し(数秒の動画数本分)のみ。本格的なクリエイティブ制作には月額プランが必須。
Midjourney(画像生成)
本物の写真と見分けがつかない高精細な画像や、圧倒的なクオリティの芸術作品を生成できる画像生成AI
有料のみ: 現在は無料体験(お試し)がほぼ廃止されており、利用には月額約10ドルからの有料プラン契約が必須。
Stable Diffusion(画像生成)
Midjourneyと並ぶ世界最高峰の画像生成AIですが、作れるものの幅広さと自由度は全AIの中でトップクラス
無料(条件あり): 自分の高性能なパソコンにインストールして動かす場合は「完全無料」。ただし、WEB上の生成代行サービス(Clipdrop等)を使う場合は一部無料・基本有料。
Suno (音楽生成)
無料: 毎日一定の無料クレジット(約5曲分)が配られるため、お試し利用が可能。
有料: 月額サブスクリプション。生成できる曲数が大幅に増え、作った曲の商業利用(商用権)が得られる。
Aiをどう使い分けるべき?
お金をかけずに試したい場合:
まずは無料の ChatGPT、Claude、Gemini を併用し、回答の好みを比べるのがおすすめです。Microsoftの Copilot も無料で高機能なため重宝します。仕事や創作で本気で使う場合:
文章やビジネス効率化なら ChatGPT Plus か Claude Pro、Office製品との連携なら Copilot Pro、プロレベルのイラスト制作なら Midjourney の有料契約を検討するのが一般的です。
画像生成Ai
MidjourneyとStable Diffusionがあります。
Midjourney(ミッドジャーニー)
言葉(プロンプト)で指示するだけで、本物の写真と見分けがつかない高精細な画像や、圧倒的なクオリティの芸術作品を生成できる画像生成AI。
数ある画像生成AIの中でもトップクラスの画力を持ち、主に以下のようなジャンルの画像を生成できます。
1. 実写と見まがう「超リアルな写真」
カメラのレンズ、照明、アングル、カメラの機種まで指定して、スタジオで撮影したかのようなクオリティの写真が作れます。
人物ポートレート: 肌の質感、髪の毛の1本1本、瞳の反射まで驚くほどリアルに再現します。
風景・建築写真: 現実の絶景から、サイバーパンクな未来都市、洗練されたモダンなインテリアデザインまで描けます。
商品(プロダクト)ショット: 広告やECサイトにそのまま使えるような、おしゃれな化粧品やガジェットの物撮り写真が作れます。
2. あらゆるタッチの「イラスト・アート」
世界中の有名アーティストの作風、特定の絵の具や技法を指定したアート作品を生成できます。
アニメ・漫画風イラスト: 日本のアニメ風、アメコミ風、3Dピクサー風など、自由なタッチでキャラクターを描けます。
コンセプトアート・ファンタジー: 映画やゲームの開発で使われるような、壮大な世界観の背景グラフィックが得意です。
水彩画・油絵・浮世絵: 伝統的な絵画の手法を完璧に模倣した、温かみのある芸術的なイラストも作れます。
Midjourney Fantasy Landscape Ai Art
Fantasy Forest Ruins - Environment Concept Art using AI ... - ArtStation
Midjourney Concept Art Fantasy Landscape
3. ビジネスやWebで使える「グラフィックデザイン」
アイデア出しや、クリエイティブな制作活動のベースとなる素材を瞬時に作れます。
ロゴ・アイコン: シンプルで洗練されたフラットデザインや、ミニマルな企業ロゴのアイデアを生成できます。
UI/UX・Webデザイン: スマホアプリの画面や、Webサイトのランディングページのレイアウト案を視覚化できます。
3Dアイソメトリック・ゲーム素材: 斜め上から見下ろしたような3Dミニチュア風のイラストや、ゲームのキャラクター・アイテム素材も作れます。 [1, 2, 3]
3D Isometric Illustration Pack made using Mid Journey V4 Stable ...
50+ Midjourney Isometric Prompts: Game Art, Sprites, Buildings - Aituts
Midjourney Logo Design: Ultimate Guide For Creating Logos with AI
Midjourneyの「便利な特殊機能」
画像を作るだけでなく、以下のような高度な編集機能も備わっています。
キャラクターの固定(Character Reference):
同じ顔・髪型のキャラクターを、別のポーズや別のシチュエーションで何度も生成できます(絵本や漫画、SNSのアイコン運用に便利)。画像の合成(Blend):
2枚以上の画像をアップロードして掛け合わせ、新しい1枚の画像を作れます。画像の一部を変更・拡張(Inpainting / Outpainting):
生成した画像の一部分だけを指定して「服の色を変える」「手に持っているものを変える」といった変更や、画像の周囲を自然に広げてサイズ(画角)を拡張できます。
「こんな画像を作ってみたい」というイメージ(例:SNSのアイコン用のアニメキャラ、カフェのチラシ用の写真など)の生成で、Midjourneyにそのまま使える英語の指示文(プロンプト)
Midjourney(ミッドジャーニー)とは?始め方からできること ...
2026/04/06 — Midjourney(ミッドジャーニー)とは? 始め方からできることまで詳しく解説 * コールセンター * LINE連携...
知らないと損!生成AIでできること一覧ランキングTOP10【2025年】
2026/03/02 — 生成コンテンツの著作権は誰に? 法整備の課題 第2位は、圧倒的なクオリティと芸術的な表現力で世界中のクリエイターを魅了す...
【2025年最新版】Midjourneyとは?使い方・料金・始め方を徹底解説|株式会社AIworker
2025/04/19 — 最新版Midjourney ( ミッドジャーニー ) の進化ポイント 超高精細な画像生成能力:写真と見分けがつかないほど...
Stable Diffusion
Stable Diffusion(ステーブル・ディフュージョン)は、Midjourneyと並ぶ世界最高峰の画像生成AIですが、作れるものの幅広さと自由度は全AIの中でトップクラスです。
Midjourneyが「AIにお任せで綺麗な絵を描いてもらう」のに対し、Stable Diffusionは「人間の手でポーズや構図をミリ単位でコントロールして、思い通りの画像を生成する」ことが得意です。
具体的には、以下のようなものが生成・制作できます。
1. 人物・アニメ・実写の圧倒的な描き分け
世界中の開発者が作った「モデル(画風のデータ)」を自由に入れ替えられるため、どんなジャンルでもプロレベルのクオリティで描けます。
超リアルな実写(美女・イケメン・モデル):肌の質感や服のシワまで、実在する人間と区別がつかないクオリティの写真が作れます。
日本のアニメ・2Dイラスト:現代の流行りのアニメ風から、レトロなゲーム風、同人誌風のタッチまで完璧に再現します。
ファンタジー・クリーチャー:映画の3Dグラフィックのような、リアルな怪物やロボットのデザインも得意です。
2. ポーズや構図を「完全に指定した画像」
他のAIと最も違う強みがこれです。無料の拡張機能(ControlNetなど)を使うことで、人間の思い通りの絵を作れます。
ポーズの指定:「棒人間」でポーズを描いたり、ポーズの骨組みデータを読み込ませることで、キャラクターに狙った通りのポーズ(ジャンプする、踊る、お辞儀するなど)をさせられます。
構図・レイアウトの指定:簡単な白黒の線画や、色の配置(ラフ画)を読み込ませて、「この位置に山、ここに人を配置して」とAIに正確に指示できます。
顔の固定:同じキャラクターを、全く別の服装や場所、ポーズで、顔を一切崩さずに何枚でも生成できます。
3. ビジネス・実務で使えるクリエイティブ素材
デザインの現場やWeb制作でも強力なツールとして使われています。
建築・インテリアのパース(完成予想図):手書きの間取り図や線画から、一瞬でリアルな部屋の3D完成予想図を作れます。
文字のアート化(タイポグラフィ):文字の形に合わせて、背景のビルや自然の風景、炎などの模様を同化させたおしゃれな画像を作れます。
AIコスプレ・衣装の着せ替え:モデルが着ている服の形だけを保ったまま、柄や素材(革、デニム、シルクなど)を一瞬で変更できます。
無限に繋がる背景(シームレスパターン):Webサイトの背景や壁紙に使える、上下左右どこを繋げても継ぎ目が目立たない模様・テクスチャを作れます。
4. 短いアニメーションや動画の生成
1枚の静止画から、キャラクターが滑らかに動くショート動画や、音楽のテンポに合わせて映像が次々に変化するミュージックビデオ(MV)のようなアニメーションも作ることができます。
Midjourneyとの最大の違いは?
Midjourneyは、短い言葉を入れるだけで「AIが気を利かせて勝手に100点満点のおしゃれな絵」を作ってくれます。ただし細かい修正やポーズの指定は苦手です。
Stable Diffusionは、最初は指示が難しいですが、使いこなせば「手の形、ポーズ、視線、服、背景」を1から100まで人間の思い通りにコントロールできます。
Stable Diffusionは、高スペックなパソコンを持っていれば完全無料・枚数無制限で使える(オープンソースである)点も大きな特徴です。
現在のパソコン環境(Windows、Mac、またはスマホなど)に基づき、「自分のパソコンの性能で動くか知りたい」「Webで手軽に試せる方法が知りたい」などがあれば、導入方法や簡単な始め方をご案内します。
世界トップ級の画像生成AI「Midjourney」更に強力に。ライバル「Stable Diffusion」との違いもはっきり (1/3)
2023/11/20 — このスタイルを使って画像を生成してみると、以下のような形になりました。
Stable Diffusionとは?
2026/06/10 — 通常のAIは「ガチャ」のように運任せで画像を作りますが、Stable Diffusion ( ステーブル・ディフュージョ...
7日間かけてStable Diffusion WebUIによる人物画像生成の学習に取り組んでみた
2023/06/26 — 最近も「指定した同じ顔で何枚も画像を生成できる(通常だと生成するたびに違う人物の画像になる)」機能がリリースされたりと(...
動画生成AI
Runway(ランウェイ)とSora(ソラ)は、映画クオリティの映像を作れる世界最高峰の動画生成AIですが、その開発思想やアプローチには「クリエイター向けの編集道具」か「AIお任せのシネマティック映像」かという決定的な違いがあります。
Runway(最新:Gen-3 Alpha / Gen-4)
「人間の手でミリ単位の演出ができる、プロの現場向けのクリエイティブツール」
Runwayは、ハリウッドの映画制作スタジオや広告代理店など、実際の映像制作のプロが仕事で使うことを想定して作られています。
圧倒的なコントロール力(演出の自由度)
生成したい動画の一部分だけを指定して「ここだけ動かす」といった指示ができる「モーションブラシ」機能があります。
カメラの動き(ズーム、パン、水平移動など)の速度や方向を数値やボタンで細かく制御できます。
キャラクターや世界観の「一貫性」が高い
1枚の画像(登場人物のイラストなど)を読み込ませて、その顔や服装を保ったまま滑らかに動かす「Image to Video」が非常に得意です。
豊富な動画編集機能
動画生成だけでなく、背景のワンクリック削除、グリーンバック化、自動字幕生成など、生成した後の動画を加工・編集するツールが最初からすべて揃っています。
動画の長さ
1回につき最大10秒程度の高画質動画を生成でき、それを延長していく形をとります。
💡 こんな人向け
「自分のイラストを思い通りに動かしたい」「広告動画のカメラワークを細かく指定したい」など、人間のイメージ通りに動画をコントロール・編集したいクリエイターに向いています。
Sora (OpenAI)
「言葉の意図を完璧に汲み取る、圧倒的な表現力の映像メーカー」
OpenAIが開発したSoraは、現実世界の物理法則(光の反射、水の動き、重力など)をAI自体が深く理解して、映画のワンシーンのような映像を生成することを得意としています。
映画レベルの圧倒的な映像美
テキストの指示(プロンプト)に対する理解力がずば抜けて高く、カメラのライティング、色彩、空気感、質感の表現において他のAIを一歩リードしています。
現実さながらの「物理シミュレーション」
例えば「車椅子が水しぶきをあげて走る」「液体がこぼれる」といった、複雑な現実世界の動きを非常にリアルに描写できます。
AIが同時に「音声(効果音)」も生成する
進化版のモデル(Sora 2など)では、映像の生成と同時に、そのシーンに合わせた環境音や足音などの「音」もセットで自動生成してくれるのが大きな特徴です。
動画の長さ
1回の指示で最大20秒〜60秒といった、他のAIよりも長い「1本のまとまったカット」を一度に生成できます。
⚠️ 注意:Soraの最新状況(2026年現在)
Soraはその圧倒的なクオリティで世界を驚かせましたが、OpenAIは計算資源(AIの頭脳を動かすパワー)を「AIエージェント」や次世代の研究に集中させるため、2026年4月に一般向けのアプリ・WEB版の提供を終了しました。そのため、現在個人が手軽に動画作成を試す場合は、今すぐ利用可能な Runway などが主流の選択肢となっています。
2つの違いのまとめ
Runway 人間が細かく指示して作る「編集ツール」
カメラワーク指定、画像からの動画化、キャラ固定が得意
編集画面があり、ボタンやブラシで微調整できる
有料プラン等で今すぐ誰でも利用可能
Sora AIが言葉から映画を作る「自動ジェネレーター」
圧倒的な映像美、リアルな物理法則の再現、音の同時生成が得意
基本はテキスト(言葉)の指示のみで一発勝負
一般向けサービスは一時終了(研究に集中)
いいなと思ったら応援しよう!
この記事は noteマネー にピックアップされました

