AI PICKS
AI用語辞典 / カテゴリ

画像生成

Midjourney / Stable Diffusion / DALL-Eなど

76語を50音順で表示

Ideogram (アイデオグラム)

あいであぐらむ

Ideogramとは、画像内に正確な文字を埋め込める画像生成AIのこと。ロゴ・ポスター・バナーなど文字入りビジュアルの制作に特化し、従来の画像生成AIが苦手としていた文字化けを大幅に改善した。

IP-Adapter (参照画像アダプタ)

あいぴーあだぷたー

IP-Adapterとは、参照画像をプロンプト代わりに使い、拡散モデルの出力スタイル・構図・被写体を制御する軽量アダプタ技術のこと。

アウトペインティング (Outpainting)

あうとぺいんてぃんぐ

アウトペインティングとは、既存の画像の境界を超えて周囲の領域をAIが自動補完し、元画像と自然につながるよう拡張する画像生成技術のこと。

アップスケーリング (Upscaling)

あっぷすけーりんぐ

アップスケーリングとは、低解像度の画像をAIが細部を補完・生成しながら高解像度へ変換する技術のこと。単純なピクセル補間と異なり、存在しうるテクスチャを自動で再構成できる。

Adobe Firefly

あどびふぁいあふらい

Adobe Fireflyとは、Adobe社が開発した商用利用可能なAI画像生成エンジンのこと。PhotoshopやIllustratorに統合され、著作権クリアな学習データにより安全にクリエイティブ制作へ活用できる。

アニメ画像生成 (Anime Generation)

あにめがぞうせいせい

アニメ画像生成とは、 Stable Diffusion や Midjourney などの画像生成 AI を使い、 アニメ・イラスト調のキャラクターやイラストを生成する技術のこと。

Imagen (Google画像生成)

いまじぇん

Imagenとは、Googleが開発したテキストから高品質な画像を生成するAIモデルのこと。Vertex AIやGeminiを通じて利用でき、写実的な表現と著作権リスクの低さを得意とする。

イメージ・トゥ・イメージ (画像変換)

いめーじとぅいめーじ(がぞうへんかん)

イメージ・トゥ・イメージとは、既存の画像を入力として新たな画像を生成・変換するAI技術のこと。元画像の構図やポーズを維持しながらスタイルや質感を変えられる。

InstantID (顔ID保持生成)

いんすたんとあいでぃー

InstantIDとは、1枚の顔写真だけから人物の同一性を保持したまま、別のポーズや画風で画像を再生成できる顔ID保持技術のこと。

インペインティング (Inpainting)

いんぺいんてぃんぐ

インペインティングとは、画像の一部をマスクで指定し、AIが自然に補完・置換する編集技術のこと。既存画像を活かしながら特定領域だけを変更できる。

AI商品画像生成 (Product Photography)

えーあいしょうひんがぞうせいせい

AI商品画像生成 (AI Product Photography) とは、 商品写真の実写撮影を省き、 AI が EC・広告向けのスタジオ品質ビジュアルを自動生成する技術のこと。

AIヘッドショット (プロフィール写真生成)

えーあいへっどしょっと

AIヘッドショットとは、複数枚の顔写真を生成AIで加工し、スーツ姿やオフィス背景のビジネス用プロフィール写真として自動生成するサービスのこと。

AIマンガ生成 (Manga Generation)

えーあいまんがせいせい

AIマンガ生成とは、 テキストや画像入力から AI がコマ割り・キャラクター・背景を含む漫画形式の画像を自動生成する技術のこと。

SDXL (Stable Diffusion XL)

えすでぃーえっくすえる

SDXLとは、Stability AIが開発した画像生成AI「Stable Diffusion」の上位モデルで、解像度1024pxを標準としてより高精細で破綻の少ない画像を生成できる拡張版のこと。

OmniGen (統合画像生成モデル)

おむにじぇん

OmniGenとは、画像の理解・生成・編集を一つのモデルで統合的にこなせるマルチタスク型の画像生成モデルのことである。

拡散モデル (Diffusion Model)

かくさんもでる

拡散モデルとは、画像にノイズを加えて壊す過程を学習し、逆にノイズから画像を復元することで高品質な画像を生成するAIの仕組みのこと。

画像内テキストレンダリング (Text Rendering)

がぞうないてきすとれんだりんぐ

画像内テキストレンダリングとは、AI画像生成モデルが画像の中に指定した文字・単語を正確に描画する技術のこと。看板・バナー広告・UIモックなど「読める文字」が必要な用途で重要視される。

画像プロンプト逆生成 (Image-to-Prompt)

がぞうぷろんぷとぎゃくせいせい

画像プロンプト逆生成とは、既存の画像をAIに解析させ、構図・画風・被写体の特徴を言語化してプロンプト文に変換する技術のこと。

GAN (敵対的生成ネットワーク)

がん

GAN(敵対的生成ネットワーク)とは、生成器と識別器という2つのニューラルネットワークを競わせながら学習させ、本物と見分けがつかないデータを作り出す機械学習の手法のこと。

Canny制御 (エッジ検出制御)

きゃにーせいぎょ

Canny制御とは、画像から輪郭線(エッジ)を検出し、その線画情報をガイドに生成AIの構図やポーズを固定する制御技術のこと。

キャラクター一貫性 (Character Consistency)

きゃらくたーいっかんせい

キャラクター一貫性とは、複数の画像や動画フレームをまたいで同一キャラクターの顔立ち・衣装・画風・体型を崩さずに保ち続けるための技術・運用手法の総称のこと。

Canva AI (Magic Studio)

きゃんばえーあい

Canva 統合の AI デザイン機能群。 Magic Write / Magic Edit / Magic Switch 等。

Qwen-Image (通義画像生成)

くうぇんいめーじ

Qwen-Image(通義画像生成)とは、Alibaba傘下のQwenチームが開発したオープンウェイトの画像生成AIモデルのこと。特に多言語の文字入れ精度の高さで知られる。

CLIP (画像テキスト対照学習モデル)

くりっぷ

CLIPとは、画像とテキストのペアを大量学習し同じベクトル空間に埋め込むことで、両者の意味的な近さを判定できるようにした対照学習モデルのこと。

Krea (クレア)

くれあ

Kreaとは、リアルタイムに画像を生成・編集できるAI画像生成ツールのこと。スケッチや指示に応じて生成結果が即座に変化し、デザイナーの試行錯誤を高速化する。

ControlNet

こんとろーるねっと

ControlNetとは、骨格・輪郭・深度マップなどの構造情報を条件として与え、画像生成AIの出力を精密にコントロールするための拡張モデルのこと。

ComfyUI (コンフィUI)

こんふぃゆーあい

ComfyUIとはStable DiffusionなどのAI画像生成モデルをノードベースのワークフローで視覚的に操作できるオープンソースGUIのこと。

SANA (高速画像生成)

さな

SANAとは、圧縮率の高い専用オートエンコーダーと軽量な変換アーキテクチャにより、少ない計算資源で高解像度画像を高速生成できるAI画像生成モデルのこと。

参照画像 (Reference Image)

さんしょうがぞう

参照画像とは、AI画像生成の際にスタイル・構図・人物外見などを視覚的に指定するために入力する見本画像のこと。テキストプロンプトだけでは伝えにくい一貫したビジュアルを再現するために使われる。

3Dガウシアンスプラッティング (Gaussian Splatting)

さんでぃーがうしあんすぷらってぃんぐ

3Dガウシアンスプラッティングとは、複数視点から撮影した画像群から、色と透明度を持つ無数の3Dガウシアン(楕円体)の集合として空間を再現し、高速にレンダリングする技術のこと。

サンプラー (Sampler / DPM++)

さんぷらー

サンプラーとは、拡散モデル画像生成において段階的にノイズを除去して画像を仕上げていく計算アルゴリズムのこと。

CFGスケール (Guidance Scale)

しーえふじーすけーる(がいだんすすけーる)

CFGスケールとは、画像生成AIがテキストプロンプトにどれほど忠実に従うかを数値で制御するパラメーターのこと。値が高いほど指示通りの画像になるが、破綻リスクも増す。

シード値 (Seed)

しーどち

シード値とは、AI画像生成において乱数の初期値として機能する数値のこと。同じプロンプトと同じシード値を指定すれば、ほぼ同一の画像を再現できる。

Seedream (ByteDance画像生成)

しーどりーむ

SeedreamとはByteDanceが開発したテキストから画像を生成するAIモデルのこと。東アジア系の人物描写やアニメ・イラストスタイルの再現精度が高く、商用ライセンスも整備されている。

GPT Image (ネイティブ画像生成)

じーぴーてぃーいめーじ

GPT Imageとは、OpenAIがChatGPTに統合したネイティブ画像生成機能のこと。従来のDALL-E系と異なり、テキストと画像を同一モデル内で処理する。

自己回帰画像生成 (Autoregressive Image Generation)

じこかいきがぞうせいせい

自己回帰画像生成とは、画像をトークン列として扱い、直前のトークンから次のトークンを順に予測しながら生成する画像生成方式のこと。

指示ベース画像編集 (Instruct Editing)

しじべーすがぞうへんしゅう

指示ベース画像編集とは、マスク指定なしで「背景を夕焼けにして」のような自然言語の指示だけで、既存画像の一部だけを書き換える画像生成AIの手法のこと。

写真修復 (Photo Restoration)

しゃしんしゅうふく

写真修復とは、色あせや傷、破損のある古い写真をAIが解析し、欠損部分の補完や色彩・解像度の復元を自動で行う画像修復技術のこと。

Janus (統合視覚生成モデル)

じゃなす

Janusとは、画像の「理解(認識・説明)」と「生成(作成)」という性質の異なる2つのタスクを、単一の自己回帰型モデルで統合的にこなす視覚モデルのこと。

深度マップ制御 (Depth Map)

しんどまっぷせいぎょ

深度マップ制御とは、画像内の奥行き情報をグレースケールで可視化したデータを条件に与え、被写体の立体構造や構図を保ったまま画像を生成する制御手法のこと。

スケッチから画像 (Sketch-to-Image)

すけっちからがぞう

スケッチから画像(Sketch-to-Image)とは、手描きの線画やラフスケッチをAIが解析し、写実的な画像やスタイル指定画像に変換する画像生成技術のこと。

スタイル転送 (Style Transfer)

すたいるてんそう

スタイル転送とは、ある画像の「絵柄・質感・タッチ」を別の画像に転写するAI技術のこと。写真を油絵風やアニメ風に変換する処理が代表例。

Stable Diffusion

すてーぶるでぃふゅーじょん

オープンソースの画像生成 AI。 ローカル環境で無料利用可能、 LoRA で自由にカスタマイズできる。

整合性モデル (Consistency Model)

せいごうせいもでる

整合性モデルとは、拡散モデルの数十段階に及ぶノイズ除去処理を1〜数ステップまで圧縮し、高速に高品質な画像や動画を生成できるようにした生成モデルの一種のこと。

線画着色 (Lineart Colorization)

せんがちゃくしょく

線画着色とは、輪郭線のみで描かれたラインアートに対してAIが自動で配色や陰影を推定し着色する画像生成技術のこと。

潜在拡散モデル (Latent Diffusion)

せんざいかくさんもでる

潜在拡散モデルとは、画像そのものではなく圧縮した潜在空間上でノイズ除去を繰り返すことで高速に画像を生成する拡散モデルの手法のこと。

DALL-E

だりー

DALL-Eとは、OpenAIが開発したテキストから画像を生成するAIモデルのこと。プロンプトを入力するだけで高品質な画像を生成できる。

T2I-Adapter (画像生成アダプタ)

てぃーつーあいあだぷたー

T2I-Adapterとは、拡散モデルによる画像生成AIに対し、線画・姿勢・深度などの構造情報を軽量なアダプタネットワークで追加学習させ、生成結果を細かく制御する技術のこと。

テキスト・トゥ・イメージ (画像生成)

てきすと・とぅ・いめーじ (がぞうせいせい)

テキスト・トゥ・イメージとは、テキストで記述したプロンプトを入力するだけで、AIが自動的に画像を生成する技術のこと。デザイン・広告・コンテンツ制作など幅広い用途で活用されている。

テキスト・トゥ・3D (3Dモデル生成)

てきすとつぅすりーでぃー

テキスト・トゥ・3Dとはテキスト(文章)の指示をもとに3Dモデルを自動生成するAI技術のこと。ゲーム・映像・EC商品ビジュアル制作の工数を大幅に削減する次世代クリエイティブ技術として注目を集めている。

Textual Inversion (テキスト反転)

てきすとるいんばーじょん

Textual Inversionとは、画像生成AIに新しい概念・スタイル・人物を数枚の参照画像から学習させ、テキストトークンとして埋め込む技術のこと。

テクスチャ生成 (Texture Generation)

てくすちゃせいせい

テクスチャ生成とは、AIが3Dモデルやゲームアセット向けの表面素材画像(色・凹凸・反射などのマップ)を自動生成する技術のこと。

DreamBooth (ドリームブース)

どりーむぶーす

DreamBooth(ドリームブース)とは、数枚〜数十枚の写真から特定の人物・ペット・商品をモデルに学習させ、任意のシーンや構図で生成できるようにする画像生成AIのファインチューニング手法のこと。

Nano Banana (ナノバナナ)

なのばなな

Nano Banana(ナノバナナ)とは、テキストプロンプトから高品質な画像を生成するAIモデルのこと。軽量設計による高速推論を特徴とし、APIや業務ツールへの組み込み用途に適した画像生成エンジンである。

ネガティブプロンプト (Negative Prompt)

ねがてぃぶぷろんぷと

ネガティブプロンプトとは、画像生成AIに対して「生成してほしくない要素」を指定する除外指示のこと。

バーチャル試着 (Virtual Try-On)

ばーちゃるしちゃく

バーチャル試着とは、AIを用いて実際に衣服やアクセサリーを着用せずにデジタル上で試着体験をシミュレートする技術のこと。ECサイトや小売業を中心に返品率低減・購買促進手段として導入が加速している。

背景除去 (Background Removal)

はいけいじょきょ

背景除去とは、画像から被写体以外の背景部分をAIが自動で認識・切り抜き、透明レイヤーや任意の背景に差し替える画像処理技術のこと。

HiDream (ハイドリーム)

はいどりーむ

HiDream (ハイドリーム) とは、HiDream.aiが開発したオープンウェイト(重み公開)の画像生成AIモデルのこと。MITライセンスで商用利用も無償で認められている。

ピクセルアート生成 (Pixel Art Generation)

ぴくせるあーとせいせい

ピクセルアート生成とは、限られた色数とドット単位のグリッドで構成されるレトロゲーム風の画像をAIで自動生成する技術のこと。

VAE (変分オートエンコーダ)

ぶいえー

VAEとは、データを低次元の潜在空間に圧縮し、そこから元に近い形へ復元するニューラルネットワークの一種のこと。

フェイススワップ (顔入れ替え)

ふぇいすすわっぷ

フェイススワップとは、画像や動画に写った人物の顔を別人の顔と入れ替えて自然に合成するAI技術のこと。

Flux (フラックス)

ふらっくす

FluxとはBlack Forest Labsが開発したオープンソース系テキスト→画像生成モデルのこと。Stable Diffusionの後継格として2024年に登場し、高い被写体忠実度と優れたプロンプト追従性で急速に普及した。

FLUX Kontext (文脈画像編集)

ふらっくすこんてきすと

FLUX Kontextとは、画像とテキスト指示を同時に読み込み、元の構図やキャラクターの一貫性を保ったまま部分編集や文脈に沿った画像修正を行う、画像編集特化のAIモデルのこと。

Flow Matching (フローマッチング)

ふろーまっちんぐ

フローマッチングとは、ノイズと実データを結ぶ経路を直接学習することで画像・動画を生成する拡散モデルの発展技術のこと。

プロンプトウェイト (Prompt Weighting)

ぷろんぷとうぇいと

プロンプトウェイトとは、画像生成AIにおいてプロンプト内の各キーワードに数値的な重みを付与し、生成画像への影響度を要素ごとに細かく制御する技術のこと。

プロンプト忠実度 (Prompt Adherence)

ぷろんぷとちゅうじつど

プロンプト忠実度とは、 画像・動画生成 AI が入力プロンプトの指示内容をどれだけ正確に画像へ反映できるかを示す指標のこと。

Magnific (AIアップスケーラー)

まぐにふぃっく

Magnific とは AI で画像の解像度と質感を大幅に引き上げる アップスケーリングツールのこと。 生成画像特有ののっぺり感を解消する用途で使われる。

マルチ参照生成 (Multi-Reference Generation)

まるちさんしょうせいせい

マルチ参照生成とは、複数の参照画像を同時入力し、人物・スタイル・構図の一貫性を保ったまま新しい画像を生成する手法のこと。

Midjourney

みっどじゃーにー

高品質な AI 画像生成。 アート / イラスト / 写真風画像が最も美しく出力されると評判。

Recraft (デザイン特化生成)

りくらふと(でざいんとっかせいせい)

Recraftとは、SVGベクター出力に対応したデザイン特化型のAI画像生成サービスのこと。ロゴ・アイコン・ブランドイラストなど実務向けアセット生成を得意とし、デザイナーのワークフローへの統合に強みがある。

領域別プロンプト (Regional Prompter)

りょういきべつぷろんぷと

領域別プロンプトとは、画像生成AIで1枚の画像内を複数の領域に分割し、各領域ごとに異なるプロンプトを個別に適用できる制御手法のこと。

リライティング (Relighting / 再照明)

りらいてぃんぐ

リライティングとは、AI を使って撮影済み画像や生成画像の光源・影・色温度を事後的に自由に変更できる再照明技術のこと。

レイヤー分離生成 (Layered Generation)

れいやーぶんりせいせい

レイヤー分離生成とは、画像を背景・被写体・文字などの要素ごとに独立したレイヤーとして生成し、後から個別に編集できるようにする画像生成手法のこと。

Reve (レーヴ画像生成)

れーぶがぞうせいせい

Reveとは、プロンプトへの忠実な反映とテキスト描画精度に強みを持つAI画像生成モデル・サービスのこと。

Leonardo AI (レオナルド)

れおなるど

Leonardo AI (レオナルド) とは、テキストプロンプトから画像を生成する AI サービスのこと。ゲームアセットや広告クリエイティブ制作向けの機能が充実している。

Rectified Flow (整流フロー)

れくてぃふぁいどふろー

Rectified Flow(整流フロー)とは、ノイズからデータへの生成過程を直線的な経路として学習し、少ないステップで高品質な画像・動画生成を可能にする拡散モデルの派生手法のこと。

他のカテゴリ

AI用語辞典のトップへ

全カテゴリ横断で検索・絞り込みができます

辞典トップへ