画像生成
Midjourney / Stable Diffusion / DALL-Eなど
76語を50音順で表示
あいであぐらむ
Ideogramとは、画像内に正確な文字を埋め込める画像生成AIのこと。ロゴ・ポスター・バナーなど文字入りビジュアルの制作に特化し、従来の画像生成AIが苦手としていた文字化けを大幅に改善した。
あいぴーあだぷたー
IP-Adapterとは、参照画像をプロンプト代わりに使い、拡散モデルの出力スタイル・構図・被写体を制御する軽量アダプタ技術のこと。
あうとぺいんてぃんぐ
アウトペインティングとは、既存の画像の境界を超えて周囲の領域をAIが自動補完し、元画像と自然につながるよう拡張する画像生成技術のこと。
あっぷすけーりんぐ
アップスケーリングとは、低解像度の画像をAIが細部を補完・生成しながら高解像度へ変換する技術のこと。単純なピクセル補間と異なり、存在しうるテクスチャを自動で再構成できる。
あどびふぁいあふらい
Adobe Fireflyとは、Adobe社が開発した商用利用可能なAI画像生成エンジンのこと。PhotoshopやIllustratorに統合され、著作権クリアな学習データにより安全にクリエイティブ制作へ活用できる。
あにめがぞうせいせい
アニメ画像生成とは、 Stable Diffusion や Midjourney などの画像生成 AI を使い、 アニメ・イラスト調のキャラクターやイラストを生成する技術のこと。
いまじぇん
Imagenとは、Googleが開発したテキストから高品質な画像を生成するAIモデルのこと。Vertex AIやGeminiを通じて利用でき、写実的な表現と著作権リスクの低さを得意とする。
いめーじとぅいめーじ(がぞうへんかん)
イメージ・トゥ・イメージとは、既存の画像を入力として新たな画像を生成・変換するAI技術のこと。元画像の構図やポーズを維持しながらスタイルや質感を変えられる。
いんすたんとあいでぃー
InstantIDとは、1枚の顔写真だけから人物の同一性を保持したまま、別のポーズや画風で画像を再生成できる顔ID保持技術のこと。
いんぺいんてぃんぐ
インペインティングとは、画像の一部をマスクで指定し、AIが自然に補完・置換する編集技術のこと。既存画像を活かしながら特定領域だけを変更できる。
えーあいしょうひんがぞうせいせい
AI商品画像生成 (AI Product Photography) とは、 商品写真の実写撮影を省き、 AI が EC・広告向けのスタジオ品質ビジュアルを自動生成する技術のこと。
えーあいへっどしょっと
AIヘッドショットとは、複数枚の顔写真を生成AIで加工し、スーツ姿やオフィス背景のビジネス用プロフィール写真として自動生成するサービスのこと。
えーあいまんがせいせい
AIマンガ生成とは、 テキストや画像入力から AI がコマ割り・キャラクター・背景を含む漫画形式の画像を自動生成する技術のこと。
えすでぃーえっくすえる
SDXLとは、Stability AIが開発した画像生成AI「Stable Diffusion」の上位モデルで、解像度1024pxを標準としてより高精細で破綻の少ない画像を生成できる拡張版のこと。
おむにじぇん
OmniGenとは、画像の理解・生成・編集を一つのモデルで統合的にこなせるマルチタスク型の画像生成モデルのことである。
かくさんもでる
拡散モデルとは、画像にノイズを加えて壊す過程を学習し、逆にノイズから画像を復元することで高品質な画像を生成するAIの仕組みのこと。
がぞうないてきすとれんだりんぐ
画像内テキストレンダリングとは、AI画像生成モデルが画像の中に指定した文字・単語を正確に描画する技術のこと。看板・バナー広告・UIモックなど「読める文字」が必要な用途で重要視される。
がぞうぷろんぷとぎゃくせいせい
画像プロンプト逆生成とは、既存の画像をAIに解析させ、構図・画風・被写体の特徴を言語化してプロンプト文に変換する技術のこと。
がん
GAN(敵対的生成ネットワーク)とは、生成器と識別器という2つのニューラルネットワークを競わせながら学習させ、本物と見分けがつかないデータを作り出す機械学習の手法のこと。
きゃにーせいぎょ
Canny制御とは、画像から輪郭線(エッジ)を検出し、その線画情報をガイドに生成AIの構図やポーズを固定する制御技術のこと。
きゃらくたーいっかんせい
キャラクター一貫性とは、複数の画像や動画フレームをまたいで同一キャラクターの顔立ち・衣装・画風・体型を崩さずに保ち続けるための技術・運用手法の総称のこと。
きゃんばえーあい
Canva 統合の AI デザイン機能群。 Magic Write / Magic Edit / Magic Switch 等。
くうぇんいめーじ
Qwen-Image(通義画像生成)とは、Alibaba傘下のQwenチームが開発したオープンウェイトの画像生成AIモデルのこと。特に多言語の文字入れ精度の高さで知られる。
くりっぷ
CLIPとは、画像とテキストのペアを大量学習し同じベクトル空間に埋め込むことで、両者の意味的な近さを判定できるようにした対照学習モデルのこと。
くれあ
Kreaとは、リアルタイムに画像を生成・編集できるAI画像生成ツールのこと。スケッチや指示に応じて生成結果が即座に変化し、デザイナーの試行錯誤を高速化する。
こんとろーるねっと
ControlNetとは、骨格・輪郭・深度マップなどの構造情報を条件として与え、画像生成AIの出力を精密にコントロールするための拡張モデルのこと。
こんふぃゆーあい
ComfyUIとはStable DiffusionなどのAI画像生成モデルをノードベースのワークフローで視覚的に操作できるオープンソースGUIのこと。
さな
SANAとは、圧縮率の高い専用オートエンコーダーと軽量な変換アーキテクチャにより、少ない計算資源で高解像度画像を高速生成できるAI画像生成モデルのこと。
さんしょうがぞう
参照画像とは、AI画像生成の際にスタイル・構図・人物外見などを視覚的に指定するために入力する見本画像のこと。テキストプロンプトだけでは伝えにくい一貫したビジュアルを再現するために使われる。
さんでぃーがうしあんすぷらってぃんぐ
3Dガウシアンスプラッティングとは、複数視点から撮影した画像群から、色と透明度を持つ無数の3Dガウシアン(楕円体)の集合として空間を再現し、高速にレンダリングする技術のこと。
さんぷらー
サンプラーとは、拡散モデル画像生成において段階的にノイズを除去して画像を仕上げていく計算アルゴリズムのこと。
しーえふじーすけーる(がいだんすすけーる)
CFGスケールとは、画像生成AIがテキストプロンプトにどれほど忠実に従うかを数値で制御するパラメーターのこと。値が高いほど指示通りの画像になるが、破綻リスクも増す。
しーどち
シード値とは、AI画像生成において乱数の初期値として機能する数値のこと。同じプロンプトと同じシード値を指定すれば、ほぼ同一の画像を再現できる。
しーどりーむ
SeedreamとはByteDanceが開発したテキストから画像を生成するAIモデルのこと。東アジア系の人物描写やアニメ・イラストスタイルの再現精度が高く、商用ライセンスも整備されている。
じーぴーてぃーいめーじ
GPT Imageとは、OpenAIがChatGPTに統合したネイティブ画像生成機能のこと。従来のDALL-E系と異なり、テキストと画像を同一モデル内で処理する。
じこかいきがぞうせいせい
自己回帰画像生成とは、画像をトークン列として扱い、直前のトークンから次のトークンを順に予測しながら生成する画像生成方式のこと。
しじべーすがぞうへんしゅう
指示ベース画像編集とは、マスク指定なしで「背景を夕焼けにして」のような自然言語の指示だけで、既存画像の一部だけを書き換える画像生成AIの手法のこと。
しゃしんしゅうふく
写真修復とは、色あせや傷、破損のある古い写真をAIが解析し、欠損部分の補完や色彩・解像度の復元を自動で行う画像修復技術のこと。
じゃなす
Janusとは、画像の「理解(認識・説明)」と「生成(作成)」という性質の異なる2つのタスクを、単一の自己回帰型モデルで統合的にこなす視覚モデルのこと。
しんどまっぷせいぎょ
深度マップ制御とは、画像内の奥行き情報をグレースケールで可視化したデータを条件に与え、被写体の立体構造や構図を保ったまま画像を生成する制御手法のこと。
すけっちからがぞう
スケッチから画像(Sketch-to-Image)とは、手描きの線画やラフスケッチをAIが解析し、写実的な画像やスタイル指定画像に変換する画像生成技術のこと。
すたいるてんそう
スタイル転送とは、ある画像の「絵柄・質感・タッチ」を別の画像に転写するAI技術のこと。写真を油絵風やアニメ風に変換する処理が代表例。
すてーぶるでぃふゅーじょん
オープンソースの画像生成 AI。 ローカル環境で無料利用可能、 LoRA で自由にカスタマイズできる。
せいごうせいもでる
整合性モデルとは、拡散モデルの数十段階に及ぶノイズ除去処理を1〜数ステップまで圧縮し、高速に高品質な画像や動画を生成できるようにした生成モデルの一種のこと。
せんがちゃくしょく
線画着色とは、輪郭線のみで描かれたラインアートに対してAIが自動で配色や陰影を推定し着色する画像生成技術のこと。
せんざいかくさんもでる
潜在拡散モデルとは、画像そのものではなく圧縮した潜在空間上でノイズ除去を繰り返すことで高速に画像を生成する拡散モデルの手法のこと。
だりー
DALL-Eとは、OpenAIが開発したテキストから画像を生成するAIモデルのこと。プロンプトを入力するだけで高品質な画像を生成できる。
てぃーつーあいあだぷたー
T2I-Adapterとは、拡散モデルによる画像生成AIに対し、線画・姿勢・深度などの構造情報を軽量なアダプタネットワークで追加学習させ、生成結果を細かく制御する技術のこと。
てきすと・とぅ・いめーじ (がぞうせいせい)
テキスト・トゥ・イメージとは、テキストで記述したプロンプトを入力するだけで、AIが自動的に画像を生成する技術のこと。デザイン・広告・コンテンツ制作など幅広い用途で活用されている。
てきすとつぅすりーでぃー
テキスト・トゥ・3Dとはテキスト(文章)の指示をもとに3Dモデルを自動生成するAI技術のこと。ゲーム・映像・EC商品ビジュアル制作の工数を大幅に削減する次世代クリエイティブ技術として注目を集めている。
てきすとるいんばーじょん
Textual Inversionとは、画像生成AIに新しい概念・スタイル・人物を数枚の参照画像から学習させ、テキストトークンとして埋め込む技術のこと。
てくすちゃせいせい
テクスチャ生成とは、AIが3Dモデルやゲームアセット向けの表面素材画像(色・凹凸・反射などのマップ)を自動生成する技術のこと。
どりーむぶーす
DreamBooth(ドリームブース)とは、数枚〜数十枚の写真から特定の人物・ペット・商品をモデルに学習させ、任意のシーンや構図で生成できるようにする画像生成AIのファインチューニング手法のこと。
なのばなな
Nano Banana(ナノバナナ)とは、テキストプロンプトから高品質な画像を生成するAIモデルのこと。軽量設計による高速推論を特徴とし、APIや業務ツールへの組み込み用途に適した画像生成エンジンである。
ねがてぃぶぷろんぷと
ネガティブプロンプトとは、画像生成AIに対して「生成してほしくない要素」を指定する除外指示のこと。
ばーちゃるしちゃく
バーチャル試着とは、AIを用いて実際に衣服やアクセサリーを着用せずにデジタル上で試着体験をシミュレートする技術のこと。ECサイトや小売業を中心に返品率低減・購買促進手段として導入が加速している。
はいけいじょきょ
背景除去とは、画像から被写体以外の背景部分をAIが自動で認識・切り抜き、透明レイヤーや任意の背景に差し替える画像処理技術のこと。
はいどりーむ
HiDream (ハイドリーム) とは、HiDream.aiが開発したオープンウェイト(重み公開)の画像生成AIモデルのこと。MITライセンスで商用利用も無償で認められている。
ぴくせるあーとせいせい
ピクセルアート生成とは、限られた色数とドット単位のグリッドで構成されるレトロゲーム風の画像をAIで自動生成する技術のこと。
ぶいえー
VAEとは、データを低次元の潜在空間に圧縮し、そこから元に近い形へ復元するニューラルネットワークの一種のこと。
ふぇいすすわっぷ
フェイススワップとは、画像や動画に写った人物の顔を別人の顔と入れ替えて自然に合成するAI技術のこと。
ふらっくす
FluxとはBlack Forest Labsが開発したオープンソース系テキスト→画像生成モデルのこと。Stable Diffusionの後継格として2024年に登場し、高い被写体忠実度と優れたプロンプト追従性で急速に普及した。
ふらっくすこんてきすと
FLUX Kontextとは、画像とテキスト指示を同時に読み込み、元の構図やキャラクターの一貫性を保ったまま部分編集や文脈に沿った画像修正を行う、画像編集特化のAIモデルのこと。
ふろーまっちんぐ
フローマッチングとは、ノイズと実データを結ぶ経路を直接学習することで画像・動画を生成する拡散モデルの発展技術のこと。
ぷろんぷとうぇいと
プロンプトウェイトとは、画像生成AIにおいてプロンプト内の各キーワードに数値的な重みを付与し、生成画像への影響度を要素ごとに細かく制御する技術のこと。
ぷろんぷとちゅうじつど
プロンプト忠実度とは、 画像・動画生成 AI が入力プロンプトの指示内容をどれだけ正確に画像へ反映できるかを示す指標のこと。
まぐにふぃっく
Magnific とは AI で画像の解像度と質感を大幅に引き上げる アップスケーリングツールのこと。 生成画像特有ののっぺり感を解消する用途で使われる。
まるちさんしょうせいせい
マルチ参照生成とは、複数の参照画像を同時入力し、人物・スタイル・構図の一貫性を保ったまま新しい画像を生成する手法のこと。
みっどじゃーにー
高品質な AI 画像生成。 アート / イラスト / 写真風画像が最も美しく出力されると評判。
りくらふと(でざいんとっかせいせい)
Recraftとは、SVGベクター出力に対応したデザイン特化型のAI画像生成サービスのこと。ロゴ・アイコン・ブランドイラストなど実務向けアセット生成を得意とし、デザイナーのワークフローへの統合に強みがある。
りょういきべつぷろんぷと
領域別プロンプトとは、画像生成AIで1枚の画像内を複数の領域に分割し、各領域ごとに異なるプロンプトを個別に適用できる制御手法のこと。
りらいてぃんぐ
リライティングとは、AI を使って撮影済み画像や生成画像の光源・影・色温度を事後的に自由に変更できる再照明技術のこと。
れいやーぶんりせいせい
レイヤー分離生成とは、画像を背景・被写体・文字などの要素ごとに独立したレイヤーとして生成し、後から個別に編集できるようにする画像生成手法のこと。
れーぶがぞうせいせい
Reveとは、プロンプトへの忠実な反映とテキスト描画精度に強みを持つAI画像生成モデル・サービスのこと。
れおなるど
Leonardo AI (レオナルド) とは、テキストプロンプトから画像を生成する AI サービスのこと。ゲームアセットや広告クリエイティブ制作向けの機能が充実している。
れくてぃふぁいどふろー
Rectified Flow(整流フロー)とは、ノイズからデータへの生成過程を直線的な経路として学習し、少ないステップで高品質な画像・動画生成を可能にする拡散モデルの派生手法のこと。
他のカテゴリ
GPT / Claude / Geminiなど大規模言語モデルの基礎用語
AIから良い出力を得るための指示文の設計手法
社内資料や外部DBを検索してAIに答えさせる技術
自律的に計画・行動を繰り返すAIの設計
Sora / Runway / Klingなど動画AI
Suno / ElevenLabs / Whisperなどの音声AI
MMLU / HumanEval / ArenaなどAIの評価軸
GPU / 推論 / 量子化 / FP8など計算基盤
EU AI Act / 著作権 / バイアスなど
業務自動化 / SaaS統合 / DX
プロンプトインジェクション / モデル抽出 / 防御
AI用語辞典のトップへ
全カテゴリ横断で検索・絞り込みができます
辞典トップへ