Midjourney / Stable Diffusion / DALL-Eなど
172語を50音順で表示
画像生成の用語172語
- Ideogram (アイデオグラム)あいであぐらむIdeogramとは、画像内に正確な文字を埋め込める画像生成AIのこと。ロゴ・ポスター・バナーなど文字入りビジュアルの制作に特化し、従来の画像生成AIが苦手としていた文字化けを大幅に改善した。
- IP-Adapter (参照画像アダプタ)あいぴーあだぷたーIP-Adapterとは、参照画像をプロンプト代わりに使い、拡散モデルの出力スタイル・構図・被写体を制御する軽量アダプタ技術のこと。
- アウトペインティング (Outpainting)あうとぺいんてぃんぐアウトペインティングとは、既存の画像の境界を超えて周囲の領域をAIが自動補完し、元画像と自然につながるよう拡張する画像生成技術のこと。
- アスペクト比指定 (Aspect Ratio)あすぺくとひしていアスペクト比指定とは、AIで画像や動画を生成する際に、幅と高さの比率(16:9や1:1など)をあらかじめ指定するパラメータ設定のことである。
- アップスケーリング (Upscaling)あっぷすけーりんぐアップスケーリングとは、低解像度の画像をAIが細部を補完・生成しながら高解像度へ変換する技術のこと。単純なピクセル補間と異なり、存在しうるテクスチャを自動で再構成できる。
- Adobe FireflyあどびふぁいあふらいAdobe Fireflyとは、Adobe社が開発した商用利用可能なAI画像生成エンジンのこと。PhotoshopやIllustratorに統合され、著作権クリアな学習データにより安全にクリエイティブ制作へ活用できる。
- アニメ画像生成 (Anime Generation)あにめがぞうせいせいアニメ画像生成とは、 Stable Diffusion や Midjourney などの画像生成 AI を使い、 アニメ・イラスト調のキャラクターやイラストを生成する技術のこと。
- アルファマッティング (毛先まで精密な切り抜き)あるふぁまってぃんぐアルファマッティングとは、被写体の輪郭を毛先や産毛まで含めてピクセル単位の透明度で精密に抜き出す画像切り抜き技術のこと。
- 一括生成枚数 (Batch Count)いっかつせいせいまいすう一括生成枚数(バッチカウント)とは、1回の生成リクエストで画像生成AIが同時に出力する画像の枚数のことである。プロンプトは共通のまま複数案を得られる設定を指す。
- Imagen (Google画像生成)いまじぇんImagenとは、Googleが開発したテキストから高品質な画像を生成するAIモデルのこと。Vertex AIやGeminiを通じて利用でき、写実的な表現と著作権リスクの低さを得意とする。
- イメージ・トゥ・イメージ (画像変換)いめーじとぅいめーじ(がぞうへんかん)イメージ・トゥ・イメージとは、既存の画像を入力として新たな画像を生成・変換するAI技術のこと。元画像の構図やポーズを維持しながらスタイルや質感を変えられる。
- イメージ・トゥ・3D (画像から3D生成)いめーじとぅーすりーでぃーイメージ・トゥ・3Dとは、写真や画像1枚(または複数枚)から立体的な3Dモデルを自動生成するAI技術のこと。EC商材の360度化やゲーム制作の工数削減に使われる。
- InstantID (顔ID保持生成)いんすたんとあいでぃーInstantIDとは、1枚の顔写真だけから人物の同一性を保持したまま、別のポーズや画風で画像を再生成できる顔ID保持技術のこと。
- インフォグラフィック生成 (Infographic Generation)いんふぉぐらふぃっくせいせいインフォグラフィック生成とは、テキストやデータをAIが解析し、図表・アイコン・レイアウトを組み合わせた視覚資料に自動変換する技術のこと。
- インペインティング (Inpainting)いんぺいんてぃんぐインペインティングとは、画像の一部をマスクで指定し、AIが自然に補完・置換する編集技術のこと。既存画像を活かしながら特定領域だけを変更できる。
- Whisk (Google画像リミックス)ういすくWhiskとは、被写体・シーン・スタイルの画像を組み合わせ、Geminiと画像生成AIで新しい画像を作れる、Googleの画像リミックスツールのこと。
- AIアイコン生成 (Icon Generation)えーあいあいこんせいせいAIアイコン生成とは、画像生成AIを使ってSNSやアプリ用のプロフィールアイコン・ロゴ素材を自動作成する手法のこと。
- AI絵本生成 (Picture Book)えーあいえほんせいせいAI絵本生成とは、生成AIで物語の文章とイラストを組み合わせ、子供向け絵本を自動または半自動で制作する手法のこと。
- AI建築パース生成 (Architectural Rendering)えーあいけんちくぱーすせいせいAI建築パース生成とは、建物の設計図や3Dモデルから、AIが写真のようなリアルな完成予想図(パース)を自動生成する技術のこと。
- AIサムネイル生成 (Thumbnail Generation)えーあいさむねいるせいせいAIサムネイル生成とは、動画や記事のクリック率を左右するサムネイル画像を、生成AIモデルが構図・配色・テキスト配置まで自動で作成する技術のこと。
- AI商品画像生成 (Product Photography)えーあいしょうひんがぞうせいせいAI商品画像生成 (AI Product Photography) とは、 商品写真の実写撮影を省き、 AI が EC・広告向けのスタジオ品質ビジュアルを自動生成する技術のこと。
- AIステッカー生成 (Sticker Generation)えーあいすてっかーせいせいAIステッカー生成とは、テキストプロンプトや参照画像をもとに、LINEスタンプやチャット用のステッカー画像をAIが自動生成する技術のこと。
- AIチラシ・DTP生成 (Flyer Generation)えーあいちらし・でぃーてぃーぴーせいせいAIチラシ・DTP生成とは、生成AIを使って店舗や商品のチラシ・ポスターなど印刷物のレイアウトと画像を自動で作成する手法のこと。
- AIぬりえ生成 (Coloring Page)えーあいぬりえせいせいAIぬりえ生成とは、画像生成AIを使って子ども向け・大人向けの線画イラスト(塗り絵用テンプレート)を自動で作り出す手法のこと。
- AIパッケージデザイン生成 (Packaging Design)えーあいぱっけーじでざいんせいせいAIパッケージデザイン生成とは、生成AIで商品パッケージのラベルや箱・缶のデザイン案を自動生成する技術のこと。立体形状や陳列時の見え方を踏まえた複数案を短時間で比較検討できる。
- AIバナー広告生成 (Banner Generation)えーあいばなーこうこくせいせいAIバナー広告生成とは、生成AIモデルを使い、広告用バナー画像のデザイン案を自動で複数パターン量産する手法のこと。
- AIファッションデザイン生成えーあいふぁっしょんでざいんせいせいAIファッションデザイン生成とは、テキストや参照画像から衣服のデザイン案や着用イメージを画像生成AIで作り出す手法のこと。
- AIフィギュア化生成 (Figurine Generation)えーあいふぃぎゅあかせいせいAIフィギュア化生成とは、実写や2Dイラストの人物・キャラクター画像を、生成AIでフィギュア風の立体的なパッケージ写真調ビジュアルに変換する技術のこと。
- AIフォント生成 (Font Generation)えーあいふぉんとせいせいAIフォント生成とは、機械学習モデルが文字の形状パターンを学習し、指定したスタイルの書体やロゴ用文字を自動生成する技術のこと。
- AIヘッドショット (プロフィール写真生成)えーあいへっどしょっとAIヘッドショットとは、複数枚の顔写真を生成AIで加工し、スーツ姿やオフィス背景のビジネス用プロフィール写真として自動生成するサービスのこと。
- AI間取り図生成 (Floor Plan Generation)えーあいまどりずせいせいAI間取り図生成とは、テキストや条件指定をもとに生成AIが建物の間取り図やレイアウト案を自動生成する技術のこと。
- AIマンガ生成 (Manga Generation)えーあいまんがせいせいAIマンガ生成とは、 テキストや画像入力から AI がコマ割り・キャラクター・背景を含む漫画形式の画像を自動生成する技術のこと。
- AIモックアップ生成 (Mockup Generation)えーあいもっくあっぷせいせいAIモックアップ生成とは、テキスト指示や参考画像から、Webサイトやアプリ画面、製品パッケージなどの完成イメージ(モックアップ)をAIが自動生成する技術のこと。
- AIレタッチ (Portrait Retouching)えーあいれたっちAIレタッチとは、AIモデルが人物写真の肌質や輪郭、光の当たり方などを自動で補正する画像編集手法のこと。
- AIロゴ生成 (Logo Generation)えーあいろごせいせいAIロゴ生成とは、ブランド名やイメージを入力するだけで、画像生成AIが複数パターンのロゴ案を自動で作り出す技術のこと。
- ADetailer (顔・手の自動補正)えーでぃていらーADetailerとは、AI画像生成で崩れやすい顔や手を自動検出し、その部分だけ高解像度で描き直して補正するStable Diffusion拡張機能のこと。
- SDXL (Stable Diffusion XL)えすでぃーえっくすえるSDXLとは、Stability AIが開発した画像生成AI「Stable Diffusion」の上位モデルで、解像度1024pxを標準としてより高精細で破綻の少ない画像を生成できる拡張版のこと。
- LCM-LoRA (高速生成LoRA)えるしーえむろーらLCM-LoRAとは、画像生成AIの推論ステップ数を4〜8程度まで削減し、数秒での高速生成を可能にする軽量LoRAアダプターのこと。
- Automatic1111 (画像生成WebUI)おーとまてぃっくいちいちいちいちAutomatic1111とは、Stable Diffusionをブラウザ上のGUIで操作できるオープンソースの画像生成WebUIのこと。拡張機能導入で機能を柔軟に拡張できる。
- オブジェクト除去 (Object Removal)おぶじぇくとじょきょオブジェクト除去(Object Removal)とは、写真や画像に写り込んだ不要な人物・物体・文字などをAIが検出し、周囲の情報から自然に補完して消し去る画像編集機能のこと。
- OmniGen (統合画像生成モデル)おむにじぇんOmniGenとは、画像の理解・生成・編集を一つのモデルで統合的にこなせるマルチタスク型の画像生成モデルのことである。
- 解像度バケット (Bucketing)かいぞうどばけっと解像度バケット(Bucketing)とは、画像生成AIの学習時に、元画像を縦横比の近い解像度グループに分類し、バッチごとに近い解像度でまとめて処理する手法のこと。
- 解剖学的破綻 (指・手の崩れ)かいぼうがくてきはたん(ゆび・てのくずれ)解剖学的破綻とは、AI画像生成で指の本数・関節の位置・手や腕のつながりなどが人体構造として不自然に破綻してしまう現象のことである。
- 顔匿名化 (Face Anonymization)かおとくめいか顔匿名化とは、画像や動画に写った人物の顔を検出し、ぼかし・モザイクやAI生成の別人格顔に置き換えてプライバシーを保護する技術のこと。
- 顔復元 (Face Restoration)かおふくげん顔復元(Face Restoration)とは、劣化・低解像度・ブレなどで乱れた顔写真をAIが特徴を推定して自然な状態に復元する画像処理技術のこと。
- 拡散モデル (Diffusion Model)かくさんもでる拡散モデルとは、画像にノイズを加えて壊す過程を学習し、逆にノイズから画像を復元することで高品質な画像を生成するAIの仕組みのこと。
- 画像キャプション生成 (Image Captioning)がぞうきゃぷしょんせいせい画像キャプション生成とは、画像の内容をAIが解析し、その説明文を自然な文章として自動で作り出す技術のこと。
- 画像生成セーフティフィルタ (Safety Filter)がぞうせいせいせーふてぃふぃるた画像生成セーフティフィルタとは、AI画像生成サービスが暴力的表現・性的表現・著作権侵害などの不適切な出力を自動検知してブロックする仕組みのこと。
- 画像内テキストレンダリング (Text Rendering)がぞうないてきすとれんだりんぐ画像内テキストレンダリングとは、AI画像生成モデルが画像の中に指定した文字・単語を正確に描画する技術のこと。看板・バナー広告・UIモックなど「読める文字」が必要な用途で重要視される。
- 画像バリエーション生成 (Image Variation)がぞうばりえーしょんせいせい画像バリエーション生成とは、元となる1枚の画像から構図や画風を保ちながら複数の異なるパターンを自動生成する機能のこと。
- 画像プロンプト逆生成 (Image-to-Prompt)がぞうぷろんぷとぎゃくせいせい画像プロンプト逆生成とは、既存の画像をAIに解析させ、構図・画風・被写体の特徴を言語化してプロンプト文に変換する技術のこと。
- 画像モーフィング (Image Morphing)がぞうもーふぃんぐ画像モーフィングとは、ある画像から別の画像へ滑らかに変形しながら遷移させる画像生成・編集技術のこと。
- カメラ設定プロンプト (焦点距離・被写界深度)かめらせっていぷろんぷとカメラ設定プロンプトとは、画像生成AIに焦点距離(mm)や絞り値(F値)などカメラ用語を指定し、写真的な質感や構図を制御する手法のこと。
- カラーパレット制御 (Color Palette Control)からーぱれっとせいぎょカラーパレット制御とは、AI画像生成で出力画像の配色をプロンプトやパラメータによって指定・調整する手法のこと。ブランドカラーの統一や狙った色調の再現に使われる。
- GAN (敵対的生成ネットワーク)がんGAN(敵対的生成ネットワーク)とは、生成器と識別器という2つのニューラルネットワークを競わせながら学習させ、本物と見分けがつかないデータを作り出す機械学習の手法のこと。
- Canny制御 (エッジ検出制御)きゃにーせいぎょCanny制御とは、画像から輪郭線(エッジ)を検出し、その線画情報をガイドに生成AIの構図やポーズを固定する制御技術のこと。
- キャラクター一貫性 (Character Consistency)きゃらくたーいっかんせいキャラクター一貫性とは、複数の画像や動画フレームをまたいで同一キャラクターの顔立ち・衣装・画風・体型を崩さずに保ち続けるための技術・運用手法の総称のこと。
- キャラクター参照 (--cref)きゃらくたーさんしょうキャラクター参照 (--cref) とは、Midjourneyで同一キャラクターの外見や特徴を複数の生成画像間で一致させるために、参照画像を指定するパラメータのこと。
- Canva AI (Magic Studio)きゃんばえーあいCanva 統合の AI デザイン機能群。 Magic Write / Magic Edit / Magic Switch 等。
- Qwen-Image (通義画像生成)くうぇんいめーじQwen-Image(通義画像生成)とは、Alibaba傘下のQwenチームが開発したオープンウェイトの画像生成AIモデルのこと。特に多言語の文字入れ精度の高さで知られる。
- CLIP (画像テキスト対照学習モデル)くりっぷCLIPとは、画像とテキストのペアを大量学習し同じベクトル空間に埋め込むことで、両者の意味的な近さを判定できるようにした対照学習モデルのこと。
- CLIP Skip (クリップスキップ)くりっぷすきっぷCLIP Skipとは、Stable Diffusionなど画像生成AIでCLIPテキストエンコーダーの最終層を意図的に読み飛ばす設定のことである。
- Krea (クレア)くれあKreaとは、リアルタイムに画像を生成・編集できるAI画像生成ツールのこと。スケッチや指示に応じて生成結果が即座に変化し、デザイナーの試行錯誤を高速化する。
- Chroma (オープン画像生成モデル)くろまChromaとは、Flux.1系アーキテクチャを基盤に公開されたオープンウェイトの画像生成AIモデルのこと。
- ゲームアセット生成 (Game Asset Generation)げーむあせっとせいせいゲームアセット生成とは、AI画像生成モデルを使ってキャラクター・背景・アイテムなどのゲーム内素材を自動生成する手法のこと。
- 個数・配置指定の精度 (Counting)こすう・はいちしていのせいど個数・配置指定の精度とは、画像生成AIに「りんごを3個」「左に犬、右に猫」のように数や配置を指示した際、その通りに描き分けられる度合いのこと。
- Kohya_ss (LoRA学習ツール)こひやえすえすKohya_ssとは、Stable Diffusionモデルの追加学習(LoRA等)を行うためのオープンソースなGUI/スクリプト群のことである。
- ControlNetこんとろーるねっとControlNetとは、骨格・輪郭・深度マップなどの構造情報を条件として与え、画像生成AIの出力を精密にコントロールするための拡張モデルのこと。
- ComfyUI (コンフィUI)こんふぃゆーあいComfyUIとはStable DiffusionなどのAI画像生成モデルをノードベースのワークフローで視覚的に操作できるオープンソースGUIのこと。
- SANA (高速画像生成)さなSANAとは、圧縮率の高い専用オートエンコーダーと軽量な変換アーキテクチャにより、少ない計算資源で高解像度画像を高速生成できるAI画像生成モデルのこと。
- SAM (Segment Anything Model)さむSAMとは、画像内の任意の物体をクリックやボックス指定だけで自動的に切り出せる、Meta AI開発の汎用セグメンテーションモデルのこと。
- 参照画像 (Reference Image)さんしょうがぞう参照画像とは、AI画像生成の際にスタイル・構図・人物外見などを視覚的に指定するために入力する見本画像のこと。テキストプロンプトだけでは伝えにくい一貫したビジュアルを再現するために使われる。
- 参照画像の重み (Image Weight)さんしょうがぞうのおもみ参照画像の重み(Image Weight)とは、画像生成AIで入力した参照画像の特徴をどの程度反映させるかを数値で調整するパラメータのこと。
- 3Dガウシアンスプラッティング (Gaussian Splatting)さんでぃーがうしあんすぷらってぃんぐ3Dガウシアンスプラッティングとは、複数視点から撮影した画像群から、色と透明度を持つ無数の3Dガウシアン(楕円体)の集合として空間を再現し、高速にレンダリングする技術のこと。
- サンプラー (Sampler / DPM++)さんぷらーサンプラーとは、拡散モデル画像生成において段階的にノイズを除去して画像を仕上げていく計算アルゴリズムのこと。
- サンプリングステップ数 (Steps)さんぷりんぐすてっぷすうサンプリングステップ数とは、拡散モデルがノイズ画像から最終画像を生成するまでに繰り返すノイズ除去の反復回数のこと。
- CFGスケール (Guidance Scale)しーえふじーすけーる(がいだんすすけーる)CFGスケールとは、画像生成AIがテキストプロンプトにどれほど忠実に従うかを数値で制御するパラメーターのこと。値が高いほど指示通りの画像になるが、破綻リスクも増す。
- シード値 (Seed)しーどちシード値とは、AI画像生成において乱数の初期値として機能する数値のこと。同じプロンプトと同じシード値を指定すれば、ほぼ同一の画像を再現できる。
- Seedream (ByteDance画像生成)しーどりーむSeedreamとはByteDanceが開発したテキストから画像を生成するAIモデルのこと。東アジア系の人物描写やアニメ・イラストスタイルの再現精度が高く、商用ライセンスも整備されている。
- GPT Image (ネイティブ画像生成)じーぴーてぃーいめーじGPT Imageとは、OpenAIがChatGPTに統合したネイティブ画像生成機能のこと。従来のDALL-E系と異なり、テキストと画像を同一モデル内で処理する。
- 自己回帰画像生成 (Autoregressive Image Generation)じこかいきがぞうせいせい自己回帰画像生成とは、画像をトークン列として扱い、直前のトークンから次のトークンを順に予測しながら生成する画像生成方式のこと。
- 指示ベース画像編集 (Instruct Editing)しじべーすがぞうへんしゅう指示ベース画像編集とは、マスク指定なしで「背景を夕焼けにして」のような自然言語の指示だけで、既存画像の一部だけを書き換える画像生成AIの手法のこと。
- Civitai (モデル共有コミュニティ)しびたいCivitai とは、 Stable Diffusion 系の画像生成モデルや LoRA を 無料でアップロード・共有・ダウンロードできる モデル共有コミュニティサイトのこと。
- 写真修復 (Photo Restoration)しゃしんしゅうふく写真修復とは、色あせや傷、破損のある古い写真をAIが解析し、欠損部分の補完や色彩・解像度の復元を自動で行う画像修復技術のこと。
- Janus (統合視覚生成モデル)じゃなすJanusとは、画像の「理解(認識・説明)」と「生成(作成)」という性質の異なる2つのタスクを、単一の自己回帰型モデルで統合的にこなす視覚モデルのこと。
- 深度マップ制御 (Depth Map)しんどまっぷせいぎょ深度マップ制御とは、画像内の奥行き情報をグレースケールで可視化したデータを条件に与え、被写体の立体構造や構図を保ったまま画像を生成する制御手法のこと。
- スケッチから画像 (Sketch-to-Image)すけっちからがぞうスケッチから画像(Sketch-to-Image)とは、手描きの線画やラフスケッチをAIが解析し、写実的な画像やスタイル指定画像に変換する画像生成技術のこと。
- スコア蒸留サンプリング (SDS)すこあじょうりゅうさんぷりんぐスコア蒸留サンプリング(SDS)とは、学習済みの2D拡散モデルが出力するノイズ予測を勾配として使い、3Dモデルや画像のパラメータを直接最適化する生成手法のこと。
- スタイライズ強度 (--stylize)すたいらいずきょうどスタイライズ強度 (--stylize) とは、 画像生成 AI が プロンプトの内容に忠実な出力と AI 独自の芸術的な装飾を どの程度混ぜるかを 調整するパラメータのこと。
- スタイル転送 (Style Transfer)すたいるてんそうスタイル転送とは、ある画像の「絵柄・質感・タッチ」を別の画像に転写するAI技術のこと。写真を油絵風やアニメ風に変換する処理が代表例。
- スタイルリファレンス (Style Reference / --sref)すたいるりふぁれんすスタイルリファレンスとは、生成したい画像の代わりに参照画像のURLをプロンプトに加え、その画風だけを新しい画像生成に継承させるMidjourneyなどの機能のこと。
- Stable Diffusionすてーぶるでぃふゅーじょんオープンソースの画像生成 AI。 ローカル環境で無料利用可能、 LoRA で自由にカスタマイズできる。
- ステップ蒸留 (Turbo/Lightning系の少ステップ生成)すてっぷじょうりゅうステップ蒸留とは、拡散モデルの生成に必要な演算ステップ数を教師モデルからの知識蒸留によって数ステップまで削減する高速化手法のこと。
- 整合性モデル (Consistency Model)せいごうせいもでる整合性モデルとは、拡散モデルの数十段階に及ぶノイズ除去処理を1〜数ステップまで圧縮し、高速に高品質な画像や動画を生成できるようにした生成モデルの一種のこと。
- 生成塗りつぶし (Generative Fill)せいせいぬりつぶし生成塗りつぶし(Generative Fill)とは、画像の一部を選択範囲として指定し、AIがその周囲の文脈に合わせて自然な新しい要素を生成・合成する画像編集機能のこと。
- 生成パラメータ埋め込み (PNG Info)せいせいぱらめーたうめこみ生成パラメータ埋め込みとは、AI画像生成時に使ったプロンプトやモデル名、seed値などの設定情報を画像ファイル自体に記録する仕組みのこと。
- 正則化画像 (Regularization Images)せいそくかがぞう正則化画像とは、DreamBoothやLoRAなどの追加学習で過学習を防ぐために使う、対象クラスの一般的な生成画像のこと。
- 世代劣化 (Generation Loss / 反復編集の劣化)せだいれっか世代劣化とは、AI画像を生成・編集を繰り返すたびに画質やディテールが少しずつ失われ、元の意図から乖離していく現象のこと。
- 線画着色 (Lineart Colorization)せんがちゃくしょく線画着色とは、輪郭線のみで描かれたラインアートに対してAIが自動で配色や陰影を推定し着色する画像生成技術のこと。
- 線画抽出 (Lineart Extraction)せんがちゅうしゅつ線画抽出とは、写真やカラーイラストから輪郭線だけを検出し、着色前の線画データとして取り出す画像処理技術のこと。
- 潜在拡散モデル (Latent Diffusion)せんざいかくさんもでる潜在拡散モデルとは、画像そのものではなく圧縮した潜在空間上でノイズ除去を繰り返すことで高速に画像を生成する拡散モデルの手法のこと。
- 潜在空間補間 (Latent Interpolation)せんざいくうかんほかん潜在空間補間とは、生成AIの潜在空間上で2点間を滑らかに繋ぐことで、中間的な画像や動画フレームを生成する手法のこと。
- 属性バインディング (要素の取り違え)ぞくせいばいんでぃんぐ属性バインディングとは、画像生成AIが複数の被写体や物体を同時に描く際、色・形状・素材などの属性を本来とは別の対象に取り違えて出力してしまう現象のこと。
- タイル拡散 (Tiled Diffusion)たいるかくさんタイル拡散とは、高解像度画像を生成する際にキャンバスを複数の小領域(タイル)に分割し、各タイルを個別に拡散処理してつなぎ合わせる画像生成AIの手法のこと。
- 対話型画像編集 (Conversational Image Editing)たいわがたがぞうへんしゅう対話型画像編集とは、チャット形式で指示を出しながら画像を段階的に修正していく生成AIの画像編集手法のこと。
- タグ形式プロンプト (Danbooruタグ)たぐけいしきぷろんぷとタグ形式プロンプトとは、単語やフレーズをカンマ区切りで並べて画像生成AIに特徴・スタイルを指示する記法のこと。
- DALL-EだりーDALL-Eとは、OpenAIが開発したテキストから画像を生成するAIモデルのこと。プロンプトを入力するだけで高品質な画像を生成できる。
- チェックポイントモデル (Checkpoint)ちぇっくぽいんともでるチェックポイントモデルとは、Stable Diffusionなど画像生成AIが学習した重みパラメータ一式を保存したファイルのことで、生成される画風や画質の土台となるもののこと。
- T2I-Adapter (画像生成アダプタ)てぃーつーあいあだぷたーT2I-Adapterとは、拡散モデルによる画像生成AIに対し、線画・姿勢・深度などの構造情報を軽量なアダプタネットワークで追加学習させ、生成結果を細かく制御する技術のこと。
- DDIMインバージョン (実画像の潜在復元)でぃーでぃーあいえむいんばーじょんDDIMインバージョンとは、拡散モデルの逆過程をたどって実在する画像に対応する潜在変数(初期ノイズ)を復元する手法のこと。
- Diffusers (拡散モデルライブラリ)でぃふゅーざーずDiffusersとは、Hugging Faceが提供する、Stable Diffusionなど拡散モデルの学習・推論を統一APIで扱えるPythonライブラリのことである。
- テキスト・トゥ・イメージ (画像生成)てきすと・とぅ・いめーじ (がぞうせいせい)テキスト・トゥ・イメージとは、テキストで記述したプロンプトを入力するだけで、AIが自動的に画像を生成する技術のこと。デザイン・広告・コンテンツ制作など幅広い用途で活用されている。
- テキスト・トゥ・3D (3Dモデル生成)てきすとつぅすりーでぃーテキスト・トゥ・3Dとはテキスト(文章)の指示をもとに3Dモデルを自動生成するAI技術のこと。ゲーム・映像・EC商品ビジュアル制作の工数を大幅に削減する次世代クリエイティブ技術として注目を集めている。
- テキスト・トゥ・CAD (CADデータ生成)てきすととぅーきゃどテキスト・トゥ・CADとは、自然言語による指示文からCAD(コンピュータ支援設計)用の設計データを自動生成する生成AI技術のこと。
- Textual Inversion (テキスト反転)てきすとるいんばーじょんTextual Inversionとは、画像生成AIに新しい概念・スタイル・人物を数枚の参照画像から学習させ、テキストトークンとして埋め込む技術のこと。
- テクスチャ生成 (Texture Generation)てくすちゃせいせいテクスチャ生成とは、AIが3Dモデルやゲームアセット向けの表面素材画像(色・凹凸・反射などのマップ)を自動生成する技術のこと。
- 透過画像生成 (Transparent Background)とうかがぞうせいせい透過画像生成とは、AIが被写体を背景から自動分離し、アルファチャンネル付きPNGなど透明背景の画像を出力する技術のこと。
- DreamBooth (ドリームブース)どりーむぶーすDreamBooth(ドリームブース)とは、数枚〜数十枚の写真から特定の人物・ペット・商品をモデルに学習させ、任意のシーンや構図で生成できるようにする画像生成AIのファインチューニング手法のこと。
- トリガーワード (LoRA起動語)とりがーわーどトリガーワードとは、LoRA(追加学習モデル)が学習した人物・画風・構図などの特徴を画像生成時に呼び出すため、プロンプトに含める特定の単語やフレーズのことである。
- Nightshade / Glaze (学習妨害ツール)ないとしぇーど・ぐれいずNightshade / Glazeとは、イラストをAI学習データとして無断利用されないよう、画像に人間の目にはほぼ見えない微細なノイズを加えて学習を妨害する保護ツールのこと。
- Nano Banana (ナノバナナ)なのばななNano Banana(ナノバナナ)とは、テキストプロンプトから高品質な画像を生成するAIモデルのこと。軽量設計による高速推論を特徴とし、APIや業務ツールへの組み込み用途に適した画像生成エンジンである。
- Nano Banana Pro (ナノバナナプロ)なのばななぷろNano Banana Proとは、Google DeepMindが開発したGemini基盤の高精度画像生成・編集AIモデルのこと。
- ネガティブ埋め込み (Negative Embedding)ねがてぃぶうめこみネガティブ埋め込みとは、Stable Diffusion系の画像生成AIで、除外したい特徴を学習済みベクトルとしてネガティブプロンプトに読み込み、不要な要素の出現を抑える手法のこと。
- ネガティブプロンプト (Negative Prompt)ねがてぃぶぷろんぷとネガティブプロンプトとは、画像生成AIに対して「生成してほしくない要素」を指定する除外指示のこと。
- ノイズオフセット (Noise Offset)のいずおふせっとノイズオフセットとは、拡散モデルの学習時にノイズへ一定のオフセットを加算し、真っ黒や真っ白に近い極端な明暗の画像を生成しやすくする手法のこと。
- ノイズスケジュール (Noise Schedule)のいずすけじゅーるノイズスケジュールとは、拡散モデルが画像を生成する各ステップで、どれだけノイズを加える・取り除くかを制御する数値の変化パターンのこと。
- NovelAI (イラスト生成サービス)のべるあいNovelAIとは、アニメ・イラスト調の画像生成に特化したサブスクリプション型AIサービスのこと。独自学習の拡散モデルとテキスト生成補助機能も提供する。
- バーチャル試着 (Virtual Try-On)ばーちゃるしちゃくバーチャル試着とは、AIを用いて実際に衣服やアクセサリーを着用せずにデジタル上で試着体験をシミュレートする技術のこと。ECサイトや小売業を中心に返品率低減・購買促進手段として導入が加速している。
- バーチャルステージング (Virtual Staging)ばーちゃるすてーじんぐバーチャルステージングとは、空室の物件写真にAIで家具や装飾を合成し、生活感のあるインテリア画像を作る手法のこと。
- 背景除去 (Background Removal)はいけいじょきょ背景除去とは、画像から被写体以外の背景部分をAIが自動で認識・切り抜き、透明レイヤーや任意の背景に差し替える画像処理技術のこと。
- HiDream (ハイドリーム)はいどりーむHiDream (ハイドリーム) とは、HiDream.aiが開発したオープンウェイト(重み公開)の画像生成AIモデルのこと。MITライセンスで商用利用も無償で認められている。
- Hires.fix (高解像度補助)はいれずふぃっくすHires.fixとは、画像生成AIで低解像度の画像をまず生成し、その後アップスケールして高解像度で再度描画し直す二段階の生成処理のこと。
- ピクセルアート生成 (Pixel Art Generation)ぴくせるあーとせいせいピクセルアート生成とは、限られた色数とドット単位のグリッドで構成されるレトロゲーム風の画像をAIで自動生成する技術のこと。
- PixArt (画像生成モデル)ぴっくすあーとPixArtとは、Diffusion Transformer構造を採用し高速・低コストな学習を実現する画像生成AIモデルのことである。
- 美的スコア (Aesthetic Score)びてきスコア美的スコアとは、AIが生成した画像の構図・色彩・ディテールなどを学習済みモデルが自動採点し、数値で表す評価指標のこと。
- VAE (変分オートエンコーダ)ぶいえーVAEとは、データを低次元の潜在空間に圧縮し、そこから元に近い形へ復元するニューラルネットワークの一種のこと。
- フェイススワップ (顔入れ替え)ふぇいすすわっぷフェイススワップとは、画像や動画に写った人物の顔を別人の顔と入れ替えて自然に合成するAI技術のこと。
- フォトバッシュ (素材合成を下地にした生成)ふぉとばっしゅフォトバッシュとは、複数の写真素材を切り貼り・合成した下地を作り、その上から加筆やAI生成で仕上げるコンセプトアート制作手法のこと。
- フォトリアリズム (写実性の再現度)ふぉとりありずむフォトリアリズムとは、AI生成画像において肌の質感・光の反射・素材の陰影などを実写と見分けがつかないレベルまで精密に再現する表現水準のこと。
- Flux (フラックス)ふらっくすFluxとはBlack Forest Labsが開発したオープンソース系テキスト→画像生成モデルのこと。Stable Diffusionの後継格として2024年に登場し、高い被写体忠実度と優れたプロンプト追従性で急速に普及した。
- FLUX Kontext (文脈画像編集)ふらっくすこんてきすとFLUX Kontextとは、画像とテキスト指示を同時に読み込み、元の構図やキャラクターの一貫性を保ったまま部分編集や文脈に沿った画像修正を行う、画像編集特化のAIモデルのこと。
- ブランドキット (生成スタイルの固定)ぶらんどきっとブランドキットとは、AI画像生成において配色・フォント・キャラクター・トンマナなどのスタイル要素を事前登録し、量産する画像やクリエイティブの見た目を統一する仕組みのこと。
- ブレ除去 (Deblurring)ぶれじょきょブレ除去(デブラー)とは、手ブレや被写体ブレで劣化した画像・動画から、AIが鮮明な状態を推定して復元する画像処理技術のこと。
- Flow Matching (フローマッチング)ふろーまっちんぐフローマッチングとは、ノイズと実データを結ぶ経路を直接学習することで画像・動画を生成する拡散モデルの発展技術のこと。
- プロンプトウェイト (Prompt Weighting)ぷろんぷとうぇいとプロンプトウェイトとは、画像生成AIにおいてプロンプト内の各キーワードに数値的な重みを付与し、生成画像への影響度を要素ごとに細かく制御する技術のこと。
- プロンプトエンハンサー (Prompt Enhancer)ぷろんぷとえんはんさープロンプトエンハンサーとは、ユーザーが入力した短い指示文をAIが自動で語彙補完・具体化し、画像生成AIの出力品質を底上げする支援機能のこと。
- プロンプト忠実度 (Prompt Adherence)ぷろんぷとちゅうじつどプロンプト忠実度とは、 画像・動画生成 AI が入力プロンプトの指示内容をどれだけ正確に画像へ反映できるかを示す指標のこと。
- Prompt-to-Prompt (注意制御編集)ぷろんぷととぅぷろんぷと(ちゅういせいぎょへんしゅう)Prompt-to-Promptとは、拡散モデルのクロスアテンションマップを操作し、プロンプトの一部を書き換えるだけで元画像の構図を保ったまま特定要素を編集できる画像編集手法のこと。
- ベクター画像生成 (SVG Generation)べくたーがぞうせいせいベクター画像生成とは、AIが拡大縮小しても輪郭が崩れないSVG形式のパスデータとして、ロゴやアイコン、イラストを生成する技術のこと。
- 変換強度 (Denoising Strength)へんかんきょうど変換強度とは、img2img生成で元画像へどれだけノイズを加えて再構成するかを0〜1の数値で指定するパラメータのこと。
- 編集の局所性 (Edit Locality)へんしゅうのきょくしょせい編集の局所性とは、AI画像編集で指定した箇所だけを変更し、無関係な部分は元の状態を保ったまま維持する性質のこと。
- ポーズ制御 (OpenPose Control)ぽーずせいぎょポーズ制御(OpenPose Control)とは、画像生成AIで人物の骨格・関節位置を指定し、狙った姿勢の人物画像を生成させる制御技術のこと。
- Magnific (AIアップスケーラー)まぐにふぃっくMagnific とは AI で画像の解像度と質感を大幅に引き上げる アップスケーリングツールのこと。 生成画像特有ののっぺり感を解消する用途で使われる。
- マルチ参照生成 (Multi-Reference Generation)まるちさんしょうせいせいマルチ参照生成とは、複数の参照画像を同時入力し、人物・スタイル・構図の一貫性を保ったまま新しい画像を生成する手法のこと。
- マルチビュー生成 (Multi-view Generation)まるちびゅーせいせいマルチビュー生成とは、1枚または少数の画像から同一の被写体やシーンを複数の視点(アングル)で一貫性を保ちながら生成するAI技術のこと。
- Midjourneyみっどじゃーにー高品質な AI 画像生成。 アート / イラスト / 写真風画像が最も美しく出力されると評判。
- Meshy (3Dアセット生成)めっしーMeshyとは、テキストや画像プロンプトから3Dモデル(形状・テクスチャ・簡易リギング付き)を自動生成できるAI3Dアセット生成ツールのこと。
- U-Net (拡散モデルの生成ネットワーク)ゆーねっとU-Netとは、画像を段階的に圧縮してから元の解像度へ復元する、左右対称の構造を持つニューラルネットワークのこと。拡散モデルのノイズ除去処理の中核を担う。
- LAION (大規模画像テキストデータセット)らいおんLAIONとは、Web上から収集した画像とテキストのペアを数十億件規模で集めたオープンな学習用データセット、またはそれを公開する非営利団体のこと。
- LyCORIS (拡張LoRA形式)らいこりすLyCORISとは、画像生成AIのLoRAを拡張し、学習可能パラメータの構造を柔軟に変えられるようにした追加学習手法群の総称のこと。
- Real-ESRGAN (超解像モデル)りある・いーえすあーるじーえーえぬReal-ESRGANとは、低解像度の画像をAIで拡大し、ノイズやブロックノイズを抑えながら自然な高解像度画像に変換する超解像モデルのこと。
- リアルタイム画像生成 (Real-time Image Generation)りあるたいむがぞうせいせいリアルタイム画像生成とは、テキストや操作入力に応じて数十〜数百ミリ秒単位で画像を逐次生成し、描画やプレビューをその場で更新する技術のこと。
- Recraft (デザイン特化生成)りくらふと(でざいんとっかせいせい)Recraftとは、SVGベクター出力に対応したデザイン特化型のAI画像生成サービスのこと。ロゴ・アイコン・ブランドイラストなど実務向けアセット生成を得意とし、デザイナーのワークフローへの統合に強みがある。
- リファイナー (Refiner)りふぁいなーリファイナーとは、画像生成AIが出力した粗い画像を追加処理し、ディテールや画質を高める仕上げ用モデルのこと。
- 領域別プロンプト (Regional Prompter)りょういきべつぷろんぷと領域別プロンプトとは、画像生成AIで1枚の画像内を複数の領域に分割し、各領域ごとに異なるプロンプトを個別に適用できる制御手法のこと。
- リライティング (Relighting / 再照明)りらいてぃんぐリライティングとは、AI を使って撮影済み画像や生成画像の光源・影・色温度を事後的に自由に変更できる再照明技術のこと。
- レイアウト指定生成 (Layout-to-Image)れいあうとしていせいせいレイアウト指定生成とは、画像内の各要素の位置やサイズをバウンディングボックスなどで事前指定してから生成する画像生成手法のこと。
- レイヤー分離生成 (Layered Generation)れいやーぶんりせいせいレイヤー分離生成とは、画像を背景・被写体・文字などの要素ごとに独立したレイヤーとして生成し、後から個別に編集できるようにする画像生成手法のこと。
- Reve (レーヴ画像生成)れーぶがぞうせいせいReveとは、プロンプトへの忠実な反映とテキスト描画精度に強みを持つAI画像生成モデル・サービスのこと。
- Leonardo AI (レオナルド)れおなるどLeonardo AI (レオナルド) とは、テキストプロンプトから画像を生成する AI サービスのこと。ゲームアセットや広告クリエイティブ制作向けの機能が充実している。
- Rectified Flow (整流フロー)れくてぃふぁいどふろーRectified Flow(整流フロー)とは、ノイズからデータへの生成過程を直線的な経路として学習し、少ないステップで高品質な画像・動画生成を可能にする拡散モデルの派生手法のこと。
- ワイルドカード生成 (Dynamic Prompts)わいるどかーどせいせいワイルドカード生成とは、プロンプト内に候補語群や変数を埋め込み、生成のたびにランダムまたは規則的に置き換えて多数のバリエーション画像を自動生成する手法のこと。
AI用語辞典のトップへ
全カテゴリ横断で検索・絞り込みができます
辞典トップへ