2026年、ローカルとオンラインはどちらを選ぶべき?
たまに画像を作る人、スマホやノートPCで手軽に始めたい人、会話しながら修正したい人はオンラインから。対応GPUをすでに持ち、同じモデルやLoRAで繰り返し制作したい人はローカルが有力です。月額課金を節約するためだけに高額GPUを買うと、回収に数年かかることがあります。
ローカルとは、AIモデルを自分の端末で実行する方式です。それだけで高画質になるわけでも、料金や制限がすべてなくなるわけでもありません。同じ配布モデルをPCでもクラウドAPIでも動かせる場合があります。画質を左右するのは、実行場所に加えてモデル、精度、設定、処理工程です。
| 比較項目 | ローカル生成 | オンライン生成 |
|---|---|---|
| 初期費用 | 対応GPU・PC、ストレージ、設定時間が必要 | 通常はGPU購入不要。無料体験・月額・従量課金から選ぶ |
| モデル性能 | モデルとワークフロー、搭載メモリ次第 | 非公開モデルも使えるが、処理環境は提供元に依存 |
| 文字・プロンプト | 文章を理解する新しいモデルもある。タグ向きのモデルも存在 | 会話で修正しやすいサービスがある。画像内の誤字確認は必要 |
| NSFW対応 | モデル・ライセンス・アプリ次第。一律に無制限ではない | SFW限定からセンシティブ表現に対応するものまで異なる |
| 速度・回数 | GPU性能、解像度、バッチ数が上限になる | 待ち時間、契約プラン、クレジット、レート制限に依存 |
| アニメ・実写 | 特化モデルと対応LoRAで調整しやすい | アニメ特化型と汎用型を用途に合わせて選ぶ |
| 管理・プライバシー | 自分で更新・保存を管理。完全ローカルなら素材を端末内に置ける | 導入は簡単。データの扱いと公開範囲はサービスごとに確認 |
本記事は2026年9月8日に確認した公式情報を中心とする比較ガイドです。全モデルを同一条件で実測したベンチマークではありません。メーカー公表の速度と独自の費用試算を区別して記載します。ハードウェアは日本円の国内掲載価格、サブスクリプションは購入経路を明記した料金で比較します。米ドル公表のサービスには、為替の基準日を示した円の参考換算額を併記します。
実際の制作は「生成」と「仕上げ」を分ける
1. 生成環境を決める。 ComfyUIは、画像生成モデルそのものではなく、ノードを組み合わせるオープンソースの操作画面・実行エンジンです。生成から編集まで処理をつなげられます。ただし、自分のPCに入れたComfyUIでも、外部APIを呼ぶノードを使えばオンライン処理や別料金が発生します。

2. 採用した画像だけ仕上げる。 構図が決まっていて画像サイズだけ足りない場合は、AirMore AI画像アップスケーラーをブラウザで使う方法もあります。これは生成後の画像を拡大するツールで、画像生成AIの代わりではありません。誤字を確実に直したり、補われた細部の正しさを保証したりする機能でもないため、拡大後に確認してください。機密素材には、必要なデータ管理条件を満たす方法を選びましょう。

最初から候補をすべて高解像度にすると、時間もクレジットも消費します。小さなラフで構図を選び、採用画像にだけ仕上げの処理をかけると、ローカルでもオンラインでも無駄を減らせます。
料金比較:GPU購入・月額課金・APIのどれが安い?
ローカルの予算はGPU単体で考えず、PC全体で見積もります。VRAM、メインメモリ、SSDの空き、電源容量、冷却が必要です。編集部の目安としては、新たに環境を組むならVRAM 16GB・メインメモリ32GBから検討すると選択肢を広げやすくなります。ただし、すべてのモデルが動く最低条件ではありません。大型モデルでは追加メモリや、速度を犠牲にするオフロードが必要になる場合があります。
| 国内販売モデルの例 | VRAM | 日本円の掲載価格 | 購入先・条件 |
|---|---|---|---|
| ZOTAC RTX 5060 Ti 16GB Twin Edge OC | 16GB | 157,850円(税込) | 公式ショップ掲載価格 |
| ZOTAC RTX 5070 Ti SOLID SFF OC | 16GB | 278,850円(税込) | 公式ショップ掲載価格・在庫切れ |
| ZOTAC RTX 5090 SOLID OC | 32GB | 900,800円(税込) | 公式ショップ掲載価格 |
上表は2026年9月8日に確認した特定モデルの国内ショップ掲載価格です。市場最安値やNVIDIAの発売時希望価格ではありません。在庫切れの商品は、その価格ですぐに購入できるとは限りません。送料・納期・最終請求額を販売店で確認してください。16GB同士でも速度は異なり、32GBは大きな処理を載せやすい一方で、電源・冷却などの追加費用も考慮が必要です。
| オンラインの選択肢 | 料金・円の参考額 | 料金に含まれるもの/制限 |
|---|---|---|
| ChatGPT Plus | 3,000円(日本のApp Store掲載価格例) | ChatGPTの画像生成。利用上限あり、APIは別料金 |
| Midjourney | 月払い:Basic 10 USD(約1,547円)/Standard 30 USD(約4,642円)/Pro 60 USD(約9,285円)/Mega 120 USD(約18,570円) | プラン別のFast時間。Standard以上はRelax画像生成に対応 |
| NovelAI | 月払い:Tablet 10 USD(約1,547円)/Scroll 15 USD(約2,321円)/Opus 25 USD(約3,869円) | Anlasと各プランの特典。V5のOpus無料生成枠には回復式の上限あり |
| FLUX.2 klein 4B API | 1MP画像1枚あたり0.014 USDから(約2.17円から) | 画像ごとの従量課金。大きさや編集入力によって加算 |
| GPT Image 2 API | 100万画像トークンあたり入力8 USD(約1,238円)/出力30 USD(約4,642円)。テキスト入力は100万トークンあたり5 USD(約774円) | 標準料金。解像度・品質・入力画像などで総額が変わる |
ChatGPT Plusの円価格はiOSの掲載価格例です。購入画面で請求周期を確認してください。Web契約の日本円価格と同一とは限りません。OpenAIの通貨・請求案内ではWebでJPYを利用でき、アプリはストア経由で請求され、APIクレジットは米ドルで購入すると説明しています。
出典:ChatGPT Plus、Midjourney料金表、NovelAIサブスクリプション、BFL料金、OpenAI API料金。キャッシュ入力やバッチ処理には別単価があります。年払いの月額換算と月払い、税抜きと税込みを混同しないようにしましょう。
参考換算の基準:フランス銀行の2026年9月7日公表値(1 EUR=1.1622 USD、1 EUR=179.8500 JPY)から、1 USD≒154.7496円で計算し丸めています。Midjourney・NovelAI・APIの円表示は国内固定価格ではなく、米ドル公表料金の目安です。税・カード会社の為替手数料は含みません。Midjourneyの税の案内のとおり、税は請求先に応じて決済時に加算される場合があります。
回収期間の試算(仮定):追加ハードウェアが120,000円、解約するオンラインプランが月4,500円、ローカルの継続費用が月750円なら、120,000 ÷(4,500 − 750)=32か月です。PC一式を225,000円と仮定すると60か月です。上表の製品価格や特定プランの料金を表す例ではありません。契約を継続する場合、この節約は発生しません。売却額、修理費、設定時間は含めていません。
電気代の計算例:PC全体が0.35kW、月30時間、仮の電力単価が31円/kWhなら、0.35 × 30 × 31=325.5円です。特定GPUの実測値や全国共通の電気料金ではありません。自宅の契約単価と実測消費電力に置き換えてください。導入や不具合対応の時間も費用に含めて考えましょう。
少量ならAPI、対応GPUをすでに持って大量生成するならローカルが有利になりやすいものの、比較すべきは「採用1枚」の費用です。仮に1回5円でも採用率25%なら、採用1枚は修正前の時点で20円です。
ローカルのモデル性能:大きさより用途で選ぶ
FLUX.2 [klein] 4Bは、比較的小さなモデルで生成・編集を試したい場合の候補です。4BはApache 2.0ですが、9Bの配布重みは別の非商用ライセンスで、商用利用には別途条件の確認が必要です。「FLUXなら全部同じ条件」とは考えないでください。公式のローカル利用・ライセンス案内。

BFLの表では、蒸留版4BのRTX 5090での推論が約1.2秒、VRAMが約8.4GB。一方、実行ガイドはより広い処理構成で約13GBを挙げています。測定範囲が異なるため、8GBのGPUで余裕を持って動くという意味ではありません。エンコーダー、画像の復元処理、編集用入力の分も必要です。5090の時間を5060 Tiに当てはめることもできません。公式性能表/実行ガイド。
Qwen-Image-2512は、実写表現や文字を含む構図を検討したい20B規模の配布モデルです。公式カードでは人物の自然さと文字描画の改善、英語・中国語が案内されています。大きなモデルなので、量子化やCPUへのオフロードで動かす場合は速度・出力への影響も確認しましょう。本記事ではダウンロード可能な比較対象として扱い、Qwen全製品の最新版とは位置付けていません。公式モデルカード・Apache 2.0ライセンス。

Z-Image-Turboは効率重視の6B蒸留モデルです。開発元は8回の関数評価、写真風の生成、英語・中国語の文字描画、VRAM 16GBの一般向け環境への適合を説明しています。「1秒未満」という速度は業務用H800での公表値で、自宅のGPUの保証値ではありません。公式モデルカード。

アニメでは、最大サイズの汎用モデルを選ぶより、目的に合う特化モデルや対応LoRAを探す方が効果的な場合があります。LoRAは特定のモデル系列に対応する追加学習データで、どのモデルにも使える共通プラグインではありません。まずは同じベースモデルの動作例を使いましょう。配布元の見方はAI画像生成モデル・LoRA配布サイトのガイドで紹介しています。
オンラインのモデル性能:会話編集・画風・アニメ特化を比較
公式の利用窓口:ChatGPT・Midjourney・NovelAI。
ChatGPT Images 2.0/GPT Image 2は、会話で画像を作り、続けて修正を頼みたい人の候補です。指示を少しずつ変える広告案や構図検討と相性がよいと考えられます。ChatGPTの製品機能と、開発者向けAPIモデルの契約・料金は分けて確認してください。OpenAI公式日本語発表/APIモデルの案内。

Midjourney V8.2は、公式資料によると2026年7月24日からデフォルトになりました。美的表現やパーソナライズ、新しいEdit Modelが特徴です。同サービスのアニメ向けにはNiji 7もあります。画風の方向性を探す用途に向きますが、それだけで商品ラベルの正確さや複雑な指示の再現性まで優れているとは判断できません。公式バージョン比較。

NovelAI Diffusion V5は、アニメ系の生成に加え、自然文・日本語プロンプト、複数キャラクターの制御、文字描画を改善したモデルです。Fullは対象が広く、Curatedは意図しないセンシティブ表現を抑えたい場合の選択肢です。キャラクター場面や漫画制作との相性を検討できます。V5の公式モデル説明。

初心者向けの会話編集、画風を探すための仕組み、キャラクターを配置する機能は、それぞれ違う強みです。年契約の前に、自分の仕事で難しい指示をいくつか試しておくと、見栄えのよいサンプルだけで選ぶ失敗を減らせます。
「プロンプト理解」と「画像内の文字描画」は別の能力
プロンプト理解は、物の数、位置、色、動作などを指示どおりに描く能力です。文字描画は、画像の中に正しい文字列を描く能力です。ポスターが美しくても見出しに誤字がある、文字は正しいのに商品を持つ人物が違う、といった失敗は分けて評価します。
| 確認する能力 | 試す指示 | 見るポイント |
|---|---|---|
| 位置・属性の理解 | 青い本の左に赤いマグカップ。奥に緑の植物 | 左右、数、色の対応が合っているか |
| 正確な文字 | 引用符で指定した短い見出しと価格を別々に置く | 脱字、数字の変更、余計な語、配置 |
| 日本語の組版 | 漢字・ひらがな・カタカナ・数字を混ぜた短文 | 小書き文字、長音、句読点、字間 |
| 部分修正 | 商品とラベルを残し、背景だけ変える | 保持したい細部まで描き直していないか |
まずは「架空のカフェの正方形ポスター。左側に青いカップ。上部に『朝のブレンド』。下3分の1は余白にする」のように、具体的な自然文で頼みます。その後、直したい点を一つずつ指定すると、矛盾する形容詞を大量に並べるより原因を追いやすくなります。
ローカルでも新しいモデルは文章を理解できます。一方、タグで学習されたアニメ系モデルでは、推奨タグや重み付けの方が扱いやすい場合があります。難しさを決めるのは実行場所だけでなく、モデルと操作方法です。古いネガティブプロンプトをどのモデルにも貼り付けるのは避けましょう。
日本語の成果物では、英語や中国語の作例だけで判断しないことが大切です。実際の文言を生成し、使用サイズで校正してください。価格、注意書き、連絡先、長文は、画像生成後に編集可能な文字として配置すると修正が容易です。指示づくりに迷ったらAI画像プロンプト作成ツールの比較も参考にできます。
生成速度・回数制限は「使える画像が完成するまで」で比較
比較する時間には、モデル読み込み、通信、待ち行列、生成、やり直し、拡大、手作業の修正を含めます。メーカーの「推論1秒」は、その一部にすぎません。
| 環境 | 主な上限 | 実際の影響 |
|---|---|---|
| 完全ローカル | VRAM、演算性能、熱、保存容量 | サービスの回数制限はないが、大きなバッチではメモリ不足になる |
| ChatGPT | 契約プランと画像生成枠、指示の複雑さ | 複雑な生成は数分かかる場合がある。全員共通の固定枚数とは限らない |
| Midjourney | Fast時間とRelaxの待ち行列 | FastはBasic 3.3/Standard 15/Pro 30/Mega 60時間。Standard以上はRelax画像生成あり |
| NovelAI V5 Opus | 回復式の無料生成枠とAnlas | 対象条件でも無料枠は有限。消費後はAnlas利用か回復待ち |
| 外部API | レート制限、残高、同時実行数 | 自動化できても無制限ではない。再試行分も予算に含める |
出典:ChatGPT画像ヘルプ、Midjourney料金表、NovelAIのOpus上限FAQ。NovelAIはV5の枠が継続的に回復し、使い切った状態から完全回復までは約1週間と説明しています。旧モデルの対象条件では別の無制限ルールが残っています。V5まで一律に「無制限」と紹介するのは不正確です。
比較するときは、同じ10件の指示と同程度の出力サイズで、生成回数、採用枚数、経過時間、支払額を記録しましょう。ローカルはモデル読み込み済みと起動直後を分けると公平です。別条件のSNS動画の秒数を比べるより、自分の作業に役立つ判断材料になります。
アニメ・実写・キャラクターの一貫性はどう違う?
アニメ・漫画:オンラインならNovelAIやMidjourneyのNiji、ローカルなら対応するアニメ特化モデルとLoRAを比較します。一枚の顔が好みかどうかに加え、コマ割り、手、登場人物の数、ページをまたぐ一貫性を個別に見てください。
実写風の人物・商品:肌、布、反射、物の形、参照画像への忠実さで評価します。顔が自然でも、商品のロゴ、パッケージ寸法、手の位置が正しいとは限りません。QwenやZ-Imageの実写に関する説明は試す理由になりますが、全オンラインモデルへの優位を証明するものではありません。
同じキャラクターの連続制作:必要な参照機能や追加学習に対応するワークフローを選び、モデルの版、指示、利用できる場合はシード、編集設定を残します。モデルや処理が変われば、同じシードでも同じ人物になる保証はありません。一枚の成功例より、10場面で同じ人物を維持する作業量が重要です。
NSFW対応:ローカルなら何でも生成できるわけではない
NSFWには芸術的な裸体、露骨な性的表現、激しい暴力表現など、異なる区分が含まれます。以下は一般的な対応と公式資料の制限を整理したもので、本記事では露骨な画像の生成実験やフィルター回避の検証は行っていません。
| 選択肢 | NSFWの位置付け | 注意する境界 |
|---|---|---|
| ローカル配布モデル | モデル・学習内容・アプリごとに異なる | 外部サービスを使わなくても、モデルの条件や法令はなくならない |
| ChatGPT Images/GPT Image 2 | 制限あり。無検閲の成人向けサービスではない | 入力・出力の安全対策があり、性的ディープフェイクなどを制限 |
| Midjourney/Niji | SFW限定 | 成人向け・残虐表現は禁止。非公開サーバーやStealthでも同じ |
| NovelAI V5 | FullとCuratedでセンシティブ表現の扱いが異なる | 公式はCuratedを意図しないセンシティブ画像の回避に適した選択肢として案内 |
| 配布モデルの外部API | ホスティング先の規約次第 | 同じモデル名でも、ローカル版と同じ許容範囲とは限らない |
根拠:OpenAI Images 2.0安全性レポート、Midjourneyコミュニティガイドライン、NovelAIモデル説明、NovelAI利用規約、BFL利用ポリシー。ここで参照したNovelAIの資料だけでは、あらゆる露骨な表現について共通の許可一覧までは確認できません。「Full」という名前を無条件の許可と解釈しないでください。
成人向け用途を検討する場合は、技術的に出力できるかと、契約上許可されるかを分けて確認します。適法で同意のある成人の題材に限定し、未成年の性的表現や、同意のない実在人物の性的な画像は扱わないでください。非公開保存できることと、特定の内容を生成してよいことも別の問題です。
プライバシー・商用利用を含めた選び方
必要な構成をインストールした完全ローカル環境なら、素材を端末内に置いたまま処理できます。ただし、外部ノードや拡張機能の通信は確認が必要です。オンラインも一律ではなく、Midjourneyの作品は初期設定で公開され、StealthはPro・Megaに限られます。ChatGPTのデータ設定も別途確認しましょう。有料契約だけでオフライン環境になるわけではありません。
仕事では、モデル本体、LoRA、参照素材、サービスプランの利用条件を確認します。重みをダウンロードできることと、制限なく商用利用できることは同じではありません。モデルのライセンスだけで、生成したロゴや人物の権利まで保証されるわけでもありません。
- 対応GPUがなく、たまに作る:無料体験やオンラインの月契約から。月額の節約だけでPC購入費を回収するのは難しい場合があります。
- GPUを持ち、同じ作業を繰り返す:ローカルで一つのモデルと安定したワークフローを試し、採用率と管理時間を記録します。
- 日本語ポスターや修正の多い案件:文字の実地確認、部分編集、最終文字を編集できる工程を優先します。
- アニメの連続制作:キャラクター制御、画風素材の互換性、V5や契約プランの実際の上限を比べます。
- 用途が混在する:定型作業はローカル、特定モデルの編集が有効な案件はオンラインと使い分けます。
併用は便利ですが、両方に支払うなら単純な節約にはなりません。ほかの候補はAI画像生成サイトの比較記事でも確認できます。
よくある質問
ローカルのAI画像生成は無料ですか?
無料のソフトや配布モデルもありますが、GPU、電気、保存容量、保守、作業時間には費用がかかります。対応PCをすでに持っているかどうかで判断が大きく変わります。
VRAM 8GBでも動きますか?
小型・量子化モデルなど、一部の構成なら可能です。ただし全モデル向けの目安にはできません。モデル単体の数値ではなく、解像度、編集入力、周辺処理を含む必要量を確認してください。
VRAMが多いほど高画質になりますか?
大きなモデルや処理を載せやすくなり、オフロードを減らせます。同じモデルを同じ条件で動かすだけなら、容量が多いだけで画質が自動的に上がるわけではありません。
オンラインでもNSFW画像を生成できますか?
サービスによって異なります。MidjourneyはSFW限定で、OpenAIにも画像の安全制限があります。他サービスではモデルの版やセンシティブ表現の条件が分かれるため、現在の規約を確認してください。
日本語を正確に描くならどちらですか?
実行場所ではなく、モデルと実際の文言で判断します。かな、句読点、数字まで確認し、重要な最終原稿は編集可能な文字として配置すると安心です。
月額課金をやめるためにGPUを買うべきですか?
まず目的のローカル環境が使えることを確かめ、実際に解約できる契約だけを節約額に入れます。購入見積もり、継続費用、採用率も含めると、買い替え時期までに回収できない場合があります。
結論:先に必要な画像を決め、それから実行環境を選ぶ
対応GPUがない人には、オンラインの方が始めやすい選択です。ローカルは、すでにGPUを持ち、同じ処理を繰り返し、自分で環境を管理できる人ほど魅力が増します。どちらを選んでも、それだけでアニメ、実写、文字描画のすべてが最良になるわけではありません。
用途に合うモデルを選び、NSFWと商用利用の条件を確認し、実際に使える一枚が完成するまでの費用と時間を比べてください。2026年の選び方で大切なのは、「ローカルは無料」「オンラインなら高性能」という大まかな印象より、この具体的な差です。