AI動画モデル

オープンソースAIで無限の創造性を手に入れる

Stable DiffusionはAI画像生成のオープンソース標準です。数千のコミュニティモデルにアクセスし、あらゆるパラメータを微調整し、アニメからフォトリアルまであらゆるスタイルで画像を生成。制限なし、サブスクリプションなし、完全な創造的自由を。

安定拡散の例

Stable Diffusionが生み出すものをご覧ください — アニメ風景からフォトリアルな車、レトロなピクセルアートまで。

AI生成のアニメスタイルの日本の村の秋の風景、紅葉の谷

アニメ風景

AI生成のフォトリアルな銀色のスポーツカー、海岸道路の夕日

フォトリアルな車

AI生成のダークエルフの盗賊キャラクターコンセプト、精巧な革の鎧

ファンタジーキャラクター

Stable Diffusionが無限の可能性を提供する理由

Stable Diffusionは活発なオープンソースコミュニティによる数千の専用モデルとツールで、類を見ないカスタマイズ性と柔軟性を提供します。

オープンソースの自由

数千のコミュニティトレーニングモデル、LoRAs、カスタムチェックポイントを備えたオープンソースアーキテクチャを基盤に構築。ベンダーロックインなし、使用制限なし、完全な透明性。

無限の芸術スタイル

アニメ、フォトリアル、ファンタジー、建築、その他無数のニッチ向けの専用モデルにアクセス。想像できるスタイルなら、そのモデルがあります。

ピクセル単位のコントロール

シード値、CFGスケール、サンプリングステップ、ノイズ除去強度を調整して、生成のあらゆる側面をピクセル単位でコントロール。完璧になるまで微調整できます。

高度な画像編集

インペインティング、アウトペインティング、img2img機能で、特定の領域を正確に修正したり、元のキャンバスを超えて創造的に拡張したりできます。

仕様

技術仕様

Stable Diffusion 画像生成の詳細仕様

最大解像度ハイレゾリューションフィックスとタイリングオプションで最大2048x2048。
アスペクト比任意のカスタムアスペクト比をサポート。1:1、16:9、9:16、4:3、21:9など。
入力方式テキストプロンプト、画像から画像、インペインティング、アウトペインティング、ControlNetガイダンス。
生成速度モデルと設定に応じて、平均5〜20秒で1枚の画像を生成。
出力形式オプションの透過サポート付きPNG、JPEG、WebP。
モデルバリエーションSD 1.5、SDXL、SDXL Turbo、および数百のコミュニティファインチューン。

高度な機能

Stable Diffusionが利用可能な最も柔軟なAI画像生成ツールである理由をご紹介

精密なテキストから画像ネガティブプロンプト、プロンプト重み付け、強調修飾子をサポートするテキストプロンプトから画像を生成。Stable Diffusionは生成プロセスの深いコントロールを提供 — 出力がビジョンと完全に一致するまであらゆる側面を微調整できます。
画像から画像の変換ノイズ除去強度を調整して既存の画像を変換。構造を保ちながらスタイルを変更するか、高ノイズ除去で画像を完全に再想像。スタイル転送や創造的リミックスに最適です。
インペインティング&アウトペインティングインペインティングで画像の特定の領域を編集したり、アウトペインティングで元の境界を超えてキャンバスを拡張。ディテールの修正、不要な要素の除去、構図の拡張に最適です。
ControlNet ガイダンスポーズ、深度マップ、エッジ検出、セグメンテーションなどの追加入力で生成をガイド。構図、アナトミー、構造の精密なコントロールを維持してプロ級の結果を得られます。

人気のユースケース

クリエイターがStable Diffusionの柔軟性を活用して専門的なプロジェクトに取り組む方法

01

アニメ・マンガアート

専用のアニメモデルにアクセスして、本格的な日本アニメーションスタイルでキャラクター、シーン、アートワークを作成。少年から少女まで、あらゆるエステティックに対応するモデルがあります。

02

建築・インテリアデザイン

フォトリアルまたはスタイライズなレンダリングで建物のコンセプト、インテリアデザイン、ランドスケープアーキテクチャを生成。数時間でクライアントに複数のデザインオプションを提示。

03

一貫したキャラクターデザイン

LoRAsとエンベディングを使用して一貫したキャラクターを作成。キャラクターの連続性が重要なゲーム開発、ストーリーテリング、コンセプトアートに最適です。

04

写真修復・編集

インペインティングとimg2imgを使用して古い写真を修復、不要な要素を除去、画像品質を向上、元のフレームを超えて構図を拡張します。

比較

関連ツールとモデル

他のAI画像ツールを探索し、モデルを比較して最適なものを見つけましょう

AI画像生成複数のAIモデルでテキストプロンプトから驚異的な画像を生成開く
画像から画像AIパワーのスタイル転写で既存の画像を変換開く
DALL-E 3正確なプロンプト理解を備えたOpenAIの先進的画像生成ツール開く
テキストから画像詳細なテキスト記述から画像を生成開く

よくある質問

ClipCanvaでのStable Diffusionの利用について知っておくべきこと

SD 1.5とSDXLの違いは何ですか?
SD 1.5は数千のファインチューンを持つ巨大なコミュニティサポートを備えたオリジナルモデル(512x512)です。SDXLは新しいバージョン(1024x1024)で、より優れたプロンプト理解、高解像度、改善された画質を標準で提供します。SDXL Turboはほぼ即座の生成を実現します。ClipCanvaはすべてのバリエーションをサポートしています。
Stable Diffusionの画像を商業プロジェクトに使用できますか?
はい、Stable Diffusionはオープンソースであり、ベースモデルで生成された画像は商業利用が可能です。ただし、一部のコミュニティファインチューンモデルには独自のライセンスがある場合がありますので、個別のモデル利用規約をご確認ください。ClipCanvaの有料プランで生成されたすべての画像には商業利用権が含まれています。
LoRAsとエンベディングとは何ですか?
LoRAs(低ランク適応)は、Stable Diffusionに特定のスタイル、キャラクター、概念を教える小さなモデルアドオンです。エンベディングは、特定の被写体の一貫した生成のために語彙に新しいキーワードを追加するテキスト反転モデルです。両方ともClipCanvaでサポートされています。
ネガティブプロンプトはどう機能しますか?
ネガティブプロンプトは、生成される画像に含めたくないものをモデルに伝えます。不要な要素の除去、アナトミーの改善、画像品質の洗練に不可欠です。一般的なネガティブプロンプトには「ぼやけた、低品質、変形した手、余分な指、悪い解剖学」などがあります。
ローカルで実行するのとClipCanva経由で使うのは何が違いますか?
Stable Diffusionをローカルで実行するには、高性能GPU、技術的設定、手動のモデル管理が必要です。ClipCanvaではSD 1.5、SDXL、コミュニティモデルにゼロ設定ですぐにアクセスできます。ハードウェア投資もドライバーの問題もダウンロードの待ち時間もなし — ただ生成するだけです。
Stable Diffusionの料金はいくらですか?
ClipCanvaでのStable Diffusionは1枚の画像生成あたり20クレジット — DALL-E 3と同じです。400クレジットが$9.90からで、最大20枚の画像を生成可能。サブスクリプション不要。クレジットはすべてのClipCanvaモデルとツールで共有できます。
安定拡散は DALL-E 3 とどう違うのですか?
Stable DiffusionはLoRAs、ControlNet、パラメータチューニングによるより深いカスタマイズを提供 — 細かいコントロールが必要なパワーユーザーに最適です。DALL-E 3はより一貫した標準の結果と優れたプロンプト理解、テキストレンダリングを提供します。多くのクリエイターが異なるプロジェクトで両方を使用しています。
画像にウォーターマークは入りますか?
有料プランの画像はウォーターマークなしで商業利用可能です。無料トライアルの出力には小さなウォーターマークが入る場合があります。