パイプライン一覧に戻る

画像生成

テキストや参照写真からAI画像を生成。商品写真、キャラクターアート、読みやすいテキスト入りポスター、フォトリアルなポートレート, 高解像度で数秒で完成。

0.2

未入力の項目: プロンプト, 参照画像

使用モデル

API

Nano Banana Pro

ランタンの灯りのPyra(Nano Banana Pro)

Nano Banana Pro。同じプロンプトをプレミアムティアで。フリルと鱗のディテールがより精細に、ランタンの光の落ち方もより豊かに。プロンプトのみ、参照画像なしです。

最適な用途

  • ストックフッテージのないニッチ/特定の題材(歴史的再現、SFコンセプト、ファンタジーシーン)
  • 概念的なビジュアル(抽象的アイデア、未来技術、あり得ないシーン)
  • 複数画像にわたる一貫したビジュアルスタイル(同じライティング、カラーパレット)
  • 商品ビジュアライゼーションとモックアップ
  • ラテン文字・非ラテン文字にわたる読みやすいテキスト入りポスター

ヒント

  • 極めて具体的に:「道路上の車」ではなく「山道を走るフォトリアルな未来的電気自動車、ドラマチックなローアングル、ゴールデンアワー、シネマティックなライティング」
  • 写真が欲しいのに出力がイラスト寄りになる場合は、「フォトリアル」を明示的に加える
  • 効果的なスタイルの軸:「シネマティック」「ドラマチックなライティング」「ボリュメトリックな霧」「浅い被写界深度」
  • 複数の生成にわたって被写体、ポーズ、商品形状を一貫させるには参照画像を使う

このパイプラインを使うレシピ

このパイプラインに関する記事

画像生成 API

このパイプラインをご自身のコードから呼び出せます。1回のリクエストで実行が始まり、モデルは独立したエンドポイントではなく入力フィールドです。

6 個の入力
0.2 to 6.4 クレジット
bun add @pipe2-ai/sdk
import { createClient } from "@pipe2-ai/sdk";

const client = createClient(process.env.PIPE2_TOKEN!);

const { run_pipeline } = await client.RunPipeline({
  pipeline_slug: "image-generator",
  input: {
    prompt: "A vintage brass telescope on a wooden desk, warm afternoon sunlight",
    model: "gemini-3-1-flash-image",
  },
});
pip install pipe2
import asyncio
import os

from pipe2 import Pipe2Client

client = Pipe2Client(token=os.environ["PIPE2_TOKEN"])

run = asyncio.run(client.run_pipeline(
    pipeline_slug="image-generator",
    input={
        "prompt": "A vintage brass telescope on a wooden desk, warm afternoon sunlight",
        "model": "gemini-3-1-flash-image",
    },
))
go get github.com/pipe2-ai/sdk-go
client := pipe2.NewClient(os.Getenv("PIPE2_TOKEN"))

input := json.RawMessage(`{
  "prompt": "A vintage brass telescope on a wooden desk, warm afternoon sunlight",
  "model": "gemini-3-1-flash-image"
}`)

run, err := pipe2.RunPipeline(context.Background(), client, "image-generator", input)
if err != nil {
    log.Fatal(err)
}
brew install pipe2-ai/tap/pipe2
pipe2 pipelines run \
  --pipeline image-generator \
  --input-json '{"prompt": "A vintage brass telescope on a wooden desk, warm afternoon sunlight", "model": "gemini-3-1-flash-image"}' \
  --wait

APIトークンを取得 →

パラメータ

prompt いずれか

画像のテキスト説明。AI が構図、ライティング、スタイルを加えて強化します。

string
reference_images いずれか

任意: 出力のスタイルと構図を導くための参照画像 URL(1〜5 枚)。

array
aspect_ratio

Output aspect ratio.

1:116:99:164:33:4 既定値 1:1
6 個の入力をすべて表示
model

Image engine to use. Leave unset and Pipe2 routes to the best fit for your prompt.

autogemini-3-1-flash-imagegemini-3-pro-imagegpt-image-2 既定値 auto
quality

Engine-aware. Auto picks the balanced tier for the chosen engine — GPT Image 2 medium, Gemini 3.1 Flash 2K. Fast renders smaller and cheaper (GPT Image 2 low, Gemini 3.1 Flash 1K); hd takes the top tier, which on GPT Image 2 costs many times auto. Gemini 3 Pro changes size at one price.

autofasthd 既定値 auto
reference_videos

Video references (first ~8s of each is used), only the Gemini 3.1 Flash model supports these

array

AIエージェントから使う

任意の MCP クライアントを pipe2 に接続すると、エージェントがこれらのツールを使えるようになります。このパイプラインを見つけ、上と同じスキーマを読み取って実行します。

  • list_pipelines
  • get_pipeline_schema
  • run_pipeline
  • get_pipeline_run_status
  • request_upload
https://mcp.pipe2.ai/mcp
{
  "mcpServers": {
    "pipe2ai": {
      "url": "https://mcp.pipe2.ai/mcp",
      "headers": { "Authorization": "Bearer YOUR_TOKEN" }
    }
  }
}

APIリファレンス全文 MCP のセットアップ CLIリファレンス

AI画像ジェネレーター

テキストプロンプトや参照写真から高品質な画像を生成します。商品写真、キャラクターアート、読みやすいテキスト入りポスター、フォトリアルなポートレート, 欲しいものを記述すれば、数秒で完成した画像が手に入ります。

作成できるもの

  • 商品写真: スタジオなしでカタログ写真、ライフスタイルシーン、憧れを誘うクリエイティブ
  • キャラクターアート: 記述や参照写真からのコンセプトデザインとバリエーション
  • 読みやすいテキスト入りポスター: ラテン文字と非ラテン文字(日本語、韓国語、中国語、ヒンディー語、ベンガル語、アラビア語)にわたってきれいにレンダリングされるタイポグラフィ
  • エディトリアル画像: 任意のスタイルの表紙アート、ヒーロー画像、ソーシャル投稿
  • ブランドを軸にしたバリエーション: 商品写真や参照をアップロードし、その周りに一貫したビジュアルを生成

使い方

  1. 画像を記述: 欲しいものを書くか、最大5枚の参照写真をアップロード
  2. モデルを選ぶ: または自動のままにすればルーターが選択(安価な下書き、バランスの取れたHD、プレミアムなタイポグラフィ)
  3. 自動ルーティングの仕組み: テキストの多いポスターはタイポグラフィに強いモデルへ、フォトリアルなポートレートは顔と商品ディテールに強いモデルへルーティング
  4. 調整: プロンプトを変える、参照を追加する、アスペクト比を切り替えて再実行

プロンプトのコツ

  • 被写体、スタイル、ライティングを具体的に, 「望遠鏡」より「木製デスクの上のヴィンテージ真鍮製望遠鏡、暖かい午後の日差し」が優れています
  • 画像内のテキストは、レンダリングしたい内容を引用符で, 「太字サンセリフで『GRAND OPENING』と書かれたポスター」
  • 複数の生成にわたってポーズ、色、商品形状を固定するには参照画像をアップロード
  • 出力先に合わせてアスペクト比を使う, ソーシャルには1:1、ヒーローバナーには16:9、縦型投稿には9:16

よくある質問

画像ジェネレーターで何が作れますか?
商品写真、キャラクターアート、あらゆる文字体系の読みやすいテキスト入りポスター、フォトリアルなポートレート、エディトリアル画像、参照写真からのブランドを軸にしたバリエーション, そしてその間の多くのもの。
プロンプトと参照画像の両方が必要ですか?
いいえ, どちらか一方でも機能します。プロンプトはテキストから生成し、参照はバリエーションを生成、両方を組み合わせると最も制御が効きます。
参照画像は何枚使えますか?
最大5枚。参照が多いほど、バリエーションにわたって被写体のアイデンティティ、ポーズ、商品形状を固定しやすくなります。
どんな画像品質が期待できますか?
3つのモデルすべてで制作グレードです。プレミアムモデルは最もきれいなタイポグラフィと最高忠実度のフォトリアルなポートレートをレンダリングし、バランスモデルは参照画像を持ち込むときの最適な選択です。
画像内にテキストをレンダリングできますか?
はい, 非ラテン文字(日本語、韓国語、中国語、ヒンディー語、ベンガル語、アラビア語)も含みます。最もきれいな結果を得るには、プロンプト内でテキストをそのまま引用してください。
何クレジットかかりますか?
0.2 to 6.4 クレジット。あなたが選ぶ(または自動が選ぶ)モデルによります。

他のパイプラインを見る

すべて見る →
動画生成
from 9.5
動画生成
音声生成
0.7-1.3
音声生成
音楽生成
2.5-45.1
音楽生成
動画編集
13.1-29.8
動画編集