画像生成
テキストや参照写真からAI画像を生成。商品写真、キャラクターアート、読みやすいテキスト入りポスター、フォトリアルなポートレート, 高解像度で数秒で完成。
未入力の項目: プロンプト, 参照画像
使用モデル
API例
ランタンの灯りのPyra(Nano Banana Pro)
Nano Banana Pro。同じプロンプトをプレミアムティアで。フリルと鱗のディテールがより精細に、ランタンの光の落ち方もより豊かに。プロンプトのみ、参照画像なしです。
最適な用途
- •ストックフッテージのないニッチ/特定の題材(歴史的再現、SFコンセプト、ファンタジーシーン)
- •概念的なビジュアル(抽象的アイデア、未来技術、あり得ないシーン)
- •複数画像にわたる一貫したビジュアルスタイル(同じライティング、カラーパレット)
- •商品ビジュアライゼーションとモックアップ
- •ラテン文字・非ラテン文字にわたる読みやすいテキスト入りポスター
ヒント
- ✓極めて具体的に:「道路上の車」ではなく「山道を走るフォトリアルな未来的電気自動車、ドラマチックなローアングル、ゴールデンアワー、シネマティックなライティング」
- ✓写真が欲しいのに出力がイラスト寄りになる場合は、「フォトリアル」を明示的に加える
- ✓効果的なスタイルの軸:「シネマティック」「ドラマチックなライティング」「ボリュメトリックな霧」「浅い被写界深度」
- ✓複数の生成にわたって被写体、ポーズ、商品形状を一貫させるには参照画像を使う
このパイプラインを使うレシピ
このパイプラインに関する記事
画像生成 API
このパイプラインをご自身のコードから呼び出せます。1回のリクエストで実行が始まり、モデルは独立したエンドポイントではなく入力フィールドです。
bun add @pipe2-ai/sdk import { createClient } from "@pipe2-ai/sdk";
const client = createClient(process.env.PIPE2_TOKEN!);
const { run_pipeline } = await client.RunPipeline({
pipeline_slug: "image-generator",
input: {
prompt: "A vintage brass telescope on a wooden desk, warm afternoon sunlight",
model: "gemini-3-1-flash-image",
},
});pip install pipe2 import asyncio
import os
from pipe2 import Pipe2Client
client = Pipe2Client(token=os.environ["PIPE2_TOKEN"])
run = asyncio.run(client.run_pipeline(
pipeline_slug="image-generator",
input={
"prompt": "A vintage brass telescope on a wooden desk, warm afternoon sunlight",
"model": "gemini-3-1-flash-image",
},
))go get github.com/pipe2-ai/sdk-go client := pipe2.NewClient(os.Getenv("PIPE2_TOKEN"))
input := json.RawMessage(`{
"prompt": "A vintage brass telescope on a wooden desk, warm afternoon sunlight",
"model": "gemini-3-1-flash-image"
}`)
run, err := pipe2.RunPipeline(context.Background(), client, "image-generator", input)
if err != nil {
log.Fatal(err)
}brew install pipe2-ai/tap/pipe2 pipe2 pipelines run \
--pipeline image-generator \
--input-json '{"prompt": "A vintage brass telescope on a wooden desk, warm afternoon sunlight", "model": "gemini-3-1-flash-image"}' \
--waitパラメータ
-
promptいずれか -
画像のテキスト説明。AI が構図、ライティング、スタイルを加えて強化します。
string -
reference_imagesいずれか -
任意: 出力のスタイルと構図を導くための参照画像 URL(1〜5 枚)。
array -
aspect_ratio -
Output aspect ratio.
1:116:99:164:33:4既定値1:1
6 個の入力をすべて表示
-
model -
Image engine to use. Leave unset and Pipe2 routes to the best fit for your prompt.
autogemini-3-1-flash-imagegemini-3-pro-imagegpt-image-2既定値auto -
quality -
Engine-aware. Auto picks the balanced tier for the chosen engine — GPT Image 2 medium, Gemini 3.1 Flash 2K. Fast renders smaller and cheaper (GPT Image 2 low, Gemini 3.1 Flash 1K); hd takes the top tier, which on GPT Image 2 costs many times auto. Gemini 3 Pro changes size at one price.
autofasthd既定値auto -
reference_videos -
Video references (first ~8s of each is used), only the Gemini 3.1 Flash model supports these
array
AIエージェントから使う
任意の MCP クライアントを pipe2 に接続すると、エージェントがこれらのツールを使えるようになります。このパイプラインを見つけ、上と同じスキーマを読み取って実行します。
- list_pipelines
- get_pipeline_schema
- run_pipeline
- get_pipeline_run_status
- request_upload
https://mcp.pipe2.ai/mcp {
"mcpServers": {
"pipe2ai": {
"url": "https://mcp.pipe2.ai/mcp",
"headers": { "Authorization": "Bearer YOUR_TOKEN" }
}
}
}AI画像ジェネレーター
テキストプロンプトや参照写真から高品質な画像を生成します。商品写真、キャラクターアート、読みやすいテキスト入りポスター、フォトリアルなポートレート, 欲しいものを記述すれば、数秒で完成した画像が手に入ります。
作成できるもの
- 商品写真: スタジオなしでカタログ写真、ライフスタイルシーン、憧れを誘うクリエイティブ
- キャラクターアート: 記述や参照写真からのコンセプトデザインとバリエーション
- 読みやすいテキスト入りポスター: ラテン文字と非ラテン文字(日本語、韓国語、中国語、ヒンディー語、ベンガル語、アラビア語)にわたってきれいにレンダリングされるタイポグラフィ
- エディトリアル画像: 任意のスタイルの表紙アート、ヒーロー画像、ソーシャル投稿
- ブランドを軸にしたバリエーション: 商品写真や参照をアップロードし、その周りに一貫したビジュアルを生成
使い方
- 画像を記述: 欲しいものを書くか、最大5枚の参照写真をアップロード
- モデルを選ぶ: または自動のままにすればルーターが選択(安価な下書き、バランスの取れたHD、プレミアムなタイポグラフィ)
- 自動ルーティングの仕組み: テキストの多いポスターはタイポグラフィに強いモデルへ、フォトリアルなポートレートは顔と商品ディテールに強いモデルへルーティング
- 調整: プロンプトを変える、参照を追加する、アスペクト比を切り替えて再実行
プロンプトのコツ
- 被写体、スタイル、ライティングを具体的に, 「望遠鏡」より「木製デスクの上のヴィンテージ真鍮製望遠鏡、暖かい午後の日差し」が優れています
- 画像内のテキストは、レンダリングしたい内容を引用符で, 「太字サンセリフで『GRAND OPENING』と書かれたポスター」
- 複数の生成にわたってポーズ、色、商品形状を固定するには参照画像をアップロード
- 出力先に合わせてアスペクト比を使う, ソーシャルには1:1、ヒーローバナーには16:9、縦型投稿には9:16
よくある質問
画像ジェネレーターで何が作れますか?
プロンプトと参照画像の両方が必要ですか?
参照画像は何枚使えますか?
どんな画像品質が期待できますか?
画像内にテキストをレンダリングできますか?
何クレジットかかりますか?
他のパイプラインを見る
すべて見る →テキストプロンプト、画像、参照クリップからAI動画を生成。シネマティックなショット、商品リビール、ライフスタイル広告, 同期した音声と自然な動きで。
テキストを自然な音声に変換。数十種類の声、70以上の言語に対応し、トーン・アクセント・テンポをスタイル指定でカスタマイズできます。
記述したムード、ジャンル、長さに合ったオリジナルのBGMを生成。ロイヤリティフリーで、数秒で用意できます。
既存の動画をAIで編集。スタイルの変更、エフェクトの追加、シーンの修正、あるいは見た目全体の変換ができます。