各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る

Kuaishou: Kling IMAGE O3

Kling IMAGE O3は、最大4K解像度での高精細なテキスト・トゥ・イメージおよび画像・トゥ・画像生成のために構築されたオムニ画像モデルです。複数画像の参照プロンプト、一貫したバリエーションのためのシリーズ画像生成、および出力全体でアイデンティティを安定させるためのオプションの顔面要素制御をサポートしています。
モデルを比較
kling-image-o3
利用可能Kuaishou画像同期
価格
価格 $0.028
モダリティ
画像

Kling IMAGE O3 について

Kling IMAGE O3は、Klingの3.0世代におけるOmni画像モデルであり、最大4K解像度でのテキストから画像への生成および画像から画像への編集向けに作られています。IMAGE 3.0がプロンプト優先であるのに対し、O3は制御を重視して構築されています。1つのプロンプトで複数の参照画像を取り込み、一貫性のあるバリエーションのシリーズを生成し、オプションで顔に特化した要素制御を提供することで、出力間でアイデンティティを安定させます。

得意なこと

  • 1つのプロンプトで複数の参照画像を組み合わせることができるため、被写体、スタイル、シーンをそれぞれ異なるソースから取得できます。
  • シリーズ生成により、関連性のない単一の画像ではなく、1つのアイデアに基づいた一貫性のあるバリエーションが生成されます。
  • オプションの顔に特化した要素制御により、出力間で人物のアイデンティティを安定させます。
  • 同一モデルでテキストから画像への生成と画像から画像への編集の両方を処理し、最大4Kの出力が可能です。
  • Klingは強力なテキストレンダリング機能を備えており、ポスターやパッケージのモックアップに役立ちます。

他のモデルを検討すべきケース

  • リファレンスを多用するプロンプトは1行のプロンプトよりも設定に手間がかかるため、素早く単一の画像を生成する場合は軽量なIMAGE 3.0が適しています。
  • アイデンティティ制御は顔を対象としているため、オブジェクトやロゴの厳密な一貫性は、ご自身の素材で確認する必要があります。
  • 静止画のみを出力します。動画が必要な場合は、Klingの動画モデルのいずれかを使用してください。

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    画像編集テキストから画像TokenLab エンドポイント
    POST/v1/images/generations
    curl -X POST "https://api.tokenlab.sh/v1/images/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "operation": "image-to-image",
      "model": "kling-image-o3",
      "prompt": "A minimalist product photo of matte black headphones on a soft blue background.",
      "image_url": "https://example.com/source.png"
    }'

料金

Official価格はモデル提供者の公開基準です。TokenLab価格はTokenLabでのご利用料金です。

画像編集

1画像あたり
公式価格
$0.028
Official
$0.028
割引
—

テキストから画像

1画像あたり
公式価格
$0.028
Official
$0.028
割引
—

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間
リクエスト数
成功率
P95 レイテンシ
合計トークン数
モデルパフォーマンス
プライバシーおよびデータ量のしきい値に達すると、メトリクスが表示されます。

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでKling IMAGE O3を開き、プロンプトを編集・送信できます。

kling-image-o3と/v1/images/editsでimage-editを実行。結果、コスト、制限事項を表示します。

ユースケース

向いている用途
  • テキストから画像
  • キャラクターシート

    顔の参照とシリーズ生成を使用して、1人のキャラクターの多くのポーズや衣装を作成し、そのセットをアニメーションや動画制作の工程に渡します。

  • ブランドキャンペーンセット

    商品写真、ムード参照、場所の参照をブレンドして、一貫性のあるヒーロー画像のファミリーを作成します。

  • ポスターおよびパッケージのモックアップ

    見出しのテキストが正しく読めるアートワークを、印刷プレビューに耐えうる解像度で生成します。

  • ストーリーボードのフレーム

    動画生成を確定させる前に、同じキャストと設定で連続したフレームを作成します。

プロンプト例

画像1の顔と画像2のジャケットを使用してください。雨の降る夜のネオン街を歩く彼女を、35mmフィルム風のルックで表現してください。

このマスコットの、手を振る、走る、眠る、旗を持つという4つの整合性のあるバリエーションを作成してください。

ミニマルなコーヒーバッグ。正面に太字のセリフ体で「NORTH ROAST」というテキストを配置し、スタジオのソフトボックス照明で撮影してください。

FAQ

Kling IMAGE O3の「O」は何を意味しますか?

Klingのマルチモーダル層である「Omni」ラインを指します。画像モデルにおいては、テキストのみではなく、テキストと複数の参照画像および要素制御を組み合わせてプロンプトを作成できることを意味します。その結果、出力内容をより詳細に制御できます。

何枚の参照画像を使用できますか?

Klingはマルチ画像参照プロンプトに対応しており、1つのプロンプトで複数の参照画像を同時に活用できます。被写体、スタイル、シーンに個別の参照を使用することで、各ソースを明確に保つことができます。

テキストから画像への生成と編集の両方をサポートしていますか?

はい。テキストから画像への生成と画像から画像への編集の両方をサポートしています。Klingは、どちらの開始点からでも最大4Kの解像度で高忠実度な結果が得られるようモデルを位置づけており、1つのモデルで両方の作業をカバーします。

多くの画像間で顔を同一に保つことはできますか?

それが、シリーズ生成と組み合わせた「顔に特化した要素制御」の目的です。結果は被写体によって異なるため、実際の参照写真で小さなバッチを実行し、スケールアップする前に顔を比較してください。

Kling IMAGE O3 の料金はいくらですか?

TokenLab では Kling IMAGE O3 は $0.028 1画像あたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。

Kling IMAGE O3 はどのエンドポイントを使うべきですか?

Kling IMAGE O3 のデフォルトは https://api.tokenlab.sh/v1/images/edits です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

Kling IMAGE O3 はどの操作に対応していますか?

Kling IMAGE O3 は 画像編集, テキストから画像 に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

Kling IMAGE O3 を比較する

ソース

2026/10/02 時点での評価

Kling の他のモデル

関連モデル