ChatGPT は Sketch を起動して図面から画像を作成し、そのジェネレータを画像 2.5 で更新します。

Google の優先ソースとして当社を追加してください

アイデアによっては、言葉で説明するよりも絵に描いたほうが簡単なものもあります。その前提から出発して、 OpenAI を提示しました スケッチ、会話内で直接スケッチを作成し、後で完全なイメージを生成するための参照として使用できる新しい ChatGPT 機能です。

ツールには以下のものが付属しています ChatGPT イメージ 2.5、OpenAI の画像生成および編集システムの新たな進化。同社は、ChatGPT 画像とその API を介して使用される GPT 画像モデルの間で毎週 30 億以上の画像が作成されることを保証しており、今回のアップデートで提供しようとしています 創造的なプロセスをより細かく制御できる特に、ビジュアル生成がデザイン、マーケティング、コマース、メディアなどの専門的なフローに組み込まれ始めているためです。

このアップデートでは、クリエイティブなプロセスをより細かく制御できるようにすることを目指しています。

それで、 スケッチ 人工知能に指示を与える新しい方法を導入します。ユーザーは書き込むことができます @スケッチ ChatGPT でキャンバスを開き、頭の中にあるものをおおよそ描きます。その後、スタイル、仕上げ、またはその他の詳細に関する指示をスケッチに添付して、システムが生成するようにすることができます。 決定的なイメージ。 したがって、描画方法を知る必要はありません。スケッチは、書面による指示を補完する空間的および視覚的な参照として機能します。
OpenAI は部屋のレイアウト、衣服の輪郭、または単純な落書きを例として挙げますが、この機能は図、ポスター、およびテキストで各要素の正確な位置を説明するのが複雑なその他の構成に拡張することもできます。

スケッチ したがって、これはビジュアル生成インターフェイスの進化における新たなステップを表します。 プロンプト 必ずしもそれが唯一の出発点ではなくなり、ユーザーは言語とグラフィック情報の組み合わせを通じて意図を伝えることができます。

画像の残りの部分を変更せずに、より正確な編集が可能

の隣に スケッチの主な改善点の 1 つ 画像2.5 これは、AI 編集における一般的な問題、つまり 1 つのことを変更するように要求すると、他のものも変更されていることを確認することを目的としています。
OpenAI は、新しいモデルが変更すべき要素と保持すべき要素をより適切に識別できるようにします。これにより、たとえば、作品の残りの部分の主題、構成、視覚的処理をそのまま維持しながら、製品、背景、またはテキストを置き換えることができます。

また、長い会話中の一貫性も向上します。画像に数回の変更が加えられる場合、Images 2.5 は以前の編集内容をより確実に保存し、新しい指示を組み込みながら品質を維持する必要があります。この能力は特に次のような場合に関係します。 プロの用途、画像が 1 世代で解決さ​​れることはほとんどありません。製品、人物、構成、または特定のブランド コードを維持しながら、さまざまなバージョンを作成すると、AI の操作が反復的な編集プロセスに近づきます。

ChatGPTにも組み込まれています 画像に直接コメントするこれにより、ユーザーは一般的なメッセージだけで説明するのではなく、変更したい内容をよりローカライズされた方法で示すことができます。

参考写真の忠実性が高まり、構図が改善されました

Images 2.5 はまた、参考として使用される写真に存在する人物や物体をより適切に保存することを目指しています。によると OpenAI、設定、ビジュアル スタイル、または構成を変更すると、被写体がより認識しやすくなり、照明とテクスチャがより自然になります。

アップデートでも改善される 視覚的な指示の解釈 複雑な 多数の要素を含む作品の作成。 OpenAI は、インフォグラフィックス、プレゼンテーション資料、透明な背景の進歩に加えて、指示が徐々に具体的になるにつれて特定の芸術的方向性を遵守する能力の向上を強調しています。

スピード これも変更点の 1 つです。OpenAI は、Images 2.0 と比較して生成レイテンシーを最大 50% 削減したと主張しており、同じアイデアの最初の作成とその後の反復の両方を高速化しようとしています。

ポスター、製品、その他の形式のテンプレート

アップデートには次の内容も含まれます テンプレート、どのタイプのパーツが必要かはわかっているが、適切なプロンプトの書き方は必ずしもわからない人向けに設計されたシステムです。
ChatGPT の[画像]セクションから開始できます。 一般的なクリエイティブ フォーマットのテンプレート 必要な情報、デザイン要素、またはスタイルを提供します。 OpenAI が示す例には、ポスター、製品、マーチャンダイジングが含まれます。 ChatGPT は、パーツを生成する前に指示を完了するために追加の質問をする場合があります。

プロンプトは共有可能

もう 1 つの目新しさは、特にうまく機能する世代を再利用できるように設計されています。画像を共有するときに、ChatGPT を使用すると、画像を含めることもできます。 作成に使用したプロンプト。

その後、他の人がその指示を使用して自分の写真や詳細を入力して、別のバージョンを作成できます。こちらです、 良いプロンプト 実際には、同僚、チーム、ユーザー間で共有されるテンプレートとして機能します。
この機能は、感染拡大の加速にも役立つ可能性があります。 ビジュアルトレンド。 OpenAI は、80 年代の人物の肖像画を再現するプロンプトを例として使用します。各ユーザーは創造的な構造を維持し、主人公を自分自身に置き換えることができます。

このアップデートでは、2 つの異なるモデルの API も提供されます。 GPT 画像 2.5 フレア 品質、編集、速度の向上が組み込まれており、アプリケーション、コンテンツ作成、製品エクスペリエンス、ビジュアル検索、プロトタイピング、大規模生成の一般的なオプションとして提案されています。 OpenAI は、GPT-Image-2 よりも高品質で、遅延が 50% 低いと述べています。

GPT イメージ 2.5 サンバースト一方、生成時間は長くなりますが、精度を優先します。制作の準備ができている広告クリエイティブや、より丁寧に仕上げられた製品画像など、連続するエディション間の制御が特に重要なビジュアル作品を対象としています。

同社はまた、C2PA メタデータや目に見えない透かしなど、AI によって生成されたコンテンツ識別メカニズムも維持しています。
ChatGPT Images 2.5 は、デスクトップ、モバイル、Web 上の ChatGPT、ChatGPT Work、Codex ユーザーに展開されており、開発者は API 経由で Flare と Sunburst を利用できます。