La page de documentation développeur OpenAI « Génération d’images » fournit une explication centralisée des capacités de génération et d’édition d’images : les développeurs peuvent générer, éditer ou générer directement des variations via l’API d’images (les variantes ne sont disponibles que dans DALL· E 2 est pris en charge), et « image_generation » peut également être utilisé comme outil intégré dans l’API Réponses pour la restructuration itérative conversationnelle multi-round et des méthodes d’entrée plus flexibles (prenant en charge l’identifiant de fichier comme entrée d’image). Le document propose également une comparaison de modèles, indiquant que gpt-image-1.5 est actuellement le modèle principal de la série GPT Image, et invite DALL· E 2 et DALL· E 3 a été marqué comme obsolète et doit cesser le support le 12 mai 2026.
En termes de contrôle de sortie, le document liste des paramètres ajustables tels que la taille, la qualité, le format, la compression et la transparence en arrière-plan, et fournit une option automatique pour que le modèle soit automatiquement sélectionné comme demandé. La sortie par défaut est une image encodée en base64 ; Les formats sont png, jpeg, webp, le jpeg étant généralement meilleur pour réduire la latence. L’arrière-plan transparent doit être réglé sur transparent et n’est disponible que sous PNG et WebP, avec une qualité moyenne ou élevée. Le coût et la latence sont directement proportionnels aux jetons nécessaires pour la génération : une taille plus grande et une qualité supérieure augmentent significativement les jetons de sortie ; Si vous utilisez partial_images pour la génération de streaming, vous serez facturé en supplément pour chaque « image partielle ». La documentation suggère également que certaines organisations pourraient devoir effectuer la validation de l’organisation API avant d’utiliser les modèles d’image GPT.
Foire aux
questions Q : Quel est le contenu principal de ce document « Génération d’images » ?
R : Le document explique comment générer et modifier des images à l’aide de l’API OpenAI, et compare les scénarios et capacités applicables de l’API d’image et de l’API Responses.
Q : Quels modèles sont recommandés pour la génération d’images en premier ?
R : Le document recommande d’utiliser la série d’images GPT, en mettant l’accent sur gpt-image-1.5 comme option de meilleure qualité et gpt-image-1-mini pour un coût plus bas.
Q : DALL· Est-ce que E 2/3 peut continuer à être utilisé et quand sera-t-il arrêté ?
R : Le document est marqué DALL· E 2 et DALL· E 3 est déprécié et doit cesser le support le 12 mai 2026.
Q : Comment générer des images d’arrière-plan transparentes et quels formats sont pris en charge ?
R : Mettre l’arrière-plan transparent ; Transparent ne prend en charge que PNG et WebP, et les réglages de qualité moyenne à élevée sont généralement plus stables.
Q : Quels sont les principaux facteurs influencés par le coût de la génération d’images ?
R : Les frais sont liés aux jetons, et plus la taille et la qualité sont grandes, plus ils sont chers. L’utilisation d’une entrée d’édition ou de hi-fi augmente le nombre de jetons d’entrée, et partial_images engendre également des frais supplémentaires pour les jetons de sortie.