LarpGPT · Guides
Formats d’image pour l’IA : choisir et régler le ratio
Carré, 3:2, 16:9 ou vertical 9:16 : choisir le format d’une image IA, comprendre ce qu’il change à la composition, et le régler dans Midjourney et chez OpenAI.

Dans ce guide14
Pourquoi le format passe en premier
Le format, ou rapport d’aspect, est la relation entre la largeur et la hauteur d’une image, écrite avec deux nombres comme 3:2 ou 16:9. C’est la première décision d’un photographe, parce qu’elle fixe ce que le cadre peut contenir. En génération d’images, c’est encore plus important : le modèle compose toute la scène pour le cadre que tu lui donnes, donc changer de format ensuite oblige à recadrer ou à relancer. Choisis-le avant d’affiner le reste du prompt.
Le format n’est pas la résolution
Un format ne dit rien du nombre de pixels. La documentation de Midjourney le souligne directement : le rapport d’aspect n’est pas la même chose que les dimensions de l’image, et la taille finale dépend de la version et de l’agrandissement utilisé. Une image en 3:2 peut être petite ou grande. Décide de la forme selon l’endroit où l’image sera vue et la place du sujet, puis traite la résolution comme une question séparée.
Le carré, 1:1
Le carré est équilibré et statique, sans direction dominante. Il convient aux objets seuls, aux compositions symétriques et aux sujets centrés, et c’est le cadre que beaucoup de réseaux sociaux utilisent depuis longtemps pour les publications et les photos de profil. C’est aussi le format par défaut de Midjourney, dont la documentation indique que les images partent d’un carré. Le carré convient mal aux paysages et aux scènes de groupe, où le sujet s’étend naturellement en largeur.
La photo classique, 3:2 et 2:3
Le 3:2 est le format traditionnel de la photographie, hérité du film 35 mm, et beaucoup d’appareils l’utilisent encore. Il paraît naturel pour un prompt photographique, parce que c’est la forme que l’on associe aux photos. Le 3:2 horizontal convient aux rues, aux intérieurs et aux paysages ; le 2:3 vertical convient aux portraits, aux portes et aux bâtiments hauts, et la documentation de Midjourney le cite comme courant en photo imprimée et pour les cadres.
4:3 et 5:4
Le 4:3 était le format d’origine de la télévision et reste utilisé par beaucoup de tablettes et par la plupart des appareils photo compacts numériques. Un peu plus carré que le 3:2, il laisse plus de place au-dessus et au-dessous du sujet. Le 5:4 est plus carré encore et courant en moyen et grand format, ainsi que pour les tirages 20 × 25 cm. Les deux conviennent aux intérieurs et aux portraits quand tu veux un peu d’air sans l’attraction horizontale d’un format large.
L’écran large, 16:9
Le 16:9 est le format standard de la télévision et de la vidéo en ligne ; le centre d’aide de YouTube le décrit comme le format standard sur ordinateur. Son cadre large convient aux paysages, aux villes, aux voitures en mouvement et aux scènes cinématographiques avec un sujet placé sur un côté. C’est un bon choix pour les bannières, les diapositives et les miniatures de vidéo. Il convient moins à une personne seule debout, qui devient petite dans un cadre large.
Le vertical, 9:16
Le 9:16 est la même forme tournée sur le côté : l’écran entier d’un téléphone tenu droit. La documentation de Midjourney le décrit comme courant pour les contenus mobiles sur les réseaux sociaux, et YouTube précise que les vidéos verticales en 9:16 peuvent être affichées avec des bandes sur un écran d’ordinateur. Il convient aux personnes debout, à l’architecture haute, aux cascades et à tout ce qui a une forte ligne verticale. Compose pour lui volontairement : une scène horizontale serrée dans du 9:16 perd souvent son sujet entre le ciel et le sol vides.
Comment la composition change avec le cadre
Un cadre plus large laisse de la place au décor et à la règle des tiers, avec un sujet décentré et de l’espace pour que l’œil circule. Un cadre plus haut met en valeur la hauteur et invite à étager les plans, du premier plan à l’arrière-plan. Indique la position dans le prompt : "the car in the right third of the frame, the empty road leading in from the left" ne donne pas du tout la même chose en 16:9 et en 1:1. Quand tu changes de format, relis les phrases de composition et adapte-les.
Régler le format dans Midjourney
La documentation de Midjourney indique le paramètre --ar, ou sa forme longue --aspect, ajouté à la fin du prompt avec une espace avant les tirets, par exemple "quiet harbour at dawn --ar 16:9". Les nombres doivent être entiers : la documentation précise que les décimales ne sont pas acceptées et propose 139:100 au lieu de 1.39:1, et une taille en pixels comme 1920:1080 est simplifiée en 16:9. Elle signale aussi que certains formats changent légèrement à l’agrandissement et que les formats extrêmement larges ou hauts sont expérimentaux.
Régler la taille avec les modèles d’images d’OpenAI
La documentation d’OpenAI sur la génération d’images exprime la taille en pixels plutôt qu’en format. Au moment où ces lignes sont écrites, elle cite parmi les tailles recommandées 1024x1024 en carré, 1536x1024 en paysage et 1024x1536 en portrait, avec une option automatique. Pour ses modèles récents, elle décrit aussi des tailles personnalisées écrites largeur par hauteur, où les deux côtés doivent être des multiples de 16 et où le rapport entre grand et petit côté ne doit pas dépasser 3:1. À noter : 1536x1024 correspond lui-même à un format 3:2.
Stable Diffusion et les autres outils
Dans la bibliothèque diffusers de Hugging Face, le pipeline texte-vers-image de Stable Diffusion accepte des arguments height et width en pixels. Le principe est partout le même : choisis d’abord la forme, puis règle ce que l’outil demande, pixels ou format. Quand un outil ne propose que quelques tailles, prends la plus proche et recadre ensuite, en laissant de la marge dans la composition pour que le recadrage n’entame pas le sujet.
Prévoir plusieurs formats
Si une image doit servir à plusieurs endroits, par exemple une bannière web large et une story verticale, générer une seule image et la recadrer dans les deux sens marche rarement. Soit tu composes avec beaucoup d’espace libre autour d’un sujet central pour que les deux recadrages tiennent, soit tu génères chaque format séparément à partir du même prompt, en adaptant les phrases de composition. La seconde option donne en général de meilleurs résultats pour un peu plus de temps.
Une façon rapide de choisir
Demande-toi où l’image sera vue et quelle forme a le sujet. Un objet seul ou une scène symétrique centrée va bien en carré. Une image qui doit ressembler à une photo va bien en 3:2 ou 2:3. Un grand paysage ou une image de vidéo va bien en 16:9. Une image plein écran sur téléphone ou un sujet haut va bien en 9:16. Quand rien ne penche clairement, le 3:2 est un point de départ photographique sûr, qui se recadre bien vers d’autres formes.
La place de LarpGPT
LarpGPT est une bibliothèque de prompts photo pour des scènes de voyage, d’architecture, de voitures et de style de vie, où la composition est écrite dans chaque prompt à côté du sujet, de la lumière et de l’optique. Tu copies un prompt, tu adaptes son cadrage au format voulu, et tu règles ce format dans le générateur d’images que tu utilises déjà. LarpGPT ne génère pas d’images, et les résultats varient d’un essai à l’autre.
Questions
Quel est le meilleur format pour une image IA ?
Tout dépend de l’endroit où l’image sera vue et de la forme du sujet. Le 3:2 est un choix photographique naturel, le 16:9 convient aux scènes larges et à la vidéo, le 9:16 aux images plein écran sur téléphone et le 1:1 aux sujets centrés.
Comment changer le format dans Midjourney ?
Ajoute --ar suivi de deux nombres entiers à la fin du prompt, par exemple --ar 3:2, selon la documentation de Midjourney. Les décimales ne sont pas acceptées, et le format par défaut est le carré.
Quelles tailles prennent en charge les modèles d’images d’OpenAI ?
Au moment où ces lignes sont écrites, la documentation d’OpenAI cite 1024x1024, 1536x1024 et 1024x1536 parmi les tailles recommandées, plus une option automatique, et décrit des tailles personnalisées pour les modèles récents dans certaines limites.
Puis-je recadrer une image IA dans un autre format ensuite ?
Oui, mais une composition pensée pour une forme perd souvent son sujet dans une autre. Laisse de l’espace autour d’un sujet central, ou génère chaque format séparément en adaptant les phrases de composition.
