En bref
- GPT Image 2.5 arrive premier au classement général avec une moyenne de 90/100.
- FLUX.2 [pro] obtient 93 points pour le prompt de villa en pierre à Bodrum.
- Qwen-Image 3.0 Pro se démarque sur le détail de cuisine, tandis que Nano Banana 2 excelle sur le prompt de place urbaine.
- Le coût par image le plus bas est celui de GPT Image 2.5 ; la durée moyenne la plus longue est mesurée pour Seedream 5.0 Pro.
Ce que nous avons testé et comment nous avons évalué les résultats
Pour le test d’octobre 2026 du Model League de 3dsınıfı, nous avons comparé six modèles de génération d’images à l’aide de cinq prompts architecturaux. Ils portaient sur une façade résidentielle au crépuscule, un salon scandinave, une villa en pierre avec piscine à Bodrum, un détail de matériaux de cuisine et une vue aérienne d’une place urbaine. Chaque modèle a été exécuté via la même API, avec ses paramètres standard.
Les images ont été évaluées à l’aveugle par un arbitre IA selon quatre critères : respect du prompt (30 %), précision architecturale (30 %), photoréalisme (25 %) et absence d’imperfections (15 %). Les scores globaux ont été calculés sur 100. Les durées ci-dessous correspondent au temps moyen de génération et les coûts au prix par image.
Classement
| Rang | Modèle | Score | Durée | Coût |
|---|---|---|---|---|
| 1 | GPT Image 2.5 | 90/100 | 11,9 s | 0,011 $ |
| 2 | FLUX.2 [pro] | 85,8/100 | 11,7 s | 0,045 $ |
| 3 | Nano Banana 2 | 85,6/100 | 22 s | 0,103 $ |
| 4 | Nano Banana Pro | 85,3/100 | 31,7 s | 0,138 $ |
| 5 | Qwen-Image 3.0 Pro | 84,9/100 | 59,5 s | 0,04 $ |
| 6 | Seedream 5.0 Pro | 84,4/100 | 77,7 s | 0,096 $ |
Les points forts, prompt par prompt
Façade résidentielle au crépuscule : GPT Image 2.5 l’emporte avec 94,5 points. La maison à deux étages, les avant-toits plats, les grandes baies vitrées, la lumière de l’heure bleue et l’aménagement paysager de graviers avec des oliviers ont été jugés conformes au prompt. Le paysage masquait une partie de la façade. Nano Banana Pro s’est distingué par ses matériaux et sa lumière intérieure chaleureuse ; le ciel de Seedream était plus lumineux et sa cheminée rompait la ligne du toit plat.
Salon scandinave : GPT Image 2.5 obtient 90 points. Avec ses deux plantes, son unique suspension, son parquet à chevrons et sa grande fenêtre aux rideaux en voile, l’image présentait une géométrie et une lumière naturelle convaincantes. Qwen-Image 3.0 Pro se distinguait également par la présence des éléments principaux demandés et l’aspect naturel des matériaux. FLUX.2 [pro], en revanche, montrait trois plantes en pot au lieu des deux demandées.
Villa en pierre et piscine à Bodrum : FLUX.2 [pro] prend la première place avec 93 points. La villa en pierre, les grandes baies vitrées, la piscine à débordement avec vue sur la mer et les bougainvilliers étaient clairement représentés ; la géométrie et la lumière ont été jugées réussies. La perspective du bâtiment de GPT Image 2.5 était également cohérente. Chez Seedream, certaines jonctions entre les balcons et l’étage supérieur étaient complexes, et les fleurs semblaient parfois artificielles.
Détail des matériaux de cuisine : Qwen-Image 3.0 Pro obtient 90 points. Le robinet en laiton, le bol en céramique avec des citrons et les façades cannelées étaient bien visibles ; la lumière venant de la fenêtre a été jugée naturelle. Malgré un petit défaut de forme à l’extrémité du robinet, l’image était propre. Chez Nano Banana 2, la silhouette d’une personne à l’arrière-plan distrayait le regard.
Vue aérienne d’une place urbaine : Nano Banana 2 l’emporte avec 90 points. Le tissu urbain dense, les alignements d’arbres, le long élément aquatique et le tramway étaient clairement représentés ; l’organisation architecturale restait cohérente malgré le cadrage large. GPT Image 2.5 a également bien rendu le tramway, les vélos et la géométrie de la place. Chez Nano Banana Pro, la perspective des bâtiments et la géométrie de la place étaient moins cohérentes.
Quel modèle choisir selon vos besoins ?
Si vous tenez compte à la fois du score global, de la vitesse et du coût, GPT Image 2.5 est l’option la plus équilibrée de ce test : il a obtenu la meilleure moyenne, avec un temps mesuré de 11,9 secondes et le coût par image le plus bas du classement. FLUX.2 [pro] s’est distingué pour les scènes d’architecture locale et de paysage, comme la villa en pierre de Bodrum ; sa durée moyenne de 11,7 secondes le place aussi parmi les modèles rapides. Qwen-Image 3.0 Pro a remporté le test pour le gros plan de cuisine, tandis que Nano Banana 2 s’est imposé pour la composition de place urbaine. Ces résultats concernent uniquement les prompts correspondants et ne signifient pas que le même classement s’appliquera à tous les cas.
Limites
Une seule image a été générée pour chaque prompt ; les résultats peuvent varier lors de nouvelles générations. L’évaluation a été menée par un arbitre IA et les scores des critères reposent sur une appréciation visuelle. Le style de rédaction, le niveau de détail et les éléments mis en avant dans les prompts peuvent également influer sur le résultat. Le classement doit donc être considéré comme une comparaison sur ce jeu de test, et non comme une garantie de qualité absolue pour différents types de projets.
Pour voir toutes les images côte à côte, consultez la page Model League.
Sources
1 sourceLes textes sources ne sont pas republiés ; les courtes citations sont signalées, le reste est notre propre résumé et commentaire.
Questions fréquentes
Quel modèle est arrivé premier au classement général du Model League d’octobre 2026 ?
GPT Image 2.5 s’est classé premier avec une moyenne de 90/100.
Quel modèle affiche le coût par image le plus bas ?
Dans le test, le coût par image indiqué pour GPT Image 2.5 est de 0,011 $.
Les résultats sont-ils reproductibles pour chaque prompt ?
Une seule image ayant été générée par prompt, les résultats peuvent varier. Le style de rédaction des prompts peut également influer sur l’évaluation.



