Aller au contenu principal
AGE Services
Logo GPT

GPT

Pour bien commencer — la présentation complète

Site officiel OpenAI
GPT — aperçu de l'interface (OpenAI)

GPT, la famille de modèles d’OpenAI

GPT — pour Generative Pre-trained Transformer — désigne la famille de modèles d’intelligence artificielle générative développée par OpenAI, société américaine de recherche et de déploiement en IA. Ces modèles comprennent une consigne écrite, raisonnent et produisent une réponse en texte ; dans leurs versions récentes, ils acceptent aussi des images en entrée et s’accompagnent de modèles dédiés à l’image, à l’audio et à la vidéo.

Autour de ces modèles, OpenAI a bâti deux grands canaux d’accès — l’un pour les humains, l’autre pour les logiciels.

Une famille, deux canaux d'accès
Les modèles
GPT-5.5 & la gamme
Les moteurs : comprendre, raisonner, générer du texte (et de l'image en entrée). Du nano économique au Pro le plus précis.
ChatGPT
L'usage humain
L'assistant grand public et professionnel — web, bureau, mobile, vocal — avec ses modes (agents, Canvas, recherche, GPTs, Sora, Codex).
L'API
L'intégration logicielle
La plateforme pour brancher les modèles dans ses propres produits et automatisations, facturée à l'usage.

L’unité de mesure technique est le token, un fragment de mot : en première approximation, 1 000 tokens valent environ 750 mots de français. Deux chiffres résument la « taille » d’un modèle à l’usage : la fenêtre de contexte (le volume de texte qu’il prend en compte d’un seul tenant) et la sortie maximale (la longueur de réponse qu’il produit en une fois). Les modèles récents se distinguent enfin par leur raisonnement : plutôt que de répondre d’emblée, ils peuvent décomposer un problème en étapes — la logique de l’ancienne « série o », aujourd’hui absorbée dans GPT-5.5 et son mode « Thinking ».

Les surfaces produit : ChatGPT et au-delà

OpenAI ne se résume pas à un modèle : c’est l’écosystème de surfaces le plus large du marché, regroupable en quatre familles.

Panorama des accès

Les surfaces produit, par usage

Famille
Surfaces
À quoi ça sert
ChatGPT (assistant)
Web, bureau (macOS/Windows), mobile (iOS/Android), mode vocal, recherche web, navigateur Atlas
Dialoguer avec l'assistant sur tous les écrans, à la voix, avec des réponses web sourcées.
Outils de production
Canvas, Analyse de données, Vision, Génération d'images, Mode Agent, Recherche approfondie
Rédiger et coder à deux, analyser un fichier, lire une image, générer des visuels, déléguer des tâches web.
Personnalisation
GPTs personnalisés, GPT Store
Configurer des assistants spécialisés sans code, les publier ou les réserver à l'organisation.
Création, code & API
Sora (vidéo), Codex (agent de code), API & plateforme, intégration Apple
Produire des vidéos, déléguer du développement, intégrer les modèles dans ses propres produits.

Deux surfaces illustrent bien l’amplitude de l’offre. ChatGPT reste le point d’entrée : un assistant conversationnel propulsé par GPT-5.5, présent dans le navigateur, sur le poste de travail (où il peut lire e-mails, captures et fichiers) et en mobilité (voix, photos).

Interface de ChatGPT : une conversation où l'utilisateur demande de reformuler un e-mail, la réponse rédigée par l'assistant, l'historique des conversations à gauche et le champ de saisie « Message ChatGPT » avec le sélecteur de modèle.
Capture · ChatGPT (OpenAI) ChatGPT, l'assistant conversationnel : historique des échanges, réponse rédigée en direct, sélection du modèle et pièces jointes — la porte d'entrée grand public de l'écosystème OpenAI.

Côté production, Canvas ouvre un espace de travail latéral pour rédiger et réviser textes et code de façon itérative (ajuster la longueur, le niveau de lecture, demander des retouches ciblées). À côté, GPTs permet de configurer des assistants métier sans écrire de code, publiables dans le GPT Store (lancé en janvier 2024) ou réservés aux espaces privés Team et Enterprise.

Enfin, pour la création avancée et l’intégration : Sora génère des vidéos par IA (intégré aux offres Plus et Pro), Codex est un agent de codage (écriture, exécution, revues de code et de sécurité automatisées), et l’API / plateforme OpenAI branche les modèles dans des produits tiers. À part, le canal Azure OpenAI de Microsoft distribue les mêmes modèles avec une facturation et des engagements gérés côté Microsoft — souvent retenu par les organisations déjà ancrées dans l’écosystème Microsoft.

La lignée des modèles à jour

Au 10 juin 2026, le modèle phare est GPT-5.5, entouré d’une gamme qui ajuste le couple précision / coût.

État de la gamme au 10 juin 2026

La lignée des modèles GPT

Modèle
Identifiant API
Contexte
Sortie max
Positionnement
GPT-5.5 (phare)
gpt-5.5
~1,05M tokens
128k
Modèle frontière par défaut : raisonnement complexe, code, travail professionnel. Connaissances jusqu'à déc. 2025.
GPT-5.5 Pro
gpt-5.5-pro
~1,05M tokens
128k
Réponses plus précises pour les tâches les plus exigeantes (recherche approfondie).
GPT-5.4
gpt-5.4
~1,05M tokens
128k
Alternative plus abordable, notamment pour le code.
GPT-5.4 mini
gpt-5.4-mini
400k tokens
128k
Le « mini » le plus performant : code, usage agent, sous-tâches.
GPT-5.4 nano
gpt-5.4-nano
La variante à plus faible latence et coût de la gamme.

OpenAI propose par ailleurs des modèles spécialisés par modalité : GPT Image 2 pour la génération d’images (qui remplace DALL·E, retiré en mai 2026), la gamme Realtime pour la voix temps réel (audio entrée/sortie, traduction parlée, transcription en flux), et Sora pour la vidéo.

À noter — modèles en voie de retrait. Pour de nouveaux projets, il est déconseillé de bâtir sur les générations programmées à l’arrêt : l’ancienne série « o » de raisonnement (o1, o3-mini, o4-mini) s’arrête le 23 octobre 2026 ; GPT-4 / GPT-4-turbo à la même date ; les familles GPT-5.0 à 5.3 entre juillet et août 2026. La migration recommandée pointe vers GPT-5.5 (ou GPT-5.4 mini pour les usages légers).

La fenêtre de contexte

La fenêtre de contexte est le volume de texte — consigne, documents fournis, historique — que le modèle prend en compte d’un seul tenant. Sur la gamme GPT-5.5, elle atteint son maximum.

Capacité de contexte
1,05 M tokens Fenêtre de contexte

≈ 750 000 mots, soit plusieurs livres, en un seul tenant

  • Dossiers de due diligence
  • Bases contractuelles complètes
  • Corpus documentaires métier

Concrètement, 1,05 million de tokens représentent de l’ordre de 750 000 mots : un dossier entier — appel d’offres, due diligence, base contractuelle — peut être soumis sans le découper. Le modèle GPT-5.4 mini (400 000 tokens, ~300 000 mots) reste très confortable pour la plupart des usages bureautiques, à moindre coût. La sortie maximale de 128 000 tokens (~96 000 mots) autorise la production de documents longs en une seule génération.

La grille tarifaire de l’API

L’accès par API se facture à l’usage, au volume de tokens, séparément pour l’entrée (consigne + documents) et la sortie (réponse). Les tarifs sont en dollars par million de tokens (Mtok).

Tarifs API · USD par million de tokens

Grille tarifaire de l'API

Modèle
Entrée
Sortie
Cache (entrée)
Batch (entrée / sortie)
gpt-5.5
5,00 $
30,00 $
0,50 $
2,50 $ / 15,00 $
gpt-5.5-pro
30,00 $
180,00 $
n.c.
15,00 $ / 90,00 $
gpt-5.4
2,50 $
15,00 $
0,25 $
1,25 $ / 7,50 $
gpt-5.4-mini
0,75 $
4,50 $
0,075 $
0,38 $ / 2,25 $
gpt-5.4-nano
0,20 $
1,25 $
0,02 $
0,10 $ / 0,63 $

Les modèles par modalité ont leur propre grille : GPT Image 2 à 8 $ / 30 $ le Mtok, Realtime (audio) à 32 $ / 64 $, Sora facturé à la seconde de vidéo (de 0,10 $ à 0,70 $ selon la résolution). Deux mécanismes réduisent fortement la facture sur les usages répétitifs.

Effet du cache d'entrée
−90 % sur la portion d'entrée réutilisée (cache), exemple GPT-5.5
Sans cache
5,00 $/Mtok
Entrée en cache
économisé
0,50 $/Mtok

Quand une même portion d'entrée est réutilisée d'un appel à l'autre (un long document de référence stable), elle est facturée à ~0,1× le tarif d'entrée. En complément, le traitement par lots (Batch) applique environ −50 % sur l'entrée et la sortie pour les traitements non urgents.

Les abonnements ChatGPT

Pour un usage sans développement, OpenAI propose une gamme d’abonnements, du gratuit à l’entreprise. Prix relevés sur la page française (en euros, par mois).

Offres · prix France (EUR)

Les abonnements ChatGPT

Offre
Prix
Pour qui
Inclus principal
Free
0 €
Découverte
Accès limité à GPT-5.5 Instant ; messages, imports et images limités ; historique illimité ; web et mobile.
Go
8 €/mois
Usage léger
Accès étendu à GPT-5.5 Instant, plus de messages et d'images, mémoire étendue. Peut inclure de la publicité.
Plus
23 €/mois
Professionnel individuel
Ajoute le raisonnement « Thinking », images avancées, recherche approfondie et agent étendus, projets et GPT personnels, Codex, Sora.
Pro
dès 103 €/mois
Usage intensif
Ajoute GPT-5.5 Pro, usage 5× à 20×, Codex max, fichiers et images illimités, vitesse maximale.
Business
21 €/utilisateur/mois
Équipes
Tout Plus + Codex Business, 60+ apps connectées, admin/SSO/MFA, aucun entraînement sur vos données, RGPD & SOC 2.
Enterprise
sur devis
Grandes organisations
Contexte étendu, SCIM/EKM/RBAC, résidence des données (10 régions dont UE/UK), support 24/7, SLA.

À ces offres s’ajoutent Codex (à l’usage, pour les équipes de développement) et Edu / for Teachers (gratuit pour les enseignants K-12 aux États-Unis jusqu’en juin 2027, sur devis pour l’éducation). Une remise pouvant atteindre 75 % est proposée aux organisations à but non lucratif.

Cas d’usage métier

Au-delà des spécifications, voici comment les organisations mobilisent GPT — l’arbitrage central étant abonnement (usage humain interactif) ou API (intégration logicielle à volume).

Trois familles d'usage
Direction & métiers
Productivité interne
Synthèse de longs dossiers (due diligence, appels d'offres), préparation de comités, rédaction et traduction, analyse de données chiffrées. Via abonnement ChatGPT.
Produit & API
Intégration logicielle
Classification et extraction à grande échelle, agents de support, recherche augmentée sur une base propriétaire, assistance au code (Codex). Via API, à l'usage.
Création & agents
Contenu et automatisation
Génération d'images et de vidéos (Sora), assistants métier sans code (GPTs), délégation de tâches web multi-étapes (mode Agent).

Le choix du modèle suit la nature de la tâche : GPT-5.4 mini / nano pour le volume et le coût, GPT-5.5 pour la majorité des usages, GPT-5.5 Pro quand la précision prime sur le prix.

Quand une autre approche est préférable

Décrire la solution suppose d’en délimiter le périmètre. Plusieurs situations justifient d’examiner d’autres options, sans préjuger de leur supériorité.

Points de vigilance

Souveraineté et résidence des données en Europe. OpenAI est une société américaine ; l’offre Enterprise propose une résidence des données dans plusieurs régions dont l’UE, et le canal Azure OpenAI (Microsoft) est souvent retenu pour la gouvernance. Les organisations à exigences strictes — santé, secteur public, défense — examineront aussi des modèles européens (Mistral) ou des déploiements maîtrisés.

Données ultra-sensibles, hébergement local. Lorsqu’aucune donnée ne doit sortir du système d’information, des modèles ouverts auto-hébergés peuvent être préférés, au prix d’un effort d’ingénierie et de coûts d’infrastructure supérieurs.

Budget et volumétrie. Pour des tâches simples à très gros volume, les variantes mini/nano — ou des modèles concurrents plus légers — offrent un coût unitaire plus adapté que le modèle phare.

Précision maximale vs coût. GPT-5.5 Pro vise la précision la plus haute mais à un tarif nettement supérieur (180 $/Mtok en sortie contre 30 $ pour GPT-5.5) ; pour de nombreux usages, le modèle standard suffit.

Cartographie besoin → option
Usage interactif des équipes
Abonnement ChatGPT (Plus / Business)
Collaborateurs qui dialoguent avec l'assistant.
Intégration logicielle à volume
API (GPT-5.5 ou GPT-5.4 mini)
Facturation à l'usage, cache + batch.
Précision maximale, recherche
GPT-5.5 Pro
Coût minimal à très gros volume
GPT-5.4 mini / nano, ou modèle léger
Souveraineté UE stricte
Modèle européen ou Azure OpenAI / déploiement maîtrisé
Données ultra-sensibles sur site
Modèle ouvert auto-hébergé

En synthèse, GPT couvre un spectre très large — de l’assistant conversationnel à l’agent autonome et à l’intégration logicielle — autour du modèle phare GPT-5.5 (contexte ~1,05M, multimodal en entrée). Les choix structurants portent moins sur « quel modèle » que sur quelle voie d’accès (abonnement ou API), quel régime de coût au regard du volume, et quelles contraintes de souveraineté et de confidentialité.

Vos questions

Questions fréquentes

Quel est le modèle GPT le plus récent ?
Au 10 juin 2026, c'est GPT-5.5 (identifiant API gpt-5.5), le modèle frontière par défaut d'OpenAI : fenêtre de contexte d'environ 1,05 million de tokens, multimodal en entrée (texte + image) et doté d'un mode de raisonnement « Thinking ». Il se décline en GPT-5.5 Pro (précision maximale) et en gamme GPT-5.4 / mini / nano (plus économiques). Les anciennes séries « o » (raisonnement) et GPT-4 sont en voie de retrait.
Comment GPT est-il facturé ?
Deux régimes coexistent. Les abonnements ChatGPT (Free 0 €, Go 8 €, Plus 23 €, Pro à partir de 103 €, Business 21 €/utilisateur, Enterprise sur devis) couvrent l'usage interactif. L'API se facture à l'usage, au million de tokens, séparément pour l'entrée et la sortie ; le cache d'entrée et le traitement par lots (Batch, −50 %) réduisent fortement la facture sur les usages répétitifs.
GPT répond-il aux exigences de souveraineté française ?
OpenAI est une société américaine. L'offre Enterprise propose une résidence des données dans plusieurs régions, dont l'Union européenne, et le canal Azure OpenAI (Microsoft) est souvent retenu pour des raisons de gouvernance. Pour une souveraineté stricte — santé, secteur public, défense —, des modèles européens (par exemple Mistral) ou des déploiements maîtrisés sont aussi à examiner.

Discutons de votre projet

Un appel de 30 minutes pour cadrer votre cas d'usage IA.

Sans formulaire de qualification, sans engagement. On parle de votre contexte, on identifie ce qui peut bouger vite, on vous dit honnêtement où l'IA n'apportera rien.