À choisir pour
- Recherche sémantique
- RAG, clustering et classement
Embeddings
text-embedding-ada-002text-embedding-ada-002 est un modèle OpenAI orienté compatibilité avec les index vectoriels historiques. Il s’adresse surtout aux équipes qui ne peuvent pas réindexer immédiatement. La fiche le présente sans fenêtre de contexte chiffrée publiée, et Non applicable : la sortie est un vecteur de sortie maximale, via Embeddings et Batch. Il faut le comparer sur des cas réels avant toute migration.
Disponibilité sur chatgptfrancais.org : page informative — ce modèle n’est pas proposé dans le chatbot du site.
Verdict
Analyse éditoriale — choisissez text-embedding-ada-002 lorsque votre priorité est maintenance d’un RAG construit sur ada-002 et que son profil de représentation vectorielle du texte correspond au produit. Écartez-le si une option moins coûteuse satisfait les mêmes évaluations, si l’endpoint imposé ne convient pas, ou si vous avez besoin d’une modalité que la fiche ne liste pas.
Données issues de la fiche OpenAI, contrôlées le 2026-08-10. « OpenAI ne publie pas » signifie que la valeur n’apparaît pas dans cette source, sans estimation de notre part.
| Identifiant | text-embedding-ada-002 |
|---|---|
| Entrées | texte |
| Sorties | vecteur |
| Fenêtre de contexte | OpenAI ne publie pas la fenêtre sur cette fiche |
| Sortie maximale | Non applicable : la sortie est un vecteur |
| Knowledge cutoff | OpenAI ne publie pas de date de cutoff sur cette fiche |
| Endpoint | Embeddings et Batch |
| Raisonnement | Non applicable aux embeddings |
| Outils et fonctions | Aucun outil autonome annoncé sur la fiche. |
| Prix publié | 0,10 $ par million de jetons. |
Le premier différenciateur est compatibilité avec les index vectoriels historiques. OpenAI documente OpenAI ne publie pas la fenêtre sur cette fiche de contexte, Non applicable : la sortie est un vecteur en sortie et les modalités d’entrée texte. Ces chiffres décrivent une capacité technique ; ils ne prouvent pas, à eux seuls, la qualité sur un corpus français ou un métier particulier.
text-embedding-ada-002 passe par Embeddings et Batch. Les capacités listées incluent aucun outil autonome annoncé sur la fiche. Cette combinaison détermine l’architecture possible : session persistante, requête asynchrone, traitement par lot ou composant spécialisé ne sont pas interchangeables.
Du point de vue éditorial, son intérêt tient à maintenance d’un RAG construit sur ada-002. La sélection doit pourtant arbitrer rappel, dimensions, stockage et coût. Un modèle plus puissant peut coûter trop cher pour un flux simple ; un modèle économique peut déplacer la dépense vers les reprises manuelles et la gestion des erreurs.
Ce scénario vérifie text-embedding-ada-002 sur sa promesse centrale sans confondre démonstration et production. L’équipe doit comparer les erreurs, la latence et le coût au modèle témoin.
Le modèle apporte ici un premier traitement, tandis que l’opérateur garde la décision. Cette séparation réduit le risque d’automatiser une conclusion insuffisamment fondée.
Le périmètre fermé permet de construire une évaluation reproductible. Il révèle si le gain de débit justifie le modèle avant d’élargir le domaine.
Cette utilisation transforme le choix de text-embedding-ada-002 en décision mesurée. Elle évite de migrer sur le seul argument d’une fiche technique ou d’un prix facial.
| Modèle | Positionnement | Contexte | Endpoint | Prix |
|---|---|---|---|---|
| text-embedding-ada-002 | Ancien modèle d’embedding toujours présenté comme actif. | OpenAI ne publie pas la fenêtre sur cette fiche | Embeddings et Batch | 0,10 $ par million de jetons. |
| text-embedding-3-small | Petit modèle d’embedding économique. | OpenAI ne publie pas la fenêtre sur cette fiche | Embeddings et Batch | 0,02 $ par million de jetons. |
| text-embedding-3-large | Modèle d’embedding à capacité élevée. | OpenAI ne publie pas la fenêtre sur cette fiche | Embeddings et Batch | 0,13 $ par million de jetons. |
| GPT-4.1 mini | Version plus petite et rapide de GPT-4.1. | 1 047 576 jetons | Responses, Chat Completions, Assistants, Batch et Fine-tuning | Entrée 0,40 $, cache 0,10 $, sortie 1,60 $ par million de jetons. |
Analyse éditoriale — text-embedding-ada-002 est le meilleur candidat lorsque maintenance d’un RAG construit sur ada-002 domine la décision. text-embedding-3-small constitue le premier témoin à tester, tandis que text-embedding-3-large permet de mesurer le compromis opposé. Conservez le modèle qui atteint le seuil qualité avec la marge de coût et de latence acceptable.
Coût et déploiement
Pour déployer text-embedding-ada-002, partez de l’endpoint Embeddings et Batch, fixez un budget par requête à partir du tarif publié et journalisez la consommation sans conserver de données sensibles inutiles. Versionnez prompts, schémas et jeux d’évaluation. Lors d’une migration, rejouez le même trafic sur text-embedding-3-small et text-embedding-3-large, puis comparez qualité, latence, erreurs d’outil et coût total. Analyse éditoriale : une bascule progressive avec seuil de repli est plus sûre qu’un remplacement global.
Limites
Au 2026-08-10, la fiche OpenAI indique : 0,10 $ par million de jetons. Le coût final dépend aussi du volume réellement envoyé, du cache disponible, des outils appelés et de l’infrastructure qui entoure le modèle.
text-embedding-ada-002 dispose de la valeur suivante sur sa fiche officielle : OpenAI ne publie pas la fenêtre sur cette fiche. La sortie maximale est Non applicable : la sortie est un vecteur. Une grande fenêtre ne garantit pas que toutes les informations auront le même poids ; le découpage et les évaluations restent nécessaires.
L’endpoint documenté est : Embeddings et Batch. Il faut éviter de supposer qu’un endpoint voisin est compatible. Les équipes doivent valider streaming, outils, formats de sortie et gestion d’erreur dans l’API effectivement annoncée.
La comparaison la plus utile porte sur text-embedding-3-small et text-embedding-3-large. Le bon choix dépend de rappel, dimensions, stockage et coût, pas du seul numéro de version. Notre recommandation est une analyse éditoriale, à confirmer sur vos données.
Les caractéristiques et tarifs ci-dessus proviennent uniquement des pages OpenAI indiquées. Les choix de modèle, cas d’usage et conseils de migration sont signalés comme analyses éditoriales. chatgptfrancais.org est indépendant et sans affiliation à OpenAI.