Sur cette page
Que réunit réellement l’API xAI ?
xAI réunit des modèles texte-image, des outils serveur et plusieurs interfaces vocales, avec des unités de facturation distinctes.
Grok 4.6 accepte texte et image, annonce 500 000 tokens de contexte et prend en charge raisonnement, appels de fonctions et sorties structurées.
Une requête avec recherche Web ou X additionne les tokens du modèle et les invocations d’outils. Une requête dont le prompt atteint 200 000 tokens bascule entièrement au tarif long contexte.
Nature et accès de xAI
La plateforme développeur xAI et ses API, référent principal explicite de la fiche.
Interfaces : API.
Le critère qui compte
Le coût d’un agent xAI ne se résume pas au prix du modèle : contexte, outils et voix doivent être budgétés ensemble.
Les fonctionnalités principales de l’API xAI
Les capacités ci-dessous sont documentées par xAI ; aucune mesure de performance indépendante n’est revendiquée.
Grok 4.6, texte et image
Le modèle documente 500 000 tokens de contexte, le raisonnement, les appels de fonctions et les sorties structurées.
Recherche Web et X
Web Search et X Search sont disponibles comme outils serveur. Leur coût s’ajoute aux tokens consommés par le modèle.
Voix en temps réel
La grille distingue speech-to-speech, transcription REST ou streaming et synthèse vocale ; cette fiche ne mesure pas leur latence.
Contexte long
À partir de 200 000 tokens de prompt, tous les tokens de la requête Grok 4.6 suivent le tarif long contexte.
Appels de fonctions
Grok 4.6 prend en charge le tool calling et les sorties structurées pour relier le modèle à une application.
Comprendre les coûts cumulés
Un agent xAI peut additionner trois postes : tokens du modèle, appels d’outils serveur et, pour un produit vocal, minutes ou caractères audio. Le tableau tarifaire officiel doit donc être lu comme plusieurs compteurs, pas comme un prix unique.
Choisir le modèle et les outils
Grok 4.6 est le modèle de référence documenté pour les tâches complexes. Grok 4.3 réduit le coût en contexte court. Web Search et X Search deviennent utiles lorsque l’agent doit récupérer une information récente, mais chaque appel augmente la facture et mérite un plafond.
Comparer sans prix tiers périmés
Comparez xAI à OpenAI ou Anthropic sur vos propres prompts et besoins d’outils. Ajoutez Vapi seulement si l’orchestration téléphonique est réellement le sujet. Les prix tiers changent trop vite pour être figés ici sans preuve datée.
À qui s’adresse l’API xAI ?
xAI vise les équipes capables de suivre la consommation par composant et de comparer les sorties sur leurs propres scénarios.
Particulièrement adapté
- {'title': 'Éditeurs SaaS et développeurs d’applications', 'description': 'Pour ajouter des fonctionnalités de chatbot conversationnel ou d’assistant vocal dans leurs produits.'}
- {'title': 'Intégrateurs de systèmes de support client', 'description': 'Pour concevoir des agents téléphoniques autonomes capables de consulter des bases de connaissances en direct.'}
Moins adapté
- {'title': 'Utilisateurs non techniques', 'description': "Personnes cherchant un simple abonnement grand public (se tourner plutôt vers l'interface Grok.com)."}
- {'title': 'Besoins 100 % hors ligne', 'description': 'Équipes nécessitant un modèle fonctionnant sur leurs propres serveurs locaux.'}
En bref
Les points forts et limites de l’API xAI
Ce qu’on aime
- Migration ultra simple grâce à la compatibilité SDK OpenAI
- Voice Agent API réactive et taillée pour l'interaction réelle
- Accès aux données temps réel du réseau X
Ce qui peut frustrer
- Cumul des coûts sur les appels d'outils serveur répétés
- Nécessite une gestion technique des connexions WebSocket
Tarification des API xAI
Le texte est facturé par token, la voix par minute ou caractère et les outils par invocation.
Grok 4.6 — contexte courtNotre choix2 $ entrée · 0,50 $ cache · 6 $ sortie / 1 M tokens+
Raisonnement, fonctions et sorties structurées
Capacité : 500 000
Grok 4.3 — contexte court1,25 $ entrée · 0,20 $ cache · 2,50 $ sortie / 1 M tokens+
Option moins chère
Capacité : Selon usage
Voice API0,08 $/min en speech-to-speech+
STT REST 0,10 $/h ; streaming 0,20 $/h
Capacité : Selon usage
Web Search, X Search et Code Execution coûtent 5 $ pour 1 000 appels au 12 septembre 2026.
Le changement de tarification X Search annoncé pour le 21 septembre 2026 impose une revalidation rapide.
Quelles alternatives à l’API xAI comparer ?
OpenAI, Anthropic et Vapi répondent à des besoins voisins mais différents ; comparez d’abord l’écosystème, les outils et l’orchestration attendue.
xAI API face à trois approches
Cette matrice compare le rôle de chaque plateforme, sans prix tiers non revalidé.
| Outil | Plateforme | Point de départ | À choisir si |
|---|---|---|---|
| xAI API | xAI API | Grok et outils Web/X | La recherche X native est centrale |
| OpenAI API | OpenAI API | Modèles et outils OpenAI | Votre pile utilise déjà cet écosystème |
| Anthropic API | Anthropic API | Modèles Claude | Vous comparez un autre fournisseur de modèles |
| Vapi | Vapi | Orchestration vocale | La téléphonie clé en main est prioritaire |
Intégration & Développeurs
Déployez vos premiers agents avec l’API xAI
Créez une clé API sur la console développeur xAI et commencez à tester les modèles Grok avec votre code existant pour évaluer la réactivité et les performances.
À savoir : Les appels d’outils serveur génèrent des surcoûts par millier de requêtes.
FAQ sur xAI API et Grok
Quel est le prix de l’API xAI ?
Grok 4.6 coûte 2 $/M tokens en entrée et 6 $/M en sortie en contexte court. Les outils et le contexte long sont facturés en plus.
Que change le seuil de 200 000 tokens ?
Dès que le prompt atteint ce seuil, tous les tokens de la requête Grok 4.6 sont facturés au tarif long contexte.
La Voice API a-t-elle été testée ici ?
Non. La fiche reprend les capacités et tarifs publiés, sans revendiquer de mesure de latence ni d’écoute.
Quelles alternatives à xAI API comparer ?
OpenAI API pour son écosystème, Anthropic API pour Claude et Vapi pour l’orchestration vocale.
Comment fonctionnent les outils Web et X de xAI ?
Web Search et X Search sont des outils serveur : le modèle décide de les appeler et leurs invocations sont facturées en plus des tokens.
