API OX Alpha : Essayez gratuitement le modèle furtif 1M tokens dès aujourd'hui
Felo API propose désormais OX Alpha, un modèle de raisonnement furtif de pointe avec un contexte de 1 million de tokens. Gratuit par million de tokens pour une durée limitée. Essayez-le dès maintenant.
Il y a deux jours, un modèle de pointe est apparu, sans que personne ne le revendique. Il disposait d'une fenêtre de contexte d'un million de tokens, de spécifications de niveau frontier, et d'une étiquette « Stealth » là où le nom du créateur aurait dû figurer. Les observateurs du secteur l'ont trouvé amusant ; les développeurs ont jugé qu'il valait la peine d'être testé.
Aujourd'hui, ce même modèle est disponible en API, et il est gratuit par million de tokens, du moins pour l'instant.
Vous n'avez pas besoin d'une invitation spéciale ni d'un gros budget IA. Il suffit d'ouvrir la page du modèle, ou de faire un appel API avec une clé API.
Qu'est-ce que OX Alpha ?
OX Alpha est un modèle de raisonnement conçu pour le travail sur le long terme : codage efficace, tâches agentiques soutenues et workflows de production. Il est apparu le 20 août sous l'étiquette « Stealth », sans créateur identifié, donc personne ne peut prouver qui l'a construit. Les spéculations vont bon train : un laboratoire chinois, un modèle open source renommé, une petite équipe avec un très grand cluster. Rien n'est confirmé.
Ce qui est confirmé parle de lui-même :
| Fonctionnalité | Détails |
|---|---|
| Fenêtre de contexte | 1 048 576 tokens (une base de code entière, ou une pile de recherche, en une seule passe) |
| Sortie max | 128K tokens en une seule réponse |
| Entrées | Texte, images et vidéo (sortie en texte) |
| Raisonnement | Épisodes de raisonnement explicites, optimisés pour les tâches longues |
| Utilisation d'outils | Appels de fonctions pour les workflows agentiques |
| Modes de sortie | Appels d'outils, mode JSON et streaming |

Un modèle qui prend un million de tokens d'un coup n'est pas un simple autocompléteur plus grand. Il garde l'ensemble de votre projet en mémoire : le code écrit le mois dernier, les articles que vous comparez, la trace d'erreur du crash d'hier. Puis il raisonne sur tout cela en une seule passe.
Deux mises en garde, clairement énoncées. Le buzz autour des benchmarks d'OX Alpha est réel mais non audité : une affirmation virale sur une victoire DeepSWE en codage vient d'un test de 10 questions, et un classement interne le plaçant deuxième sur Kingbench repose sur les chiffres d'un seul développeur, pas sur un leaderboard vérifié. Le créateur est anonyme. Si vous choisissez un modèle pour une stack de production, considérez les benchmarks comme des rumeurs et vérifiez avec votre propre charge de travail.
Plateforme Felo API : Une clé, tous les modèles
OX Alpha est proposé via la plateforme Felo API, une passerelle unifiée qui parle les dialectes API que vos outils utilisent déjà. Pointez votre SDK OpenAI vers une URL de base, ou votre client Anthropic vers une autre, et la plateforme vous dirige vers le modèle nommé dans la requête.
- Surface compatible OpenAI :
POST https://openapi.felo.ai/api/v1/chat/completions. Définissez l'URL de base du SDK OpenAI surhttps://openapi.felo.ai/api/v1et cela fonctionne sans modification. - Surface compatible Anthropic :
POST https://openapi.felo.ai/api/v1/messages. Les clients de type Claude définissent leur URL de base surhttps://openapi.felo.ai/api. - Une surface Responses sur
.../api/v1/responsespour les agents et clients de workflow.
En plus d'OX Alpha, la plateforme propose les modèles Claude, DeepSeek, GPT et Grok. Cela signifie un seul compte, une seule clé API, un seul tableau de bord, et pas de jonglage entre fournisseurs selon le modèle. Pour OX Alpha en particulier, vous disposez d'une page dédiée avec toutes les spécifications, les tarifs en temps réel et un guide de démarrage rapide.
Comment essayer OX Alpha gratuitement en moins d'une minute
Le chemin le plus rapide prend environ trente secondes, sans écrire une seule ligne de code :
- Ouvrez https://openapi.felo.ai/models/stealth/ox-alpha, la page publique du modèle sur la plateforme Felo API.
- Cliquez sur Open Playground pour lancer un chat sur playground.felo.ai.
- Testez le modèle avec votre propre question.
Lorsque vous souhaitez l'intégrer à votre code, créez une clé API depuis votre compte Felo API Platform, puis définissez la variable d'environnement et c'est parti :
export FELO_API_KEY="YOUR_API_KEY"
Une requête minimale, version cURL :
curl -N https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "ox-alpha",
"stream": true,
"messages": [{"role": "user", "content": "Hello"}]
}'
Avec le SDK OpenAI, le changement tient en trois lignes :
from openai import OpenAI
client = OpenAI(base_url="https://openapi.felo.ai/api/v1", api_key=FELO_API_KEY)
reply = client.chat.completions.create(model="ox-alpha", messages=[{"role": "user", "content": "Why is my test flaky?"}])
Cet identifiant de modèle est la chaîne utilisée partout sur la plateforme : ox-alpha.

À quoi ça sert
La fiche du modèle sur la plateforme indique clairement ses « meilleurs usages » : codage sur le long terme, raisonnement complexe, workflows agentiques et tâches multimodales. Trois exemples concrets :
La question de code tout-en-un. Collez le log de crash, le test qui échoue et les pull requests ayant modifié le fichier concerné dans une seule requête, puis demandez ce qui ne va pas réellement. La fenêtre d'un million de tokens garde toute l'histoire visible, au lieu de ce qu'une boîte de résumé retient encore.
La chaîne agentique. OX Alpha prend en charge les appels de fonctions et le streaming d'appels d'outils, ce qui en fait un choix naturel pour les agents multi-étapes. Les agents construits sur Claude Code ou Codex peuvent l'appeler via les surfaces compatibles Anthropic et OpenAI de la plateforme, sans intégration personnalisée.
Le fil multimodal. Un même contexte contient une image, un extrait vidéo et un cahier des charges écrit. Demandez au modèle de les concilier : la capture d'écran dit une chose, la spec une autre, et la sortie résout la contradiction.
Parce que le modèle est capable de raisonnement, la plateforme recommande de conserver les métadonnées de raisonnement retournées lors de la poursuite d'une conversation, et l'en-tête optionnel X-Request-Id peut accélérer le dépannage.
Le même modèle, deux façons d'y accéder
OX Alpha est désormais accessible aussi depuis le navigateur. Felo Search le propose déjà dans son sélecteur de modèles (felo.ai/search, ou accédez-y directement ici : felo.ai/search?search_model=ox-alpha) pour les questions-réponses. L'API dont il est question ici est le même modèle, destiné aux tâches nécessitant du code : pipelines, agents, traitements batch, et l'intérieur de votre propre produit.
Cette distinction est à garder en tête. Si la question est la vôtre et la réponse s'affiche à l'écran, la barre de recherche est le chemin le plus rapide. Si la tâche s'exécute selon un planning, signe votre code ou s'intègre dans un produit, l'API est l'endroit approprié.
Lisez avec prudence, testez en toute confiance
La bonne posture face à ce modèle est le scepticisme vis-à-vis des affirmations, et la curiosité sur le coût. Pendant cette période de lancement, l'API OX Alpha affiche un tarif gratuit par million de tokens en entrée comme en sortie. Cela rend la vérification de première main vraiment abordable. De manière générale, les tarifs de lancement de la plateforme facilitent l'essai des nouveaux modèles sans validation budgétaire.
C'est d'ailleurs la meilleure façon d'évaluer un modèle mystérieux : posez-lui la question la plus difficile dont vous connaissez déjà la réponse, et voyez ce qu'il propose. S'il tient la route, l'absence de logo fournisseur n'a plus d'importance.
Essayez OX Alpha avant la fin de la période gratuite
Un modèle furtif avec un contexte d'un million de tokens est apparu de nulle part il y a deux jours. Il n'est plus qu'à un identifiant de modèle et une clé API. Et pour l'instant, il est gratuit. Les fenêtres de lancement finissent toujours par se refermer.
Si vous souhaitez simplement l'essayer dans le navigateur, le playground vous attend. Si vous le voulez en production, les endpoints et le guide de démarrage rapide sont cités en détail ci-dessus.
Essayez OX Alpha gratuitement sur Felo API →
FAQ
Quel est l'identifiant du modèle OX Alpha ?
ox-alpha. C'est la même chaîne dans le playground, dans cURL, dans chaque SDK, et dans le répertoire des modèles à openapi.felo.ai/models/stealth/ox-alpha.
Ai-je besoin d'un compte OpenAI ou Anthropic ?
Non. La plateforme propose des surfaces compatibles OpenAI et Anthropic, donc les SDK et outils agents existants fonctionnent avec les endpoints Felo via une seule clé API Felo. Apportez vos clients, pas vos comptes.
OX Alpha est-il vraiment gratuit ?
La page du modèle affiche un tarif gratuit par million de tokens en entrée et sortie pendant cette période de lancement. Les tarifs de lancement ne durent pas, donc vérifiez la page du modèle avant de cliquer.
Dois-je faire confiance à ces benchmarks ?
Considérez-les comme une rumeur venant d'un inconnu très éloquent. Les échantillons sont petits, le leaderboard n'est pas audité, et le créateur est anonyme. La façon la moins coûteuse de trancher est de poser votre propre question, et ici c'est gratuit.
Note : les affirmations sur les benchmarks mentionnées ici sont préliminaires et non auditées. Les tarifs affichés reflètent la grille de lancement publiée par la plateforme et peuvent évoluer ; vérifiez les tarifs actuels sur la page du modèle.
Cet article est également disponible en English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.