Vérifiez avant de faire confiance
Testeur de modèles d'API IA
Vérifiez qu'un endpoint fournit réellement le modèle annoncé. S'exécute dans votre navigateur — votre clé n'est jamais envoyée à nos serveurs.
Configuration de la requête
Configurez l'endpoint et la clé, puis lancez le test dans votre navigateur.
Envoyée uniquement à l'endpoint configuré — jamais à nos serveurs.
Un run envoie 6 petites requêtes avec votre clé (des fractions de centime sur api.airforce).
Pourquoi ce testeur est différent
Déterministe, pas une supposition
Chaque contrôle correspond à un signal concret dans la réponse : les modèles authentiques ne sont donc jamais marqués comme faux comme le fait le fingerprinting statistique.
Des preuves visibles
Chaque verdict montre le prompt envoyé, la réponse brute et le texte exact qui l'a déclenché. Rien n'est caché.
Votre clé reste à vous
Tout s'exécute dans votre navigateur. La clé ne va qu'à l'endpoint que vous testez — jamais à nos serveurs — et l'historique vit dans le localStorage.
Comment fonctionnent les sondes
Empreinte du tokenizertokenizer
Le modèle doit répéter une chaîne fixe à l'identique. Les wrappers et les passerelles qui re-tokenisent massacrent souvent les échos exacts — le vrai modèle passe sans faute.
Echo this exact string back verbatim: Hello, world! This is a tokenizer fingerprint test.
Compter les lettres (strawberry)quirk
Combien de 'r' dans strawberry ? Les modèles faibles ou de substitution échouent ici notoirement ; le niveau annoncé répond '3'.
How many letter r appear in the word strawberry? Reply with ONLY a single integer.
Sens des nombres (9.11 vs 9.9)quirk
Un piège de raisonnement classique : 9.9 est plus grand que 9.11. Les petits modèles de substitution se trompent ici régulièrement.
Which is larger: 9.11 or 9.9? Reply with ONLY the larger number, no explanation.
Limite de connaissancescutoff
Qui a gagné l'élection américaine de novembre 2024 ? Les modèles plus anciens qu'annoncé ne peuvent pas le savoir — un signal clair quand la réponse manque.
Who won the November 2024 US Presidential election? If you genuinely do not know, reply exactly: I DO NOT KNOW.
Fidélité linguistiquelanguage
Une instruction en allemand exige exactement un mot allemand. Les couches de traduction silencieuses ou les wrappers se trahissent en répondant en anglais.
Antworte ausschließlich mit dem einen deutschen Wort „Apfel". Kein anderes Wort, keine Erklärung.
Auto-déclaration (info seulement)identity
Nous demandons au modèle de se nommer et de nommer son créateur. Ce n'est jamais un échec : les vrais modèles sont souvent incertains de leur version exacte — affiché comme simple indice.
In ONE short sentence: state your exact model name, who built you, and your training data cutoff.
Cohérence de l'usageusage
Nous comparons le nombre de tokens facturés au texte livré. Un token représente en moyenne ~4 caractères : un compte de completion très supérieur au nombre de caractères est impossible sans gonflage — un signal déterministe de surfacturation. Le seuil est volontairement haut pour que les réponses courtes ne le déclenchent jamais.
Ce qui ne compte PAS comme fraude
Un vrai modèle confirme son fournisseur et son niveau, mais est souvent incertain de sa version exacte. Cela seul n'est jamais un échec — noté comme simple indice.
Les rate limits (429), les 5xx et les timeouts marquent un run comme non vérifié, jamais comme suspect. Un endpoint authentique qui passe un mauvais moment n'est pas pénalisé.
Nommer AWS Bedrock, Google Vertex ou Azure comme hôte est accepté — ce sont des moyens légitimes de revendre le vrai modèle.
Traduire entre chat-completions et le format natif messages est un comportement normal de passerelle, pas un signal de fraude, tant que le modèle lui-même est réel.
Quatre sondes réussies sur cinq suffisent pour l'authenticité — une seule réponse déviante ne condamne pas un endpoint honnête.
Questions fréquemment posées
Ma clé API touche-t-elle vos serveurs ?
Non. Le testeur s'exécute entièrement dans votre navigateur : les requêtes vont directement de votre machine à l'endpoint que vous configurez. Nous ne voyons, n'enregistrons ni ne stockons jamais votre clé. L'historique des runs est conservé uniquement dans le localStorage de votre navigateur.
Combien coûte un run de test ?
Six petites requêtes avec quelques tokens de sortie chacune — sur api.airforce, cela représente une fraction de centime, facturée sur votre propre clé. Les clés free-tier utilisent leur quota gratuit habituel.
Mon run est revenu « non vérifié » — l'endpoint est-il faux ?
Non. Non vérifié signifie seulement qu'un problème transitoire (rate limit, 5xx, timeout ou un blocage CORS) a interrompu le test. Attendez un instant et relancez. Nous ne marquons jamais un endpoint comme suspect à cause d'un mauvais moment.
Puis-je tester des endpoints autres que api.airforce ?
Oui — saisissez n'importe quelle URL de base et clé. La sécurité du navigateur (CORS) s'applique cependant : api.airforce répond garanti aux appels du navigateur, d'autres fournisseurs peuvent les bloquer — le run est alors marqué non vérifié plutôt qu'échoué.