Prüfen, bevor du vertraust
KI-API-Modell-Tester
Prüfe, ob ein Endpunkt wirklich das angegebene Modell liefert. Läuft im Browser — dein Schlüssel wird nicht an unsere Server gesendet.
Anfragekonfiguration
Konfiguriere Endpunkt und Schlüssel und führe den Test im Browser aus.
Wird nur an den konfigurierten Endpunkt gesendet — niemals an unsere Server.
Ein Lauf sendet 6 winzige Anfragen über deinen Schlüssel (auf api.airforce Bruchteile eines Cents).
Warum dieser Tester anders ist
Deterministisch, keine Schätzung
Jede Prüfung bildet auf ein konkretes Signal in der Antwort ab — echte Modelle werden so nie als Fälschung markiert, wie es statistisches Fingerprinting tut.
Belege, die du sehen kannst
Jedes Urteil zeigt den gesendeten Prompt, die rohe Antwort und den genauen Text, der es ausgelöst hat. Nichts wird verborgen.
Dein Schlüssel bleibt deiner
Alles läuft in deinem Browser. Der Schlüssel geht nur an den getesteten Endpunkt — niemals an unsere Server — und der Verlauf lebt im localStorage.
So funktionieren die Proben
Tokenizer-Fingerabdrucktokenizer
Das Modell muss einen festen String wörtlich wiederholen. Wrapper und umkodierende Gateways vermurksen exakte Echos oft — das echte Modell besteht sauber.
Echo this exact string back verbatim: Hello, world! This is a tokenizer fingerprint test.
Buchstaben zählen (strawberry)quirk
Wie viele ‚r' stecken in strawberry? Schwache oder unterschobene Modelle scheitern daran bekanntermaßen — das beworbene Modell antwortet ‚3'.
How many letter r appear in the word strawberry? Reply with ONLY a single integer.
Zahlenverständnis (9.11 vs 9.9)quirk
Eine klassische Reasoning-Falle: 9.9 ist größer als 9.11. Kleinere Ersatzmodelle liegen hier regelmäßig falsch.
Which is larger: 9.11 or 9.9? Reply with ONLY the larger number, no explanation.
Wissensstandcutoff
Wer hat die US-Wahl im November 2024 gewonnen? Ältere Modelle als behauptet können das nicht wissen — ein klares Signal, wenn die Antwort fehlt.
Who won the November 2024 US Presidential election? If you genuinely do not know, reply exactly: I DO NOT KNOW.
Sprachtreuelanguage
Eine deutsche Anweisung verlangt genau ein deutsches Wort. Stille Übersetzungsschichten oder Wrapper verraten sich durch eine englische Antwort.
Antworte ausschließlich mit dem einen deutschen Wort „Apfel". Kein anderes Wort, keine Erklärung.
Selbstauskunft (nur Info)identity
Wir bitten das Modell, sich selbst und seinen Hersteller zu nennen. Das ist nie ein Fehlschlag: echte Modelle sind sich über ihre genaue Version oft unsicher — nur als Hinweis gewertet.
In ONE short sentence: state your exact model name, who built you, and your training data cutoff.
Usage-Plausibilitätusage
Wir vergleichen die berechneten Tokenzahlen mit dem gelieferten Text. Ein Token sind im Schnitt ~4 Zeichen — eine Completion-Zahl weit über der Zeichenzahl ist ohne Aufblähung unmöglich und damit ein deterministisches Over-Billing-Signal. Die Schwelle ist bewusst hoch, damit kurze Antworten sie nie auslösen.
Was NICHT als Fälschung gilt
Ein echtes Modell bestätigt Anbieter und Stufe, ist sich aber über seine genaue Version oft unsicher. Das allein ist nie ein Fehlschlag — nur als Hinweis vermerkt.
Rate-Limits (429), 5xx und Timeouts markieren einen Lauf als ungeprüft, nie als verdächtig. Ein echter Endpunkt mit einem schlechten Moment wird nicht bestraft.
AWS Bedrock, Google Vertex oder Azure als Host zu nennen wird akzeptiert — das sind legitime Wege, das echte Modell weiterzuverkaufen.
Die Übersetzung zwischen Chat-Completions und dem nativen Messages-Format ist normales Gateway-Verhalten und kein Betrugssignal, solange das Modell selbst echt ist.
Vier von fünf bestandenen Proben reichen für Echtheit aus — eine einzelne abweichende Antwort verurteilt einen ehrlichen Endpunkt nicht.
Häufig gestellte Fragen
Berührt mein API-Schlüssel eure Server?
Nein. Der Tester läuft komplett in deinem Browser: Anfragen gehen direkt von deinem Rechner an den konfigurierten Endpunkt. Wir sehen, loggen oder speichern deinen Schlüssel nie. Der Verlauf liegt nur im localStorage deines Browsers.
Was kostet ein Testlauf?
Sechs winzige Anfragen mit wenigen Output-Tokens — auf api.airforce sind das Bruchteile eines Cents, abgerechnet über deinen eigenen Schlüssel. Free-Tier-Schlüssel nutzen ihr normales Gratis-Kontingent.
Mein Lauf kam als ‚ungeprüft' zurück — ist der Endpunkt gefälscht?
Nein. Ungeprüft heißt nur, dass ein vorübergehendes Problem (Rate-Limit, 5xx, Timeout oder eine CORS-Sperre) den Test unterbrochen hat. Warte kurz und starte erneut. Wir markieren keinen Endpunkt wegen eines schlechten Moments als verdächtig.
Kann ich auch andere Endpunkte als api.airforce testen?
Ja — trage eine beliebige Basis-URL und einen Schlüssel ein. Es gilt aber Browser-Sicherheit (CORS): api.airforce antwortet Browser-Aufrufen garantiert, andere Anbieter können sie blockieren — dann gilt der Lauf als ungeprüft, nicht als Fehlschlag.