Prüfen, bevor du vertraust

KI-API-Modell-Tester

Prüfe, ob ein Endpunkt wirklich das angegebene Modell liefert. Läuft im Browser — dein Schlüssel wird nicht an unsere Server gesendet.

Anfragekonfiguration

Konfiguriere Endpunkt und Schlüssel und führe den Test im Browser aus.

Wird nur an den konfigurierten Endpunkt gesendet — niemals an unsere Server.

Ein Lauf sendet 6 winzige Anfragen über deinen Schlüssel (auf api.airforce Bruchteile eines Cents).

Warum dieser Tester anders ist

Deterministisch, keine Schätzung

Jede Prüfung bildet auf ein konkretes Signal in der Antwort ab — echte Modelle werden so nie als Fälschung markiert, wie es statistisches Fingerprinting tut.

Belege, die du sehen kannst

Jedes Urteil zeigt den gesendeten Prompt, die rohe Antwort und den genauen Text, der es ausgelöst hat. Nichts wird verborgen.

Dein Schlüssel bleibt deiner

Alles läuft in deinem Browser. Der Schlüssel geht nur an den getesteten Endpunkt — niemals an unsere Server — und der Verlauf lebt im localStorage.

So funktionieren die Proben

Tokenizer-Fingerabdrucktokenizer

Das Modell muss einen festen String wörtlich wiederholen. Wrapper und umkodierende Gateways vermurksen exakte Echos oft — das echte Modell besteht sauber.

Echo this exact string back verbatim: Hello, world! This is a tokenizer fingerprint test.

Buchstaben zählen (strawberry)quirk

Wie viele ‚r' stecken in strawberry? Schwache oder unterschobene Modelle scheitern daran bekanntermaßen — das beworbene Modell antwortet ‚3'.

How many letter r appear in the word strawberry? Reply with ONLY a single integer.

Zahlenverständnis (9.11 vs 9.9)quirk

Eine klassische Reasoning-Falle: 9.9 ist größer als 9.11. Kleinere Ersatzmodelle liegen hier regelmäßig falsch.

Which is larger: 9.11 or 9.9? Reply with ONLY the larger number, no explanation.

Wissensstandcutoff

Wer hat die US-Wahl im November 2024 gewonnen? Ältere Modelle als behauptet können das nicht wissen — ein klares Signal, wenn die Antwort fehlt.

Who won the November 2024 US Presidential election? If you genuinely do not know, reply exactly: I DO NOT KNOW.

Sprachtreuelanguage

Eine deutsche Anweisung verlangt genau ein deutsches Wort. Stille Übersetzungsschichten oder Wrapper verraten sich durch eine englische Antwort.

Antworte ausschließlich mit dem einen deutschen Wort „Apfel". Kein anderes Wort, keine Erklärung.

Selbstauskunft (nur Info)identity

Wir bitten das Modell, sich selbst und seinen Hersteller zu nennen. Das ist nie ein Fehlschlag: echte Modelle sind sich über ihre genaue Version oft unsicher — nur als Hinweis gewertet.

In ONE short sentence: state your exact model name, who built you, and your training data cutoff.

Usage-Plausibilitätusage

Wir vergleichen die berechneten Tokenzahlen mit dem gelieferten Text. Ein Token sind im Schnitt ~4 Zeichen — eine Completion-Zahl weit über der Zeichenzahl ist ohne Aufblähung unmöglich und damit ein deterministisches Over-Billing-Signal. Die Schwelle ist bewusst hoch, damit kurze Antworten sie nie auslösen.

Was NICHT als Fälschung gilt

Versionsunklarheit

Ein echtes Modell bestätigt Anbieter und Stufe, ist sich aber über seine genaue Version oft unsicher. Das allein ist nie ein Fehlschlag — nur als Hinweis vermerkt.

Vorübergehende Fehler

Rate-Limits (429), 5xx und Timeouts markieren einen Lauf als ungeprüft, nie als verdächtig. Ein echter Endpunkt mit einem schlechten Moment wird nicht bestraft.

Namen von Cloud-Hosts

AWS Bedrock, Google Vertex oder Azure als Host zu nennen wird akzeptiert — das sind legitime Wege, das echte Modell weiterzuverkaufen.

Protokollumformung

Die Übersetzung zwischen Chat-Completions und dem nativen Messages-Format ist normales Gateway-Verhalten und kein Betrugssignal, solange das Modell selbst echt ist.

Eine instabile Probe

Vier von fünf bestandenen Proben reichen für Echtheit aus — eine einzelne abweichende Antwort verurteilt einen ehrlichen Endpunkt nicht.

Häufig gestellte Fragen

Berührt mein API-Schlüssel eure Server?

Nein. Der Tester läuft komplett in deinem Browser: Anfragen gehen direkt von deinem Rechner an den konfigurierten Endpunkt. Wir sehen, loggen oder speichern deinen Schlüssel nie. Der Verlauf liegt nur im localStorage deines Browsers.

Was kostet ein Testlauf?

Sechs winzige Anfragen mit wenigen Output-Tokens — auf api.airforce sind das Bruchteile eines Cents, abgerechnet über deinen eigenen Schlüssel. Free-Tier-Schlüssel nutzen ihr normales Gratis-Kontingent.

Mein Lauf kam als ‚ungeprüft' zurück — ist der Endpunkt gefälscht?

Nein. Ungeprüft heißt nur, dass ein vorübergehendes Problem (Rate-Limit, 5xx, Timeout oder eine CORS-Sperre) den Test unterbrochen hat. Warte kurz und starte erneut. Wir markieren keinen Endpunkt wegen eines schlechten Moments als verdächtig.

Kann ich auch andere Endpunkte als api.airforce testen?

Ja — trage eine beliebige Basis-URL und einen Schlüssel ein. Es gilt aber Browser-Sicherheit (CORS): api.airforce antwortet Browser-Aufrufen garantiert, andere Anbieter können sie blockieren — dann gilt der Lauf als ungeprüft, nicht als Fehlschlag.