Modelranglijst
Wat er echt draait op api.airforce. Elk cijfer is gemeten aan ons eigen verkeer — niets is geïmporteerd, geschat of op mening gerangschikt.
Topmodellen
Tokengebruik over alle modellen op api.airforce.
Laden…
Ranglijst
De volledige tabel, met prompt, antwoord, redeneren en cache naast elkaar. „Gebruikers/dag” is het hoogste aantal verschillende gebruikers op één dag in de periode.
Laden…
Topmodellen per taak
De koplopers per taak, gerangschikt naar aandeel in de uitgaven.
Laden…
Kosten per sessie
Wat een sessie doorgaans kost, naar sessieduur.
Laden…
Benchmarks
Onafhankelijke benchmarkscores naast het gemeten gebruik.
Laden…
Snelste modellen
Mediane tijd tot het eerste token en aanhoudende doorvoer, alleen gemeten op geleverde antwoorden.
Laden…
Talen
Modelgebruik per natuurlijke taal.
Wij detecteren de taal van prompts niet. Dat zou betekenen dat we de inhoud van berichten inspecteren, en die bewaren we bewust niet — daarom blijft deze sectie leeg in plaats van een gok te tonen.
Programmeren
Modelgebruik per programmeertaal.
Wij detecteren geen programmeertalen in prompts, om dezelfde reden: het zou vereisen dat we berichtinhoud inspecteren, die we niet bewaren.
Contextlengte
Verzoeken naar promptlengte.
Laden…
Toolaanroepen
Toolaanroepen over alle modellen.
Laden…
Afbeeldingen
Gegenereerde afbeeldingen over alle modellen.
Laden…
Topapps
Applicaties met het meeste verkeer.
Laden…