Ranking modeli

Co naprawdę działa na api.airforce. Każda liczba pochodzi z pomiaru naszego własnego ruchu — nic nie jest importowane, szacowane ani układane według opinii.

Najpopularniejsze modele

Zużycie tokenów we wszystkich modelach na api.airforce.

Ładowanie…

Ranking

Pełna tabela: prompt, odpowiedź, rozumowanie i pamięć podręczna obok siebie. „Użytkownicy/dzień” to najwyższa liczba różnych użytkowników w jednym dniu okresu.

Ładowanie…

Modele według zadania

Czołowe modele dla każdego zadania, według udziału w wydatkach.

Ładowanie…

Koszt sesji

Ile zwykle kosztuje jedna sesja, w zależności od jej długości.

Ładowanie…

Udział w rynku

Udział w zapytaniach według producenta modelu w czasie.

Ładowanie…

Benchmarki

Niezależne wyniki benchmarków obok zmierzonego użycia.

Ładowanie…

Najszybsze modele

Mediana czasu do pierwszego tokena i trwała przepustowość, mierzone tylko na dostarczonych odpowiedziach.

Ładowanie…

Języki

Użycie modeli według języka naturalnego.

Nie wykrywamy języka promptów. Wymagałoby to analizy treści wiadomości, której świadomie nie przechowujemy — dlatego ta sekcja pozostaje pusta zamiast pokazywać domysł.

Programowanie

Użycie modeli według języka programowania.

Nie wykrywamy języków programowania w promptach z tego samego powodu: wymagałoby to analizy treści wiadomości, których nie przechowujemy.

Długość kontekstu

Zapytania według długości promptu.

Ładowanie…

Wywołania narzędzi

Wywołania narzędzi we wszystkich modelach.

Ładowanie…

Obrazy

Wygenerowane obrazy we wszystkich modelach.

Ładowanie…

Najpopularniejsze aplikacje

Aplikacje generujące największy ruch.

Ładowanie…