Peringkat model
Apa yang benar-benar dipakai di api.airforce. Setiap angka di sini diukur dari trafik kami sendiri — tidak ada yang diimpor, diperkirakan, atau diurutkan berdasarkan opini.
Model teratas
Penggunaan token di seluruh model pada api.airforce.
Memuat…
Papan peringkat
Tabel lengkap: prompt, jawaban, penalaran, dan cache berdampingan. „Pengguna/hari” adalah jumlah pengguna berbeda tertinggi pada satu hari dalam periode.
Memuat…
Model teratas per tugas
Model terdepan untuk tiap tugas, berdasarkan pangsa belanja.
Memuat…
Biaya per sesi
Berapa biaya satu sesi pada umumnya, menurut panjang sesi.
Memuat…
Benchmark
Skor benchmark independen di samping penggunaan terukur.
Memuat…
Model tercepat
Waktu median hingga token pertama dan throughput berkelanjutan, diukur hanya pada jawaban yang terkirim.
Memuat…
Bahasa
Penggunaan model menurut bahasa alami.
Kami tidak mendeteksi bahasa prompt. Itu berarti memeriksa isi pesan, yang sengaja tidak kami simpan — jadi bagian ini dibiarkan kosong alih-alih menampilkan tebakan.
Pemrograman
Penggunaan model menurut bahasa pemrograman.
Kami juga tidak mendeteksi bahasa pemrograman dalam prompt, dengan alasan sama: itu memerlukan pemeriksaan isi pesan yang tidak kami simpan.
Panjang konteks
Permintaan menurut panjang prompt.
Memuat…
Panggilan alat
Panggilan alat di seluruh model.
Memuat…
Gambar
Gambar yang dihasilkan di seluruh model.
Memuat…
Aplikasi teratas
Aplikasi yang mengirim trafik terbanyak.
Memuat…