Classificação de modelos

O que realmente é usado na api.airforce. Cada número é medido no nosso próprio tráfego — nada é importado, estimado ou ordenado por opinião.

Modelos principais

Uso de tokens em todos os modelos da api.airforce.

A carregar…

Classificação

A tabela completa, com prompt, resposta, raciocínio e cache lado a lado. «Utilizadores/dia» é o maior número de utilizadores distintos num único dia do período.

A carregar…

Modelos por tarefa

Os modelos líderes de cada tarefa, por quota de despesa.

A carregar…

Custo por sessão

Quanto custa normalmente uma sessão, consoante a duração.

A carregar…

Quota de mercado

Quota de pedidos por fabricante ao longo do tempo.

A carregar…

Benchmarks

Pontuações de benchmarks independentes junto ao uso medido.

A carregar…

Modelos mais rápidos

Tempo mediano até ao primeiro token e débito sustentado, medidos apenas em respostas entregues.

A carregar…

Idiomas

Uso de modelos por idioma natural.

Não detetamos o idioma dos prompts. Isso implicaria inspecionar o conteúdo das mensagens, que deliberadamente não guardamos — por isso esta secção fica vazia em vez de mostrar um palpite.

Programação

Uso de modelos por linguagem de programação.

Não detetamos linguagens de programação nos prompts, pela mesma razão: exigiria inspecionar o conteúdo das mensagens, que não guardamos.

Comprimento do contexto

Pedidos por comprimento do prompt.

A carregar…

Chamadas de ferramentas

Chamadas de ferramentas em todos os modelos.

A carregar…

Imagens

Imagens geradas em todos os modelos.

A carregar…

Apps principais

Aplicações que enviam mais tráfego.

A carregar…