Models
Operación de modelos LLM: consumo, latencia, errores y costo por modelo y proveedor.
Modelos Activos
8
4 proveedores
Total Requests
490.3K
todos los modelos
Avg Latency
1.16s
ponderado por requests
Total Cost
$2,586
periodo seleccionado
Cost by Model
Gasto total del periodo por modelo, ordenado de mayor a menor
Key Insights
Modelos que requieren atención
Mayor Error Rate
Azure GPT-4.1
4.21% de error rate · 1.6K errores
Mejor Costo/Latencia
Gemini 2.5 Flash
$0.0004/req · 518ms
Más Utilizado
Claude Sonnet 5
$768.55 de gasto total del periodo
Cost vs. Latency
Cada punto es un modelo — tamaño de burbuja proporcional al volumen de requests
Model Operations
Marca la casilla de hasta 4 modelos para habilitar la comparación
8 registros
| Anthropic | Claude Sonnet 5 | 77.1K | 69.2M | 35.9M | 18.6M | 1.30s | 418 | $768.55 | healthy | |
| Anthropic | Claude Opus 4.8 | 10.9K | 9.9M | 5.2M | 2.7M | 3.14s | 86 | $553.47 | healthy | |
| OpenAI | GPT-4o | 59.8K | 50.2M | 28.4M | 13.9M | 1.45s | 1.3K | $392.57 | degraded | |
| Gemini 2.5 Pro | 47.9K | 43.1M | 23.1M | 12.2M | 1.63s | 472 | $303.62 | healthy | ||
| Azure OpenAI | Azure GPT-4.1 | 37.3K | 33.4M | 18.3M | 9.2M | 1.84s | 1.6K | $199.57 | critical | |
| OpenAI | GPT-5.4 mini | 152.5K | 130.2M | 75.3M | 34.7M | 784ms | 686 | $196.87 | healthy | |
| OpenAI | GPT-5.5 | 18.9K | 17M | 8.2M | 4.7M | 2.07s | 125 | $134.98 | healthy | |
| Gemini 2.5 Flash | 85.8K | 76.8M | 40.4M | 21.3M | 518ms | 573 | $36.68 | healthy |