Periodo

Models

Operación de modelos LLM: consumo, latencia, errores y costo por modelo y proveedor.

Modelos Activos
8
4 proveedores
Total Requests
490.3K
todos los modelos
Avg Latency
1.16s
ponderado por requests
Total Cost
$2,586
periodo seleccionado

Cost by Model

Gasto total del periodo por modelo, ordenado de mayor a menor

Key Insights

Modelos que requieren atención

Mayor Error Rate
Azure GPT-4.1
4.21% de error rate · 1.6K errores
Mejor Costo/Latencia
Gemini 2.5 Flash
$0.0004/req · 518ms
Más Utilizado
Claude Sonnet 5
$768.55 de gasto total del periodo

Cost vs. Latency

Cada punto es un modelo — tamaño de burbuja proporcional al volumen de requests

Model Operations

Marca la casilla de hasta 4 modelos para habilitar la comparación

8 registros
AnthropicClaude Sonnet 577.1K69.2M35.9M18.6M1.30s418$768.55healthy
AnthropicClaude Opus 4.810.9K9.9M5.2M2.7M3.14s86$553.47healthy
OpenAIGPT-4o59.8K50.2M28.4M13.9M1.45s1.3K$392.57degraded
GoogleGemini 2.5 Pro47.9K43.1M23.1M12.2M1.63s472$303.62healthy
Azure OpenAIAzure GPT-4.137.3K33.4M18.3M9.2M1.84s1.6K$199.57critical
OpenAIGPT-5.4 mini152.5K130.2M75.3M34.7M784ms686$196.87healthy
OpenAIGPT-5.518.9K17M8.2M4.7M2.07s125$134.98healthy
GoogleGemini 2.5 Flash85.8K76.8M40.4M21.3M518ms573$36.68healthy