Airtime Fleet · Workload & Compute Scale

Qué IA corremos: LLMs, cómputo y workload documentado. No es una factura; es la huella operativa.

as of 2026-10-11
fleet.bucardo.io

Nodos de cómputo MEASURED

Bare-metal soberano2
Azure Container Apps5
Azure Postgres Flex8–10
unidades heterogéneas — no se suman en un escalar

Throughput por corrida MEASURED

qwen2.5:3b (DGX)~100 tok/s
qwen2.5:32b 4-bit (DGX)~11 tok/s
DGX mem bandwidth273 GB/s @ ~73%
corrida única, no serie sostenida

Flota de LLMs MEASURED

11 proveedores
Asientos nombrados del Council10
KimiDeepSeekQwenGLMbytedance ollamatelcotelco-arkreviewerchairman

Workload documentado MEASURED · reproducible

Logs de sesión de agentes322
└ de los que mencionan Council97
Reports168
Docs de Council79
conteos de artefactos, NO consumo en runtime · comandos en el ledger §0.1

Cola DGX no reproducible

#50 id máx observado
un id de cola, no un conteo de tareas completadas — queue.json vive en el worker