# Ingeniería de IA

Canonical URL: https://luisalejandro.org/blog/category/ingenieria-de-ia

### [KV cache quantization: el nuevo cuello de botella para correr agentes de IA en local (y cómo medirlo)](https://luisalejandro.org/blog/posts/kv-cache-quantization-el-nuevo-cuello-de-botella-para-correr-agentes-de-ia-en-local-y-como-medirlo) — 2026-08-24

Pasé horas depurando mi GPU. Te explico qué es el KV cache en transformers para lograr una inferencia de contexto largo local. ¡Te lo cuento todo!