(Modificado:
2026-10-10)
— Escrito por
SimeonOnSecurity— 11 min de lectura
Dimensiona una configuración de LLM local de 16GB según los pesos del modelo, la caché KV y el procesamiento de prompts. Compara los presupuestos de memoria, el ancho de banda de GPU y el coste de propiedad de Qwen3.8 27B.
(Modificado:
2026-10-10)
— Escrito por
SimeonOnSecurity— 13 min de lectura
Guía práctica de octubre de 2026 para elegir modelos de IA locales para agentes de programación. Compara memoria de GPU, crecimiento de KV-cache, tamaño de contexto, calidad de cuantización, procesamiento de prompts, ajustes de razonamiento y costes de alquiler en la nube.
(Modificado:
2026-10-10)
— Escrito por
SimeonOnSecurity— 12 min de lectura
Compara la IA local con ChatGPT y Claude mediante puntuaciones de referencia, estimaciones de memoria, velocidad de servicio y verificación de agentes. Incluye escenarios con RTX 5090, DGX Spark y Mac Studio.
(Modificado:
2026-10-10)
— Escrito por
SimeonOnSecurity— 10 min de lectura
Diagnostica respuestas inconsistentes de OpenRouter, compara límites de endpoints y costes de caché, y configura el enrutamiento sin desactivar controles de calidad por accidente.