(Modificado:
2026-10-10)
— Escrito por
SimeonOnSecurity— 11 min de lectura
Dimensiona una configuración de LLM local de 16GB según los pesos del modelo, la caché KV y el procesamiento de prompts. Compara los presupuestos de memoria, el ancho de banda de GPU y el coste de propiedad de Qwen3.8 27B.
(Modificado:
2026-10-10)
— Escrito por
SimeonOnSecurity— 10 min de lectura
Compara OpenCode y Claude Code en elección de modelos, inferencia local, precios, permisos, instrucciones del proyecto y flujos diarios de programación.
(Modificado:
2026-10-10)
— Escrito por
SimeonOnSecurity— 13 min de lectura
Guía práctica de octubre de 2026 para ejecutar un modelo Qwen 27B con 32 GB de memoria utilizable del acelerador. Compara GPU individuales, equipos con dos tarjetas, memoria unificada, tarjetas usadas de centros de datos, cómputo alquilado, soporte de software y límites de contexto completo.
(Modificado:
2026-10-10)
— Escrito por
SimeonOnSecurity— 10 min de lectura
La versión de 64 GB del DGX Spark de NVIDIA muestra cómo la presión sobre el suministro de memoria está moldeando el hardware de IA local. Esta guía explica la reducción de capacidad, las concesiones de la memoria unificada y por qué el alivio de la DRAM es poco probable antes de finales de 2027.