TLP:CLEAR · Distribución sin restricción.Actualizado 2026-10-08
Series
Correr un modelo en local
Cómo funciona de verdad la inferencia en una máquina propia. La primera parte explica el mecanismo; la segunda es el montaje, pensada para reenviar al equipo técnico.
№ 014TLP:CLEAR: Distribución sin restricción.BajaEjecutivo: Decisión, costo y riesgo. Sin requisitos técnicos.
Qué ocurre entre que lanzas un modelo y aparece la primera palabra en pantalla, contado paso a paso y sin dar nada por sabido. Al final queda claro por qué una tarjeta con cuatro veces menos memoria puede ser seis veces más rápida.
№ 013TLP:GREEN: Limitado a la comunidad.MediaPráctico: Código, configuración y detalle de implementación.
El montaje completo de un modelo de 27B en una RTX 5090: qué cuantización cabe y por qué, cada parámetro del arranque explicado, cómo se mide, cómo hacer que suba solo, y la tabla de qué se rompe y cómo se reconoce.