TLP:CLEAR · Distribución sin restricción. Actualizado 2026-10-08

Series

Correr un modelo en local

Cómo funciona de verdad la inferencia en una máquina propia. La primera parte explica el mecanismo; la segunda es el montaje, pensada para reenviar al equipo técnico.

№ 014 TLP:CLEAR: Distribución sin restricción. Baja Ejecutivo: Decisión, costo y riesgo. Sin requisitos técnicos.

Cómo corre un modelo en tu máquina

Qué ocurre entre que lanzas un modelo y aparece la primera palabra en pantalla, contado paso a paso y sin dar nada por sabido. Al final queda claro por qué una tarjeta con cuatro veces menos memoria puede ser seis veces más rápida.

Plataforma y criptografía 11 min Serie: Correr un modelo en local ·
№ 013 TLP:GREEN: Limitado a la comunidad. Media Práctico: Código, configuración y detalle de implementación.

Montar un modelo local, paso a paso

El montaje completo de un modelo de 27B en una RTX 5090: qué cuantización cabe y por qué, cada parámetro del arranque explicado, cómo se mide, cómo hacer que suba solo, y la tabla de qué se rompe y cómo se reconoce.

Plataforma y criptografía 11 min Serie: Correr un modelo en local ·