Cuando un modelo explica su razonamiento, no está reportando lo que pasó adentro. Está generando más texto.
Cómo funciona mecánicamente la inferencia en un LLM moderno — el forward pass, la caché KV, el muestreo, la cuantización y lo que cada uno cuesta de verdad — y qué puede y qué no puede decirle hoy la investigación en interpretabilidad sobre por qué un modelo produjo una salida. Parte 2 de nuestra serie de profundidad técnica.