
Bradley Amy, director técnico de Pangram, afirma que el postentrenamiento y las restricciones de seguridad reducen notablemente el rango expresivo de los modelos de lenguaje. Según el material publicado por The Decoder, los modelos base sin tales restricciones ya son capaces de escribir con mayor diversidad.
Esto significa que la detectabilidad de un texto generado por una modelo puede deberse no a una incapacidad fundamental para escribir de forma humana, sino a las consecuencias del postentrenamiento y de las configuraciones de seguridad.
La confirmación disponible se limita al resumen de The Decoder y no incluye el texto completo de la publicación, la metodología ni verificación independiente. No está claro qué modelos y procedimientos exactamente se compararon y cuán aplicable es el resultado a sistemas modernos en general.
comentario editorial
Por qué importa
Consecuencia probable: los detectores y analistas de procedencia de texto pueden considerar no solo las capacidades del modelo, sino también los efectos del postentrenamiento. La siguiente señal observable será la aparición de comparaciones reproducibles entre modelos base y postentrenados. Una incertidumbre sustancial se debe a la ausencia de en el paquete de metodología, datos y verificación independiente.