Safetensors
Safetensors es el formato en que los modelos se publican originalmente: pesos en precisión completa repartidos en muchos archivos, pensados para GPUs de centro de datos y entrenamiento, no para laptops.
Abre la página de un modelo en Hugging Face y los archivos que ves suelen ser .safetensors: los pesos originales del editor en precisión de entrenamiento, a menudo divididos en decenas de fragmentos de varios gigabytes. El nombre es literal: el formato se creó como reemplazo seguro de los antiguos archivos basados en pickle, que podían ejecutar código al cargarse.
Estos originales son la identidad autorizada del modelo y la opción correcta para hacer fine-tuning o para servirlo en hardware GPU serio. Para ejecutar en local son la descarga equivocada: decenas o cientos de gigabytes donde el GGUF cuantizado del mismo modelo es una fracción del tamaño.
Los dos formatos son etapas de una misma cadena: los editores publican safetensors, y la comunidad y los proveedores los convierten y cuantizan a GGUF para todos los demás.
Dónde lo ves en el radar
Los nombres de modelo del radar enlazan al repositorio safetensors original, la identidad del modelo, mientras que el enlace GGUF aparte es el archivo exacto del que se midieron nuestras cifras de memoria.
Ver ambos enlaces en el tablero →Términos relacionados