Safetensors
Safetensors é o formato em que os modelos são publicados originalmente: pesos em precisão completa espalhados por muitos arquivos, feitos para GPUs de data center e treinamento, não para notebooks.
Abra a página de um modelo no Hugging Face e os arquivos que você vê geralmente são .safetensors: os pesos originais do editor na precisão de treinamento, muitas vezes divididos em dezenas de fragmentos de vários gigabytes. O nome é literal: o formato foi criado como substituto seguro dos antigos arquivos baseados em pickle, que podiam executar código ao serem carregados.
Esses originais são a identidade oficial do modelo e a escolha certa para fazer fine-tuning ou para servi-lo em hardware de GPU sério. Para rodar localmente, são o download errado: dezenas ou centenas de gigabytes onde o GGUF quantizado do mesmo modelo é uma fração do tamanho.
Os dois formatos são etapas de uma mesma cadeia: os editores publicam safetensors, e a comunidade e os fornecedores os convertem e quantizam para GGUF para todos os outros.
Onde você vê isso no radar
Os nomes dos modelos no radar levam ao repositório safetensors original, a identidade do modelo, enquanto o link GGUF separado é o arquivo exato de onde nossos números de memória foram medidos.
Ver os dois links no painel →Termos relacionados