Skip to content
AI Model Radar

Glossário

Safetensors

Safetensors é o formato em que os modelos são publicados originalmente: pesos em precisão completa espalhados por muitos arquivos, feitos para GPUs de data center e treinamento, não para notebooks.

Abra a página de um modelo no Hugging Face e os arquivos que você vê geralmente são .safetensors: os pesos originais do editor na precisão de treinamento, muitas vezes divididos em dezenas de fragmentos de vários gigabytes. O nome é literal: o formato foi criado como substituto seguro dos antigos arquivos baseados em pickle, que podiam executar código ao serem carregados.

Esses originais são a identidade oficial do modelo e a escolha certa para fazer fine-tuning ou para servi-lo em hardware de GPU sério. Para rodar localmente, são o download errado: dezenas ou centenas de gigabytes onde o GGUF quantizado do mesmo modelo é uma fração do tamanho.

Os dois formatos são etapas de uma mesma cadeia: os editores publicam safetensors, e a comunidade e os fornecedores os convertem e quantizam para GGUF para todos os outros.

Onde você vê isso no radar

Os nomes dos modelos no radar levam ao repositório safetensors original, a identidade do modelo, enquanto o link GGUF separado é o arquivo exato de onde nossos números de memória foram medidos.

Ver os dois links no painel

Termos relacionados

GGUFQuantizaçãoParâmetros (7B, 70B)

Também em:EnglishEspañol

← Todos os termos