O termo open-weight (ou pesos abertos em uma tradução livre) descreve um modelo de distribuição e licenciamento de inteligência artificial em que os pesos treinados do modelo são disponibilizados publicamente.
Embora esse modelo seja frequentemente chamado pela mídia de “código aberto” (open-source), a comunidade técnica prefere o termo open-weight por ser mais preciso e honesto sobre o que está (e o que não está) sendo disponibilizado.
A Diferença Fundamental: Open-Weight vs. Open-Source vs. Closed-Source
Para entender a distinção no ecossistema de IA, vale comparar esses três níveis de transparência:
| Característica | Closed-Source (SaaS / API) | Open-Weight | Open-Source Autêntico (OSI) |
| Exemplos | GPT-4o, Claude 3.5 Sonnet, Gemini Pro | Llama 3, DeepSeek-V3, Mistral 7B | OLMo (Allen AI), Amber, LLM360 K2 |
| Acesso ao Modelo | Apenas via requisições de API no servidor da empresa. | Download dos arquivos de pesos para rodar localmente. | Download dos pesos + código completo + datasets. |
| Pesos | Privados | Públicos | Públicos |
| Código de Inferencia | Privado | Público | Público |
| Dataset de Treino | Privado | Privado (na maioria das vezes) | Público |
| Receita/Código de Treino | Privado | Privado / Parcial | Público |
Por que a diferença importa?
No software tradicional, open-source significa acesso ao código-fonte para que qualquer um possa recompilar o programa do zero. Em IA, ter apenas os pesos permite executar, modificar e aplicar fine-tuningO Ajuste Fino (Fine-Tuning) é o processo que transforma uma IA generalista em um especialista em uma tarefa. A Metáfora da Especialização Para entender como o processo se divide, podemos dividi-lo em duas grandes etapas: • Pré-treinamento (A "Graduaç... More, mas não permite reproduzir o treinamento original se a empresa não publicar os dados de treino e a receita de otimização.
O que o acesso aos Pesos permite fazer?
Ter os arquivos de pesos abertos desbloqueia capacidades de controle que são impossíveis de obter com APIs fechadas:
- Execução Local e Soberania de Dados: O modelo pode rodar em servidores próprios (on-premises) ou em computadores pessoais (usando formatos como GGUFA sigla GGUF significa GPT-Generated Unified Format (Formato Unificado Gerado por GPT). Trata-se de um formato de arquivo binário criado pela comunidade de código aberto (liderada por Georgi Gerganov e pelos mantenedores do projeto llama.cpp) para ar... More).
- Ajuste Fino (Fine-TuningO Ajuste Fino (Fine-Tuning) é o processo que transforma uma IA generalista em um especialista em uma tarefa. A Metáfora da Especialização Para entender como o processo se divide, podemos dividi-lo em duas grandes etapas: • Pré-treinamento (A "Graduaç... More e LoRAO LoRA (sigla para Low-Rank Adaptation, ou Adaptabilidade de Baixo Posto) é uma das técnicas de eficiência mais revolucionárias para o ajuste fino (fine-tuning) de LLMs e também redes neurais profundas. Desenvolvido por pesquisadores da Microsoft em ... More): É possível treinar o modelo para se especializar em uma tarefa ou domínio muito específico, alterando ou estendendo a matriz de pesos original.
- QuantizaçãoA Quantização (ou Quantization) é uma das técnicas fundamentais de otimização no campo do Aprendizado de Máquina. Ela permite compactar Grandes Modelos de Linguagem (LLMs), reduzindo drasticamente o consumo de memória (VRAM/RAM) e acelerando o tempo ... More Personalizada: É possível comprimir os pesos para rodar em hardware com menos memória VRAMA VRAM (sigla para Video Random Access Memory, ou Memória de Acesso Aleatório de Vídeo) é um tipo especial de memória RAM de altíssima velocidade dedicada exclusivamente ao processamento gráfico e a operações de computação paralela intensa, como o tr... More (como reduzir de
FP16paraINT4ouINT8). - Inspecionabilidade de Camadas: Pesquisadores e desenvolvedores podem inspecionar as ativações internas do modelo, entender como o mecanismo de atenção está reagindo ou usar técnicas de steering (guiar o comportamento editando ativações em tempo de inferência).
As Licenças e as Restrições Open-Weight
Nem todos os modelos open-weight são totalmente livres do ponto de vista comercial. Os criadores costumam usar licenças customizadas com algumas restrições comuns:
- Cláusulas de Escala de Usuários: Licenças como a do Llama (Meta) permitem uso comercial gratuito, exceto se a aplicação atingir mais de centenas de milhões de usuários ativos mensais (caso em que exige uma licença especial).
- Restrição de Treinamento Sintético: Algumas licenças proíbem o uso da saída do modelo para treinar ou aprimorar outros modelos concorrentes.
- Restrições de Uso Aceitável: Cláusulas que proíbem o uso do modelo em cenários específicos (militar, vigilância em massa, geração de conteúdo ilegal).