Model Weights
Saiba como os pesos do modelo funcionam como o conhecimento da IA. Explore como o Ultralytics YOLO26 utiliza pesos otimizados para um treino e uma inferência mais rápidos e precisos.
Os pesos do modelo são os parâmetros ajustáveis dentro de um modelo de machine learning que transformam os dados de entrada em resultados previstos. Numa rede neuronal, estes pesos representam a força das ligações entre os neurónios nas diferentes camadas. Quando um modelo é inicializado, estes pesos são normalmente definidos com valores aleatórios e pequenos, o que significa que o modelo "não sabe" nada. Através de um processo chamado treino, o modelo ajusta iterativamente estes pesos com base nos erros que comete, aprendendo gradualmente a reconhecer padrões, características e relações nos dados. Podes pensar nos pesos do modelo como a "memória" ou o "conhecimento" da IA; eles armazenam aquilo que o sistema aprendeu com os seus dados de treino.
O papel dos pesos na aprendizagem#
O principal objetivo do treino de uma rede neuronal é encontrar o conjunto ideal de pesos do modelo que minimize o erro entre as previsões do modelo e a verdade fundamental real. Este processo envolve passar os dados pela rede — uma etapa conhecida como passagem direta — e, em seguida, calcular um valor de perda utilizando uma função de perda específica. Se a previsão estiver incorreta, um algoritmo de otimização como o Descenso de gradiente estocástico (SGD) ou o mais recente otimizador Muon utilizado no YOLO26 calcula quanto cada peso contribuiu para o erro.
Através de uma técnica chamada retropropagação, o algoritmo atualiza ligeiramente os pesos para reduzir o erro da próxima vez. Este ciclo repete-se milhares ou milhões de vezes até que os pesos do modelo estabilizem e o sistema alcance uma elevada precisão. Quando o treino termina, os pesos são "congelados" e guardados, permitindo que o modelo seja implementado para inferência em dados novos e nunca vistos.
Pesos do modelo vs. vieses#
É importante distinguir entre pesos e vieses, pois trabalham em conjunto, mas têm finalidades diferentes. Enquanto os pesos do modelo determinam a força e a direção da ligação entre os neurónios (controlando a inclinação da ativação), os vieses permitem deslocar a função de ativação para a esquerda ou para a direita. Este deslocamento garante que o modelo consiga ajustar-se melhor aos dados, mesmo quando todas as características de entrada são zero. Em conjunto, os pesos e os vieses formam os parâmetros ajustáveis que definem o comportamento de arquiteturas como as redes neuronais convolucionais (CNNs).
Aplicações no mundo real#
Os pesos do modelo são o componente central que permite o funcionamento dos sistemas de IA em vários setores. Aqui estão dois exemplos concretos de como são aplicados:
- Visão computacional no retalho: Num sistema de supermercado inteligente, um modelo como o YOLO26 utiliza os seus pesos treinados para identificar produtos numa prateleira. Os pesos "aprenderam" características visuais — como a forma de uma caixa de cereais ou a cor de uma lata de refrigerante — permitindo que o sistema detete artigos, gira o inventário e até facilite eficientemente processos de pagamento automatizados.
- Análise de imagens médicas: Na área da saúde, os modelos de deep learning utilizam pesos especializados para analisar radiografias ou exames de MRI. Por exemplo, um modelo treinado para a deteção de tumores utiliza os seus pesos para distinguir entre tecido saudável e potenciais anomalias. Estes pesos captam padrões complexos e não lineares nos dados dos píxeis que podem ser subtis para o olho humano, ajudando os radiologistas a fazer diagnósticos mais rápidos.
Guardar e carregar pesos#
Na prática, trabalhar com pesos do modelo envolve guardar os parâmetros treinados num ficheiro e carregá-los posteriormente para fazer previsões ou ajustá-los. No ecossistema Ultralytics, estes são normalmente armazenados como ficheiros .pt (PyTorch).
Aqui está um exemplo simples de como carregar pesos pré-treinados num modelo YOLO e executar uma previsão:
from ultralytics import YOLO
# Load a model with pre-trained weights (e.g., YOLO26n)
model = YOLO("yolo26n.pt")
# Run inference on an image using the loaded weights
results = model("https://ultralytics.com/images/bus.jpg")
# Print the number of detected objects
print(f"Detected {len(results[0].boxes)} objects.")Aprendizagem por transferência e ajuste fino#
Um dos aspetos mais poderosos dos pesos do modelo é a sua portabilidade. Em vez de treinar um modelo de raiz — o que requer enormes conjuntos de dados e um poder computacional significativo — os programadores utilizam frequentemente a aprendizagem por transferência. Isto envolve pegar num modelo com pesos pré-treinados num grande conjunto de dados como o COCO ou o ImageNet e adaptá-lo a uma tarefa específica.
Por exemplo, podes pegar nos pesos de um detetor geral de objetos e ajustá-los num conjunto de dados mais pequeno de painéis solares. Como os pesos pré-treinados já compreendem contornos, formas e texturas, o modelo converge muito mais rapidamente e requer menos dados anotados. Ferramentas como a Ultralytics Platform simplificam este processo, permitindo que as equipas giram conjuntos de dados, treinem modelos na cloud e implementem pesos otimizados em dispositivos de edge computing sem problemas.
Compressão e otimização#
A investigação moderna em IA centra-se frequentemente na redução do tamanho dos ficheiros dos pesos do modelo sem sacrificar o desempenho, um processo conhecido como quantização do modelo. Ao reduzir a precisão dos pesos (por exemplo, de números de vírgula flutuante de 32 bits para inteiros de 8 bits), os programadores podem diminuir significativamente a utilização de memória e melhorar a velocidade de inferência. Isto é crucial para implementar modelos em hardware com recursos limitados, como telemóveis ou dispositivos Raspberry Pi. Além disso, técnicas como a poda removem os pesos que pouco contribuem para o resultado, tornando o modelo ainda mais eficiente para aplicações em tempo real.









