Quantização (q4, q5)

Processo de reduzir o tamanho do modelo para consumir menos memória, com pequena perda de precisão.

Processo de reduzir o tamanho do modelo para consumir menos memória, com pequena perda de precisão.

Onde isto aparece