NVIDIA publikuje przepis na fine-tuning rozpoznawania mowy dla konkretnych dialektów z Nemotron
| Parametr | Było | Jest |
|---|---|---|
| WER (test nadżdyjski+hidżaski) | 55,05% | 29,96% |
| CER (test nadżdyjski+hidżaski) | 31,63% | 12,18% |
| Pełny SADA WER | 58,84% | 35,61% |
| WER FLEURS angielski | 11,04% | 10,42% |
| WER FLEURS arabski | 12,67% | 11,41% |
| Trenowalne parametry (odmrożone górne 8 warstw) | Nie określono | 230,4 mln z 638 mln łącznie |
| Pokrycie językowe | 40 lokalizacji językowych (model bazowy) | To samo, plus wyspecjalizowane dialekty nadżdyjski/hidżaski |