Ir para o conteúdo
BBSIABanco Brasileiro de Soluções de IA para a Gestão PúblicaSeja voluntário(a)

Modelo de IA · requer integração técnica para uso

Whisper

OpenAI (EUA)

Modelo de transcrição de fala (áudio para texto) em ~99 idiomas, com o português entre os de melhor desempenho medido. Seis tamanhos, do tiny (roda em CPU) ao large-v3; o turbo transcreve ~8x mais rápido. Provável componente aberto mais implantado em transcrição no setor público.

Transcrição de áudio

Quando faz sentido usar

Para colocar em uso

Limitações e cuidados

Acessar fonte oficial ↗ (abre em nova aba, fora do BBSIA)

Infraestrutura e variantes

Execução em infraestrutura própria: possível computador local, servidor com gpu.

Modalidades e idiomas

Entrada: áudio · Saída: texto
Português: Declarado na fonte

Licença e nível de abertura

Nível de abertura: Open source
Licença do modelo/pesos: MIT — licença OSI; o README oficial declara explicitamente que código E pesos estão sob MIT

A classificação resume as informações verificadas nas fontes oficiais. Confira os termos da licença antes da adoção.

Fontes

Informações verificadas em setembro de 2026.