Modelo de IA · requer integração técnica para uso
BERTimbau
NeuralMind (pesquisa em parceria com a Unicamp)
Encoder BERT em português do Brasil para classificação de texto, reconhecimento de entidades, similaridade e busca semântica — não gera texto nem conversa. Leve, roda em CPU, e segue sendo o encoder pt-BR mais usado.
Busca semântica e embeddings · Leitura e extração de documentos
Quando faz sentido usar
- Classificação, triagem e roteamento de documentos e manifestações em português
- Extração de entidades (nomes, órgãos, locais) e busca semântica com ajuste fino
Para colocar em uso
- Exige fine-tuning para a tarefa alvo (não funciona por instrução)
- Roda em CPU; treino do ajuste fino em GPU modesta
Limitações e cuidados
- Não é modelo generativo: não redige, não resume, não conversa
- Publicado em 2020; contexto de 512 tokens e vocabulário anterior a termos recentes
Acessar fonte oficial ↗ (abre em nova aba, fora do BBSIA)
Infraestrutura e variantes
Execução em infraestrutura própria: possível — computador local.
- BERTimbau base (110M) · porte pequeno · computador local
- BERTimbau large (335M) · porte pequeno · computador local
Modalidades e idiomas
Entrada: texto · Saída: texto
Português: Declarado na fonte
Licença e nível de abertura
Nível de abertura: Open source
Licença do modelo/pesos: MIT — licença OSI, uso comercial e modificação livres
A classificação resume as informações verificadas nas fontes oficiais. Confira os termos da licença antes da adoção.
Fontes
Informações verificadas em setembro de 2026.