Modelo de IA · requer integração técnica para uso
ptt5-v2
unicamp-dl — Universidade Estadual de Campinas (Unicamp)
Família T5 adaptada ao português (60M a 3B) para tarefas texto-a-texto por ajuste fino: sumarização, reescrita, classificação e ranqueamento de busca. Não conversa nem segue instruções sem fine-tuning.
Leitura e extração de documentos
Quando faz sentido usar
- Ajuste fino para sumarização, reescrita ou classificação texto-a-texto em português
- Ranqueamento de busca (rerankers) em acervos documentais em português
Para colocar em uso
- Exige fine-tuning para a tarefa alvo
- small/base/large rodam em GPU de consumo; 3B pede GPU maior ou quantização
Limitações e cuidados
- Não é modelo de chat nem de instrução: sem ajuste fino não produz resultado útil
- Pré-treino baseado em C4/mC4 (web): vieses do corpus se transferem à tarefa
Acessar fonte oficial ↗ (abre em nova aba, fora do BBSIA)
Infraestrutura e variantes
Execução em infraestrutura própria: possível — computador local, servidor com gpu.
- ptt5-v2-small (60M) / base (220M) / large (740M) · porte pequeno · computador local
- ptt5-v2-3B · porte médio · computador local, servidor com gpu
Variantes maiores normalmente exigem mais memória e infraestrutura.
Modalidades e idiomas
Entrada: texto · Saída: texto
Português: Declarado na fonte
Licença e nível de abertura
Nível de abertura: Open source
Licença do modelo/pesos: Apache-2.0 — licença OSI, uso comercial e modificação livres (o PTT5 original de 2020 é MIT)
A classificação resume as informações verificadas nas fontes oficiais. Confira os termos da licença antes da adoção.
Fontes
Informações verificadas em setembro de 2026.