Produto
Transcrição local de áudio com IA
Transcrição de vídeos e áudios longos em lote, com modelos abertos, processamento local e baixo custo.
- Problema
- Precisava transcrever, de forma recorrente, vídeos com mais de duas horas de duração. O uso de serviços pagos elevaria os custos e exigiria o upload de arquivos grandes, dificultando a rotina de processamento.
- Minha contribuição
- Desenvolvi uma solução que divide o conteúdo em pequenos trechos com áudio e utiliza o faster-whisper para gerar as transcrições. O processamento pode ser executado em CPU ou acelerado com GPU NVIDIA via CUDA, conforme os recursos disponíveis.
- Resultados e aprendizados
- Viabilizei a transcrição em lote de conteúdos longos com baixo custo, aproveitando os equipamentos disponíveis e mantendo o processamento local. O projeto demonstrou como modelos abertos podem atender a uma necessidade recorrente sem depender de serviços pagos de transcrição.