Todos os projetos
Arquitetura

Produto

Transcrição local de áudio com IA

Transcrição de vídeos e áudios longos em lote, com modelos abertos, processamento local e baixo custo.

Problema
Precisava transcrever, de forma recorrente, vídeos com mais de duas horas de duração. O uso de serviços pagos elevaria os custos e exigiria o upload de arquivos grandes, dificultando a rotina de processamento.
Minha contribuição
Desenvolvi uma solução que divide o conteúdo em pequenos trechos com áudio e utiliza o faster-whisper para gerar as transcrições. O processamento pode ser executado em CPU ou acelerado com GPU NVIDIA via CUDA, conforme os recursos disponíveis.
Resultados e aprendizados
Viabilizei a transcrição em lote de conteúdos longos com baixo custo, aproveitando os equipamentos disponíveis e mantendo o processamento local. O projeto demonstrou como modelos abertos podem atender a uma necessidade recorrente sem depender de serviços pagos de transcrição.

Vamos conversar?

Para conversar sobre dados, estratégia e tecnologia.

Até 5.000 caracteres.

Seu nome, e-mail e mensagem serão usados para responder ao contato. Política de privacidade