Transcrição nível Whisper, online, sem código, sem instalação
Gosta da precisão do Whisper da OpenAI, mas não da configuração? Carregue áudio ou vídeo diretamente no navegador e receba uma transcrição precisa, com identificação de oradores, em minutos, além de legendas, tradução e uma API que o modelo open-source não oferece.
Experimente agora, sem registo
Grave em direto ou largue um ficheiro (até {maxMb} MB) e veja a transcrição a acontecer.
O Whisper da OpenAI é um modelo de fala open-source poderoso, mas executá-lo por conta própria exige Python, linha de comandos, GPUs e não traz identificação de oradores nem interface. O RealtimeVoiceKIT entrega o mesmo nível de precisão de ponta como um produto pronto: largue um ficheiro e receba texto limpo e com marcação de tempo, identificação automática de oradores, índices de confiança e exportação num clique, nada para instalar.
Quem usa o Whisper online
Quem já experimentou o Whisper puro
Esqueça o ambiente Python, as transferências de modelo e as contas de GPU, obtenha transcrições do mesmo calibre no seu navegador.
Criadores e podcasters
Transforme episódios e vídeos em transcrições precisas, notas do programa e legendas sem tocar num terminal.
Investigadores e estudantes
Transcreva entrevistas e aulas em notas pesquisáveis e citáveis, com identificação de oradores que o Whisper sozinho não oferece.
Programadores
Quer resultados nível Whisper sem alojar um modelo? Use uma REST API limpa com chaves rtvk_.
O que ganha e o Whisper puro não dá
Como funciona
Carregue
Arraste áudio ou vídeo, MP3, WAV, M4A, MP4 e mais, ou cole uma URL. Sem configuração, sem linha de comandos.
Transcreva
A nossa IA processa o ficheiro, separa os oradores e produz uma transcrição limpa, com marcação de tempo e índices de confiança.
Exporte
Transfira em texto, SRT ou VTT, traduza para outro idioma ou obtenha os resultados pela API.
Perguntas frequentes
Isto é a mesma coisa que o OpenAI Whisper?
O RealtimeVoiceKIT é um produto de transcrição gerido que entrega o mesmo tipo de precisão de ponta que esperaria de um dos melhores modelos open-source, sem a configuração. Recebe uma aplicação pronta, com identificação de oradores, legendas e tradução, em vez de um modelo bruto para alojar por conta própria.
Preciso de instalar algo ou escrever código?
Não. Tudo corre no seu navegador. Carregue um ficheiro ou cole uma URL e receba a transcrição de volta, sem Python, sem GPU, sem linha de comandos. Os programadores podem, opcionalmente, usar a REST API.
Consegue identificar diferentes oradores?
Sim. A diarização automática de oradores deteta quem disse o quê e identifica cada orador, algo que o modelo open-source do Whisper não faz sozinho.
Existe uma opção gratuita?
Sim. 10 minutos de transcrição todos os meses, grátis, com identificação de oradores e exportação de legendas, e sem precisar de cartão de crédito.