VozParaTexto
100% gratuito · Sem registo · 99 idiomas

Transcrição de áudio em Árabe — gratuita no browser

O VoxScriber Nano entende Árabe (العربية) e processa localmente no seu dispositivo. Limite de 10 min no modo gratuito.

Corre o VoxScriber Nano open-source no seu browser — IA local, até 10 min por ficheiro, precisão básica (~85%). Para uso profissional, conheça o Premium.

🔒 IA local💰 100% gratuito📝 10 min por ficheiro

A transcrição corre no seu browser (IA local). Pode optar por partilhar o resultado connosco (opcional, com consentimento) para melhorar o serviço. Limite: 10 min por ficheiro, precisão ~85%.

Ver Premium →

Gratuito vs Premium — veja a diferença

Gratuito (browser) Premium (nuvem)
Limite por ficheiro 10 min 10 horas
Precisão ~85% >95%
Diarização (quem falou)
Timestamps por palavra
Suporte a vídeo (MP4/MOV)
Formatos de exportação TXT, SRT, VTT DOCX, PDF, JSON…
Velocidade (1h de áudio) ~2 min / 1h ~2 min / 1h
Privacidade 100% local ☁️ + 🔒
🔒

IA local

Transcrição feita no seu browser. Partilha com os nossos servidores é opcional (requer consentimento).

Rápido e local

Processamento direto no browser, sem filas de espera.

🌍

99 idiomas

Deteta automaticamente o idioma do áudio.

💻

Sem registo

Comece imediatamente, sem criar conta.

Como funciona

1

Carregue ou grave o áudio

Arraste um ficheiro MP3, WAV, M4A, OGG ou use o microfone diretamente.

2

O modelo corre no seu dispositivo

O Whisper AI é descarregado uma vez e fica em cache. Sem espera na próxima vez.

3

Copie ou descarregue o texto

Resultado no ecrã em segundos. Descarregue em .txt ou copie com um clique.

Quão bem o Whisper lida com Árabe?

O Whisper transcreve o árabe padrão moderno de forma mais fiável, escrito da direita para a esquerda sem diacríticos (tashkeel) — correspondendo à forma como o árabe é normalmente escrito. O suporte a dialetos varia: o egípcio e o levatino têm um desempenho razoável, enquanto o magrebino (Darija) é o mais fraco. A alternância de código com francês ou inglês dentro de uma frase funciona, mas reduz a precisão.

De onde vem normalmente o áudio em Árabe

Notas de voz do WhatsApp — o meio de voz dominante no mundo árabe — além de recitação e sermões do Alcorão, palestras universitárias e clips de TV ou notícias.

Idiomas relacionados que também pode transcrever gratuitamente: Hebraico · Turco · Francês · Todos os 20 idiomas de transcrição gratuita

Quão precisa é a transcrição no browser?

A transcrição no browser executa o modelo Whisper da OpenAI diretamente no seu dispositivo usando WebAssembly. Oferecemos três tamanhos de modelo, e a precisão depende de qual escolher:

  • Nano (~40MB) — O predefinido. Cerca de 85% de precisão em discurso claro. Ideal para notas rápidas, mensagens de voz e rascunhos. O único modelo que funciona no iOS.
  • Mini (~150MB) — Aproximadamente 90% de precisão. Um bom meio-termo se o seu dispositivo tiver 4GB+ de RAM e precisar de uma saída mais limpa.
  • Plus (~500MB) — A opção local mais precisa, aproximando-se de 93% em áudio claro. Mais lento para descarregar e executar; ideal em computadores de mesa com 8GB+ de RAM.

O que reduz a precisão de qualquer modelo local: ruído de fundo, várias pessoas a falar ao mesmo tempo, sotaques carregados e gravações de baixa taxa de bits, como notas de voz comprimidas. Se precisar de precisão profissional acima de 95%, timestamps ao nível da palavra ou etiquetas de orador, isso requer modelos na cloud — veja a comparação acima.

Transcrição no browser vs cloud: qual precisa?

A transcrição no browser é a ferramenta certa quando a privacidade é o mais importante ou o áudio é curto: nada é carregado, não há nada para apagar depois e não custa nada. A contrapartida é a velocidade e precisão — o seu CPU processa aproximadamente uma hora de áudio em vinte minutos, e o modelo local ignora etiquetas de orador e temporização ao nível da palavra.

A transcrição na cloud é a ferramenta certa quando está a trabalhar: reuniões, entrevistas, palestras, gravações legais. GPUs dedicadas transformam uma hora de áudio em texto em cerca de dois minutos com mais de 95% de precisão, etiquetam até 30 oradores diferentes, aceitam ficheiros até 10 horas e exportam para DOCX, PDF e JSON além dos formatos de legenda.

Uma regra prática: se se sentir confortável em ler a gravação em voz alta num café, a velocidade e precisão da cloud vencem. Se o áudio for sensível — uma consulta médica, uma reunião confidencial, uma nota de voz privada — a ferramenta do browser mantém tudo na sua máquina e ainda lhe dá uma transcrição utilizável em minutos. Muitos dos nossos utilizadores combinam ambas: notas privadas rápidas no browser, trabalho profissional na cloud.

Ver planos Premium →

Formatos de áudio suportados

Carregue MP3, WAV, M4A, OGG, OPUS, FLAC ou WEBM — qualquer coisa que o seu browser consiga descodificar. Fontes comuns funcionam de imediato: notas de voz do WhatsApp (OPUS), memorandos de voz do iPhone (M4A), ficheiros do gravador Android, gravações do Zoom (M4A/MP4), mensagens de voz do Telegram (OGG) e ficheiros de podcast (MP3). Contentores de vídeo como MP4 e MOV são descodificados para a sua faixa de áudio quando o browser suporta o codec. Se um ficheiro não carregar, a causa habitual é um codec incomum dentro de um contentor comum — convertê-lo para MP3 primeiro resolve em quase todos os casos.

Precisa de um formato diferente primeiro? Use os nossos conversores gratuitos: conversor de áudio gratuito MP3 / WAV / OGG / AAC

🚀 Premium

Precisa de mais? Conheça o Premium

Para uso profissional — diarização, áudios longos, análise por IA e exportação em todos os formatos.

🎭

Diarização de locutores

Identifica automaticamente quem está a falar em cada trecho. Ideal para reuniões, entrevistas e podcasts.

⏱️

Áudios até 10 horas

O modelo local suporta até 10 min. Com o Premium, transcreva ficheiros até 10 horas.

🧠

Resumo, sentimento e tópicos

A IA analisa o conteúdo e gera resumo executivo, análise de sentimento e extração de tópicos.

📄

Exportação completa

Exporte em SRT, VTT, DOCX, JSON e PDF — ideal para legendas, documentos e automatizações.

Ver planos Premium →

Perguntas frequentes

O áudio é enviado para algum servidor?

A transcrição corre 100% no seu browser (IA local). Após concluir, pode optar por partilhar o áudio e o texto transcrito connosco (checkbox de consentimento) para nos ajudar a melhorar o serviço — mas é totalmente opcional.

Que formatos de áudio são aceites?

MP3, WAV, M4A, OGG, FLAC, WEBM, MP4, MOV e qualquer formato que o seu browser consiga descodificar.

Quanto tempo de áudio posso transcrever?

Até 10 minutos por ficheiro no modo gratuito. Para áudios maiores, o plano Premium suporta até 10 horas.

Em que idiomas funciona?

O modelo Whisper suporta 99 idiomas, incluindo português, inglês, espanhol, francês, alemão, japonês, árabe e muito mais.

Preciso de instalar alguma coisa?

Não. Funciona diretamente no browser. O modelo de IA (~40MB) é descarregado uma vez e fica em cache.

A transcrição é guardada em algum lado?

Por defeito, não — o resultado fica apenas no seu browser. Se marcar a opção de consentimento, o áudio e o texto são enviados para os nossos servidores (eliminados em 7 dias). Pode recusar o consentimento a qualquer momento.

Qual é a diferença para o plano Premium?

O modo gratuito usa o modelo VoxScriber Nano quantizado em 4 bits (q4), que corre localmente com limite de 10 min, precisão ~85%, sem diarização de locutores e timestamps por segmentos de ~30s — não por palavra. O Premium usa modelos em nuvem (AssemblyAI + Whisper Large float32): precisão >95%, diarização de até 30 locutores, timestamps por palavra, ficheiros até 10h, suporte a vídeos MP4/MOV/MKV e exportação em DOCX, PDF e JSON. Velocidade: 1h de áudio demora ~20min no seu CPU local vs ~2min no GPU dedicado do Premium.

Funciona no telemóvel?

Sim, mas o desempenho depende do dispositivo. Em smartphones com pouca RAM, a transcrição pode ser mais lenta.

É realmente gratuito?

Sim. O transcritor no browser é genuinamente gratuito, sem período de teste, sem marca de água e sem registo. Ganhamos dinheiro com os planos Premium na cloud, não com a ferramenta gratuita.

O meu áudio sai do meu dispositivo?

Não — a transcrição é executada localmente via WebAssembly. A única exceção é se marcar explicitamente a caixa de consentimento opcional para partilhar uma gravação connosco.

Há um limite de tamanho de ficheiro?

O limite prático é a duração (10 minutos por ficheiro) e a memória do seu dispositivo, não os megabytes. Um MP3 de 10 minutos tem tipicamente 10-20MB e funciona bem na maioria dos dispositivos.

Quanto tempo demora a transcrição?

Com o modelo Nano, espere aproximadamente 1-2x a duração do áudio num portátil moderno — um ficheiro de 5 minutos demora cerca de 5-10 minutos. A primeira execução adiciona um download único do modelo de ~40MB.

Posso exportar legendas (SRT)?

Sim — as exportações gratuitas incluem .txt, .srt e .vtt com timestamps de segmento. Para precisão de timestamp ao nível da palavra e exportações DOCX/PDF/JSON, veja o Premium.

Posso transcrever vários ficheiros de uma vez?

Sim — pode colocar em fila até 5 ficheiros e são processados um após o outro no seu browser. O Premium remove o limite da fila e processa ficheiros em paralelo na cloud.

Porque é que a primeira transcrição demora mais?

Na sua primeira visita, o modelo de IA é descarregado e compilado pelo seu browser. Depois é armazenado em cache, por isso todas as transcrições seguintes começam imediatamente.

Funciona offline?

Parcialmente — uma vez que o modelo está em cache, a transcrição em si não precisa de ligação. Ainda precisa de estar online para carregar a página.

Transcreve dialetos ou apenas árabe padrão moderno?

Ambos, mas o MSA é mais preciso; o egípcio e o levatino funcionam razoavelmente, o magrebino menos.

Adiciona tashkeel (diacríticos)?

Não — a saída é árabe padrão sem diacríticos, como é normalmente escrito.

A visualização da direita para a esquerda é suportada?

Sim — a transcrição é renderizada da direita para a esquerda e as exportações preservam isso.

Transcrição gratuita em 20 idiomas

O Whisper suporta 99 idiomas com deteção automática, e mantemos uma página dedicada para cada um dos 20 idiomas mais solicitados, com notas sobre como o modelo lida com esse idioma específico. Escolha o seu abaixo — o transcritor pré-seleciona o idioma certo para melhor precisão.