Créditos

Créditos de código aberto

O software e os modelos de código aberto que rodam no seu navegador neste site, com as licenças e onde obter o código-fonte.

whisper.cpp e ggml

O whisper.cpp é o motor de reconhecimento de fala que transcreve o seu arquivo. Nós o compilamos para WebAssembly, com uma pequena interface nossa, e ele roda no seu navegador. O ggml, a biblioteca de aprendizado de máquina que vem dentro dele, é dos mesmos autores e tem a mesma licença. Copyright (c) 2023-2026 The ggml authors.

Código-fonte: github.com/ggml-org/whisper.cpp, versão 1.9.4. Licenciado sob a licença MIT.

Pesos do modelo Whisper

O Whisper é o modelo de reconhecimento de fala. A OpenAI publicou o código e os pesos dele; este site usa dois dos seus tamanhos, base e small, nos arquivos ggml quantizados que o projeto whisper.cpp publica. Copyright (c) 2022 OpenAI.

Código-fonte: github.com/openai/whisper; os arquivos ggml: huggingface.co/ggerganov/whisper.cpp. Licenciado sob a licença MIT.

Silero VAD

O Silero VAD é o detector de voz que marca os trechos com fala, para o motor pular o silêncio. Copyright (c) 2020-present Silero Team.

Código-fonte: github.com/snakers4/silero-vad, versão 5.1.2, no arquivo ggml de huggingface.co/ggml-org/whisper-vad. Licenciado sob a licença MIT.

JSON for Modern C++

Esta biblioteca de Niels Lohmann vai compilada dentro do motor, onde lê as configurações que a página envia e devolve os resultados. Copyright (c) 2013-2022 Niels Lohmann.

Código-fonte: github.com/nlohmann/json, versão 3.11.2, como o whisper.cpp a inclui. Licenciado sob a licença MIT.

Ambiente de execução do Emscripten

O Emscripten é o compilador que transforma o motor em WebAssembly. Partes do seu ambiente de execução vão dentro de cada versão do motor: o código JavaScript de ligação e as bibliotecas padrão de C e C++.

emdawnwebgpu e webgpu-headers

Eles vão só na versão WebGPU do motor, que a página baixa apenas quando o seu navegador oferece um adaptador WebGPU utilizável. Eles ligam o motor ao WebGPU do seu navegador.

Mediabunny

O Mediabunny lê o arquivo que você escolhe, em partes, dentro do seu navegador, e decodifica o som com os decodificadores do próprio navegador. Copyright (c) 2026-present, Vanilagy e colaboradores.

Código-fonte: github.com/Vanilagy/mediabunny, versão 1.59.1, usado sem alterações. Licenciado sob a Mozilla Public License 2.0; o código-fonte de cada arquivo que usamos está nesse repositório, nessa versão.