Créditos

Créditos de código abierto

El software y los modelos de código abierto que se ejecutan en tu navegador en este sitio, con sus licencias y dónde conseguir su código fuente.

whisper.cpp y ggml

whisper.cpp es el motor de reconocimiento de voz que transcribe tu archivo. Lo compilamos a WebAssembly, con una pequeña interfaz propia, y se ejecuta en tu navegador. ggml, la biblioteca de aprendizaje automático que lleva dentro, es de los mismos autores y tiene la misma licencia. Copyright (c) 2023-2026 The ggml authors.

Código fuente: github.com/ggml-org/whisper.cpp, versión 1.9.4. Con licencia MIT.

Pesos del modelo Whisper

Whisper es el modelo de reconocimiento de voz. OpenAI publicó su código y sus pesos; este sitio usa dos de sus tamaños, base y small, en los archivos ggml cuantizados que publica el proyecto whisper.cpp. Copyright (c) 2022 OpenAI.

Código fuente: github.com/openai/whisper; los archivos ggml: huggingface.co/ggerganov/whisper.cpp. Con licencia MIT.

Silero VAD

Silero VAD es el detector de voz que marca los tramos con habla, para que el motor se salte el silencio. Copyright (c) 2020-present Silero Team.

Código fuente: github.com/snakers4/silero-vad, versión 5.1.2, en el archivo ggml de huggingface.co/ggml-org/whisper-vad. Con licencia MIT.

JSON for Modern C++

Esta biblioteca de Niels Lohmann va compilada dentro del motor, donde lee los ajustes que envía la página y devuelve los resultados. Copyright (c) 2013-2022 Niels Lohmann.

Código fuente: github.com/nlohmann/json, versión 3.11.2, tal como la incluye whisper.cpp. Con licencia MIT.

Entorno de ejecución de Emscripten

Emscripten es el compilador que convierte el motor en WebAssembly. Parte de su entorno de ejecución va dentro de cada versión del motor: el código JavaScript de enlace y las bibliotecas estándar de C y C++.

emdawnwebgpu y webgpu-headers

Solo van dentro de la versión WebGPU del motor, que la página descarga únicamente cuando tu navegador ofrece un adaptador WebGPU utilizable. Conectan el motor con la WebGPU de tu navegador.

Mediabunny

Mediabunny lee el archivo que eliges, por partes, dentro de tu navegador, y decodifica su sonido con los decodificadores del propio navegador. Copyright (c) 2026-present, Vanilagy y colaboradores.

Código fuente: github.com/Vanilagy/mediabunny, versión 1.59.1, usado sin cambios. Con licencia Mozilla Public License 2.0; el código fuente de cada archivo que usamos está en ese repositorio, en esa versión.