Crédits

Crédits open source

Les logiciels et modèles open source qui s'exécutent dans votre navigateur sur ce site, avec leur licence et l'endroit où obtenir leur code source.

whisper.cpp et ggml

whisper.cpp est le moteur de reconnaissance vocale qui transcrit votre fichier. Nous le compilons en WebAssembly, avec une petite interface que nous avons écrite, et il s'exécute dans votre navigateur. ggml, la bibliothèque d'apprentissage automatique qu'il contient, vient des mêmes auteurs, sous la même licence. Copyright (c) 2023-2026 The ggml authors.

Code source : github.com/ggml-org/whisper.cpp, version 1.9.4. Sous licence MIT.

Poids du modèle Whisper

Whisper est le modèle de reconnaissance vocale. OpenAI a publié son code et ses poids ; ce site en utilise deux tailles, base et small, dans les fichiers ggml quantifiés que publie le projet whisper.cpp. Copyright (c) 2022 OpenAI.

Code source : github.com/openai/whisper ; les fichiers ggml : huggingface.co/ggerganov/whisper.cpp. Sous licence MIT.

Silero VAD

Silero VAD est le détecteur de voix qui repère les passages parlés, pour que le moteur saute le silence. Copyright (c) 2020-present Silero Team.

Code source : github.com/snakers4/silero-vad, version 5.1.2, dans le fichier ggml de huggingface.co/ggml-org/whisper-vad. Sous licence MIT.

JSON for Modern C++

Cette bibliothèque de Niels Lohmann est compilée dans le moteur, où elle lit les réglages envoyés par la page et renvoie les résultats. Copyright (c) 2013-2022 Niels Lohmann.

Code source : github.com/nlohmann/json, version 3.11.2, telle que whisper.cpp l'inclut. Sous licence MIT.

Environnement d'exécution d'Emscripten

Emscripten est le compilateur qui transforme le moteur en WebAssembly. Une partie de son environnement d'exécution se trouve dans chaque version du moteur : le code JavaScript de liaison et les bibliothèques standard C et C++.

emdawnwebgpu et webgpu-headers

Ils se trouvent seulement dans la version WebGPU du moteur, que la page télécharge uniquement quand votre navigateur propose un adaptateur WebGPU utilisable. Ils relient le moteur au WebGPU de votre navigateur.

Mediabunny

Mediabunny lit le fichier que vous choisissez, morceau par morceau, dans votre navigateur, et décode son son avec les décodeurs de votre navigateur. Copyright (c) 2026-present, Vanilagy et contributeurs.

Code source : github.com/Vanilagy/mediabunny, version 1.59.1, utilisé sans modification. Sous licence Mozilla Public License 2.0 ; le code source de chaque fichier que nous utilisons se trouve dans ce dépôt, à cette version.