<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9" xmlns:image="http://www.google.com/schemas/sitemap-image/1.1"><url><loc>https://transcribe-audio.online/de/how-it-works/</loc><image:image><image:loc>https://transcribe-audio.online/assets/blog/how-it-works.de.webp</image:loc><image:title>Diagramm, wohin deine Aufnahme geht: Dein Browser liest die Datei; lässt sie sich in Stücken lesen, dekodiert ein Medienleser in einem Worker ihren Ton in Stücken von 30 Sekunden (sonst dekodiert die Seite die ganze Datei); die Whisper-Engine als WebAssembly transkribiert ihn in Fenstern von etwa 3 Minuten, und dein Tab zeigt die Absätze zum Kopieren oder Speichern als TXT. Die Aufnahme geht nie an den Server der Website. Der Server sendet die Seite und mit deiner ersten Datei die Engine, den Medienleser, das Modell (das kleinere, voreingestellte etwa 60 MB, in Teilen) und eine kleine Sprachaktivitätserkennung; der Browser behält Modell und Sprachaktivitätserkennung, wenn er Platz hat.</image:title></image:image><image:image><image:loc>https://transcribe-audio.online/assets/blog/transcript-pipeline.de.webp</image:loc><image:title>Vier Schritte von einer langen Datei zu Absätzen: Die Tonspur wird in Stücken von 30 Sekunden als Mono mit 16 kHz gelesen; die Stücke werden zu Fenstern von etwa 3 Minuten, jedes an der leisesten halben Sekunde geschnitten; die Sprachaktivitätserkennung überspringt Stille, und Whisper schreibt die Wörter jedes Fensters mit ihren Zeiten; eine Pause von 2 Sekunden oder mehr zwischen zwei Wörtern beginnt einen neuen Absatz, der seine Zeit als [hh:mm:ss] tragen kann.</image:title></image:image></url><url><loc>https://transcribe-audio.online/de/</loc><image:image><image:loc>https://transcribe-audio.online/assets/screenshots/tool-transcript.de.webp</image:loc><image:title>Das Transkript auf der Seite: drei Absätze, jeder mit Zeitstempel, das Wort place in jedem markiert, place im Suchfeld eingegeben und der Zähler daneben bei Treffer 1 von 3, darunter die Schaltflächen Text kopieren, TXT herunterladen und Neu beginnen.</image:title></image:image></url><url><loc>https://transcribe-audio.online/es/how-it-works/</loc><image:image><image:loc>https://transcribe-audio.online/assets/blog/how-it-works.es.webp</image:loc><image:title>Diagrama de adónde va tu grabación: tu navegador lee el archivo; si el archivo se puede leer por partes, un lector multimedia en un worker descodifica su sonido en fragmentos de 30 segundos (si no, la página descodifica el archivo entero); el motor Whisper en WebAssembly lo transcribe por ventanas de unos 3 minutos, y tu pestaña muestra los párrafos para que los copies o los guardes en TXT. La grabación nunca se envía al servidor del sitio. El servidor envía la página y, con tu primer archivo, el motor, el lector multimedia, el modelo (unos 60 MB el pequeño, el predeterminado, en partes) y un pequeño detector de voz; el navegador guarda el modelo y el detector si tiene espacio.</image:title></image:image><image:image><image:loc>https://transcribe-audio.online/assets/blog/transcript-pipeline.es.webp</image:loc><image:title>Cuatro pasos de un archivo largo a párrafos: la pista de sonido se lee en fragmentos de 30 segundos como mono a 16 kHz; los fragmentos se unen en ventanas de unos 3 minutos, cada una cortada en el medio segundo más silencioso; el detector de voz se salta el silencio y Whisper escribe las palabras de cada ventana con sus tiempos; una pausa de 2 segundos o más entre dos palabras empieza un párrafo nuevo, que puede llevar su marca de tiempo como [hh:mm:ss].</image:title></image:image></url><url><loc>https://transcribe-audio.online/es/</loc><image:image><image:loc>https://transcribe-audio.online/assets/screenshots/tool-transcript.es.webp</image:loc><image:title>La transcripción en la página: tres párrafos, cada uno con su marca de tiempo, la palabra place resaltada en cada uno, place escrito en el buscador y el contador de al lado en Coincidencia 1 de 3, con los botones Copiar el texto, Descargar TXT y Empezar de nuevo debajo.</image:title></image:image></url><url><loc>https://transcribe-audio.online/fr/how-it-works/</loc><image:image><image:loc>https://transcribe-audio.online/assets/blog/how-it-works.fr.webp</image:loc><image:title>Schéma du trajet de votre enregistrement : votre navigateur lit le fichier ; si le fichier peut être lu par tranches, un lecteur multimédia dans un worker en décode le son par tranches de 30 secondes (sinon, la page décode le fichier entier) ; le moteur Whisper en WebAssembly le transcrit par fenêtres d&apos;environ 3 minutes, et votre onglet affiche les paragraphes, à copier ou à enregistrer en TXT. L&apos;enregistrement n&apos;est jamais envoyé au serveur du site. Le serveur envoie la page puis, avec votre premier fichier, le moteur, le lecteur multimédia, le modèle (environ 60 Mo pour le petit, celui par défaut, en parties) et un petit détecteur de voix ; le navigateur garde le modèle et le détecteur s&apos;il a de la place.</image:title></image:image><image:image><image:loc>https://transcribe-audio.online/assets/blog/transcript-pipeline.fr.webp</image:loc><image:title>Quatre étapes d&apos;un long fichier aux paragraphes : la piste son est lue par tranches de 30 secondes en mono à 16 kHz ; les tranches forment des fenêtres d&apos;environ 3 minutes, chacune coupée sur la demi-seconde la plus silencieuse ; le détecteur de voix saute le silence et Whisper écrit les mots de chaque fenêtre avec leurs temps ; une pause de 2 secondes ou plus entre deux mots ouvre un nouveau paragraphe, qui peut porter son horodatage en [hh:mm:ss].</image:title></image:image></url><url><loc>https://transcribe-audio.online/fr/</loc><image:image><image:loc>https://transcribe-audio.online/assets/screenshots/tool-transcript.fr.webp</image:loc><image:title>La transcription dans la page : trois paragraphes précédés de leur horodatage, le mot place surligné dans chacun, place tapé dans le champ de recherche et le compteur à côté indiquant Résultat 1 sur 3, avec les boutons Copier le texte, Télécharger le TXT et Recommencer en dessous.</image:title></image:image></url><url><loc>https://transcribe-audio.online/how-it-works/</loc><image:image><image:loc>https://transcribe-audio.online/assets/blog/how-it-works.en.webp</image:loc><image:title>Diagram of where your recording goes: your browser reads the file; where the file can be read in slices, a media reader in a worker decodes its sound 30 seconds at a time (otherwise the page decodes the whole file); the Whisper engine in WebAssembly transcribes it one window of about 3 minutes at a time; and your tab shows the paragraphs for you to copy or save as TXT. The recording is never sent to the site&apos;s server. The server sends the page, then with your first file the engine, the media reader, the model (about 60 MB for the smaller, default one, in parts), and a small voice detector; the browser keeps the model and the detector when it has room.</image:title></image:image><image:image><image:loc>https://transcribe-audio.online/assets/blog/transcript-pipeline.en.webp</image:loc><image:title>Four steps from a long file to paragraphs: the sound track is read 30 seconds at a time as 16 kHz mono; the slices are joined into windows of about 3 minutes, each cut at the quietest half second; the voice detector skips silence and Whisper writes each window&apos;s words with their times; a pause of 2 seconds or more between two words starts a new paragraph, which can carry its time as [hh:mm:ss].</image:title></image:image></url><url><loc>https://transcribe-audio.online/</loc><image:image><image:loc>https://transcribe-audio.online/assets/screenshots/tool-transcript.en.webp</image:loc><image:title>The transcript on the page: three paragraphs, each starting with a timestamp, the word place highlighted in each, place typed in the search box and the counter beside it reading Match 1 of 3, with the Copy text, Download TXT, and Start over buttons below.</image:title></image:image></url><url><loc>https://transcribe-audio.online/pt/how-it-works/</loc><image:image><image:loc>https://transcribe-audio.online/assets/blog/how-it-works.pt.webp</image:loc><image:title>Diagrama do caminho da sua gravação: o navegador lê o arquivo; quando o arquivo pode ser lido em partes, um leitor de mídia em um worker decodifica o som em pedaços de 30 segundos (senão, a página decodifica o arquivo inteiro); o motor Whisper em WebAssembly transcreve em janelas de uns 3 minutos, e a sua aba mostra os parágrafos para você copiar ou salvar em TXT. A gravação nunca é enviada ao servidor do site. O servidor envia a página e, com o seu primeiro arquivo, o motor, o leitor de mídia, o modelo (uns 60 MB o menor, o padrão, em partes) e um pequeno detector de voz; o navegador guarda o modelo e o detector quando tem espaço.</image:title></image:image><image:image><image:loc>https://transcribe-audio.online/assets/blog/transcript-pipeline.pt.webp</image:loc><image:title>Quatro passos de um arquivo longo até os parágrafos: a faixa de som é lida em pedaços de 30 segundos como mono a 16 kHz; os pedaços formam janelas de uns 3 minutos, cada uma cortada no meio segundo mais silencioso; o detector de voz pula o silêncio e o Whisper escreve as palavras de cada janela com seus tempos; uma pausa de 2 segundos ou mais entre duas palavras começa um parágrafo novo, que pode trazer a marcação de tempo como [hh:mm:ss].</image:title></image:image></url><url><loc>https://transcribe-audio.online/pt/</loc><image:image><image:loc>https://transcribe-audio.online/assets/screenshots/tool-transcript.pt.webp</image:loc><image:title>A transcrição na página: três parágrafos, cada um com sua marcação de tempo, a palavra place destacada em cada um, place digitado na caixa de busca e o contador ao lado mostrando Resultado 1 de 3, com os botões Copiar o texto, Baixar TXT e Começar de novo embaixo.</image:title></image:image></url></urlset>
