Warum man den Ton aus Videos extrahiert
Jeder Container, ein Werkzeug
Video kommt in dem Container an, den das aufnehmende Gerät gerade schreibt. Eine Mac-Bildschirmaufnahme ist eine .mov, ein Twitch-VOD eine .mkv oder .ts, eine Browseraufnahme eine .webm, ein Handyclip eine .mp4 oder .m4v, und ein Kameraexport kann alles davon sein. Diese Seite liest sie alle, Sie müssen also nicht erst herausfinden, was für eine Datei Sie haben, bevor Sie an den Ton kommen. Legen Sie sie ab, und die Tonspur wird lokal dekodiert und in das von Ihnen gewählte Format geschrieben.
Auch Apple-ProRes-Dateien im .mov-Container aus Final Cut, Premiere oder DaVinci Resolve werden verarbeitet, was deshalb zählt, weil die meisten browserbasierten Werkzeuge ProRes überhaupt nicht dekodieren können. Der zugehörige Decoder wird nur geladen, wenn eine Datei ihn tatsächlich braucht, für eine gewöhnliche MP4- oder WebM-Datei wird also nichts zusätzlich heruntergeladen.
Wofür es genutzt wird
Podcasterinnen und Podcaster machen aus aufgezeichneten Interviews, Livestreams und Videoanrufen MP3-Folgen, fertig für Spotify, Apple Podcasts oder einen privaten RSS-Feed. Musikerinnen, Musiker und DJs holen den Ton von Konzertmitschnitten und Live-Sessions, um ihn unterwegs zu hören oder in einer DAW zu sampeln. Kreative lösen saubere Voiceover-Aufnahmen aus Bildschirmaufzeichnungen und verwenden sie in einem anderen Schnitt weiter, ohne neu aufzunehmen. Studierende und Forschende trennen den Ton von Vorlesungen, Webinaren und Konferenzbeiträgen, um ihn unterwegs zu hören oder durch ein Transkriptionswerkzeug laufen zu lassen. Sprachlernende machen dasselbe mit Filmen und Interviews und legen den Ton zum wiederholten Hören auf Telefon oder Lautsprecher.
Es gibt auch einen praktischen Grund: Ton ist dramatisch kleiner als Video. Ein zweistündiger Vortrag, der als Videodatei 1,5 GB belegt, landet als MP3 unter 100 MB - das ist der Unterschied zwischen einer Datei, die Sie per E-Mail verschicken können, und einer, die Sie nicht verschicken können.
Kein Upload, keine Größengrenze, keine Software
Die meisten Online-Werkzeuge zur Tonextraktion funktionieren so: Sie laden Ihr Video auf einen Server, dort wird es umgewandelt, und Sie erhalten einen Download. Das bedeutet, dass eine Kopie Ihrer Aufnahme auf Hardware liegt, die Sie nicht kontrollieren, und es bedeutet eine Warteschlange, eine Upload-Wartezeit und eine Dateigrößenbeschränkung. VidShift macht nichts davon: Die Umwandlung läuft mit WebAssembly und WebCodecs in Ihrem Browser, das Video verlässt Ihr Gerät also nie. Es wird nichts installiert und kein Konto angelegt. Die Seite wird beim ersten Besuch zwischengespeichert, und jeder Audio-Codec wird beim ersten Einsatz zwischengespeichert, sodass derselbe Vorgang danach auch offline funktioniert. Das macht das Werkzeug sicher für vertrauliche Interviews, interne Besprechungsaufzeichnungen, unveröffentlichte Musik und alles andere, was Sie einem Fremden nicht übergeben würden - und schneller bei großen Dateien, weil kein Upload abzuwarten ist.