Kostenloser Audioeditor lässt KI-Agenten Tonspuren schneiden und neu anordnen

Audionaut, ein kostenloser Open-Source-Audioeditor für mehrere Tonspuren unter Windows, macOS und Linux, setzt bei der KI-gestützten Bearbeitung auf eine ungewöhnliche Vorgabe: Änderungen eines Agenten an einem bereits in der Anwendung geöffneten Projekt lassen sich über die reguläre Rückgängig-Funktion des Editors zurücknehmen.
Laut dem Show-HN-Beitrag des Entwicklers vom 2. Oktober ist die Unterstützung für Agenten die neueste Funktion des Projekts. Audionaut wird bereits seit mehreren Jahren entwickelt, die Anwendung selbst ist also nicht neu.
Die Steuerung durch Agenten erfolgt über das Model Context Protocol (MCP). Laut der Dokumentation von Audionaut stellt der MCP-Server die Befehlszeilenfunktionen des Editors als Werkzeuge bereit, die kompatible Agenten aufrufen können. Dazu gehören der Import und Export von Audio, die Analyse, das Teilen und Verschieben von Clips, die Anpassung von Verstärkung und Ein- und Ausblendungen sowie das Ändern der Abspielgeschwindigkeit. Auch Arrangements lassen sich zusammenstellen und Audiodaten in Einzelspuren aufteilen.
Ungewöhnlich ist vor allem der Umgang mit Projekten, die bereits in der Anwendung geöffnet sind. Laut Audionaut arbeitet ein Agentenbefehl mit dem aktuellen Projektstand im Editor, einschließlich noch nicht gespeicherter Änderungen. Die daraus entstehende Bearbeitung wird anschließend in den regulären Verlauf der Rückgängig-Funktion aufgenommen. Die Projektdatei wird dabei nicht automatisch gespeichert. Der Nutzer entscheidet selbst, wann er sie speichern möchte.
Manuelle Änderungen haben ebenfalls Vorrang. Nimmt der Nutzer vor Abschluss eines Agentenbefehls eine weitere Änderung vor, wird laut Dokumentation das Ergebnis des Agenten verworfen und eine erneute Ausführung angefordert. So wird die neuere manuelle Bearbeitung nicht überschrieben. Während einer Aufnahme werden Befehle abgelehnt, bei laufender Wiedergabe sind keine Exporte möglich.
Auf Hacker News hat das Projekt bereits Rückmeldungen erhalten. Ein Nutzer, der Audionaut nach eigenen Angaben einige Minuten ausprobiert hat, hat unter anderem einen einfacheren Dateiimport, automatische Überblendungen, Hüllkurven und Effekte vorgeschlagen. Laut dem Entwickler sind mehrere dieser Vorschläge in die Aufgabenliste des Projekts aufgenommen worden. Diese Kommentare sind Einzelberichte und erlauben keine Rückschlüsse auf die allgemeine Leistungsfähigkeit oder Verbreitung von Audionaut.
Agenten können auch Audionauts Funktion zur Trennung von Audio in Einzelspuren aufrufen. Laut der zugehörigen Dokumentation nutzt sie das htdemucs-Modell von Meta AI Research über demucs.cpp, um einen ausgewählten Mono- oder Stereo-Clip in vier Spuren aufzuteilen: Schlagzeug, Bass, Sonstiges und Gesang.
Für das Modell ist laut Dokumentation ein einmaliger Download von rund 80 MB erforderlich. Anschließend erfolgt die Verarbeitung lokal auf dem Computer des Nutzers. Audionaut behandelt die gesamte Trennung als eine einzige Bearbeitung. Ein einmaliges Rückgängigmachen entfernt daher alle vier neu erstellten Spuren. Die aktuelle Implementierung verarbeitet Clips mit einer Länge von bis zu zehn Minuten und führt die Trennung auf der CPU aus.
Daraus lässt sich nicht ableiten, dass Audionauts Agentenbearbeitungen oder die Trennung in Einzelspuren bessere Ergebnisse liefern als andere Audiowerkzeuge. Der Entwickler weist zudem darauf hin, dass automatisch erzeugte Ergebnisse weiterhin manuell nachbearbeitet werden müssen. Die Besonderheit liegt darin, wie Agentenaktionen in die bestehende Projektverwaltung und Rückgängig-Funktion des Editors eingebunden werden, statt als unumkehrbare externe Änderungen behandelt zu werden.
Audionaut ist als kostenlose Open-Source-Software verfügbar. Die offizielle Website bietet Versionen für Windows, macOS und Linux. Der Quellcode ist im GitHub-Repository des Projekts zugänglich.










