Gratis ljudredigerare med öppen källkod låter AI-agenter klippa och arrangera om spår, samtidigt som ändringarna går att ångra

Audionaut, en kostnadsfri ljudredigerare med flera ljudspår och öppen källkod för Windows, macOS och Linux, inför en ovanlig begränsning för AI-assisterad redigering: när en agent ändrar ett projekt som redan är öppet i programmet kan ändringen ångras med hjälp av redigerarens vanliga ångrafunktion.
Agentfunktionen är projektets senaste funktion, enligt utvecklarens Show HN-inlägg den 2 oktober. Audionaut har varit under utveckling i flera år, så programmet är inget helt nytt projekt.
Agentstyrning tillhandahålls via Model Context Protocol (MCP). Enligt Audionauts dokumentation exponerar MCP-servern redigerarens kommandoradsfunktioner som verktyg som kompatibla agenter kan anropa. Bland dessa finns att importera och exportera ljud, analysera klipp, dela upp och flytta klipp, ändra förstärkning och toningar, justera klipphastighet, sätta samman arrangemang och separera stems.
Topp 10...
» Topp 10: Bästa bärbara allround/multimediadatorerna
» Topp 10: Bästa bärbara speldatorerna
» Topp 10: Bärbara budget/kontorsdatorer
» Topp 10: Bästa bärbara kontors/premiumdatorerna
» Topp 10: Bärbara arbetsstationer
» Topp 10: De bästa små/kompakta bärbara datorerna
» Topp 10: Bästa ultrabooks
» Topp 10: Bästa hybriddatorerna
» Topp 10: Bästa surfplattorna
» Topp 10: Marknadens bästa smartphones
Den mer ovanliga delen är vad som händer när en agent arbetar med ett projekt som redan är öppet. Audionaut säger att ett agentkommando utgår från projektets aktuella tillstånd i appen, inklusive osparade ändringar, och att den resulterande redigeringen sedan läggs till i den vanliga ångrahistoriken. Projektfilen sparas inte automatiskt i det här arbetsflödet, så användaren får själv avgöra när den ska sparas.
Användarens redigeringar prioriteras också. Om användaren gör en ny ändring innan ett agentkommando har slutförts, säger dokumentationen att agentens resultat kastas och att ett nytt försök begärs i stället för att skriva över den nyare användarredigeringen. Kommandon avvisas under inspelning, och export avvisas under uppspelning.
Projektet har också fått respons på Hacker News. En användare som sa sig ha provat Audionaut i några minuter föreslog bland annat enklare import av filer, automatiska övertoningar, envelopper och effekter. Utvecklaren sa att flera av förslagen hade lagts till i projektets backlog. Kommentarerna är anekdotiska och utgör inte belägg för Audionauts övergripande prestanda eller spridning.
Agenter kan också använda Audionauts funktion för stem-separering. Projektets dokumentation om stem-separering säger att den använder Meta AI Researchs htdemucs-modell via demucs.cpp för att omvandla ett valt mono- eller stereoklipp till fyra spår: trummor, bas, övrigt och sång.
Enligt dokumentationen kräver separeringsmodellen en engångsnedladdning på cirka 80 MB, varefter bearbetningen utförs lokalt på användarens dator. Audionaut säger att hela separeringen behandlas som en enda redigering, vilket innebär att en ångraåtgärd tar bort alla fyra nyskapade spår. Den nuvarande implementationen bearbetar klipp på upp till tio minuter och utför separeringen på processorn.
Detta visar inte att Audionauts agentgenererade redigeringar eller stem-separering är bättre än motsvarande funktioner i andra ljudverktyg, och utvecklaren påpekar att automatiskt framställda resultat fortfarande kan kräva manuell redigering. Det som utmärker implementationen är hur agentåtgärder integreras i redigerarens befintliga projekt- och ångrasystem i stället för att behandlas som oåterkalleliga externa ändringar.
Audionaut finns som kostnadsfri programvara med öppen källkod. På den officiella webbplatsen finns versioner för Windows, macOS och Linux, medan källkoden finns i projektets GitHub-arkiv.












