AI가 조종 가능한 오픈소스 멀티트랙 오디오 에디터 Audionaut 공개
원제 Show HN: Audionaut – an open-source cross-platform multitrack audio editor
122 포인트댓글 43
Key Point
AI 에이전트가 직접 오디오 편집을 자동화할 수 있는 개방형 도구로, 음악 제작·팟캐스트 워크플로우의 자동화 가능성을 열어준다.
핵심 요약
- Audionaut는 Windows, macOS, Linux에서 네이티브로 동작하는 무료 오픈소스 데스크톱 애플리케이션으로, 음악·팟캐스트·멀티트랙 녹음 편집에 특화되어 있다.
- 정밀한 커팅, 트랙별 플레이리스트, 유연한 다중채널 지원, 클린한 익스포트를 제공하며 풀 DAW의 무게와 복잡성 없이 설계되었다.
- C++로 작성된 Audionaut는 MCP(Model Context Protocol)를 지원해 Claude와 다른 AI 에이전트가 세션을 편집할 수 있다.
- Essentia 음성 분석 라이브러리를 정적 빌드로 통합해 BIC 세그먼테이션, 온셋 감지, 비트 트래킹 기능을 제공한다.
- Meta의 Demucs를 C++ 포팅한 demucs.cpp를 사용해 음성 스템 분리(드럼/베이스/기타/보컬)가 가능하며, 모델 가중치는 첫 사용 시 자동 다운로드된다.
- CLI 도구 audionaut-cli는 스크립트, CI, AI 에이전트에 헤드리스 접근을 제공하며, --json 플래그로 기계 판독 가능한 결과를 출력한다.
- CLI는 create, import, analyze, auto-edit, assemble, split, place-clip, move-clip, separate, export 등 다양한 오디오 편집 명령을 지원한다.
- 프로젝트는 GUI와 CLI 간 호환성이 있어, CLI로 작성한 프로젝트를 GUI 앱에서 열 수 있고 그 반대도 가능하다.
- macOS 앱은 샌드박스 환경이라 ~/Music 폴더 같은 권한 범위 내에서만 CLI 접근이 가능하지만, 독립형 audionaut-cli 빌드는 제한이 없다.
- Audionaut는 GPL3 또는 상용 라이선스의 이중 라이선스로 배포되며, 기여 시 기여자 라이선스 동의서(CLA)가 필요하다.