쌓인 기록에서 찾기
무엇을 찾으세요?
날짜를 몰라도 됩니다. 제목·Key Point·요약·태그를 한꺼번에 뒤집니다.
검색 범위부터 2026년 9월 14일 (월)까지402건
3건 · "로컬 처리"조건 지우기 ×
001당일 +2,546ElevenLabs 대체 오픈소스, 로컬에서 음성 변환·더빙·받아쓰기VoiceStudio는 646개 언어를 지원하는 오픈소스 음성 생성 도구로, 음성 클로닝·음성 디자인·동영상 더빙·받아쓰기·오디오북 제작을 모두 로컬에서 처리한다.오픈소스 · 도구 · debpalash/VoiceStudio · Python
ElevenLabs 대체 오픈소스, 로컬에서 음성 변환·더빙·받아쓰기

Key Point클라우드 서비스 의존 없이 모든 음성 작업을 로컬에서 처리할 수 있는 완성도 높은 오픈소스가 등장했으며, 엔진 유연성과 다국어 지원이 개발자와 콘텐츠 제작자에게 실질적인 선택지가 된다.
핵심 요약
- VoiceStudio는 646개 언어를 지원하는 오픈소스 음성 생성 도구로, 음성 클로닝·음성 디자인·동영상 더빙·받아쓰기·오디오북 제작을 모두 로컬에서 처리한다.
- TTS 16개, ASR 11개 엔진을 탑재했으며 엔진 간 전환이 자유롭다.
- 계정·API 키·구독료 없이 자신의 하드웨어에서 동작하며, macOS·Windows·Linux·Docker를 지원한다.
- CUDA·Apple Silicon MPS/MLX·ROCm·CPU 등 다양한 컴퓨팅 환경을 지원한다.
- 데스크톱 앱·로컬 REST/WebSocket API·OpenAI 호환 오디오 API를 제공한다.
- 현재 Electron 기반의 데스크톱 앱으로 재작성 중이며 AGPL-3.0 라이선스로 배포된다.
002당일 +109WiFi 신호로 심박수·호흡 감지하는 오픈소스 센싱 플랫폼WiFi 라우터의 신호 변화를 캡처해 카메라 없이 사람 감지, 호흡·심박수 측정, 움직임 추적을 수행하는 Rust 기반 오픈소스 플랫폼 RuView를 공개했다.오픈소스 · 도구 · ruvnet/RuView · Rust
WiFi 신호로 심박수·호흡 감지하는 오픈소스 센싱 플랫폼

Key Point프라이버시를 보장하면서 저비용 WiFi 센서로 생체신호를 측정할 수 있는 오픈소스 기술이 등장했으며, 기존 스마트홈 시스템과의 통합으로 실제 활용 가능성을 제시하고 있다.
핵심 요약
- WiFi 라우터의 신호 변화를 캡처해 카메라 없이 사람 감지, 호흡·심박수 측정, 움직임 추적을 수행하는 Rust 기반 오픈소스 플랫폼 RuView를 공개했다.
- ESP32(9달러 수준) 센서와 Channel State Information(CSI)를 이용해 벽을 통과한 신호를 분석하며, 8KB 크기의 양자화 모델로 라즈베리파이에서 마이크로초 단위로 처리된다.
- 수면 단계 분류, 낙상 감지, 제스처 인식 등 21개 센서 항목을 제공하고, Home Assistant, Apple Home, Google Home, Alexa 등 주요 스마트홈 생태계에 통합된다.
- 엣지 기반 완전 로컬 처리로 클라우드 불필요하며, 30초 이내에 환경에 자동 학습하는 스파이킹 신경망을 탑재했고 모든 측정값은 Ed25519 암호 서명으로 검증된다.
- v2 모델의 temporal-triplet 정확도는 82.3%이며, 카메라나 웨어러블 없이 privacy-first 설계로 구현되었다.
003당일 +117프라이버시 우선 음성 받아쓰기 앱 OpenWhispr 공개WisprFlow와 Granola의 오픈소스 대안으로, 핫키 입력 후 음성을 텍스트로 변환해 커서 위치에 자동 붙여넣기한다.오픈소스 · 도구 · OpenWhispr/openwhispr · JavaScript
프라이버시 우선 음성 받아쓰기 앱 OpenWhispr 공개

Key Point로컬 처리로 프라이버시를 보장하면서 클라우드 속도도 선택 가능한 음성 받아쓰기 도구로, 업무 자동화와 회의 기록이 필요한 개발자와 사용자들에게 실질적인 대안이 될 수 있다.
핵심 요약
- WisprFlow와 Granola의 오픈소스 대안으로, 핫키 입력 후 음성을 텍스트로 변환해 커서 위치에 자동 붙여넣기한다.
- 로컬 모델(Whisper, NVIDIA Parakeet)과 클라우드 모델을 선택 가능하며, 로컬 모드에서는 음성이 기기를 떠나지 않는다.
- Zoom·Teams·FaceTime 통화 자동 감지, 화자 구분 및 음성 지문인식, 의미 검색이 가능한 노트 기능을 제공한다.
- GPT-4o·Claude·Gemini·Groq 등 AI 어시스턴트와의 음성 대화 및 스크린샷 컨텍스트 전송을 지원한다.
- macOS·Windows·Linux 크로스플랫폼을 지원하며, 별도 API와 MCP 서버로 프로그래매틱 접근이 가능하다.
- 노트 공유·팀 협업·엔터프라이즈 SSO 등의 기능이 무료 또는 유료로 제공된다.