쌓인 기록에서 찾기
무엇을 찾으세요?
날짜를 몰라도 됩니다. 제목·Key Point·요약·태그를 한꺼번에 뒤집니다.
검색 범위부터 2026년 9월 15일 (화)까지456건
10건 · "다국어"조건 지우기 ×
001당일 +204토크나이저 없는 다국어 음성합성 VoxCPM2 공개OpenBMB가 VoxCPM2를 출시했다. 토크나이저를 거치지 않고 직접 음성을 생성하는 2B 파라미터 모델으로, 200만 시간 이상의 다국어 음성 데이터로 학습됐다.AI · 머신러닝 · OpenBMB/VoxCPM · Python
토크나이저 없는 다국어 음성합성 VoxCPM2 공개

Key Point텍스트 설명만으로 음성을 만들고, 짧은 샘플로 목소리를 복제하며, 한 번에 48kHz 고품질 오디오를 생성하는 음성합성 기술이 오픈소스로 공개되어 개발자들이 자유롭게 활용할 수 있게 됐다.
핵심 요약
- OpenBMB가 VoxCPM2를 출시했다. 토크나이저를 거치지 않고 직접 음성을 생성하는 2B 파라미터 모델으로, 200만 시간 이상의 다국어 음성 데이터로 학습됐다.
- 30개 언어를 지원하며 텍스트 설명만으로 새로운 음성을 만드는 음성 설계 기능, 짧은 음성 샘플로 목소리를 복제하는 제어 가능한 클로닝, 음성과 대본을 함께 제공하는 최고 품질 클로닝을 지원한다.
- 입력은 16kHz 음성을 받아 48kHz 스튜디오 품질 오디오로 출력하며, RTX 4090에서 RTF 0.3 수준의 실시간 스트리밍 속도를 달성한다.
- Apache-2.0 라이선스로 상용 이용이 가능하며, Hugging Face와 ModelScope에서 가중치와 코드를 공개했다.
002▲ 101 · 댓글 31컴퓨터 키보드에서 사라진 기호들의 흥미로운 역사IBM의 1970년대 타자기부터 초기 컴퓨터까지 키보드에는 지금은 사라진 독특한 기호들이 있었다.하드웨어 · 시스템 · Key symbols we lost to time, pt. 1: The PC side
컴퓨터 키보드에서 사라진 기호들의 흥미로운 역사

Key Point디지털 인터페이스 디자인의 역사에서 문자와 아이콘의 경쟁이 어떻게 현재의 표준을 만들었는지, 그리고 사라진 기호들이 오늘날의 디자인에 어떤 영향을 미쳤는지 보여준다.
핵심 요약
- IBM의 1970년대 타자기부터 초기 컴퓨터까지 키보드에는 지금은 사라진 독특한 기호들이 있었다.
- 인쇄 화면, 키 비프, 홈, 삽입, 삭제 등의 기호들이 프루프리더 마크에서 영감을 받아 디자인되었다.
- 텍스트 vs 아이콘의 오랜 경쟁에서 결국 텍스트가 승리했고, ⇧(Shift), ↵(Enter), ⇥(Tab), 백스페이스 화살표만 현대까지 남았다.
- 유럽은 다국어 환경에서 보편적 시각 언어가 필요했던 반면, 미국은 문자 표기를 선호하면서 키보드 디자인도 달라졌다.
- 과거의 많은 기호들이 현재 유니코드에도 존재하며, 프루프리더 마크에서 영감받은 시각적 언어의 유산으로 남아있다.
003당일 +1,095Ever Gauzy, 통합 업무관리 플랫폼 오픈소스 공개TypeScript 기반 오픈소스 ERP/CRM/HRM/ATS/PM 통합 플랫폼 Ever Gauzy를 공개했다.오픈소스 · 도구 · ever-co/ever-gauzy · TypeScript
Ever Gauzy, 통합 업무관리 플랫폼 오픈소스 공개

Key Point협업 경제와 원격근무 환경에서 필요한 ERP·HRM·CRM 기능을 하나의 오픈소스로 통합 제공하므로, 중소 팀과 프리랜서 조직이 자체 호스팅 또는 클라우드로 저비용에 구축할 수 있는 대안이 생겼다.
핵심 요약
- TypeScript 기반 오픈소스 ERP/CRM/HRM/ATS/PM 통합 플랫폼 Ever Gauzy를 공개했다.
- 시간 추적, 직원 관리, 고객 관리, 프로젝트 관리, 회계 등 10개 이상의 비즈니스 모듈을 포함한다.
- 웹 UI, 데스크톱 앱(Windows/Mac/Linux), SaaS 버전으로 제공되며 AGPL v3 라이선스를 적용했다.
- 데모 사이트(demo.gauzy.co)와 SaaS(app.gauzy.co, 알파 버전)를 운영하고 있으며 다국어·다중통화를 지원한다.
- Headless API를 제공해 Ever Teams(React/React Native 스택)같은 다른 애플리케이션과 연동할 수 있다.
004당일 +2,774ElevenLabs 대체 오픈소스, 로컬에서 음성 변환·더빙·받아쓰기VoiceStudio는 646개 언어를 지원하는 오픈소스 음성 생성 도구로, 음성 클로닝·음성 디자인·동영상 더빙·받아쓰기·오디오북 제작을 모두 로컬에서 처리한다.오픈소스 · 도구 · debpalash/VoiceStudio · Python
ElevenLabs 대체 오픈소스, 로컬에서 음성 변환·더빙·받아쓰기

Key Point클라우드 서비스 의존 없이 모든 음성 작업을 로컬에서 처리할 수 있는 완성도 높은 오픈소스가 등장했으며, 엔진 유연성과 다국어 지원이 개발자와 콘텐츠 제작자에게 실질적인 선택지가 된다.
핵심 요약
- VoiceStudio는 646개 언어를 지원하는 오픈소스 음성 생성 도구로, 음성 클로닝·음성 디자인·동영상 더빙·받아쓰기·오디오북 제작을 모두 로컬에서 처리한다.
- TTS 16개, ASR 11개 엔진을 탑재했으며 엔진 간 전환이 자유롭다.
- 계정·API 키·구독료 없이 자신의 하드웨어에서 동작하며, macOS·Windows·Linux·Docker를 지원한다.
- CUDA·Apple Silicon MPS/MLX·ROCm·CPU 등 다양한 컴퓨팅 환경을 지원한다.
- 데스크톱 앱·로컬 REST/WebSocket API·OpenAI 호환 오디오 API를 제공한다.
- 현재 Electron 기반의 데스크톱 앱으로 재작성 중이며 AGPL-3.0 라이선스로 배포된다.
005당일 +1,796알리바바가 공개한 AI 코드 리뷰 도구, 정밀성 높이고 비용은 1/9로알리바바의 내부 코드 리뷰 시스템을 오픈소스화한 OpenCodeReview는 Git diff를 읽어 LLM에 보낸 뒤 라인 단위 정밀한 피드백을 생성한다.AI · 머신러닝 · alibaba/open-code-review · Go
알리바바가 공개한 AI 코드 리뷰 도구, 정밀성 높이고 비용은 1/9로

Key Point자체 검증 벤치마크에서 일반 LLM 대비 정밀도는 높이면서 API 비용을 획기적으로 줄인 실용적 코드 리뷰 솔루션이 공개되었기 때문입니다.
핵심 요약
- 알리바바의 내부 코드 리뷰 시스템을 오픈소스화한 OpenCodeReview는 Git diff를 읽어 LLM에 보낸 뒤 라인 단위 정밀한 피드백을 생성한다.
- deterministic 파이프라인과 LLM Agent를 결합한 하이브리드 구조로, 파일 선택·번들링·규칙 매칭을 엔지니어링 로직으로 보장하면서 동적 판단은 Agent에 맡긴다.
- NPE, 스레드 안전성, XSS, SQL 인젝션 등 다국어 룰셋을 내장하고 OpenAI와 Anthropic 모델을 모두 지원한다.
- AACR-Bench 벤치마크(50개 오픈소스, 200개 PR, 10개 언어, 80+ 시니어 엔지니어 검증)에서 Claude Code와 비교해 정밀도와 F1 점수는 더 높으면서 토큰 사용량은 1/9 수준이다.
- 전체 파일 스캔('ocr scan')으로 diff 없이도 코드베이스를 감시할 수 있고, 대규모 변경에서도 안정적으로 모든 파일을 검토한다.
006당일 +206iOS 앱 사이드로딩을 쉽게, iLoader 오픈소스 공개SideStore 설치와 페어링 파일 임포트를 자동화하는 데스크톱 앱 iLoader를 공개했다.오픈소스 · 도구 · nab138/iloader · TypeScript
iOS 앱 사이드로딩을 쉽게, iLoader 오픈소스 공개

Key Point비공식 앱 배포(사이드로딩)를 하려는 iOS 개발자와 고급 사용자가 번거로운 설정 과정을 자동화할 수 있게 되었다.
핵심 요약
- SideStore 설치와 페어링 파일 임포트를 자동화하는 데스크톱 앱 iLoader를 공개했다.
- Windows, macOS, Linux를 지원하며 USB 연결된 iOS 기기에서 IPA 파일을 직접 설치할 수 있다.
- Apple ID 로그인 후 앱 설치, 개발 인증서 관리, 페어링 파일 관리 등을 GUI로 처리한다.
- 오류 메시지에 대한 지능형 해결책을 제시하며, 다국어(한국어 포함)로 현지화되어 있다.
- TypeScript와 Rust로 만들었으며 Tauri 프레임워크를 사용했다.
007당일 +301AI Agent 설계 원리부터 실전까지, 무료 오픈소스 교과서 공개중국 개발자 이보걸이 저술한 《깊이 있는 AI Agent 이해: 설계 원리와 공학 실제》 전자책을 GitHub에서 완전 무료 공개했다.AI · 머신러닝 · bojieli/ai-agent-book · Python
AI Agent 설계 원리부터 실전까지, 무료 오픈소스 교과서 공개

Key PointAI Agent 개발의 기초 이론부터 실제 구현까지 체계적으로 배울 수 있는 최신 교과서가 완전 무료로 공개되었으며, 한국어 번역본과 실습 코드까지 제공되어 한국 개발자가 즉시 활용할 수 있다.
핵심 요약
- 중국 개발자 이보걸이 저술한 《깊이 있는 AI Agent 이해: 설계 원리와 공학 실제》 전자책을 GitHub에서 완전 무료 공개했다.
- Agent = LLM + 컨텍스트 + 도구라는 핵심 공식을 바탕으로 10개 장에서 AI Agent의 원리부터 실전까지 다룬다.
- 전체 정문, 삽화, 109개 배치 실험 코드가 모두 오픈소스로 공개되어 직접 실행해볼 수 있다.
- 중국어 원본 외에 영어, 스페인어, 인도네시아어, 아랍어, 번체 중국어, 러시아어, 베트남어, 일본어, 터키어, 한국어 등 15개 언어로 번역되었다.
- PDF 및 EPUB 형식으로 오프라인 다운로드 가능하며, 온라인 버전은 다국어 전환, 장절 축약, 전문 검색을 지원한다.
008당일 +268대규모 시스템 설계 학습 가이드, GitHub서 36만 스타 돌파대규모 시스템 설계 원리를 배우고 기술 면접에 대비할 수 있는 오픈소스 학습 자료다.오픈소스 · 도구 · donnemartin/system-design-primer · Python
대규모 시스템 설계 학습 가이드, GitHub서 36만 스타 돌파

Key Point기술 면접에서 시스템 설계 문제는 필수 과목인데, 이 저장소는 면접 준비부터 실무 설계까지 아우르는 체계적인 학습 자료를 제공한다.
핵심 요약
- 대규모 시스템 설계 원리를 배우고 기술 면접에 대비할 수 있는 오픈소스 학습 자료다.
- 확장성, 성능, 가용성 등 시스템 설계의 핵심 개념을 주제별로 정리했으며 각 섹션마다 상세 자료로의 링크를 제공한다.
- 일반적인 시스템 설계 면접 문제와 객체지향 설계 문제를 샘플 솔루션(토론, 코드, 다이어그램)과 함께 제시한다.
- Anki 플래시카드 3종(시스템 설계, 시스템 설계 연습, 객체지향 설계)을 제공해 간격 반복을 통한 학습을 지원한다.
- 커뮤니티 기여로 지속적으로 업데이트되는 프로젝트이며 다국어 번역(한국어 포함)도 진행 중이다.
009당일 +124초보자를 위한 30일 파이썬 학습 가이드 공개30일 동안 단계별로 파이썬 기초부터 고급까지 학습하는 무료 강의 자료를 GitHub에 공개했다.오픈소스 · 도구 · Asabeneh/30-Days-Of-Python · Python
초보자를 위한 30일 파이썬 학습 가이드 공개

Key Point파이썬을 배우려는 초보자부터 전문가까지 체계적으로 학습할 수 있는 완전히 무료이고 오픈소스인 커리큘럼이 공개되었기 때문이다.
핵심 요약
- 30일 동안 단계별로 파이썬 기초부터 고급까지 학습하는 무료 강의 자료를 GitHub에 공개했다.
- 변수, 자료형, 함수, 클래스, 웹 스크래핑, API 구축 등 총 30개 주제를 다룬다.
- 초보자와 경험자 모두를 대상으로 하며 실제 예제와 연습 문제가 포함되어 있다.
- 실제로는 100일 이상 소요될 수 있으며 텔레그램 커뮤니티 참여로 완료율을 높일 수 있다.
- 포르투갈어, 중국어, 프랑스어, 그리스어 등 다국어 버전을 지원한다.
010당일 +534600개 언어 지원하는 제로샷 음성 복제 TTS 'OmniVoice' 공개K2-FSA가 600개 이상 언어를 지원하는 다중언어 제로샷 TTS 모델 OmniVoice를 공개했다.AI · 머신러닝 · k2-fsa/OmniVoice · Python
600개 언어 지원하는 제로샷 음성 복제 TTS 'OmniVoice' 공개

Key Point지금까지 가장 광범위한 언어 커버리지를 갖춘 제로샷 TTS 모델이 공개되어 다국어 음성 합성 애플리케이션 개발에 새로운 가능성을 열고 있다.
핵심 요약
- K2-FSA가 600개 이상 언어를 지원하는 다중언어 제로샷 TTS 모델 OmniVoice를 공개했다.
- 확산 언어 모델 기반 아키텍처로 설계되어 높은 음성 품질과 빠른 추론 속도(RTF 0.025, 실시간 40배)를 제공한다.
- 참조 음성 클립(3~10초)으로 음성을 복제하거나 성별, 나이, 음역, 방언 등 속성으로 음성을 설계할 수 있다.
- 웃음소리 등 비언어 기호와 병음·음소로 발음 교정을 지원하며, 음성 복제 모드는 안정적이지만 음성 설계는 중국어·영어 데이터로만 학습되었다.
- HuggingFace Space, Google Colab, 로컬 웹 UI로 코딩 없이 테스트 가능하며, 다양한 하드웨어(NVIDIA, Apple Silicon, Intel Arc GPU)를 지원한다.