쌓인 기록에서 찾기
무엇을 찾으세요?
날짜를 몰라도 됩니다. 제목·Key Point·요약·태그를 한꺼번에 뒤집니다.
검색 범위부터 2026년 9월 11일 (금)까지270건
12건 · "CPU"조건 지우기 ×
001▲ 216 · 댓글 126Stockfish 19 공개, Elo 44포인트 향상오픈소스 체스 엔진 Stockfish 19가 정식 출시되었다.오픈소스 · 도구 · Stockfish 19
Stockfish 19 공개, Elo 44포인트 향상

Key Point오픈소스 체스 엔진의 핵심 성능 개선과 기술적 혁신이 어떻게 이루어졌는지 알 수 있으며, 개발자들이 기여할 수 있는 방법을 제시하고 있다.
핵심 요약
- 오픈소스 체스 엔진 Stockfish 19가 정식 출시되었다.
- Stockfish 18 대비 Elo 44포인트 향상되어 게임 매치에서 3배 이상 승률을 기록했다.
- SFNNv16 신경망 아키텍처 도입으로 불필요한 기능을 제거하면서도 새로운 폰 쌍 기능을 추가했다.
- Quantization-Aware Training(QAT) 등 신기술을 수천억 개 학습 위치에 적용했으며, Leela 네트를 이용해 재점수 매김했다.
- RISC-V, LoongArch, WebAssembly 지원 추가와 보드 위치·FEN 문자열·UCI 명령어에 대한 검증을 강화했다.
- 범용 바이너리로 배포 방식을 단순화하여 CPU 기능을 자동으로 감지하고 최적의 코드를 실행한다.
002당일 +130일반 PC에서 744B 규모 대규모 언어모델 실행하는 C 엔진 공개Colibrì는 순수 C와 의존성 없이 744B~2.8T 규모 MoE 모델을 일반 하드웨어에서 실행하는 추론 엔진이다.오픈소스 · 도구 · JustVugg/colibri · C
일반 PC에서 744B 규모 대규모 언어모델 실행하는 C 엔진 공개

Key Point소유한 PC로 최대 2.8T 규모 모델을 실행할 수 있는 가능성을 보여주며, 하이퍼스케일러 하드웨어 의존성을 제거해 대규모 모델 접근성을 크게 낮춘다.
핵심 요약
- Colibrì는 순수 C와 의존성 없이 744B~2.8T 규모 MoE 모델을 일반 하드웨어에서 실행하는 추론 엔진이다.
- VRAM, RAM, 디스크를 하나의 계층 구조로 취급해 제한된 고속 메모리에서도 모델 정확도를 유지하며 속도만 조절된다.
- GLM, Kimi, DeepSeek, Qwen 등 8개 모델 계열을 지원하며 각각 하나의 C 파일로 구현되어 동일한 인터페이스(coli chat/serve/web)를 사용한다.
- 라우팅 히트 기반 LRU, I/O 최적화, 이질적 실행(CPU/GPU/메탈), 압축 상태 등 다층 최적화 기법으로 추론 속도와 비용을 개선한다.
- 모든 최적화는 실제 하드웨어에서 정량 측정한 결과를 바탕으로만 채택하며, 모델 의미론을 몰래 바꾸지 않는 것을 보장한다.
003당일 +258당신의 하드웨어에 맞는 LLM 찾아주는 도구 llmfitRust 기반 터미널 도구로, CPU·메모리·GPU·VRAM을 자동 감지해 실행 가능한 오픈소스 LLM 모델을 추천한다.AI · 머신러닝 · AlexsJones/llmfit · Rust
당신의 하드웨어에 맞는 LLM 찾아주는 도구 llmfit

Key Point로컬에서 LLM을 실행하려는 개발자들이 자신의 하드웨어 사양에 정확히 맞는 모델을 찾기 어려운 문제를 직접 해결해주는 도구이기 때문이다.
핵심 요약
- Rust 기반 터미널 도구로, CPU·메모리·GPU·VRAM을 자동 감지해 실행 가능한 오픈소스 LLM 모델을 추천한다.
- GGUF·AWQ·GPTQ·EXL2 등 다양한 양자화 포맷을 지원하며 메모리 사용량과 토큰 속도를 예측한다.
- 인터랙티브 TUI, 웹 대시보드, REST API 엔드포인트 중 선택해 사용할 수 있다.
- 벤치마킹 결과를 PR로 기여하면 다음 릴리스에 반영되어, 같은 하드웨어 사용자들이 검증된 수치를 얻을 수 있다.
- macOS, Linux, Windows 멀티플랫폼을 지원하고 Docker 이미지도 제공한다.
004당일 +102구글, AI 기반 파일 타입 감지 도구 'Magika' 오픈소스화구글이 개발한 파일 타입 감지 도구 Magika를 공개했으며, 딥러닝 기반 모델로 약 99% 정확도를 달성한다.보안 · google/magika · Rust
구글, AI 기반 파일 타입 감지 도구 'Magika' 오픈소스화

Key Point기존 파일 형식 감지 도구의 한계(낮은 정확도, 느린 속도)를 AI로 개선하면서도 경량화(수 MB)를 달성한 솔루션이 오픈소스로 공개되어 보안 및 콘텐츠 분석 도구 개발에 활용할 수 있다.
핵심 요약
- 구글이 개발한 파일 타입 감지 도구 Magika를 공개했으며, 딥러닝 기반 모델로 약 99% 정확도를 달성한다.
- 약 100만 개 샘플의 200개 이상 콘텐츠 타입으로 학습되었으며, 파일 크기와 무관하게 평균 5ms 내 분석을 완료한다.
- Rust 명령줄 도구, Python API, JavaScript/TypeScript, Go 바인딩으로 제공되며, 모델 로드 후 CPU만으로도 동작한다.
- Gmail, Drive, Safe Browsing의 보안 스캐닝에 사용 중이며, VirusTotal과 abuse.ch에도 통합되어 있다.
- 높음·중간·낮음 신뢰도 모드로 오류 허용도를 조절할 수 있고, 웹 데모로 설치 없이 브라우저에서 테스트 가능하다.
- Apache 2.0 라이선스로 배포되며, 공식 구글 프로젝트는 아니다.
005당일 +100무료 화면 녹화로 제품 데모 만드는 오픈소스 도구 OpenScreen원제작자 승인 아래 GitHub에서 재개발 중인 화면 녹화 소프트웨어로, 개인·상업 이용 무료이며 광고와 구독료 없다.오픈소스 · 도구 · getopenscreen/openscreen · TypeScript
무료 화면 녹화로 제품 데모 만드는 오픈소스 도구 OpenScreen

Key Point화면 녹화와 편집을 한 곳에서 처리해야 하는 스타트업·콘텐츠 제작자·개발자에게 무료이면서 AI와 GPU 가속을 갖춘 선택지가 생겼다.
핵심 요약
- 원제작자 승인 아래 GitHub에서 재개발 중인 화면 녹화 소프트웨어로, 개인·상업 이용 무료이며 광고와 구독료 없다.
- GPU 가속(macOS Metal, Windows D3D11, Linux Vulkan)으로 MP4·GIF 내보내기를 지원하고, CPU 자동 폴백이 있다.
- 자동 자막, AI 편집 어시스턴트(Claude·OpenAI·Gemini·Mistral 등 지원), 줌·주석·텍스트 애니메이션 등 포스트 프로덕션 기능을 탑재했다.
- 마이크·시스템 음성 녹음, 웹캠 오버레이, 커서 커스터마이징, 타임라인 편집 기능을 제공한다.
- Windows 1903+, macOS 13+ 이상에서 설치 가능하며, 커맨드라인 인터페이스로 헤드리스 녹화·프로젝트 편집·렌더링을 지원한다.
- 12개 언어를 지원하고, 원본 저장소는 v1.5.0 이후 아카이브된 상태이다.
006▲ 101 · 댓글 34ZX 스펙트럼의 1비트 스피커로 음성 재생하기ZX 스펙트럼의 1비트 비퍼로 간단한 톤과 화음을 재생하는 루틴을 구현했다.하드웨어 · 시스템 · ZX Spectrum: Experimenting with 1-Bit Sound
ZX 스펙트럼의 1비트 스피커로 음성 재생하기
Key Point1980년대 하드웨어로 생각하기 어려운 수준의 음성 재생 기법을 구현한 과정을 상세히 기록했으며, Z80 사이클 최적화 팁은 레트로 컴퓨팅이나 임베디드 시스템 개발자에게 실무 참고 자료가 된다.
핵심 요약
- ZX 스펙트럼의 1비트 비퍼로 간단한 톤과 화음을 재생하는 루틴을 구현했다.
- 펄스 코드 변조(PCM)와 펄스 폭 변조(PWM) 기법을 시도했으며, 1비트 PCM 재생은 성공했지만 음질 왜곡 문제가 있다.
- 스펙트럼의 약 1MHz 메모리 접근 속도로 16kHz 샘플링 재생이 가능하며, 초당 약 2KB의 표본이 필요하다.
- Z80 CPU의 T-스테이트 사이클 수를 정확히 제어해 일정한 타이밍을 유지하는 것이 핵심이다.
- IBM PC와 달리 스펙트럼은 하드웨어 타이머가 없어 사이클 카운팅으로 수동 관리해야 한다.
007▲ 116 · 댓글 44Rust 동적 언어 인터프리터, 64비트 값 표현으로 17% 성능 향상Plush 언어 인터프리터의 Value 타입을 Rust 태그 열거형(16바이트)에서 64비트 단일 워드로 변경했다.인프라 · 데브옵스 · Replacing a Rust Enum with a 64-Bit Word Made My Interpreter 17% Faster
Rust 동적 언어 인터프리터, 64비트 값 표현으로 17% 성능 향상

Key Point메모리 구조 최적화만으로 메모리 낭비를 50% 줄이면서 오히려 성능을 높인 저수준 인터프리터 튜닝 기법이 실제로 작동하는 방식을 보여준다.
핵심 요약
- Plush 언어 인터프리터의 Value 타입을 Rust 태그 열거형(16바이트)에서 64비트 단일 워드로 변경했다.
- 메모리 정렬로 인한 낭비를 제거하고 저비트 태깅 기법을 사용해 각 값을 64비트 이내로 압축했다.
- 힙 객체 주소는 8바이트 정렬되어 최하위 3비트가 항상 0이고, 정수는 최하위 2비트를 차용해 태그를 내장했다.
- Fixnum(62비트 정수), Flonum(부동소수점), Immediate(nil, true, false, 함수 ID 등), 두 종류의 포인터를 인코딩한다.
- 문자열 구조 비교와 같은 기능을 위해 포인터 두 종류를 구분해 동등성 비교를 최적화했다.
- 추가 비트 연산이 필요했지만 CPU 캐시 효율과 메모리 대역폭 개선으로 종합 성능이 17% 향상되었다.
008당일 +125로컬에서 빠르게 LLM 실행하는 llama.cpp, 고성능 추론 엔진llama.cpp는 C/C++로 구현된 경량 LLM·VLM 추론 엔진으로, 별도 의존성 없이 다양한 하드웨어에서 최적화된 성능을 제공한다.AI · 머신러닝 · ggml-org/llama.cpp · C++
로컬에서 빠르게 LLM 실행하는 llama.cpp, 고성능 추론 엔진

Key Point하드웨어 요구사항이 낮으면서도 다양한 플랫폼을 지원해 개인 PC에서도 대형 언어모델을 효율적으로 운영할 수 있다는 점이 실무에서 중요해지고 있다.
핵심 요약
- llama.cpp는 C/C++로 구현된 경량 LLM·VLM 추론 엔진으로, 별도 의존성 없이 다양한 하드웨어에서 최적화된 성능을 제공한다.
- Apple Silicon의 Metal, ARM NEON, x86의 AVX/AVX512, RISC-V의 RVV 등 각 플랫폼별 명령어세트를 지원해 효율성을 극대화했다.
- 1.5~8비트 정수 양자화를 통해 추론 속도를 높이고 메모리 사용량을 줄일 수 있으며, NVIDIA GPU(CUDA), AMD GPU(HIP), Intel NPU 등 14개 이상의 백엔드를 지원한다.
- 총 VRAM 용량을 초과하는 큰 모델도 CPU·GPU 하이브리드 방식으로 부분 가속할 수 있고, Docker·웹 UI·CLI 도구로 빠르게 시작할 수 있다.
009▲ 128 · 댓글 29FreeBSD 미니PC 재구성기, GPU 개조까지이전 AMD 기반 FreeBSD 데스크톱을 업그레이드하면서 Silverstone SG13 미니 케이스를 선택했고, 부피는 5% 증가했으나 성능은 CPU 25%, GPU 40~60% 향상했다.하드웨어 · 시스템 · AMD Based FreeBSD Desktop Reloaded
FreeBSD 미니PC 재구성기, GPU 개조까지
Key PointFreeBSD 사용자들이 실제 미니 PC 구성 시 직면하는 하드웨어 호환성과 공간 최적화 과제, 그리고 드라이버 및 펌웨어 설정 방법을 구체적으로 확인할 수 있습니다.
핵심 요약
- 이전 AMD 기반 FreeBSD 데스크톱을 업그레이드하면서 Silverstone SG13 미니 케이스를 선택했고, 부피는 5% 증가했으나 성능은 CPU 25%, GPU 40~60% 향상했다.
- 이전의 Ryzen 7 1700과 5700XT에서 Ryzen 7 PRO 4750GE와 7700XT 12GB로 교체했으며, DDR4와 AM4 플랫폼으로 가격 대비 성능을 중시했다.
- GPU가 케이스에 맞지 않아서 팬 커버와 확장 슬롯 브래킷을 절단해 장착했으며, 1~2mm 단위의 조정이 필요했다.
- FreeBSD에서 drm-kmod와 XLibre AMD Radeon GPU 드라이버로 모든 하드웨어가 정상 작동하며, X11 구현으로 XLibre를 선택했다.
- 펌웨어 설치 후 iwmbtfw 블루투스 펌웨어 누락으로 부팅 오류가 발생했고, 필요한 펌웨어 디렉토리가 생성되지 않은 상태였다.
010▲ 143 · 댓글 9NEC V20 마이크로코드 복호화 성공CPU 에뮬레이터 개발자가 NEC V20 칩의 고해상도 사진(56억 픽셀)을 촬영한 뒤 마이크로코드 ROM을 추출했다.하드웨어 · 시스템 · Decoding the NEC V20 Microcode
NEC V20 마이크로코드 복호화 성공

Key Point과거 8088 마이크로코드 복호화로 문을 열었던 저수준 CPU 에뮬레이션이 이제 V20까지 확대되면서, 진정한 사이클 정확도의 역사 CPU 에뮬레이터 구현이 가능해졌다.
핵심 요약
- CPU 에뮬레이터 개발자가 NEC V20 칩의 고해상도 사진(56억 픽셀)을 촬영한 뒤 마이크로코드 ROM을 추출했다.
- ROM 배열은 258x116 크기로 29,928비트를 담고 있으며, 29비트 단위 마이크로코드 1,032개가 저장되어 있다.
- 마이크로코드 비트를 수동으로 분류한 1,000개 샘플로 CNN(합성곱 신경망)을 학습시켰고, 약 6세대 만에 99% 이상의 정확도를 달성했다.
- PyTorch를 이용한 이 방법은 29,928개 비트 전체를 자동으로 추출하는 데 성공했으며, 이를 통해 V20의 사이클 정확도 높은 에뮬레이션이 가능해졌다.
012▲ 679 · 댓글 170DRAM 주소 변환 조작으로 CPU 보안 우회메모리 컨트롤러의 DRAM 주소 변환 레지스터를 수정해 물리 메모리 주소를 재배선한다.보안 · Spaghettifying DRAM
DRAM 주소 변환 조작으로 CPU 보안 우회

Key PointDRAM 계층의 보안 우회 기법을 실증한 구체적인 PoC로, CPU 보안 경계를 넘어서는 저수준 공격 방식을 보여줘 주목받고 있다.
핵심 요약
- 메모리 컨트롤러의 DRAM 주소 변환 레지스터를 수정해 물리 메모리 주소를 재배선한다.
- PSP, SMM, C6, 마이크로코드 등 커널도 접근 불가능한 보호된 DRAM 영역을 노출시킨다.
- AMD Family 16h CPU에서 테스트됐으며, 메모리 컨트롤러 계층의 주소 리맵을 조작하는 단일 비트 플립으로 실행된다.