중국 AI 연구소의 최적화 기술, 서방 기업들이 조용히 도입 중
원제 The AI Race Just Got Awkward
343 포인트댓글 342

Key Point
서방 AI 기업들이 중국 연구소의 혁신 기술을 도입하면서 장문맥 처리 비용이 급격히 내려가고 있으며, 이는 AI 산업 경쟁 구도의 근본적 변화를 보여준다.
핵심 요약
- Anthropic과 OpenAI가 중국 AI 연구소의 기술을 모방한다고 지적하지만, 중국 연구소들은 오히려 자신들의 혁신 기술을 공개하고 있다.
- DeepSeek이 공개한 KV 캐시 최적화 기술은 긴 문맥을 처리하는 작업에서 캐시 크기를 437배까지 줄였다.
- MLA 아키텍처로 15배 압축에 성공한 후, CSA, HCA 등의 기법을 거쳐 최신 DeepSeek-V4.1-Flash는 토큰당 890바이트로 캐시를 단축했다.
- 장문맥 모델 서빙의 최대 비용은 GPU 메모리의 KV 캐시인데, 이 최적화로 장문맥 처리 비용이 급격히 내려갔다.
- GPU 접근성 제약으로 성능 최적화에 집중한 중국 연구소들의 성과가 서방 기업의 손실 구조를 해결해주는 형태가 되고 있다.
- Claude Opus 5.5와 GPT-6.1 Sol이 이 최적화 기술을 도입했으며, 캐시 읽기 비용을 각각 60%, 80% 인하했다.
- 두 서방 기업 모두 공식 발표 없이 조용히 신 모델을 출시했으며, 사용자 평가는 긍정적이면서도 성능은 플래그십 모델과 큰 차이가 없다.