쌓인 기록에서 찾기
무엇을 찾으세요? 날짜를 몰라도 됩니다. 제목·Key Point·요약·태그를 한꺼번에 뒤집니다.
검색 범위 2026년 8월 13일 (목) 부터 2026년 9월 11일 (금)까지 270건
10건 · "DeepSeek"조건 지우기 ×
001 09:10 ▲ 108 · 댓글 61 매직, 1조 파라미터 모델을 10배 저비용으로 학습하는 기법 공개 Magic은 계산 효율을 10배 이상 개선한 사전학습 방법론을 발표했으며, DeepSeek V4 Pro Base와 동등한 성능을 GPT-3 학습량의 약 절반인 약 50배 적은 연산으로 달성했다. AI · 머신러닝 · Compute-efficient pretraining and scaling to trillion-parameter models
매직, 1조 파라미터 모델을 10배 저비용으로 학습하는 기법 공개 Key Point 알고리즘 효율성으로 대규모 모델을 저비용에 훈련하는 것이 가능함을 입증한 첫 구체적 사례로, 개발 리소스가 제한된 팀의 모델 개발 전략을 바꿀 수 있다.
핵심 요약
Magic은 계산 효율을 10배 이상 개선한 사전학습 방법론을 발표했으며, DeepSeek V4 Pro Base와 동등한 성능을 GPT-3 학습량의 약 절반인 약 50배 적은 연산으로 달성했다. 추가로 10배 규모로 확장한 모델(약 $4M 비용)은 퍼플렉시티 평가에서 공개된 모든 오픈 기본 모델을 능가했으며, 동일 성능을 DeepSeek의 방식으로 훈련하려면 $100M 이상이 소요된다. 모델 아키텍처, 최적화기, 학습 목표, 데이터 큐레이션 등 수십 가지 변경 사항이 누적되어 효율성을 달성했으며, 작은 모델에서 효과 있는 기법이 대규모 모델에서는 작동하지 않는 경우도 발견했다. 코드, 수학 문제, 연구 논문 등 다양한 도메인에서 일반화 능력과 지식을 평가했으며, 학습 데이터와의 중복을 최소화하기 위해 다양한 필터링 기법을 적용했다. Magic은 장문맥 처리, 사전학습, 강화학습을 결합하여 초인적 코딩 에이전트를 구축하고 AI 연구개발 자동화를 목표로 하고 있다. 002 21:11 당일 +130 일반 PC에서 744B 규모 대규모 언어모델 실행하는 C 엔진 공개 Colibrì는 순수 C와 의존성 없이 744B~2.8T 규모 MoE 모델을 일반 하드웨어에서 실행하는 추론 엔진이다. 오픈소스 · 도구 · JustVugg/colibri · C
일반 PC에서 744B 규모 대규모 언어모델 실행하는 C 엔진 공개 Key Point 소유한 PC로 최대 2.8T 규모 모델을 실행할 수 있는 가능성을 보여주며, 하이퍼스케일러 하드웨어 의존성을 제거해 대규모 모델 접근성을 크게 낮춘다.
핵심 요약
Colibrì는 순수 C와 의존성 없이 744B~2.8T 규모 MoE 모델을 일반 하드웨어에서 실행하는 추론 엔진이다. VRAM, RAM, 디스크를 하나의 계층 구조로 취급해 제한된 고속 메모리에서도 모델 정확도를 유지하며 속도만 조절된다. GLM, Kimi, DeepSeek, Qwen 등 8개 모델 계열을 지원하며 각각 하나의 C 파일로 구현되어 동일한 인터페이스(coli chat/serve/web)를 사용한다. 라우팅 히트 기반 LRU, I/O 최적화, 이질적 실행(CPU/GPU/메탈), 압축 상태 등 다층 최적화 기법으로 추론 속도와 비용을 개선한다. 모든 최적화는 실제 하드웨어에서 정량 측정한 결과를 바탕으로만 채택하며, 모델 의미론을 몰래 바꾸지 않는 것을 보장한다. 003 21:11 당일 +626 352개 AI 제공사를 하나의 API로, OmniRoute 게이트웨이 OpenAI, Claude, Gemini, DeepSeek 등 352개 AI 제공자 전용 엔드포인트를 통합한 오픈소스 게이트웨이 OmniRoute를 공개했다. AI · 머신러닝 · diegosouzapw/OmniRoute · TypeScript
352개 AI 제공사를 하나의 API로, OmniRoute 게이트웨이 Key Point 수백 개 AI API의 복잡한 가격·할당량 관리를 한 곳에서 해결해주므로, 비용 절감과 개발 편의성이 동시에 필요한 개발자에게 실질적인 도움이 된다.
핵심 요약
OpenAI, Claude, Gemini, DeepSeek 등 352개 AI 제공자 전용 엔드포인트를 통합한 오픈소스 게이트웨이 OmniRoute를 공개했다. 월 약 14.7억 토큰의 무료 한도를 자동으로 계산해 제공하며, 2주마다 각 제공자의 무료 정책을 재검증해 대시보드에 표시한다. 할당량 부족 시 자동으로 다른 제공자로 전환하고, RTK+Caveman 압축 기술로 토큰 사용을 15~95% 줄인다. Claude Code, Cursor, Copilot 등 주요 AI 코딩 도구와 호환되며, CLI·MCP·데스크톱·PWA 형태로 설치할 수 있다. v3.8.50 버전에서 1,312개 모델 ID, 비전·오디오·비디오 멀티모달 지원, 실시간 할당량 감시 기능을 추가했다. 004 03:10 ▲ 354 · 댓글 182 DeepSeek, V4 Pro 보다 저렴하고 강력한 V4.1 Flash 출시 DeepSeek이 9월 10일 V4.1 Flash 모델을 공식 출시한다. AI · 머신러닝 · DeepSeek launching v4.1 flash cheaper and more capable than v4 pro
DeepSeek, V4 Pro 보다 저렴하고 강력한 V4.1 Flash 출시 Key Point V4 Pro 수준의 성능을 저가로 제공하는 모델이 등장하면서 AI API 비용 절감에 직결된다.
핵심 요약
DeepSeek이 9월 10일 V4.1 Flash 모델을 공식 출시한다. V4.1 Flash는 성능, 비용, 속도, 작업 완료 시간 등 모든 주요 지표에서 V4 Pro를 앞선다. V4.1 Flash 출시 이후 Pro 모델 요청은 Flash 모델로 라우팅되며 Flash 가격으로 청구된다. 비피크 시간 기준 입력 캐시 히트 $0.003, 미스 $0.15, 출력 $0.6이며 피크 시간은 2배 요금이다. 005 11:10 당일 +111 Ollama, 오픈소스 LLM 로컬 실행 플랫폼 Ollama는 Kimi-K2.6, GLM-5.2, DeepSeek, Qwen, Gemma 등 다양한 오픈소스 모델을 로컬에서 실행할 수 있는 플랫폼이다. AI · 머신러닝 · ollama/ollama · Go
Ollama, 오픈소스 LLM 로컬 실행 플랫폼 Key Point 개발 팀이 LLM을 클라우드 종속 없이 로컬에서 운영하고 싶을 때 실용적인 선택지가 필요하기 때문이다.
핵심 요약
Ollama는 Kimi-K2.6, GLM-5.2, DeepSeek, Qwen, Gemma 등 다양한 오픈소스 모델을 로컬에서 실행할 수 있는 플랫폼이다. macOS, Windows, Linux 데스크톱은 물론 Docker로도 제공되며, Python과 JavaScript 라이브러리를 통해 기존 애플리케이션에 통합할 수 있다. Claude Code, Codex, Copilot CLI 등 다양한 코딩 IDE와 통합 지원하고, OpenClaw를 통해 WhatsApp, Telegram, Slack, Discord 등 메신저 앱과 연동 가능하다. REST API를 제공해 모델 실행과 관리를 프로그래밍 방식으로 제어할 수 있으며, llama.cpp를 기반으로 동작한다. Open WebUI, LibreChat, Lobe Chat, Perplexica 등 30개 이상의 오픈소스 커뮤니티 프로젝트가 Ollama와 통합되어 웹 인터페이스, 데스크톱 클라이언트, RAG 챗봇 등을 제공한다. 006 08:12 당일 +841 텐센트 TeamAI, 팀 협업 AI 에이전트 관리 CLI 공개 텐센트가 TeamAI라는 오픈소스 CLI 도구를 공개했으며, 팀의 스킬·규칙·MCP·지식을 Claude Code, Cursor, Codex 등 여러 AI 에이전트에 통일적으로 배포·관리한다. AI · 머신러닝 · Tencent/teamai-cli · TypeScript
텐센트 TeamAI, 팀 협업 AI 에이전트 관리 CLI 공개 Key Point 팀 전체가 같은 AI 에이전트 설정을 자동으로 동기화받을 수 있어, AI 개발 도구 도입 시 설정 관리와 팀 표준화의 장벽을 낮춘다.
핵심 요약
텐센트가 TeamAI라는 오픈소스 CLI 도구를 공개했으며, 팀의 스킬·규칙·MCP·지식을 Claude Code, Cursor, Codex 등 여러 AI 에이전트에 통일적으로 배포·관리한다. Git 저장소(GitHub, GitLab, GitCode 등)에 팀 설정을 저장하고 `teamai init`으로 초기화하면, 팀원은 `pull`로 자동으로 최신 설정을 받으며 수동 동기화가 필요 없다. 팀 관리자가 한 번 설정한 스킬, 규칙, 문서, 환경변수, 에이전트, 훅, MCP를 모든 AI 세션에 동시 적용할 수 있다. Claude Code, Cursor, Codex, CodeBuddy 같은 메이저 AI 에이전트는 전체 기능을 지원하며, DeepSeek, OpenCode 등은 부분 지원한다. 팀 학습 추적, 코드베이스 그래프, 팀 위키, 세션 관리 등 팀 협업 기능도 포함돼 있다. 007 00:10 ▲ 160 · 댓글 80 DeepSeek-V4-Pro 공개, 피크/비피크 요금제 도입 DeepSeek-V4-Pro를 출시했으며 에이전트 성능을 대폭 강화했다. AI · 머신러닝 · DeepSeek peak/off-peak pricing update
DeepSeek-V4-Pro 공개, 피크/비피크 요금제 도입 Key Point AI API 비용 최적화 기능의 도입과 DeepSeek의 모델 업그레이드가 개발자 커뮤니티에서 주목받고 있다.
핵심 요약
DeepSeek-V4-Pro를 출시했으며 에이전트 성능을 대폭 강화했다. 추론 난이도를 낮음/높음/최대로 조절할 수 있고 OpenAI Responses API를 기본 지원한다. 비피크 요금이 피크 요금의 50% 저렴하며 2026년 8월 16일 16:00 UTC부터 적용된다. 008 00:10 ▲ 703 · 댓글 287 DeepSeek, AI 에이전트 개발 프레임워크 공개 DeepSeek Harness는 AI 에이전트 개발을 위한 오픈소스 프레임워크로 개발자 프리뷰 단계에 진입했다. AI · 머신러닝 · DeepSeek Harness developer preview
DeepSeek, AI 에이전트 개발 프레임워크 공개 Key Point Cordis 플러그인 시스템 기반의 모듈식 아키텍처와 완전한 실행 추적 기능으로 에이전트 개발의 투명성과 커스터마이징 자유도를 제공하는 점이 개발자 커뮤니티의 관심을 받고 있다.
핵심 요약
DeepSeek Harness는 AI 에이전트 개발을 위한 오픈소스 프레임워크로 개발자 프리뷰 단계에 진입했다. 모든 기능이 플러그인으로 구성되어 모델·도구·저장소·UI 등을 설정만으로 교체하거나 재구성할 수 있다. Standard·Code·Minimal·Creator 4가지 런타임 모드를 지원하며 모든 에이전트 실행은 append-only 로그로 기록되어 추적과 재실행이 가능하다. 009 20:31 ▲ 951 · 댓글 399 DeepSeek V4 Pro 정식 공개 DeepSeek V4 Pro 0813은 DeepSeek이 출시한 대규모 혼합 전문가(MoE) 모델이다. AI · 머신러닝 · DeepSeek V4 Pro 0813
DeepSeek V4 Pro 정식 공개 Key Point DeepSeek의 최신 고성능 모델이 정식 공개되면서 개발자들의 관심이 집중되고 있다.
핵심 요약
DeepSeek V4 Pro 0813은 DeepSeek이 출시한 대규모 혼합 전문가(MoE) 모델이다. OpenRouter를 통해 호스팅되며, 실시간 성능 지표와 가격 정보를 제공한다. OpenAI 호환 API로 대부분의 SDK에서 베이스 URL만 변경하여 사용할 수 있다. 010 20:31 당일 +502 Unsloth, 로컬에서 LLM과 확산 모델 학습할 수 있는 데스크톱 앱 공개 로컬에서 LLM, 확산, 임베딩, 오디오 모델을 실행하고 학습할 수 있으며 Kimi K3, DeepSeek-V4, Gemma 4 등을 지원한다. AI · 머신러닝 · unslothai/unsloth · Python
Unsloth, 로컬에서 LLM과 확산 모델 학습할 수 있는 데스크톱 앱 공개 Key Point 로컬 AI 모델 실행·학습을 간편하게 만드는 도구로서 개발자가 클라우드 비용 없이 자체 서버에서 LLM을 운영할 수 있게 해주는 점이 주목받고 있다.
핵심 요약
로컬에서 LLM, 확산, 임베딩, 오디오 모델을 실행하고 학습할 수 있으며 Kimi K3, DeepSeek-V4, Gemma 4 등을 지원한다. 미세조정 시 학습 속도를 2배 빠르게 하면서 VRAM 사용량을 70% 줄일 수 있고 LoRA, QLoRA, GRPO, DPO 등 다양한 훈련 방식을 지원한다. Tauri 기반 데스크톱 앱으로 제공되며 Windows, macOS, Linux 등 여러 플랫폼을 지원하고 Cloudflare를 통한 원격 접근도 가능하다.