쌓인 기록에서 찾기
무엇을 찾으세요?
날짜를 몰라도 됩니다. 제목·Key Point·요약·태그를 한꺼번에 뒤집니다.
검색 범위부터 2026년 9월 19일 (토)까지674건
8건 · "AI API"조건 지우기 ×
001당일 +141여러 AI API를 하나로 통합하는 프록시 서버 CLIProxyAPICLIProxyAPI는 OpenAI, Gemini, Claude, Codex, Grok 호환 API 인터페이스를 제공하는 프록시 서버로, Go 언어로 개발되었습니다.AI · 머신러닝 · router-for-me/CLIProxyAPI · Go
여러 AI API를 하나로 통합하는 프록시 서버 CLIProxyAPI

Key PointCLI나 SDK를 통해 여러 AI 모델에 통일된 방식으로 접근하고 싶은 개발자에게 설정 복잡도를 대폭 줄여줍니다.
핵심 요약
- CLIProxyAPI는 OpenAI, Gemini, Claude, Codex, Grok 호환 API 인터페이스를 제공하는 프록시 서버로, Go 언어로 개발되었습니다.
- ChatGPT, Claude Code, Grok Build, Antigravity 등 여러 AI 서비스를 단일 API로 통합하여 접근할 수 있습니다.
- Kimi K3, GPT-5.6, Claude Fable, Gemini 3.5 Flash, Grok 4.5 등 최신 모델들을 지원하며, 다중 계정 관리 기능을 제공합니다.
- 데스크톱 사용자를 위해 EasyCLIProxyAPI라는 그래픽 UI 클라이언트를 제공하며 자동 업데이트와 시스템 트레이 통합 기능을 포함합니다.
- PackyAPI, AICodeMirror, APIKEY.FUN 등 여러 API 릴레이 서비스와 협력하여 할인 혜택을 제공하고 있습니다.
002당일 +801352개 AI 제공사를 하나의 API로, OmniRoute 게이트웨이OpenAI, Claude, Gemini, DeepSeek 등 352개 AI 제공자 전용 엔드포인트를 통합한 오픈소스 게이트웨이 OmniRoute를 공개했다.AI · 머신러닝 · diegosouzapw/OmniRoute · TypeScript
352개 AI 제공사를 하나의 API로, OmniRoute 게이트웨이

Key Point수백 개 AI API의 복잡한 가격·할당량 관리를 한 곳에서 해결해주므로, 비용 절감과 개발 편의성이 동시에 필요한 개발자에게 실질적인 도움이 된다.
핵심 요약
- OpenAI, Claude, Gemini, DeepSeek 등 352개 AI 제공자 전용 엔드포인트를 통합한 오픈소스 게이트웨이 OmniRoute를 공개했다.
- 월 약 14.7억 토큰의 무료 한도를 자동으로 계산해 제공하며, 2주마다 각 제공자의 무료 정책을 재검증해 대시보드에 표시한다.
- 할당량 부족 시 자동으로 다른 제공자로 전환하고, RTK+Caveman 압축 기술로 토큰 사용을 15~95% 줄인다.
- Claude Code, Cursor, Copilot 등 주요 AI 코딩 도구와 호환되며, CLI·MCP·데스크톱·PWA 형태로 설치할 수 있다.
- v3.8.50 버전에서 1,312개 모델 ID, 비전·오디오·비디오 멀티모달 지원, 실시간 할당량 감시 기능을 추가했다.
003▲ 354 · 댓글 182DeepSeek, V4 Pro 보다 저렴하고 강력한 V4.1 Flash 출시DeepSeek이 9월 10일 V4.1 Flash 모델을 공식 출시한다.AI · 머신러닝 · DeepSeek launching v4.1 flash cheaper and more capable than v4 pro
DeepSeek, V4 Pro 보다 저렴하고 강력한 V4.1 Flash 출시
Key PointV4 Pro 수준의 성능을 저가로 제공하는 모델이 등장하면서 AI API 비용 절감에 직결된다.
핵심 요약
- DeepSeek이 9월 10일 V4.1 Flash 모델을 공식 출시한다.
- V4.1 Flash는 성능, 비용, 속도, 작업 완료 시간 등 모든 주요 지표에서 V4 Pro를 앞선다.
- V4.1 Flash 출시 이후 Pro 모델 요청은 Flash 모델로 라우팅되며 Flash 가격으로 청구된다.
- 비피크 시간 기준 입력 캐시 히트 $0.003, 미스 $0.15, 출력 $0.6이며 피크 시간은 2배 요금이다.
004당일 +112다양한 AI 모델을 한 곳에서 통합 관리하는 게이트웨이New API는 OpenAI, Claude, Gemini 등 서로 다른 LLM들을 호환 가능한 포맷으로 변환해주는 통합 AI 모델 허브다.AI · 머신러닝 · QuantumNous/new-api · Go
다양한 AI 모델을 한 곳에서 통합 관리하는 게이트웨이

Key Point여러 AI 서비스의 API를 통합 관리하고 비용 추적이 필요한 개발팀이나 AI 기반 제품을 운영하는 기업이 자체 게이트웨이를 구축할 때 바로 활용 가능한 오픈소스 솔루션이다.
핵심 요약
- New API는 OpenAI, Claude, Gemini 등 서로 다른 LLM들을 호환 가능한 포맷으로 변환해주는 통합 AI 모델 허브다.
- 조직 수준의 토큰 관리, 모델별 제한, 사용자 권한 관리를 지원하며 요청별·사용량 기반 정산과 캐시 비용 계산 기능을 제공한다.
- Discord, LinuxDO, Telegram, OIDC 등 다양한 인증 방식을 지원하고 OpenAI Realtime API를 포함한 여러 API 포맷을 호환한다.
- Go 언어로 개발되었으며 Docker Compose로 쉽게 배포할 수 있고, 간편한 웹 UI와 시각화된 데이터 대시보드를 제공한다.
- 개인 사용자의 AI API 게이트웨이 구축부터 기업 수준의 모델 관리, 프라이빗 배포까지 다양한 시나리오를 지원한다.
005당일 +359AI 에이전트 토큰 65% 줄이는 '동굴인 말하기' 스킬Claude Code를 비롯한 30개 이상의 AI 에이전트에서 사용 가능한 규칙 파일 'Caveman'을 공개했다.AI · 머신러닝 · JuliusBrussee/caveman · Go
AI 에이전트 토큰 65% 줄이는 '동굴인 말하기' 스킬

Key PointAI API 사용료가 토큰 기반인 상황에서, 에이전트의 장황한 답변을 자동으로 간결하게 변환해 구체적인 비용 절감 효과를 제시한다.
핵심 요약
- Claude Code를 비롯한 30개 이상의 AI 에이전트에서 사용 가능한 규칙 파일 'Caveman'을 공개했다.
- AI 에이전트가 과도하게 긴 설명을 피하고 간결하게 답변하도록 학습시켜, 출력 토큰을 평균 65% 감소시킨다.
- 코드·명령어·파일 경로·오류 메시지는 건드리지 않고 설명 부분만 간결하게 다듬는다.
- 스킬 형태(무료, MIT 라이선스)와 프록시 형태(사용자 머신에서 읽는 토큰도 감축, BSL-1.1)로 제공된다.
- 스킬만 사용하면 출력 토큰은 줄지만 입력·추론 토큰은 유지되며, 기존에 이미 간결한 답변에선 절감 효과가 미미하다.
- 전체 세션 기준으로는 토큰 감축보다 응답 속도와 가독성 향상이 주요 이점이다.
006당일 +118Claude·OpenAI·Gemini 구독을 한곳으로, Sub2API 오픈소스Claude, OpenAI, Gemini, Grok 등 여러 AI API 제공자의 구독을 통합 관리하는 오픈소스 API 게이트웨이 플랫폼이다.오픈소스 · 도구 · Wei-Shaw/sub2api · Go
Claude·OpenAI·Gemini 구독을 한곳으로, Sub2API 오픈소스

Key Point여러 AI API 서비스의 구독을 통합하면서도 약관 위반 위험이 있는 프로젝트이므로, 사용 전에 법적 제약과 이용 약관을 정확히 파악해야 한다.
핵심 요약
- Claude, OpenAI, Gemini, Grok 등 여러 AI API 제공자의 구독을 통합 관리하는 오픈소스 API 게이트웨이 플랫폼이다.
- 사용자 간 구독 쿼터를 공유하는 기능을 제공해 AI API 비용을 효율적으로 분산할 수 있다.
- Go와 Vue.js, PostgreSQL, Redis, Docker 등으로 구축되었으며, 원래의 도구들과 호환성을 유지한다.
- 다만 이용 약관 위반 가능성이 있으므로 각 제공사의 약관을 확인한 후 사용해야 하며, 모든 위험과 책임은 사용자가 부담해야 한다.
- 기술 학습 및 연구 목적으로만 제공되며, 계정 정지나 서비스 중단 등 피해에 대해 개발자는 책임을 지지 않는다.
- 상업적 이용은 승인되지 않았으며, 이 프로젝트 기반의 모든 상업 활동은 개발자와 무관하다.
007▲ 160 · 댓글 80DeepSeek-V4-Pro 공개, 피크/비피크 요금제 도입DeepSeek-V4-Pro를 출시했으며 에이전트 성능을 대폭 강화했다.AI · 머신러닝 · DeepSeek peak/off-peak pricing update
DeepSeek-V4-Pro 공개, 피크/비피크 요금제 도입

Key PointAI API 비용 최적화 기능의 도입과 DeepSeek의 모델 업그레이드가 개발자 커뮤니티에서 주목받고 있다.
핵심 요약
- DeepSeek-V4-Pro를 출시했으며 에이전트 성능을 대폭 강화했다.
- 추론 난이도를 낮음/높음/최대로 조절할 수 있고 OpenAI Responses API를 기본 지원한다.
- 비피크 요금이 피크 요금의 50% 저렴하며 2026년 8월 16일 16:00 UTC부터 적용된다.
008▲ 669 · 댓글 262Cerebras와 OpenAI, GPT-5.6 Sol 울트라팩스트 모드 공개Cerebras와 OpenAI가 새로운 서비스 계층 울트라팩스트 모드를 OpenAI API에 출시했으며, 초당 최대 750개 토큰을 생성한다.AI · 머신러닝 · Accelerating GPT-5.6 Sol Ultrafast
Cerebras와 OpenAI, GPT-5.6 Sol 울트라팩스트 모드 공개

Key Point고성능 AI 추론 기술의 실질적 진전을 보여주는 사례로, GPU 기반 시스템의 근본적 한계를 새로운 아키텍처로 극복한 점이 개발자 커뮤니티의 관심을 받고 있다.
핵심 요약
- Cerebras와 OpenAI가 새로운 서비스 계층 울트라팩스트 모드를 OpenAI API에 출시했으며, 초당 최대 750개 토큰을 생성한다.
- 울트라팩스트 모드는 Fable 5보다 11배, Opus 4.8 Fast 모드보다 5배 빠르며, 품질 저하 없이 동작한다.
- Cerebras의 Wafer-Scale Engine 아키텍처가 칩에 44GB SRAM을 탑재하여 메모리 대역폭 병목을 제거해 고속 추론을 실현한다.