xAI, 코딩 특화 모델 'Grok 4.7' 출시
원제 Grok 4.7
245 포인트댓글 201

Key Point
엔지니어와 분석가가 실제로 사용할 수 있는 단계의 장시간 코딩 작업 능력과 사이버보안 분야의 이중용도 균형을 처음으로 구현한 모델로, 기존 모델들의 가치 사이클을 바꿀 수 있는 기술적 전환점을 보여준다.
핵심 요약
- SpaceX AI가 개발한 Grok 4.7은 장시간의 복잡한 코딩 작업에 최적화된 모델로, 더 큰 기본 모델과 강화 학습으로 훈련되었다.
- 자체 검증 능력과 긴 문맥 처리 능력을 강화했으며, CursorBench 4.0의 장기 코딩 작업 벤치마크에서 가성비 면에서 최상위 수준이다.
- 법무·의료·금융 분야의 전문가 업무를 수행하는 GDPval 및 AA Briefcase 벤치마크에서 다른 최고 수준의 모델과 비슷하거나 우월한 성능을 보인다.
- 사이버보안과 생물학 분야의 이중용도 벤치마크에서 정상적 업무는 잘 수행하면서도 위험한 요청은 막는 능력이 가장 우수하며, 생물안전 벤치마크에서 62.4%의 점수를 달성했다.
- 악의적 사이버 작업 벤치마크에서 위험한 요청의 3.3%만 통과시키면서 정당한 보안 작업은 거의 막지 않는 균형을 유지한다.
- 입력 토큰당 100만 개당 2달러, 출력 토큰당 100만 개당 6달러의 가격으로 Cursor, Grok Build, API, 클라우드 플랫폼 등에서 즉시 이용 가능하다.