Hacker NewsAI · 머신러닝오늘의 주요

xAI, 코딩 특화 모델 'Grok 4.7' 출시

원제 Grok 4.7

245 포인트댓글 201
Key Point

엔지니어와 분석가가 실제로 사용할 수 있는 단계의 장시간 코딩 작업 능력과 사이버보안 분야의 이중용도 균형을 처음으로 구현한 모델로, 기존 모델들의 가치 사이클을 바꿀 수 있는 기술적 전환점을 보여준다.

핵심 요약

  • SpaceX AI가 개발한 Grok 4.7은 장시간의 복잡한 코딩 작업에 최적화된 모델로, 더 큰 기본 모델과 강화 학습으로 훈련되었다.
  • 자체 검증 능력과 긴 문맥 처리 능력을 강화했으며, CursorBench 4.0의 장기 코딩 작업 벤치마크에서 가성비 면에서 최상위 수준이다.
  • 법무·의료·금융 분야의 전문가 업무를 수행하는 GDPval 및 AA Briefcase 벤치마크에서 다른 최고 수준의 모델과 비슷하거나 우월한 성능을 보인다.
  • 사이버보안과 생물학 분야의 이중용도 벤치마크에서 정상적 업무는 잘 수행하면서도 위험한 요청은 막는 능력이 가장 우수하며, 생물안전 벤치마크에서 62.4%의 점수를 달성했다.
  • 악의적 사이버 작업 벤치마크에서 위험한 요청의 3.3%만 통과시키면서 정당한 보안 작업은 거의 막지 않는 균형을 유지한다.
  • 입력 토큰당 100만 개당 2달러, 출력 토큰당 100만 개당 6달러의 가격으로 Cursor, Grok Build, API, 클라우드 플랫폼 등에서 즉시 이용 가능하다.
AI 요약 안내

AI가 한국어로 정리한 내용입니다. 정확한 정보는 원문을 확인해 주세요.

요약 원칙 ↗