조사

Grok 4.6 소개

읽는 데 3분

오늘 SpaceXAI와 함께 Grok 4.6을 출시합니다.

Grok 4.6은 장시간 실행 에이전트와 더욱 고도화된 인터랙티브 및 시각 작업에 특히 중점을 두고 Grok 4.5를 기반으로 발전했습니다. 주제 조사, 정보 분석, 코드베이스 전반의 작업, 아이디어를 완성도 높은 애플리케이션이나 작업 결과물로 구현하는 등 여러 단계로 이루어진 복잡한 작업을 끝까지 수행합니다.

Grok 4.6은 여러 에이전트 기반 코딩 및 지식 노동 벤치마크에서 프런티어 인텔리전스를 달성했습니다. 9개 벤치마크를 종합한 점수인 Artificial Analysis Intelligence Index에서 GPT-5.6 Sol과 동등한 성능을 보입니다.

코딩 및 지식 노동 평가 전반의 Grok 4.6 벤치마크 결과

Grok 4.6은 오늘부터 Cursor와 Grok Build에서 사용할 수 있습니다. 첫 주 동안 Cursor와 Grok Build에서 기본 제공 사용량을 2배로 제공합니다.

Grok 4.6 학습

Grok 4.6은 추론 및 고급 기술 개념을 위한 선별된 모델 생성 데이터, 고품질 엔지니어링 데이터, 개선된 옵티마이저와 학습 레시피를 바탕으로 Grok 4.5보다 더 긴 추가 학습을 거쳤습니다. 이를 통해 이어지는 SFT 및 RL 단계의 기반을 더욱 강화했습니다.

이후 Grok 4.5를 사용해 추론 수준, 에이전트 하네스, STEM, 소프트웨어 엔지니어링, 지식 노동 등의 도메인 전반에 걸친 SFT 트래젝터리를 다시 생성했습니다. 모델 기반 검사를 통해 문제가 있는 트레이스를 걸러냈습니다. 그 결과 SFT 체크포인트는 뛰어난 성능과 개선된 동작을 보여줍니다.

Grok 4.6은 지식 노동, 일반 코딩, 커널 최적화, 웹 개발, 컴퓨터 지원 설계 등의 도메인별 환경을 포함한 광범위한 에이전트 기반 RL 작업으로 학습되었습니다.

야심 찬 아이디어를 실제로 작동하는 프로젝트로 구현하기

Grok 4.6의 범위와 여러 단계에 걸쳐 작업을 지속하는 능력을 시험하기 위해 설계된 프로젝트에서 모델을 테스트했습니다. 이 모델은 폭넓은 제품 아이디어를 작동하는 첫 번째 버전으로 구현하는 데 특히 뛰어났습니다. 익숙하지 않은 분야를 조사하고, 애플리케이션을 구조화하며, 핵심 상호작용을 구현하고, 여러 차례의 피드백을 거쳐 결과를 계속 개선할 수 있습니다.

더 긴 트래젝터리에서는 다음 단계로 넘어가기 전에 자체 작업을 점검하는 등, 모델이 자체 테스트와 검증을 더 많이 수행하기 시작한 것도 확인했습니다.

Grok 4.6은 일반적으로 Grok 4.5에서 보았던 것보다 시각적이고 상호작용적인 프로젝트에서 더 강력한 첫 결과물을 만들어 냅니다. 구체적인 제품 아이디어가 주어지면 한 번의 작업으로 애플리케이션의 구조와 시각적 언어를 수립할 수 있습니다. 이로 인해 처음부터 상당한 수준의 결과물을 만든 뒤 반복적으로 개선하는 것이 좋은 결과를 가장 빠르게 얻는 방법인 프로젝트에 특히 유용해졌습니다.

안전 및 역량

Grok 4.6의 안전장치는 모델의 역량에 맞춰 개선 및 조정되었습니다.

당사의 안전 스택은 정당한 사용 사례 전반에서 유용성과 보안을 극대화하도록 설계되어, Grok 4.6이 취약점 패치, 엔지니어링 설계 주기 단축, AI 연구 지원 등의 도메인에서 유용하고 안전하게 활용될 수 있도록 합니다.

당사의 안전장치 평가 작업은 Grok 4.6의 확장된 역량을 반영합니다. 여기에는 역량 평가 및 안전장치 조정을 위한 역대 가장 폭넓은 배포 전 테스트 모음과 광범위한 배포 후 타사 테스트가 포함됩니다.

Grok 4.6 시작하기

Grok 4.6은 오늘부터 Cursor와 Grok Build에서 사용할 수 있습니다. SpaceXAI API뿐만 아니라 OpenRouter, Vercel, Cloudflare를 포함한 파트너를 통해서도 이용할 수 있습니다.

요금은 입력 토큰 100만 개당 6부터입니다. 빠른 변형은 두 배의 요금으로 제공됩니다.

첫 주 동안 Cursor와 Grok Build에서 2배의 사용량을 제공합니다.

분류: 조사

작성자: Cursor Team