xAI가 Grok 4.6을 공개함. Cursor와 Grok Build에서 당일부터 사용 가능하며, 첫 주 동안 두 서비스의 포함 사용량을 2배로 제공함 아홉 개 벤치마크를 합산한 Artificial Analysis Intelligence Index에서 GPT-5.6 Sol과 동률을 기록했다고 밝힘. 지수 값은 61이며, CursorBench와 FrontierCode, AA-Briefcase에서는 앞서지만 DeepSWE와 Terminal-Bench에서는 여전히 뒤진다는 관측이 나옴 가격은 입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러이고 두 배 가격의 fast 변형이 별도로 있음 학습 방식 Grok 4.5보다 긴 보충 학습(supplemental training) 과정을 거쳤고, 추론과 고급 기술 개념을 다루는 모델 생성 데이터, 고품질 엔지니어링 데이터, 개선된 옵티마이저와 학습 레시피를 함께 적용함 이후 Grok 4.5를 사용해 SFT 궤적을 재생성했음. 추론 강도, 에이전트 하네스, STEM과 소프트웨어 엔지니어링, 지식 노동 등 도메인 전반에 걸쳐 생성한 뒤 문제 있는 궤적은 모델 기반 검사로 걸러냄 에이전트 RL 과제는 지식 노동과 일반 코딩 외에 커널 최적화, 웹 개발, CAD 같은 도메인별 환경을 포함함 외부 보도에 따르면 기반 모델은 Grok 4.5와 같은 1.5조 파라미터 V9이며, 개선분은 사전학습 규모가 아니라 사후학습에서 나옴. 2.1조 파라미터의 Grok 4.7이 몇 주 뒤 나올 예정 실사용 관찰 xAI는 여러 단계에 걸쳐 작업을 지속하는 능력을 시험하는 프로젝트로 모델을 평가했고, 넓은 제품 아이디어를 동작하는 초기 버전으로 옮기는 작업에 특히 강했다고 설명함. 낯선 도메인을 조사하고 애플리케이션의 뼈대를 잡은 뒤 핵심 상호작용을 구현하고 여러 차례 피드백을 거쳐 다듬는 흐름을 수행함 긴 궤적에서는 다음 단계로 넘어가기 전에 스스로 결과를 확인하는 자체 테스트와 검증 행동이 더 자주 관찰됐다고 밝힘 참고 공개된 벤치마크 비교는 AA Intelligence, GDPVal-AA, DeepSWE 1.1, CursorBench 3.2, FrontierCode 1.1 다섯 개 항목이고, 경쟁 모델 수치는 각 개발사가 공개한 시스템 카드나 리더보드에서 가져왔다고 표기함 모두 회사가 자체 보고한 결과라는 점은 감안할 필요가 있음. 다만 Grok 4.5 대비 개선 폭은 공개된 거의 모든 평...
Grok 4.6 공개, 파라미터 확장 대신 사후학습에 투자한 모델
1 month ago
34
Related
Show GN: 추천링크·UTM으로 오프라인 소개의 성과를 추적하는 구조
58 minutes ago
2
소프트웨어 팩토리 패턴 시도하기
1 hour ago
2
Show GN: 웹 변경 모니터링하는 크롬 확장프로그램
2 hours ago
3
OpenAI, 확률·선택지·점수를 반환하는 Decisions API 공개 베타 시작
2 hours ago
3
제프리 카첸버그 - 세상이 바뀌고 있다: 창의성을 위한 AI
2 hours ago
3
이 모든 것이 지나간 뒤를 위한 지속 가능한 웹 커리어
2 hours ago
3
여러 팀의 시스템을 이해하기 위한 AI 집단 지성 구축하기
2 hours ago
3
Tips
click
Popular
프로들도 줄지어 샷 점검… KLPGA 스타 사랑방 된 더헤븐CC 연습장
2 weeks ago
73
iOS 27, iPadOS 27, macOS 27
3 weeks ago
69
손흥민 선제골 발판·골대 불운…LAFC, 7경기 만에 승리
3 weeks ago
65
영림원소프트랩, 나람 통합 ERP 구축…사료 제조·물류·회계 데이터 하나로
2 weeks ago
62
'이 악문' 김영범, 자유형 50m '대회 신기록' 금메달
2 weeks ago
55
© Clint IT 2026. All rights are reserved









English (US) ·