모든 모델

VM0의 GPT 5.6 Sol. OpenAI의 최신 플래그십 추론 모델

OpenAI GPT-5.6 프리뷰 세대의 플래그십 등급. 에이전트형 코딩, 심층 추론, 긴 컴퓨터 사용 루프에서 OpenAI 진영 최강의 선택지입니다.

400K tokens · Text / Vision / Code · Prompt cache

GPT 5.6 Sol은 OpenAI GPT-5.6 프리뷰 세대의 최상위 등급으로, 심층 추론과 안정적인 도구 사용이 동시에 필요한 작업에 손을 뻗게 되는 모델입니다. 여러 단계의 에이전트 루프를 조율하고, 한 번에 성공해야 하는 코드 수정을 처리하며, 수많은 GUI 동작에 걸친 컴퓨터 사용 워크플로를 수행합니다.

공급사 정가는 100만 토큰당 $5 / $30이며 캐시된 입력은 100만당 $0.50입니다. VM0에서는 ×2 크레딧 등급, 즉 프런티어 플래그십 가격대에 위치합니다. 따라서 비용 효율적인 패턴은 GPT 5.6 Terra나 Claude Sonnet 4.6을 어디서나 기본값으로 유지하고 가장 어려운 단계만 Sol로 라우팅하는 것입니다. GPT-5.6은 현재 VM0에서 프리뷰 제품군이며, Sol이 정식 승격되기 전까지는 GPT-5.5가 기본 OpenAI 모델로 유지됩니다.

GPT 5.6 Sol란?

2026년 7월 프리뷰 (GPT-5.6 제품군의 최상위 등급) · GPT-5.6 제품군의 플래그십 등급으로, GPT 5.6 Terra와 GPT 5.6 Luna 위에 위치합니다. 에이전트형 코딩과 추론을 위한 OpenAI의 최신 프런티어 모델입니다.

GPT-5.6은 OpenAI의 최신 GPT 세대로, 2026년 7월에 단일 모델이 아닌 Sol, Terra, Luna의 3단계 제품군으로 공개되었습니다. Sol은 플래그십으로, OpenAI가 가장 어려운 에이전트형 코딩, 추론, 컴퓨터 사용 작업을 위해 배치한 등급입니다. 400K 토큰 컨텍스트 창과 reasoning_effort 파라미터는 GPT-5.5에서 그대로 이어지므로, 기존 Codex 에이전트를 재작성 없이 그대로 사용할 수 있습니다.

이전 플래그십인 GPT-5.5와 비교하면 Sol은 토큰당 더 많은 연산을 추론에 사용하며, OpenAI의 프리뷰 자료에 따르면 다중 파일 리팩터링에서 더 강력한 첫 시도 패치를 성공시키고, 긴 루프에서 잘못 라우팅되는 도구 호출이 더 적으며, 대학원 수준 과학 추론과 경시대회 수학에서 향상을 보입니다. 트레이드오프는 GPT-5.5와 동일한 정가(100만 토큰당 $5 / $30)와 VM0의 ×2 크레딧 배수를 공유한다는 점이며, 이 때문에 OpenAI는 Sol을 어디서나 쓰는 기본값이 아니라 플래너 또는 에스컬레이션 등급으로 규정합니다.

GPT-5.6은 프리뷰 제품군이므로 공개된 수치는 초기값이며 변할 것입니다. OpenAI는 프런티어 모델 전반에서 SWE-bench Verified의 학습 데이터 오염을 지적했으므로, 절대 점수는 방향성 지표로만 받아들이십시오. 지속적으로 의미 있는 신호는 구조화된 동작입니다. 도구 호출 정확도, 컴퓨터 사용 신뢰성, 첫 시도 패치 품질이며, 프리뷰 데이터는 이 모든 항목이 GPT-5.5 대비 향상되고 있음을 보여줍니다.

GPT 5.6 Sol의 주목할 점

대표적인 아키텍처 및 기능 특징.

GPT 5.6 Sol은 GPT-5 계열의 400K 토큰 컨텍스트 창을 유지하며, 전체 창에 걸쳐 표준 입력 가격으로 과금됩니다. reasoning_effort 파라미터를 지원하고, 캐시된 입력이 입력 요금의 10분의 1($0.50 / 1M)로 과금되는 프롬프트 캐싱에 캐시 쓰기 요금($6.25 / 1M)이 더해지며, codex CLI가 기본으로 사용하는 Responses API 표면을 지원합니다. 도구 사용, 구조화된 출력, 컴퓨터 사용은 GPT-5.5에서 이어집니다. 입력은 텍스트, 비전, 코드 전반에 걸쳐 멀티모달이며, 네이티브 이미지 생성은 없습니다(Images API 사용).

한눈에 보는 사양

제품군GPT-5.6 세대 (프리뷰)
모달리티Text, Vision, Code
언어영어 우선, 다국어 지원
프롬프트 캐싱Supported (OpenAI)
컨텍스트 창400K 토큰
최대 출력최대 128K 토큰
추론 강도Minimal / Low / Medium / High
공급사 정가100만당 입력 $5 / 출력 $30

GPT 5.6 Sol 벤치마크

OpenAI의 GPT-5.6 Sol 자료에서 나온 프리뷰 수치로, 공개된 GPT-5.5 수치와 대비해 표시했습니다. 모든 백분율은 방향성 지표로 받아들이십시오. 이 제품군은 프리뷰 단계이며 OpenAI는 프런티어 모델 전반에서 SWE-bench Verified의 학습 데이터 오염을 지적했습니다.

SWE-bench Verified프리뷰; 5.5의 ~82%에서 상승
~84%
Terminal-Bench 2.0프리뷰 도구 사용
~72%
AIME 2025 (no tools)프리뷰 경시대회 수학
~97%
GPQA Diamond프리뷰 대학원 과학
~90%
OSWorld (computer use)프리뷰
~77%
MMMU (multimodal)프리뷰
GPT-5.6 제품군 선두
Speedmedium 강도, 초기 추정치
~70 tokens/sec

GPT 5.6 Sol 가격

공급사 정가, 100만 토큰당.

입력$5.00
출력$30.00
캐시 읽기$0.50
캐시 쓰기$6.25

GPT 5.6 Sol는 실제로 어떻게 작동하는가

프로덕션 에이전트 실행에서 관찰된 동작.

도구 라우팅

GPT-5.6 제품군에서 잘못 라우팅되는 도구 호출 비율이 가장 낮습니다. GPT-5.5와의 격차는 어려운 엣지 케이스에서 드러납니다. 조건부 도구 선택, 깊게 중첩된 인수, 긴 추론 끝에 발송되는 도구 호출 등입니다.

첫 시도 코드 수정

제품군에서 가장 강력한 패치 품질. 에이전트가 계속 컴파일되고 테스트를 통과해야 하는 코드를 수정해야 할 때, 특히 패치가 여러 파일에 걸칠 때 알맞은 선택입니다. 프리뷰 SWE-bench Verified가 이를 직접 반영합니다.

컴퓨터 사용

여러 단계의 GUI 시퀀스에서 GPT-5.5보다 더 안정적이며, 이는 OSWorld 격차가 포착하는 부분입니다. 에이전트가 수십 단계에 걸쳐 브라우저나 데스크톱 앱을 조작하고 중간 이탈이 큰 비용을 초래할 때 선택하십시오.

속도

Terra보다 느리고 Luna보다 훨씬 느립니다. 초기 테스트에서 medium 강도 기준 약 70 tokens/sec입니다. 추가적인 추론 깊이가 진정으로 필요한 단계에만 남겨두고, 더 가벼운 등급을 병렬로 실행하십시오.

환각 동작

Sol은 GPT-5 계열의 더 엄격한 보정을 이어받아, 그럴듯하게 지어내기보다 불확실성을 인정하는 경향이 있습니다. 이것이 저렴한 모델들이 벤치마크에서 따라잡더라도 팀들이 고위험 추론에 프리미엄을 계속 지불하는 이유입니다.

GPT 5.6 Sol에 가장 적합한 에이전트 작업

다중 도구 계획을 실행하는 오케스트레이터

Sol을 플래너로 사용해 요청을 10개 단계로 분해하고, 각 단계를 Terra 또는 Luna 등급 서브 에이전트에게 분배한 뒤 결과를 다시 엮으십시오. 플래너 계층에서만 Sol을 실행하면 처음부터 끝까지 실행하는 비용의 일부만 들면서도 품질 대부분을 보존합니다.

CI 실행을 낭비하지 않는 첫 시도 코드 수정

Sol에게 50개 파일 코드베이스를 한 ORM에서 다른 ORM으로 마이그레이션하거나, 얽힌 모듈을 리팩터링하거나, 저장소 전반에 보안 수정을 적용하도록 맡기십시오. 패치가 첫 시도에 깔끔하게 적용되는 빈도가 제품군의 다른 어떤 등급보다 높으며, 이는 바로 CI 청구서에 반영됩니다.

워크플로를 끝까지 완수해야 하는 컴퓨터 사용 에이전트

에이전트가 여러 단계의 예약 흐름, 데스크톱 앱, 레거시 관리자 UI를 통해 브라우저를 조작할 때, Sol의 더 높은 OSWorld 점수는 중간 이탈과 사람 개입을 줄여줍니다.

어려운 수학·과학 연구 단계

경시대회 수준 수학 문제나 대학원 물리학 유도를 넣으면 Sol은 가벼운 등급에서 보이는 한 끗 차이 실수 없이 풀어냅니다. AIME 2025와 GPQA Diamond가 바로 이 동작을 포착합니다.

GPT 5.6 Sol를 건너뛰어야 할 때

GPT 5.6 Terra가 절반의 크레딧 비용으로 동일한 품질 기준을 충족하는 대량 일상 작업, GPT 5.6 Luna가 훨씬 빠른 지연 민감 채팅 응답, 그리고 Luna가 더 저렴한 지원 옵션인 대량 분류·추출 작업에서는 Sol을 사용하지 마십시오.

GPT 5.6 Sol vs 다른 모델

GPT 5.6 Sol vs GPT 5.6 Terra

Terra는 GPT-5.6 제품군의 균형 잡힌 일꾼이며 대부분의 에이전트에 알맞은 선택입니다. Terra가 어려운 추론, 긴 에이전트 루프, 첫 시도 코드 수정에서 눈에 띄게 실패할 때만 Sol로 승격하십시오. 보통은 Terra와 Luna에게 아래로 위임하는 오케스트레이터 역할입니다.

GPT 5.6 Sol vs GPT-5.5

같은 역할, 더 새로운 세대. Sol은 동일한 정가와 크레딧 등급에서 GPT-5.5의 프리뷰 후속작이며, 에이전트형 코딩과 컴퓨터 사용에서 더 강력한 프리뷰 점수를 보입니다. GPT-5.6이 프리뷰를 졸업하기 전까지는 GPT-5.5가 VM0의 기본 OpenAI 모델로 유지됩니다. 최신 추론 깊이가 필요할 때 Sol을 선택하십시오.

GPT 5.6 Sol vs Claude Opus 4.8

서로 다른 제품군의 동급 플래그십으로, 저렴한 등급이 실패할 때 에스컬레이션하는 고위험 오케스트레이터입니다. Opus 4.8은 1M 토큰 컨텍스트 창과 Anthropic의 안전성 프로필을 갖추고, Sol은 Codex 생태계와 OpenAI의 컴퓨터 사용 점수를 갖추고 있습니다. 기존 에이전트가 어떤 프레임워크를 대상으로 하는지에 따라 선택하십시오.

결론: GPT 5.6 Sol를 사용해야 할까?

GPT 5.6 Sol은 OpenAI 진영의 최신 에스컬레이션 등급입니다. Terra를 기본으로 하고, Terra가 눈에 띄게 부족한 특정 단계에서만 Sol로 승격하십시오. 프리뷰 점수는 계속 변할 것입니다.

자주 묻는 질문

GPT 5.6 Sol의 컨텍스트 창은 얼마인가요?

400,000 토큰이며, 응답당 최대 128K 토큰까지 출력할 수 있습니다. 전체 창은 표준 요율로 과금됩니다.

GPT-5.6은 VM0에서 정식 출시되었나요?

프리뷰 단계입니다. Sol, Terra, Luna 세 등급 모두 선택 가능하지만, GPT-5.6 제품군이 정식 승격되기 전까지는 GPT-5.5가 기본 OpenAI 모델로 유지됩니다. 프리뷰 벤치마크 수치는 초기값이며 변할 것입니다.

언제 GPT 5.6 Terra 대신 Sol을 선택해야 하나요?

(a) 에이전트가 플래너이고 결정이 연쇄적으로 파급될 때, (b) 실행이 충분히 길어 Terra가 도구 호출을 잘못 라우팅하기 시작할 때, (c) 출력이 첫 시도에 깔끔하게 적용되어야 할 때(코드 수정, 구조화된 페이로드, 컴퓨터 사용 워크플로)입니다.

GPT 5.6 Sol은 프롬프트 캐싱을 지원하나요?

예. 캐시된 입력은 100만 토큰당 $0.50로 과금되어 캐시된 부분에 10배 할인이 적용되며, 캐시 쓰기 요금은 100만당 $6.25입니다. 시스템 프롬프트나 도구 스키마가 호출 간에 안정적일 때마다 사용할 가치가 있습니다.

GPT 5.6 Sol은 VM0에서 어떤 프레임워크를 사용하나요?

Codex입니다. VM0는 GPT-5.6을 Codex 프레임워크의 Responses API 표면을 통해 라우팅하며, 이는 codex CLI가 기본으로 사용하는 것입니다. Claude Code 프레임워크 에이전트는 VM0에서 GPT-5 모델과 호환되지 않습니다.

대안

VM0에서 GPT 5.6 Sol 사용하기

VM0에서 GPT 5.6 Sol에 접근하는 두 가지 방법

VM0는 GPT 5.6 Sol를 VM0 크레딧으로 과금되는 Built-in 모델로 지원하며, OpenAI API key를 사용하는 BYO(직접 키 사용) 방식으로도 지원합니다. Built-in 경로는 VM0 Managed 라우팅과 아래에서 설명하는 크레딧 배수를 사용하고, BYO 경로는 상위 공급사가 직접 과금하며 VM0 크레딧 변환을 완전히 건너뜁니다.

VM0의 추천

VM0는 GPT 5.6 Sol를 핵심 에이전트 모델로 자리매김하며, 에이전트 실행의 실제 결과를 좌우하는 단계에서 Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 4.6와 함께 추천합니다. 이 모델들은 오케스트레이터 역할, 코드를 다루는 에이전트, 그리고 오답의 대가가 큰 모든 단계에 우리가 선택할 모델입니다.

크레딧과 ×2 배수

VM0의 모든 Built-in 모델은 ×1 크레딧 기준점에 위치한 Claude Sonnet 4.6의 배수로 가격이 책정됩니다. GPT 5.6 Sol는 ×2 크레딧으로 과금됩니다. 이 배수는 VM0 청구서에 표시되는 값이며, 위 가격표의 공급사 정가는 VM0가 이를 크레딧으로 변환하기 전에 상위 공급사가 부과하는 금액입니다.

GPT 5.6 Sol는 ×2로 과금되며, 이는 여기서의 한 단계가 Sonnet 4.6(×1 기준점)에서의 동일한 단계 대비 2배의 크레딧이 든다는 뜻입니다. VM0에서 프리미엄 등급이므로, 비용 효율적인 패턴은 더 저렴한 모델을 기본으로 사용하고 추가적인 추론 깊이가 정말로 필요한 단계만 GPT 5.6 Sol로 라우팅하는 것입니다.

July 2026 (preview)부터 VM0에서 사용 가능.