2026년 7월 9일, OpenAI가 차세대 모델 패밀리 GPT-5.6을 정식 공개했습니다. 이번엔 하나의 모델이 아니라 Sol(태양), Terra(대지), Luna(달)이라는 이름의 3단계 라인업으로 나왔다는 게 특징입니다. 무슨 뜻인지, 왜 화제인지 쉽게 정리해드릴게요.
한 줄 요약
> OpenAI가 만든 차세대 AI 모델 패밀리로, 용도와 예산에 맞춰 고를 수 있게 Sol/Terra/Luna 3개 등급으로 출시됐습니다.
예정보다 늦어진 공개 배경
원래 6월 공개 예정이었지만, 미국 정부의 심사 절차 때문에 6월 26일엔 일부 “신뢰할 수 있는 파트너”에게만 제한 공개됐습니다. 예상보다 심사가 빨리 끝나면서 OpenAI는 7월 8일 정식 발표를 통해 7월 9일부터 ChatGPT, Codex, API 전반에 일반 공개한다고 밝혔습니다.
핵심 스펙 한눈에 보기
| 등급 | 성격 | 입력 가격(100만 토큰당) | 출력 가격(100만 토큰당) |
|---|---|---|---|
| Sol | 플래그십, 복잡한 추론·코딩·에이전트 작업용 | $5 | $30 |
| Terra | 균형형, 일상적 코딩·추론용 (Sol 대비 약 절반 가격) | $2.5 | $15 |
| Luna | 초경량·초저가, 대용량·저지연 작업용 | $1 | $6 |
Sol 위에는 더 깊게 사고하는 Sol Ultra 고강도 모드도 있습니다.
성능: 벤치마크 근소 우위
Terminal-Bench 2.1(에이전트형 코딩 벤치마크) 기준:
- Sol Ultra: 91.9%
- Sol: 88.8%
- Claude Mythos 5: 88.0%
- GPT-5.5: 88.0%
기존 최고 모델들과 거의 붙던 격차를 근소하게 벌린 수준입니다. OpenAI는 Sol을 “지금까지 나온 코딩 모델 중 최고”라고 자평하고 있고, 특히 보안 분야(위협 모델링, 코드 리뷰, 패치, 블루팀 방어)에서 “역대 가장 강력한 사이버보안 모델”이라고 강조하고 있습니다.
3단계로 나눈 이유
기존엔 “이 작업에 최고 모델을 쓸까, 저가 모델을 쓸까”를 사용자가 직접 고민해야 했는데, GPT-5.6은 처음부터 용도별로 등급을 나눠 놓은 게 특징입니다.
- 정확도가 비용보다 중요한 작업 → Sol (또는 Sol Ultra)
- 일상적인 코딩·추론, 비용도 신경 써야 하는 작업 → Terra
- 대량 처리·응답속도가 중요한 단순 작업 → Luna
작업 성격에 맞춰 비용을 최적화하도록 설계된 라인업입니다.
이용 가능한 곳
7월 9일부터 ChatGPT, Codex, OpenAI API에서 순차 공개됐고, OpenRouter 등 API 게이트웨이에서도 Terra 등급 기준 가격/벤치마크가 노출되고 있습니다. 다만 Sol의 API 일반공개는 이 글 작성 시점 기준 아직 순차 확대 중이라, 지역/계정별로 접근 시점이 다를 수 있습니다.
GPT-5.6 vs 다른 모델 비교
| 모델 | 개발사 | 코딩 벤치마크(Terminal-Bench 2.1) | 특징 |
|---|---|---|---|
| GPT-5.6 Sol | OpenAI | 88.8% (Ultra 91.9%) | 코딩+에이전트+사이버보안 특화 |
| Claude Mythos 5 | Anthropic | 88.0% | 근소한 차이로 2위권 |
| GPT-5.5 | OpenAI | 88.0% | 전작, Sol의 성능 기준선 |
| GLM-5.2 | Zhipu AI | 비공개(별도 지표 기준 3위권) | 오픈소스·무료(별도 글 참고) |
이런 분들께 추천드려요
- 개발자: 복잡한 리팩터링·장시간 에이전트 작업엔 Sol, 일상 코딩엔 Terra로 비용 절감
- 보안 담당자: 위협 모델링·코드 리뷰 자동화에 Sol의 보안 특화 기능 활용
- 대량 처리가 필요한 서비스: 챗봇 응대, 분류 작업 등엔 Luna로 단가 최소화
- 예산이 빠듯한 개인/스타트업: Terra가 Sol 대비 절반 가격에 준수한 성능
주의할 점
- 정부 심사 절차로 출시가 지연됐던 사례처럼, 지역에 따라 접근 시점·기능 범위가 다를 수 있습니다.
- Sol의 API 전면 개방은 아직 진행 중이라, 실제 사용 전 OpenAI 공식 문서에서 현재 접근 가능 여부를 확인하는 게 안전합니다.
- 가격은 등급별 표준 요금 기준이며, 실제 청구 방식(캐싱, 배치 처리 할인 등)은 별도 확인이 필요합니다.
정리
GPT-5.6의 핵심은 Sol/Terra/Luna로 나뉜 용도별 라인업입니다. 코딩·에이전트·보안 성능에서 근소하게나마 최상위권을 유지하면서, 가격대별 선택지를 넓힌 점이 눈에 띕니다.
AI 도구를 고를 때는 작업 성격에 맞는 등급을 고르면 Sol 하나만 쓸 때보다 비용을 크게 줄일 수 있습니다.