← 홈으로

AI

OpenAI, GPT-5.6 'Sol·Terra·Luna' 정식 출시… 멀티에이전트 'Ultra'로 '토큰당 성능' 강조

2026년 7월 10일

OpenAI가 GPT-5.6 Sol·Terra·Luna 3종을 일반 출시했다. 이번 세대의 화두는 토큰당 성능과 비용 효율이다.

OpenAI, GPT-5.6 3종 정식 출시… ‘토큰당 성능’ 앞세워

OpenAI가 차세대 언어모델 ‘GPT-5.6’을 일반 출시(GA)했다. 6월 26일 제한 프리뷰로 처음 공개한 뒤 7월 9일 ChatGPT·Codex·API 전반으로 확대했으며, 글로벌 롤아웃은 출시 후 약 24시간에 걸쳐 순차 진행된다.

제한 프리뷰는 미국 정부와의 협력에 따른 한시적 조치였다. OpenAI에 따르면 사이버보안 행정명령 이행 체계를 정부와 함께 마련하는 과정에서 출시 계획과 모델 성능을 사전 공유했고, 정부 요청으로 신뢰할 수 있는 소수 파트너부터 먼저 제공했다고 알렸다. OpenAI는 “이런 정부 대상 사전 공유가 장기 표준이 돼서는 안 된다”고 밝혔다. 일반 출시에 앞서서는 외부 전문가와 함께 자사 역사상 가장 광범위한 안전성 평가와 레드팀 테스트를 거쳤다고 전했다.

GPT-5.6은 태양(Sol)·지구(Terra)·달(Luna)에서 이름을 딴 3종으로 나뉜다. OpenAI에 따르면 모델 버전 5.6은 모델의 세대를, 세 이름은 각자의 속도로 발전하는 ‘성능 등급(capability tier)‘을 뜻한다고 설명했다. 이번 세대의 핵심 메시지는 ‘토큰당 성능’, 즉 지출 대비 효율이다. 같은 비용으로 더 많은 일을 하거나, 같은 결과를 더 낮은 비용으로 내겠다는 것이다.

용도별 3종 — Luna·Terra·Sol

가장 가벼운 쪽부터 Luna, Terra, Sol 순이다.

모델성격주 용도
Luna가장 빠르고 저렴일상 대화, 빠른 초안, 반복 업무
Terra균형형범용 작업 — 전작 GPT-5.5급 성능을 더 낮은 비용에
Sol플래그십고난도 추론·코딩·리서치·컴퓨터 사용·에이전트

OpenAI에 따르면 Terra는 GPT-5.5와 대등한 성능을 절반 수준 비용에 제공하고, Luna는 가장 빠르고 저렴하다고 소개했다. 최상위 Sol은 코딩·지식노동·사이버보안·과학 전반에서 최고 수준(SOTA) 결과를 더 적은 토큰으로 낸다는 설명이다.

주요 신기능 — 멀티에이전트 ‘Ultra’

이번 세대의 핵심 기능은 Sol의 최고 성능 설정 ‘Ultra(울트라)‘다. 여러 AI 에이전트를 병렬로 조율해 복잡한 과제를 더 빨리 처리하는 방식이며, 기본값은 4개 에이전트로 동작한다. 일부 평가에서는 16개까지 늘린 구성도 공개됐다. OpenAI는 Ultra를 “효율 기능이 아니라, 더 쓰고 더 얻는(spend-more-to-get-more) 설정”이라고 설명했다. 토큰을 더 쓰는 대신 품질과 속도를 끌어올리는 방식이다.

BrowseComp 멀티에이전트 성능 — GPT-5.6 Sol의 1·4·16개 에이전트 구성별 점수와 지연시간 비교병렬 에이전트 수에 따른 BrowseComp 점수·소요시간 변화. 에이전트를 늘릴수록 더 빠르고 높은 점수에 도달한다. (출처: OpenAI)

그 밖의 신규·강화 기능은 다음과 같다.

  • maxxhigh보다도 더 많은 시간을 들여 추론·검증·재시도하는 최고 추론 강도
  • Sol Pro — 어렵고 오래 걸리는 작업을 위한 ChatGPT 내 최고 품질 옵션
  • PTC(Programmatic Tool Calling) — 도구 호출 프로그램을 메모리 내에서 직접 실행해 중간 결과를 걸러내는 기능(Responses API, ZDR 호환)
  • 프롬프트 캐싱 개선 — 캐시 지점(breakpoint) 명시 지원, 최소 30분 유지. 캐시 쓰기는 입력 단가의 1.25배, 읽기는 90% 할인

가격 — 프리뷰와 동일

API 가격은 프리뷰 때와 같다. 100만 토큰(1M) 기준이다.

모델입력 (1M)출력 (1M)
Sol$5$30
Terra$2.50$15
Luna$1$6

제공 범위

  • ChatGPT(일반 대화) — 빠른 기본 응답은 기존 ‘GPT-5.5 Instant’가 담당한다. 추론이 필요한 Medium·High·Extra High 옵션은 Sol이, 최상위 Pro 옵션은 Sol Pro가 맡는다. Plus는 Medium·High까지, Pro·Business·Enterprise는 전 옵션을 쓰며, Free·Go는 제외다. Terra·Luna는 일반 대화창에서 선택되지 않는다.
  • ChatGPT Work·Codex — Sol·Terra·Luna를 요금제별로 제공하며, Codex는 Free·Go에도 Terra를 지원한다. max는 접근 가능한 모든 사용자가, Ultra는 Work에서는 Pro·Enterprise, Codex에서는 Plus 이상이 쓸 수 있다.
  • API — Sol·Terra·Luna를 모두 제공한다. 멀티에이전트는 Responses API의 베타로, 한 요청에서 여러 서브에이전트를 병렬 실행한다.

성능·경쟁 구도

OpenAI 공개 자료에 따르면 Sol은 터미널·코딩 평가 Terminal-Bench 2.1에서 88.8%를, Ultra 설정에서는 91.9%를 기록했다고 밝혔다. Terra는 87.4%, Luna는 84.7%로 전작 GPT-5.5(85.6%)와 비슷하거나 앞섰다. 브라우징 평가 BrowseComp에서는 Sol이 Ultra 기준 최고 92.2%로 최고 수준(SOTA)을 기록했다.

Artificial Analysis Coding Agent Index — GPT-5.6 Sol·Terra·Luna와 GPT-5.5, Claude, Gemini의 점수 대비 API 비용 비교코딩 에이전트 지수(Artificial Analysis Coding Agent Index)의 점수 대비 API 비용. GPT-5.6 계열이 같은 점수를 더 낮은 비용에 달성하는 구간이 뚜렷하다. (출처: OpenAI)

다만 경쟁이 팽팽한 지점도 있다. 광범위한 지능을 재는 Artificial Analysis Intelligence Index에서 Sol은 58.9로, 앤트로픽 ‘Claude Fable 5’(59.9)에 근소하게 뒤졌다. OpenAI는 대신 Sol이 같은 과제를 61% 더 짧은 시간에 절반가량의 비용으로 처리한다고 강조했다. 일부 소프트웨어 엔지니어링 벤치마크에서는 앤트로픽 상위 모델이 더 높은 점수를 냈다. 최상위 성능 경쟁은 ‘절대 성능’과 ‘비용 효율’ 두 축에서 진행 중인 셈이다.

안전성

OpenAI는 GPT-5.6이 생물학·사이버보안 능력에서 이전 모델보다 강력하지만 자사 기준 ‘심각(Critical)’ 임계치는 넘지 않았다고 밝혔다. 일반 출시 전에는 약 70만 A100e GPU 시간 규모의 자동 레드팀 검증을 거쳤으며, 사이버보안 등 고위험 기능은 신원 확인을 거친 ‘Trusted Access’ 대상자에게만 확대 제공한다고 덧붙였다.

종합

OpenAI는 GPT-5.6을 단일 모델로 발전시키는 대신 용도별 3종으로 나누고, 최상위 구간에 멀티에이전트 Ultra를 얹었다. 성능 등급을 모델 버전과 분리한 네이밍도 같은 전략이다. 절대 성능에서는 경쟁 모델과 접전이지만, 승부처를 비용 효율에 뒀다. 이용자는 작업의 난이도와 예산에 맞춰 Luna·Terra·Sol을 선택하면 된다.

한편 OpenAI는 7월 8일 새 모델 ‘GPT-Live’를 공개했으며, GPT-5.6은 마이크로소프트 365 코파일럿의 기본(preferred) 모델로도 채택됐다고 발표했다.

본 기사는 OpenAI 공식 발표(GPT-5.6 제품 페이지·ChatGPT 헬프센터)와 외신·업계 매체 보도를 종합해 작성했다.

자주 묻는 질문

  • GPT-5.6은 언제 출시됐나?

    2026년 6월 26일 제한 프리뷰로 처음 공개된 뒤, 7월 9일 ChatGPT·Codex·API에 일반 출시(GA)됐다. 글로벌 롤아웃은 약 24시간에 걸쳐 순차 진행된다.

  • Sol·Terra·Luna는 무엇이 다른가?

    Sol은 고난도 추론·코딩·에이전트용 플래그십, Terra는 GPT-5.5급 성능을 더 낮은 비용에 제공하는 균형형, Luna는 가장 빠르고 저렴한 모델이다. 모델 버전 5.6은 모델의 세대를, 세 이름은 각자의 속도로 발전하는 성능 등급을 뜻한다.

  • GPT-5.6 API 가격은 얼마인가?

    100만 토큰 기준 Sol은 입력 $5·출력 $30, Terra는 $2.50·$15, Luna는 $1·$6이다. 프리뷰 때 가격과 동일하다.

  • 'Ultra' 모드는 무엇인가?

    Sol의 최고 성능 설정으로, 기본값 4개(최대 16개) 에이전트를 병렬로 조율해 복잡한 작업을 더 빨리 끝낸다. 토큰을 더 쓰는 대신 품질과 속도를 높이는 '더 쓰고 더 얻는' 방식이다.

  • 기존 GPT-5.5와 무엇이 달라졌나?

    OpenAI는 '토큰당 성능'과 비용 효율을 앞세웠다. 같은 결과를 더 적은 토큰·비용으로 내며, 최고 추론 수준 max·멀티에이전트 Ultra·Programmatic Tool Calling(PTC) 등이 새로 추가됐다.