- GPT-6 Astra는 OpenAI가 2026년 9월 3일 공개한 플래그십 추론 모델이다. 가장 어려운 엔드투엔드 작업용: 복잡한 추론, 코딩, Computer Use, 조사, 긴 문서
- API 모델 ID는
gpt-6-astra, 9월 4일 투입. 표준가는 입력 $10 / 출력 $50(100만 token당). 무료 API 티어는 미지원 - ChatGPT Plus는 일반 Chat 선택기에 Astra를 주지 않는다. 입구는 Work와 Codex. 표준 Chat의 GPT-6 Pro는 Pro / Business / Enterprise용
- GPT-5.6 Sol보다 약 2.5배 비싸다. 일상 루프는 Sol을 유지하고, 난제·장시간 에이전트·Computer Use에서 승급한다. 장거리 작업에는 끊기지 않는 Cloud Mac이 필요하다
OpenAI는 2026년 9월 3일 GPT-6 Astra를 발표하고, 다음 날 API 모델 gpt-6-astra를 개발자 문서에 넣었다. 공식 한 문장은 「가장 강한 모델을, 가장 어려운 엔드투엔드 작업을 위해 만들었다」이다. 개발자가 진짜 물어야 하는 것은 슬로건이 아니라 GPT-5.6 Sol과 무엇이 다른지, 얼마인지, ChatGPT 어느 입구에서 고를 수 있는지, 기본 라우트를 바꿔야 하는지다.
이 글은 OpenAI 모델 페이지, 가격 페이지, ChatGPT 헬프 센터를 따른다. 가격과 입구는 2026년 9월 8일 공개 문서가 기준이다. 단계 공개 중에는 제품 안 모델 선택기가 기준이다.
GPT-6 Astra란
GPT-6 Astra는 OpenAI가 지금 공개한 가장 강한 텍스트 플래그십이며, 「더 부드럽게 잡담하는」 또 다른 채팅 모델이 아니다. 문서는 이를 가장 어려운 엔드투엔드 작업에 둔다: 복잡한 추론, 소프트웨어 공학, Computer Use, 조사, 문서 작성. 입력은 텍스트와 이미지, 출력은 텍스트. 오디오와 비디오는 이 모델 모달리티에 없다.
한 단계 아래 GPT-5.6 Sol과의 차이는 작업 시간과 도구 폐루프에서 난다. 저장소 규모 코딩, 데스크톱 조작, 검색과 쓰기를 한 번의 요청으로 잇도록 설계되었고, 2분마다 「계속」을 누르는 전제가 아니다. 이는 Claude Fable 5가 장시간 Agent를 전면에 올린 것과 같은 산업 선이다——경쟁은 「한 번의 답」에서 「무인으로 일을 끝내는 것」으로 옮겼다.
지식 컷오프는 공식으로 2026년 4월 30일이다. 새 사실이 필요하면 Web search 등 도구를 쓰고, 5월 이후 세상을 안다고 가정하지 마라.
출시일과 투입 리듬
| 날짜(2026) | 무엇이 일어났나 | 무엇을 쓸 수 있나 |
|---|---|---|
| 9월 3일 | OpenAI가 GPT-6 Astra를 발표 | Daybreak 신뢰 기업이 먼저 본다. 헬프 센터는 「며칠 안」에 유료 플랜으로 확대한다고 동기화 |
| 9월 4일 | API 모델 gpt-6-astra 투입 |
유료 API 계정은 호출 가능. 무료 티어는 명확히 미지원 |
| 9월 4일부터 | ChatGPT Plus / Business가 Work, Codex에서 단계 투입 | 일반 Chat 선택기는 Plus에게 여전히 Astra 주 입구가 아니다 |
| 작성일(9월 8일) | 단계 공개가 계속 진행 중 | 같은 계정도 서피스마다 어긋날 수 있다. Enterprise는 기본 꺼짐 |
OpenAI는 이후 Azure와 AWS Bedrock을 통한 제공도 언급했다. 클라우드 마켓 항목이 나오기 전에 프로덕션 라우트에 이 ID를 미리 박지 마라. Codex 쪽은 「여러 컨텍스트 창을 건너며 메모」하는 실험을 동기화한다. 긴 세션을 매번 요약 한 장으로 누르지 않고, 옛 창도 검색할 수 있다. 코딩 장거리의 제품 신호이지 SLA가 아니다.
기능: 추론 단계, 도구, Computer Use
Astra의 능력 목록은 세 층으로 누를 수 있다. 더 깊게 생각하고, 도구를 쓰고, 긴 컨텍스트를 버틴다.
- 추론 단계:
reasoning.effort는low,medium,high,xhigh,max를 지원한다. 게이트웨이 기본은 흔히low. 난제에서 올리고, 모든 요청을max로 열지 마라. - 사양: 약 105만 token 컨텍스트, 최대 12.8만 출력 token. 초장 프롬프트는 다음 절의 할증 규칙을 탄다.
- 구조화: 스트리밍, 함수 호출, Structured Outputs 사용 가능. 파인튜닝은 미지원.
- Responses API 도구: Web search, File search, 이미지 생성, Code interpreter, Hosted shell, Apply patch, Skills, Computer Use, MCP, Tool search.
iOS / macOS 개발자에게 진짜 새로운 점은 Computer Use + Hosted shell + Apply patch가 한 세션에서 파일을 고치고, 명령을 돌리고, 결과를 볼 수 있다는 것이다. 모델이 세지면 병목은 바로 실행 환경이 중간에 잠들지 않는지가 된다——노트북을 닫으면 Agent는 끊긴다.
OpenAI가 공개한 일부 자체 보고 점수(제3자 통일 재검증 없음): Terminal-Bench 4 약 57.7, DeepSWE 약 74.1, GPQA 약 96.0, BrowseComp 약 91.5. 「방향 신호」로 쓰고 계약 검수 조항에 넣지 마라. Anthropic 쪽 코딩 도구 순위와 같다. benchmark는 「더 어려운 저장소를 씹을 수 있다」만 말하고, 당신의 monorepo가 하룻밤에 머지된다는 보장은 아니다.
GPT-5.6, GPT-6 Pro와의 대응
9월 물결에서 가장 섞이기 쉬운 것은 이름이다. Astra는 하층 플래그십. GPT-6 Pro는 Chat 서피스의 제품 이름.
| 화면에서 보이는 것 | 실제 모델 | 누가 쓰나 |
|---|---|---|
| GPT-6 Astra | 플래그십 본체 | API. ChatGPT Work / Codex(유료 플랜 단계 투입 중) |
| GPT-6 Pro | Astra가 구동하는 Chat 상위 | Pro, Business, Enterprise의 표준 Chat |
| GPT-5.6 Sol | 한 단계 아래 일꾼 | 유료 Chat 기본. API에서는 여전히 고빈도 주력 |
| GPT-5.6 Terra / Luna | 중위 / 경량 | Work, Codex, API. 일반 Chat에서는 보통 고를 수 없다. 무료와 Go는 Luna가 흔하다 |
Plus 사용자가 일반 대화창에서 Astra를 못 찾는 것은 「미개방」과 같지 않다. OpenAI는 Plus의 Astra를 Work(일하기)와 Codex(코드 쓰기)에 두고, 표준 Chat의 GPT-6 Pro를 더 높은 플랜에 남겼다. Enterprise 작업 공간은 기본 꺼짐이며, 관리자가 모델 권한을 연다.
API: 모델 ID, 엔드포인트, 호출 요점
설정에 쓸 안정 ID는 gpt-6-astra다. 스냅샷 별칭도 지금은 같은 문자열을 가리킨다. 버전을 잠글 때는 모델 페이지 Snapshots 표를 보고, 날짜 접미사를 스스로 만들지 마라.
문서가 적은 주 엔드포인트는 Chat Completions(v1/chat/completions)와 Responses(v1/responses). 도구 폐루프, Computer Use, MCP는 Responses. 무료 티어 RPM/TPM은 「미지원」. Tier 1부터 한도가 생기고 사용량 티어에 따라 오른다.
model을 gpt-6-astra로 쓰고 reasoning.effort로 생각 깊이를 제어한다. 기본 low로 라우트를 탐지하고, 작업이 값어치 있으면 high / xhigh로 올린다. 검색, Computer Use 등 도구는 회차마다 따로 계산한다. token 단가만 보지 마라.
const response = await client.responses.create({
model: "gpt-6-astra",
reasoning: { effort: "high" },
input: "저장소에서 결제 타임아웃을 찾아 최소 수정 diff와 검증 명령을 제시하라."
});
프로덕션 제안: Sol을 기본 루프, Astra를 승급. 평가 점수나 사람 표본으로 발화하고, 사용자 한 마디로 max를 가득 채우지 마라. 모델을 바꿀 때는 같은 harness——이는 LLM 가격과 성능 대조와 같은 원칙이다.
가격: 표준, 캐시, 긴 컨텍스트, Fast / Batch
아래는 OpenAI 가격 페이지가 작성일에 준 100만 token당, 달러 숫자다. 도구 호출(검색, Computer Use 등)은 따로 계산한다.
| 티어 | 입력 | 캐시 입력 | 캐시 쓰기 | 출력 |
|---|---|---|---|---|
| Astra 표준 · 짧은 컨텍스트 | $10 | $1 | $12.50 | $50 |
| Astra 표준 · 긴 컨텍스트(>272K 입력) | $20 | $2 | $25 | $75 |
| Astra Batch / Flex | 표준가의 50% | |||
| Astra Fast | 적용 티어의 2배(공식은 약 2.5× 속도) | |||
| GPT-5.6 Sol 프로모션(최소 11월 21일까지) | $4 | $0.40 | $5 | $20 |
- 272K는 요청 전체 스위치다. 입력이 선을 넘는 순간 그 요청 전체가 긴 컨텍스트 가격이다. 초과분만 할증이 아니다.
- 캐시 쓰기는 미캐시 입력의 1.25×다. 큰 저장소를 처음 캐시에 넣는 것은 싸지 않다. 이후 히트가 $1이다.
- Fast는 청구를 두 배로 만든다. 대화 대기는 켜도 된다. 야간 배치는 Standard 또는 Batch/Flex.
- ChatGPT 구독 한도 ≠ API 단가. Sol 프로모션이 내리는 것은 종량 사용량이다. Plus 플랜 메시지가 3분의 1 늘지는 않는다.
거친 계산: 같은 100만 입력 + 10만 출력이면 Sol 프로모션은 약 $6, Astra 표준은 약 $15, Fast Astra는 약 $30. Agent 루프는 다시 횟수를 곱한다. 더 완전한 「API vs 클라우드 호스트 vs 로컬」 틀은 최근 AI Agent 연산 자원 비용 대조를 보라.
ChatGPT 사용법(플랜별)
공개 당일 가장 흔한 혼란은 「공식은 Plus에서 쓸 수 있다는데, Chat에서 왜 고를 수 없나」이다. 답은 서피스(surface)가 다르다는 것이지, 계정이 고장 난 것이 아니다.
Plus: Work와 Codex
- ChatGPT 데스크톱을 연다(웹 / 폰의 Work는 클라우드에서 돈다. Codex는 데스크톱이 주).
- 왼쪽 위에서 Chat을 Work로 바꾸거나 Codex 뷰로 들어간다.
- 그 서피스의 모델 전환기에서 GPT-6 Astra를 고른다.
- CLI 사용자는 Codex CLI를 0.153.0 이상으로 올리고 최신 Desktop으로 갱신한다. 옛 CLI는 Astra를 숨긴다.
Work와 Codex 한도는 일반 Chat과 따로 계산된다. 긴 작업은 「얼마나 일을 했는지」로 깎고, 「메시지를 몇 통 보냈는지」로 어림하지 마라. 한도가 끝나면 Sol / Terra로 바꾸거나 리셋을 기다린다. 서피스를 바꾼다고 무한 리필된다고 생각하지 마라. Codex 주간 한도 처리 생각은 Codex 주간 한도 소진 시를 보라.
Pro / Business / Enterprise
GPT-6 Pro(Astra 구동)는 표준 Chat에서 Pro, Business, Enterprise에게 준다. Business의 Pro 메시지 한도는 GPT-5.6 Sol Pro와 공유하며, 오가도 한 몫이 더 생기지 않는다. Enterprise는 시작 시 기본 꺼짐이며, 작업 공간 관리자가 모델 접근을 연다.
무료와 Go: 표준 Chat은 여전히 GPT-5.6 Luna 일선이다. Astra / GPT-6 Pro는 없다.
언제 Astra로 바꿔야 하나
- Sol을 유지: 일상 페어, 짧은 diff, 고빈도 도구 루프, 비용에 민감한 일괄 추출. 프로모션가는 최소 11월 21일까지. 여전히 기본 일꾼이다.
- Astra로 승급: 모듈 횡단 리팩터, 모델이 스스로 테스트를 돌리고 고치게, Computer Use로 데스크톱 조작, 긴 문서를 한 번에 먹기, 조사형 브라우즈. 예산은 「엔지니어 인일」로 보고 「채팅 통수」로 보지 마라.
- 이름 때문에 승급하지 마라: Plus 사용자가 같은 한 문장을 Chat에서 Work로 복사해도 자동으로 똑똑해지지 않고, 한도만 더 빨리 탄다.
- Claude / Gemini 대조 때는 harness를 고정: 같은 저장소, 같은 테스트, 같은 타임아웃. 모델 평가와 일상 개발이 같은 한 대를 빼앗지 마라.
장시간 작업을 Cloud Mac에 두는 이유
Astra의 Computer Use, Hosted shell, Codex 긴 세션이 실행 환경에 요구하는 것은 Fable 5와 같이 단단하다. 세션이 끊기지 않을 것, 진짜 macOS 툴체인, 디스크와 메모리가 충분할 것, 가능하면 CI와 같은 기기.
- 끊기지 않음: 시간 단위, 야간 작업은 노트북 절전을 견디지 못한다. 데스크톱 로컬 Work도 컨텍스트를 클라우드에 동기화할 수 있지만,
xcodebuild와 시뮬레이터 검수는 Mac에서만 된다. - 진짜 툴체인: Apply patch로 Swift를 고친 뒤에는 같은 기기에서 테스트를 돌려야 한다. GitHub-hosted macOS 콜드 스타트는 Agent 피드백 고리를 늘린다.
- 대조 평가: Astra vs Sol vs Fable 5는 같은 스크립트를 병렬로 돌린다. 본기기 GPU/메모리 이야기가 먼저 터진다.
모델 ID는 내년에 또 바뀔 수 있다. 호스트와 워크플로는 허물 필요가 없다. Codex / Agent 루프를 Vuncloud Cloud Mac에 두고, 노트북은 diff만 본다——이것이 2026년 플래그십 모델 공통의 물리 층이지, 어느 한 회사의 부속품이 아니다.
FAQ
GPT-6 Astra란?
OpenAI가 2026년 9월 3일 공개한 플래그십 추론 모델. 복잡한 추론, 코딩, Computer Use, 조사, 긴 문서용. API ID는 gpt-6-astra.
언제 출시됐나?
9월 3일 발표, 9월 4일 API 투입. ChatGPT 각 플랜은 서피스별로 단계 투입되며, 헬프 센터와 제품 안 선택기가 기준이다.
API는 얼마인가?
표준 짧은 컨텍스트: $10 입력 / $1 캐시 입력 / $12.50 캐시 쓰기 / $50 출력(100만 token당). 입력이 272K를 넘으면 요청 전체가 긴 컨텍스트 가격. Batch/Flex는 반값, Fast는 두 배. 무료 API 티어는 미지원.
Plus에서 쓸 수 있나?
쓸 수 있지만 Work와 Codex이고, 일반 Chat 선택기에는 없다. 표준 Chat의 GPT-6 Pro는 더 높은 플랜용이다.
Astra와 GPT-6 Pro는 같은가?
하층은 같은 플래그십. Chat은 GPT-6 Pro로 표시. Work, Codex, API는 Astra / gpt-6-astra.
컨텍스트는 얼마나 긴가?
약 105만 token 컨텍스트, 최대 12.8만 출력. 지식 컷오프는 2026-04-30. 272K를 넘는 입력은 할증된다.
마무리
세 문장으로 닫는다. Astra는 OpenAI의 2026년 9월 플래그십이다. 비싼 것은 장시간 도구 폐루프이지 채팅 말투가 아니다. Plus 사용자는 Work / Codex로 가고, 일반 Chat에서 헛기다리지 마라. 기본 라우트는 Sol을 유지하고, 난제에서 승급한다. 청구는 먼저 272K 스위치와 Fast 배율로 한 번 계산한 뒤, 저장소급 작업을 밤새 넘길지 정한다.
모델은 이름을 계속 바꾼다. 진짜 준비해야 할 것은 끊기지 않는 실행 환경과, 분명히 적은 승급 규칙이다.
Astra로 밤새 저장소를 고치려면, 끊기지 않는 Mac이 필요하다
Codex / Computer Use를 Cloud Mac에 둔다. tmux 장주, 같은 기기의 xcodebuild, DerivedData는 그대로. 노트북은 diff만 본다.