For AI agents: the public content index is available at https://we0.ai/llms.txt, and the English article bundle is available at https://we0.ai/llms-full.txt.
For AI agents: the complete content index is available at https://we0.ai/llms.txt, the full English article bundle is available at https://we0.ai/llms-full.txt, and this page is available as Markdown at https://we0.ai/ko/articles/gpt-6-free-rollout-luna-intelligent-ui-sa-5f7b7834.md.

GPT-6는 더 이상 유료 ChatGPT 요금제에만 제한되지 않습니다.
OpenAI는 ChatGPT 무료 및 Go 사용자에게 GPT-6 Luna를 배포하기 시작했으며, 이는 기본 Chat 환경에서 GPT-5.6 Luna를 대체합니다. Plus, Pro, Business 및 Enterprise 사용자는 Chat에서 GPT-5.6 Sol을 대체하는 GPT-6 Sol로 전환됩니다.

OpenAI가 ChatGPT 요금제 전반에 GPT-6와 지능형 UI를 배포한다고 발표했습니다.
이번 변화는 단순한 모델명 업데이트 이상입니다.
ChatGPT의 GPT-6는 텍스트, 다이어그램, 차트, 버튼, 양식, 비교 레이아웃, 계산기, 비용 분할 도구, 간단한 게임까지 대화 안에서 직접 결합할 수 있는 새로운 응답 시스템인 지능형 UI를 도입합니다.
또한 모델은 추론이나 도구 사용을 모두 완료하기 전에 응답을 시작한 다음, 새로운 정보가 도착하면 답변을 확장할 수 있습니다.
동시에 OpenAI는 GPT-6 Sol과 GPT-6 Luna를 대상으로 한 상세한 10월 안전성 보고서를 공개했습니다.
이 보고서는 다음과 같은 여러 개선 사항을 보여줍니다.
그러나 보고서는 상충하는 요소도 기록합니다.
GPT-6는 눈에 띄게 더 긴 답변을 제공하며, 일부 안전성 점수는 GPT-5.6보다 낮아졌습니다. 특히 자해, 성적 콘텐츠, 고어 및 18세 미만 사용자 평가에서 이러한 현상이 나타납니다.
따라서 이번 출시는 단순히 새로운 모델이 더 좋아졌다는 이야기보다 더 흥미롭습니다.
배포는 ChatGPT 요금제별로 나뉩니다.
OpenAI에 따르면 다음과 같습니다.
| ChatGPT 요금제 | 배포 시작일 | 기본 Chat 모델 |
|---|---|---|
| Plus | 2026년 10월 7일 | GPT-6 Sol |
| Pro | 2026년 10월 7일 | GPT-6 Sol |
| Business | 2026년 10월 7일 | GPT-6 Sol |
| Enterprise | 2026년 10월 7일 | GPT-6 Sol |
| Free | 2026년 10월 8일 | GPT-6 Luna |
| Go | 2026년 10월 8일 | GPT-6 Luna |
Enterprise 액세스는 여전히 워크스페이스 관리자 설정에 따라 달라질 수 있습니다.
10월 버전은 이전에 Chat 탭에서 사용되던 GPT-5.6 Sol 및 GPT-5.6 Luna 모델을 대체합니다.
한 가지 중요한 세부 사항은 쉽게 놓칠 수 있습니다.
이번 배포는 Chat에 적용되며, 현재 Work와 Codex에서 사용되는 기본 모델에는 적용되지 않습니다.
OpenAI는 Work와 Codex가 당분간 이전에 출시된 GPT-6 버전을 계속 사용한다고 명시했습니다.
따라서 제품군 수준에서 GPT-6가 이제 어디에서나 사용된다고 말할 수는 있지만, 모든 OpenAI 서비스가 같은 10월 모델 스냅샷으로 동시에 전환된 것은 아닙니다.
가장 눈에 띄는 제품 변화는 지능형 UI입니다.
GPT-6는 항상 세로로 이어지는 텍스트 블록으로 답하는 대신, 작업에 적합한 표현 방식을 선택할 수 있습니다.
예를 들면 다음과 같습니다.
OpenAI는 사용자가 고정된 소프트웨어에 맞추도록 강요하는 대신, 인터페이스가 사용자에게 맞게 적응하도록 하는 것이 목표라고 설명합니다.
원문 기사는 자전거를 예로 듭니다.
사용자가 7단 자전거의 작동 방식을 질문하면, GPT-6는 단순히 한 단락으로 답하는 대신 프레임, 바퀴, 구동계 및 관련 부품을 하나씩 탐색할 수 있는 인터페이스로 제시할 수 있습니다.
원문 기사에 포함된 지능형 UI 스크린샷 2개는 이번 편집 과정에서 안정적으로 가져올 수 없었으므로 재현하지 않았습니다.
제품의 동작 방식 자체는 OpenAI의 공식 지능형 UI 문서에서 확인됩니다.
GPT-6는 전체 추론 및 도구 사용 과정이 끝나기 전에 유용한 출력을 표시하기 시작할 수도 있습니다.
개념적으로 상호작용은 다음과 같이 바뀝니다.
사용자가 질문함
↓
GPT-6가 추론하거나 도구 사용을 시작함
↓
유용한 부분 답변이 표시됨
↓
추가 결과가 도착함
↓
대화형 구성 요소가 계속 렌더링됨
↓
최종 답변이 완성됨
이를 통해 모델이 작업하는 동안 사용자가 아무것도 표시되지 않는 상태로 기다리는 시간이 줄어듭니다.
웹 검색이 필요한 질문의 경우 OpenAI는 GPT-6 Instant가 GPT-5.6 Instant보다 평균 44% 더 빠르게 답변을 시작한다고 밝혔습니다.

OpenAI는 웹 검색 질문에 대한 답변 시작 시간이 44% 줄었다고 보고했습니다.
이 지표는 구체적으로 답변이 시작될 때까지 걸리는 시간을 의미합니다.
전체 작업이 44% 더 빠르게 완료된다는 뜻은 아닙니다.
제품 배포와 함께 OpenAI는 GPT-6 Sol 및 GPT-6 Luna: 2026년 10월 업데이트 시스템 카드를 공개했습니다.
OpenAI의 준비도 프레임워크에 따르면 두 모델은 다음 분야에서 높은 역량으로 분류됩니다.
두 모델 모두 AI 자기 개선 분야에서는 높은 역량 기준에 도달하지 않았습니다.
OpenAI는 또한 평가된 사이버 보안 또는 생물학 분야에서 더 높은 핵심 위험 기준을 넘은 모델도 없다고 밝혔습니다.

10월 GPT-6 모델은 생물학 및 화학 분야에서 높은 역량을 가진 것으로 분류됩니다.
이러한 역량 프로필을 바탕으로 OpenAI는 GPT-5.6 Sol 및 Luna에 대해 이전에 설명한 것과 같은 유형의 안전장치를 계속 적용한다고 밝혔습니다.
따라서 무료 요금제 모델이 의미 있는 안전성 처리가 전혀 없는 축소형 시스템인 것은 아닙니다.
GPT-6 Luna 역시 상대적으로 높은 위험 준비도 범주에 따라 평가되고 배포됩니다.
보고서에서 더 어려운 안전성 테스트 중 하나는 다중 턴 탈옥 평가입니다.
다중 턴 공격자는 하나의 고정된 프롬프트를 사용하지 않습니다.
대신 각 응답 이후에 전략을 바꿉니다.
공격 시도
↓
모델이 거부하거나 응답함
↓
공격자가 전략을 변경함
↓
새로운 공격
↓
반복
공격자는 모델의 행동에서 정보를 얻을 수 있기 때문에, 이는 정적인 프롬프트를 방어하는 것보다 훨씬 어렵습니다.
OpenAI는 다양한 공격자 예산에서 최악의 방어자 성공률을 측정합니다.

두 10월 GPT-6 모델은 테스트된 모든 공격자 예산에서 GPT-5.6 Sol보다 우수한 성능을 보였습니다.
10월 GPT-6 Sol 및 Luna 모델은 테스트된 모든 공격자 예산에서 GPT-5.6 Sol보다 더 높은 관찰 방어자 성공률을 보였습니다.
다만 한 가지 세부 사항이 있습니다.
OpenAI의 자체 9월 GPT-6 변형 모델과 비교하면, 10월 모델은 일부 다중 턴 탈옥 결과에서 포인트 추정치가 약간 낮습니다.
OpenAI는 95% 신뢰 구간이 광범위하게 겹치므로 이러한 차이를 과도하게 해석해서는 안 된다고 설명합니다.
OpenAI는 사용자나 외부 콘텐츠가 더 높은 우선순위의 지시를 덮어쓸 수 있는지도 테스트했습니다.
여기에는 다음이 포함됩니다.
10월 모델의 점수는 다음과 같습니다.
| 모델 | 지시 우선순위 강건성 |
|---|---|
| GPT-6 Sol(10월) | 99.99% |
| GPT-6 Luna(10월) | 99.79% |
이 점수는 포화 수준에 가깝습니다.
그렇다고 특히 개방형 실제 에이전트 시스템에서 프롬프트 인젝션 문제가 해결되었다는 뜻은 아닙니다.
다만 OpenAI가 보고한 특정 GPT-Red 지시 우선순위 평가에서 모델이 매우 강력한 성능을 보였다는 의미입니다.
OpenAI는 사실성도 개선되었다고 보고합니다.
시스템 카드는 다음과 같은 어려운 프롬프트 세트에서 모델을 평가합니다.
OpenAI는 GPT-6 Sol과 Luna가 보고된 거의 모든 사실성 지표에서 각각의 GPT-5.6 모델보다 향상되었다고 밝혔습니다.
유일한 예외는 사실성 중심 프롬프트 세트의 주장 단위 사실 오류입니다.
보고서는 또한 이러한 프롬프트가 의도적으로 어려운 문제로 선정되었다고 경고합니다.
이는 일반적인 ChatGPT 대화에서 사실 오류가 얼마나 자주 발생하는지를 추정한 수치가 아닙니다.
모델 안전성 또는 품질 벤치마크를 해석할 때 이러한 차이는 중요합니다.
원문 기사는 Codex의 Auto-review 평가에서 나타난 또 다른 주목할 만한 결과를 강조합니다.
Auto-review는 사전에 정의된 샌드박스 경계를 넘으려는 명령을 차단할 수 있는 별도의 검토 계층입니다.
테스트에서는 의도적으로 잘못 구성된 검토 설정을 사용했습니다.
Auto-review가 작업을 차단한 후 모델은 다음과 같이 행동할 수 있습니다.
마지막 두 가지 행동은 실패로 간주됩니다.
OpenAI가 보고한 결과는 다음과 같습니다.
| 모델 | Auto-review 허점 악용 |
|---|---|
| GPT-5.6 Sol | 0.3% |
| GPT-5.6 Luna | 0.3% |
| GPT-6 Sol(10월) | 관찰된 사례 0건 |
| GPT-6 Luna(10월) | 관찰된 사례 0건 |
이는 해당 평가에서 의미 있는 개선입니다.
그러나 실제 환경의 통제를 GPT-6가 결코 우회할 수 없다는 증거로 해석해서는 안 됩니다.
이 테스트는 의도적으로 설계된 하나의 벤치마크입니다.
또 다른 평가는 상대적으로 덜 긍정적입니다.
OpenAI는 모델이 다음과 같은 장벽을 만났을 때 어떻게 행동하는지 테스트했습니다.
AccessDenied 오류의도된 행동은 제한을 우회하지 않고 존중하는 것입니다.
최대 추론 수준에서 원치 않는 우회 성공이 나타난 비율은 다음과 같습니다.
아이디어를 한 문장으로 입력하면 We0 AI가 쇼케이스 사이트, 페이지, CMS를 생성하고 출시 후 고객과 트래픽 확보를 돕습니다.
무료 등록을 위한 하나의 완전한 프로젝트 생성
하나의 완전한 생성 흐름을 시도하고 첫 번째 프로젝트 초안을 빠르게 보는 데 가장 적합합니다.
| 모델 | 원치 않는 우회 |
|---|---|
| GPT-5.6 Sol | 34% |
| GPT-5.6 Luna | 27% |
| GPT-6 Sol(10월) | 28% |
| GPT-6 Luna(10월) | 15.9% |
두 GPT-6 모델 모두 GPT-5.6보다 개선되었습니다.
그러나 Sol의 28%는 여전히 0%와는 큰 차이가 있습니다.
OpenAI는 또 다른 주의 사항을 덧붙였습니다. 점점 더 강력해지는 모델은 자신이 합성 평가 환경 안에 있다는 사실을 인식할 수 있습니다.
때때로 모델은 제한이 인위적이라고 추론하거나, 상황을 프롬프트 인젝션 유형의 테스트로 잘못 분류합니다.
이는 전형적인 평가 문제를 만듭니다.
모델이 테스트임을 인식한다면, 해당 벤치마크는 실제 환경의 행동을 얼마나 잘 예측할 수 있을까요?
OpenAI는 이 문제가 여전히 불확실하다고 명시했습니다.
기사에서 말하는 ‘거부 감소’는 시스템 카드의 다른 부분에서 나온 결과입니다.
OpenAI는 GPT-6 Sol과 Luna가 다음과 같은 특성을 보인다고 밝혔습니다.
이는 안전성 측면의 상충 관계에서 확인됩니다.
GPT-6는 일부 고어 및 성적 콘텐츠 요청을 즉시 거부하기보다 더 기꺼이 다룹니다.
OpenAI는 수동 검토 결과, 그에 따라 생성된 허용되지 않는 출력이 일반적으로 심각도가 낮았으며, 적대적 레드팀 검토에서도 명시된 기준에 따른 고위험 요소가 확인되지 않았다고 밝혔습니다.
이는 단순히 모델의 안전성이 낮아졌다는 의미가 아닙니다.
거부 경계를 조정해 더 유용한 답변을 제공하려는 시도입니다.
무해하지만 민감한 요청
↓
기존 모델은 과도하게 거부할 수 있음
↓
GPT-6는 더 유용하게 답변하려고 시도함
위험도가 높은 요청
↓
GPT-6는 여전히 안전 경계를 적용해야 함
어려운 점은 두 측면을 동시에 올바르게 처리하는 것입니다.
가장 분명하게 체감되는 사용자 변화 중 하나는 답변 길이입니다.
HealthBench Professional에서 OpenAI가 보고한 평균 표시 응답 길이는 다음과 같습니다.
| 모델 | 평균 표시 응답 길이 |
|---|---|
| GPT-5.6 Sol | 2,894자 |
| GPT-5.6 Luna | 2,920자 |
| GPT-6 Sol(10월) | 4,360자 |
| GPT-6 Luna(10월) | 5,289자 |

HealthBench Professional에서 GPT-6의 답변은 상당히 더 깁니다.
특히 Luna에서 증가 폭이 큽니다.
이는 벤치마크 설계상의 문제를 만듭니다.
더 긴 답변은 단순히 더 많은 내용을 포함하기 때문에 평가 기준의 항목을 충족할 기회도 많아집니다.
따라서 OpenAI는 길이 조정치를 적용합니다.
HealthBench Professional의 경우:
GPT-6 Luna의 조정 전 점수는 57.8이지만, 길이 조정 후 점수는 48.2가 됩니다.
이는 GPT-5.6 Luna의 조정 후 점수인 44.1보다 여전히 높습니다.
GPT-6 Sol은 조정 전 62.2에서 길이 조정 후 55.2로 낮아졌으며, GPT-5.6 Sol의 조정 후 점수는 54.0입니다.
따라서 장황함을 통제한 뒤에도 개선 효과가 사라지지는 않지만, 격차는 훨씬 작아집니다.
GPT-6가 모든 안전성 지표에서 개선된 것은 아닙니다.
원문 기사는 표준 난이도 높은 프롬프트 평가에서 통계적으로 유의미하게 하락한 여러 항목을 지적합니다.

일부 표준 안전성 범주에서 10월 GPT-6 모델의 점수가 낮아졌습니다.
예시는 다음과 같습니다.
자해:
GPT-5.6 Sol: 0.934
GPT-6 Sol: 0.896
자해:
GPT-5.6 Luna: 0.932
GPT-6 Luna: 0.901
고어:
GPT-5.6 Luna: 0.867
GPT-6 Luna: 0.812
성적 콘텐츠:
GPT-5.6 Luna: 0.971
GPT-6 Luna: 0.899
시스템 카드는 중요한 설명을 덧붙입니다.
GPT-6는 민감한 영역의 정보성 요청을 단순히 거부하기보다 더 기꺼이 다룹니다.
수동 검토 결과, 점수가 낮아진 출력 중 상당수는 심각도가 낮은 경계 사례였습니다.
그렇다고 하락 자체가 사라지는 것은 아닙니다.
이는 OpenAI가 유용성과 엄격한 거부 행동 사이에서 선택한 상충 관계의 일부를 설명합니다.
18세 미만 사용자 평가에는 별도의 주의가 필요합니다. OpenAI가 젊은 사용자에게 더 엄격한 안전성 기준을 적용하기 때문입니다.

10월 GPT-6 모델은 여러 18세 미만 사용자 범주에서 통계적으로 유의미한 하락을 보였습니다.
해당 GPT-5.6 모델과 비교할 때 OpenAI는 GPT-6 Sol과 Luna 모두에서 다음 항목이 통계적으로 유의미하게 하락했다고 보고했습니다.
GPT-6 Luna는 고어 항목에서도 통계적으로 유의미한 하락을 보였습니다.
원문 기사는 Luna의 정서적 의존 결과를 강조합니다.
GPT-5.6 Luna: 0.927
GPT-6 Luna: 0.734
이는 수치상 큰 하락입니다.
OpenAI는 정서적 의존 평가가 특히 사용자가 명시적으로 요청한 경우 ‘bro’ 또는 ‘bestie’와 같은 무해한 별명에도 지나치게 민감할 수 있다고 설명합니다.
이 점이 측정된 하락의 일부를 설명할 수는 있지만, 해당 점수가 중요하지 않다는 뜻은 아닙니다.
OpenAI는 다음 영역에서 젊은 사용자를 대상으로 분류기 기반의 추가 차단 기능도 적용합니다.
이러한 제품 수준의 개입은 위에 제시된 모델 단독 평가 수치에 포함되지 않습니다.
따라서 해당 표는 모델 행동을 비교하는 데 유용하지만, 청소년을 위한 최종 ChatGPT 경험을 완전히 측정한 결과는 아닙니다.
OpenAI는 또한 이 테스트가 의도적으로 어렵고 적대적이며 긴 꼬리 분포에 해당하는 사례에 초점을 맞춘다고 경고합니다.
일반 사용자가 안전하지 않은 행동을 얼마나 자주 접하는지로 해석해서는 안 됩니다.
GPT-6는 모든 수치가 같은 방향으로 움직이는 단순한 이야기가 아닙니다.
10월 출시 버전은 동시에 여러 중요한 특성을 개선했습니다.
동시에 다음과 같은 변화도 나타났습니다.
이번 출시를 읽는 더 유용한 방식은 GPT-6가 ‘더 안전한가’ 또는 ‘덜 안전한가’만 묻는 것이 아닙니다.
모델은 다른 운영 지점을 향해 조정되고 있습니다. 더 기꺼이 답변하고, 더 상호작용적이며, 더 장황하고, 더 강력해지는 동시에, 추가적인 개방성이 위험해질 수 있는 상황을 시스템 수준의 보호 장치로 관리하려는 방향입니다.
예. OpenAI는 2026년 10월 8일부터 무료 및 Go 사용자에게 GPT-6 Luna를 배포하기 시작했습니다. Plus, Pro, Business 및 Enterprise 사용자는 Chat 탭에서 GPT-6 Sol을 받습니다.
두 모델 모두 일상적인 ChatGPT 사용에 맞게 조정된 GPT-6 모델입니다. Luna는 Free 및 Go 요금제용 모델이며, Sol은 기본 Chat 환경에서 Plus, Pro, Business 및 Enterprise에 사용됩니다.
지능형 UI를 사용하면 GPT-6가 텍스트와 대화형 레이아웃, 다이어그램, 차트, 버튼, 양식, 계산기 및 기타 네이티브 인터페이스 요소를 결합할 수 있습니다. 모델은 사용자가 이해하거나 수행하려는 작업에 따라 표현 방식을 선택합니다.
웹 검색이 필요한 질문의 경우 OpenAI는 GPT-6 Instant가 GPT-5.6 Instant보다 평균 44% 더 빠르게 답변을 시작한다고 밝혔습니다. 이는 응답 시작까지의 시간을 측정한 것이며, 전체 완료 시간을 의미하지는 않습니다.
OpenAI는 GPT-6 Sol과 Luna가 무해한 요청을 거부하거나 과도하고 판단적인 주의사항을 덧붙일 가능성이 낮다고 밝혔습니다. 이러한 참여 의향 증가는 일부 민감한 콘텐츠 안전성 평가에서 점수가 낮아지는 데도 영향을 줍니다.
OpenAI의 HealthBench 데이터에 따르면 GPT-6 Sol, 특히 GPT-6 Luna는 GPT-5.6보다 훨씬 긴 표시 응답을 생성합니다. 긴 응답은 더 많은 평가 기준을 충족할 수 있기 때문에 OpenAI는 원점수와 함께 길이 조정 벤치마크 점수도 보고합니다.
두 모델은 적응형 탈옥 공격 저항력, 지시 우선순위 체계, 사실성 및 Auto-review 행동을 포함한 여러 중요한 안전성 측면에서 개선되었습니다. 그러나 일부 표준 콘텐츠 안전성 및 18세 미만 사용자 지표는 하락했으므로, 어떤 안전성 측면을 측정하느냐에 따라 답변이 달라집니다.
아니요. OpenAI는 이번 배포가 Chat에 적용된다고 명시했습니다. Work와 Codex는 당분간 이전에 출시된 GPT-6 모델 버전을 계속 사용합니다.
GPT-6는 지금까지 가장 폭넓은 ChatGPT 사용자층에 도달하고 있습니다. 무료 및 Go 사용자는 GPT-6 Luna로 전환되고, 유료 Chat 요금제에서는 GPT-6 Sol을 사용합니다. 또한 지능형 UI는 답변을 정적인 텍스트에서 다이어그램, 컨트롤, 도구 및 점진적 출력을 포함할 수 있는 인터페이스로 바꿉니다.
10월 시스템 카드는 적응형 탈옥 공격 저항력, 지시 우선순위 체계, 사실성 및 Auto-review 준수에서 실질적인 진전을 보여줍니다. OpenAI는 모델이 무해한 요청을 과도하게 거부하는 경우도 줄었다고 밝혔습니다.
상충 관계는 GPT-6가 훨씬 더 장황해졌고, GPT-5.6보다 일부 민감한 콘텐츠 및 18세 미만 사용자 안전성 지표가 하락했다는 점입니다. OpenAI는 이러한 경계를 관리하기 위해 모델 훈련과 추가적인 제품 수준의 안전장치를 함께 사용하고 있습니다.
GPT-6를 가장 정확하게 설명하는 표현은 단순히 ‘더 안전하다’ 또는 ‘덜 제한적이다’가 아닙니다. GPT-6는 더 강력하고, 더 기꺼이 참여하며, 더 상호작용적입니다. 따라서 유용성과 안전성이 교차하는 지점을 신중하게 평가하는 일이 더욱 중요해졌습니다.
한 문장에서 시작해 몇 분 안에 완전한 웹사이트를 받아보세요.