2026년 7월 31일 · 4² AI 뉴스레터
GPT-5.6, 비용 효율성의 새로운 지평을 열다
OpenAI
파이랩 정리
GPT-5.6: 비용 효율성의 새로운 지평
최근 우리는 GPT-5.6이 자체적으로 운영 효율성을 높인 방법을 공유했습니다. 오늘은 이러한 효율성을 고객에게 전달하여 GPT-5.6 Luna와 Terra의 가격을 낮추고, API에서 GPT-5.6 Sol의 성능을 향상시켰습니다. 이러한 업데이트는 고객이 AI에 투자하는 비용 대비 더 많은 가치를 얻고, 시간이 중요한 상황에서 더 빠르게 움직일 수 있도록 돕습니다.
오늘부터 GPT-5.6 Luna, 가장 빠르고 저렴한 모델은 80% 저렴해지며, GPT-5.6 Terra, 일상 작업에 적합한 균형 잡힌 모델은 20% 저렴해집니다. Luna와 Terra의 낮아진 가격은 Codex와 ChatGPT Work 사용 시 유료 구독에 대한 사용량 계산에도 반영됩니다. Luna는 기업이 고품질의 대량 작업을 훨씬 더 비용 효율적으로 처리할 수 있는 방법을 제공합니다. 이 모델은 도구를 사용하고 다단계 워크플로를 완료할 수 있어 대규모 AI 애플리케이션 실행을 실용적으로 만듭니다.
고급 인텔리전스를 보다 풍부하고 저렴하게 만드는 것은 인류 전체에 AGI의 혜택을 보장하려는 OpenAI의 사명에 중심이 됩니다. 이러한 변화는 그 약속을 실천에 옮기는 것입니다. 이는 모델이 구축, 제공, 활용되는 방식에서 수년간의 개선을 반영합니다.
또한 API에서 Fast 모드를 도입하여 기존의 우선 처리 옵션을 대체합니다. GPT-5.6 Sol의 Fast 모드는 표준 처리보다 최대 2.5배 빠른 속도를 제공하며, 가격은 두 배이지만 인텔리전스에는 변화가 없습니다. Fast 모드는 이전 버전과 호환되며, 우선 태그가 붙은 요청은 자동으로 Fast 모드를 사용합니다.
결과에 맞는 인텔리전스 매칭
AI를 효율적으로 사용하는 것은 결과에서 시작됩니다. 위험, 오류 비용, 긴급성, 규모는 인텔리전스, 속도, 신뢰성, 비용의 적절한 균형을 결정합니다. 이 균형은 워크플로의 단계마다 달라질 수 있습니다.
GPT-5.6은 기업이 이 방정식을 최적화할 수 있는 여지를 훨씬 더 많이 제공합니다. Luna는 작년의 최첨단 모델에 비해 약 6센트로 작업당 비용을 제공하며, 거의 9배 빠른 속도를 자랑합니다. 전문 작업에서, Agents’ Last Exam에 따르면 Luna는 Fable 5보다 약 99% 낮은 추정 작업당 비용으로 더 나은 성능을 발휘합니다.
실제로 기업은 필요한 결과와 품질 기준을 정의한 다음, 추가 인텔리전스가 결과를 실질적으로 개선하는 곳과 더 빠르고 저렴한 처리가 동일한 품질을 제공할 수 있는 곳을 평가할 수 있습니다. 예를 들어, 코딩 워크플로는 Sol을 사용하여 불확실성을 해결하고 계획을 정의한 다음, Luna를 사용하여 잘 정의된 변경 사항을 구현하고 테스트를 작성 및 실행하며 결과를 평가할 수 있습니다. 다른 워크플로는 다른 균형을 요구할 수 있습니다.
GPT-5.6 제품군은 이러한 선택의 범위를 확장합니다. 기업은 각 단계에서 최대한 유용한 인텔리전스를 적용하면서 그 가치를 창출하는 데 적합한 가격을 지불할 수 있습니다.
이러한 유연성을 제공하는 것은 모델 뒤의 모든 레이어를 더 효율적으로 만드는 것에서 시작됩니다.
효율성 경계를 확장하는 방법
우리의 효율성 우위는 모델, 이를 실행하는 추론 시스템, 도구 및 컨텍스트에 연결하는 에이전트 하니스의 개선에서 비롯됩니다. GPT-5.6 모델은 작업을 더 직접적으로 처리합니다. 더 나은 라우팅은 하드웨어를 생산적으로 유지하고, 최적화된 생산 소프트웨어는 토큰을 더 효율적으로 생성하며, 더 스마트한 컨텍스트 관리로 에이전트가 완료된 작업을 반복하지 않도록 돕습니다. 이러한 개선은 동일한 컴퓨팅으로 더 많은 유용한 작업을 완료할 수 있게 하여 각 결과에 필요한 시간, 토큰 및 비용을 줄입니다.
GPT-5.6 Sol은 점점 더 많은 이익을 찾고 제공하는 데 도움을 주고 있습니다. 인간 주도의 프로세스 내에서 Sol은 자율적으로 생산 커널을 다시 작성하고 최적화했으며, 토큰 생성 개선을 위한 수백 가지 실험을 설계하고 실행했으며, 문제 발생 시 개입하여 훈련을 모니터링했습니다. 커널 작업은 모델 제공의 종단 간 비용을 20% 줄이는 데 도움을 주었으며, 실험은 토큰 생성 효율성을 15% 이상 증가시켰습니다. 이 작업은 계속 진행 중이며, 모델이 개선되고 더 자율적으로 작업할 수 있게 됨에 따라 효율성을 개선할 수 있는 우리의 능력도 가속화됩니다. GPT-5.6의 엔지니어링에 대해 더 읽어보세요.
대규모를 위한 컴퓨팅 전략
풍부한 인텔리전스에 대한 수요를 충족하려면 더 많은 컴퓨팅과 더 생산적인 컴퓨팅이 필요합니다. 우리는 회복력 있는 인프라 포트폴리오를 구축하고 각 워크로드를 실행하기에 가장 적합한 시스템에 매칭하고 있습니다. 이 접근 방식은 가격-성능 곡선의 양쪽 끝을 지원합니다. 저비용 측에서는 새로운 Luna와 Terra 가격이 대량 작업을 훨씬 더 큰 규모로 경제적으로 만듭니다. 최첨단 측에서는 Fast 모드가 API 고객에게 Sol에 대한 더 빠른 접근을 제공합니다.
기업은 가장 중요한 작업에서 속도를 희생하지 않고도 일상 운영에 더 많은 AI를 도입할 수 있습니다. 대규모 문서 분석, 고객 상호작용 분류, 일상적인 구현은 광범위하게 실행할 수 있는 경제성을 갖추고 있으며, 복잡한 Sol 워크로드는 프리미엄이 정당화될 때 더 빠르게 이동할 수 있습니다.
이러한 이익은 누적될 수 있습니다. 인간 주도의 프로세스 내에서 더 능력 있는 모델은 기술 팀이 다음 세대의 개선을 찾는 데 도움을 주어 더 나은 성능과 낮은 비용으로 가는 경로를 단축합니다. 우리의 전략은 능력과 효율성을 모두 발전시키는 데 중점을 두고 있으며, 각 세대의 인텔리전스가 더 낮은 비용으로 더 많은 작업을 수행할 수 있도록 합니다.
가용성과 가격
GPT-5.6 Terra와 Luna는 ChatGPT Work, Codex, OpenAI API에서 계속 사용할 수 있습니다. ChatGPT Work와 Codex에서는 Free 및 Go 사용자가 Terra에 접근할 수 있으며, Plus, Pro, Business, Enterprise 사용자는 Terra와 Luna를 선택할 수 있습니다.
7월 30일부터 API 가격은 Terra의 경우 백만 입력 토큰당 $2, 백만 출력 토큰당 $12이며, Luna의 경우 백만 입력 토큰당 $0.20, 백만 출력 토큰당 $1.20입니다. Sol 가격은 변동이 없습니다. ChatGPT 및 Codex 구독 가격과 할당량 예산은 변동이 없으며, Terra와 Luna 사용량은 이제 더 적은 크레딧을 소비합니다. 가격 변경은 오늘 늦게 AWS에서 시작됩니다.
GPT-5.6 Sol의 Fast 모드는 API에서 우선 처리 옵션을 대체하며, Codex의 /fast와 일치합니다. 기존의 우선 태그가 붙은 API 요청은 계속 작동합니다. 전체 API 가격 세부 정보 보기.