AI 모델 및 플랫폼
세레브라스, 오픈AI의 GPT-5.6 솔을 750 토큰당 초당으로 처리하는 새로운 초고속 티어에서 실행

세레브라스(Cerebras)는 현재 오픈AI의 플래그십 모델을 이전에 공개되지 않은 속도로 실행하고 있습니다. 2026년 8월 13일, 웨이퍼 규모의 칩 제조업체인 세레브라스는 공개하여 GPT-5.6 솔을 새로운 오픈AI 서비스 티어인 울트라패스트(Ultrafast)에서 제공하고 있으며, 이를 통해 초당 최대 750개의 출력 토큰을 생성할 수 있으며, 오픈AI의 설명에 따르면, 이는 표준 처리보다 최대 14배 빠르다고 합니다. 울트라패스트는 오픈AI API에서 제한된 프리뷰로 처음 출시되며, 선택된 고객 그룹에게 초기 액세스가 제공되며, 용량이 증가함에 따라 액세스가 확대됩니다.
중심에 있는 주장은 특정합니다: 속도 페널티 없이 프론티어 인텔리전스를 제공하는 것입니다. GPT-5.6 솔은 오픈AI의 가장 강력한 모델이며, 세레브라스의 실리콘에서 빠르게 토큰을 생성하여 실제 시간 제품 내에서 사용할 수 있습니다. 두 회사는 이 티어를 모델이 충분히 지능적인 높은 위험 작업과 충분히 빠른 작업 사이의 트레이드오프를 제거하는 것으로 설명합니다.
울트라패스트의 속도 숫자
초당 750개의 출력 토큰은 헤드라인이지만, 더 중요한 비교는 세레브라스가 공개한 직접적인 실행 비교입니다. 아티피셜 분석에서 보고된 출력 속도와 비교하여, 회사는 GPT-5.6 솔이 울트라패스트에서 클라우드 패블 5보다 11배 빠르며, 빠른 모드에서 오퍼스 4.8보다 5배 빠르다고 말합니다.
세레브라스는 또한 이 티어를 인류의 마지막 시험의 전체 패스에 걸쳐 실행했습니다. 이는 2,500개의 질문을 포함하는 벤치마크로, 박사 학위 수준의 난이도로 설계되었습니다. GPT-5.6 솔이 울트라패스트에서 2,500개의 질문에 모두 답을 한 시간은 11시간 11분이었으며, 클라우드 패블 5는 78시간 27분이 걸렸습니다. 이는 거의 7배 더 느리며, 이는 세레브라스의 설명입니다. GDP-Val, 경제적으로 가치 있는 지식 작업을 위한 벤치마크에서, 회사는 표준 처리와 비교하여 5.6배의 종단 간 속도 향상을 보고하며, 이는 품질 저하 없이 이루어졌습니다.
이것은 벤더가 실행한 평가이며, 세레브라스는 이것을 명시적으로 말합니다: 인류의 마지막 시험 비교는 2026년 7월 10일과 7월 13일에서 15일 사이에 세레브라스에서 벤치마크되었으며, GDP-Val 수치는 2026년 7월 31일의 자체 테스트에서 나왔습니다. 이것을 회사의 자체 측정치로 간주하십시오. 독립적인 결과가 아닙니다.
웨이퍼 규모 칩이 레이턴시에 승리하는 이유
기작이 여기서 중요합니다. 왜 상대적으로 작은 칩 제조업체가 오픈AI의 가장 큰 모델을 GPU 주도자들이 따라오지 못한 속도로 제공하는지 설명하기 때문입니다. 큰 모델에서 빠른 추론은 기본적으로 데이터 이동 문제입니다. GPU에서, 모델 가중치는 각 성공적인 토큰을 생성하기 위해 반복적으로 온칩 메모리와 오프칩 저장소 사이를 옮겨야 하며, 메모리 대역폭이 병목 현상이 됩니다.
세레브라스의 대답은 그 이동을 제거하는 것입니다. 그들의 웨이퍼 규모 엔진은 단일 웨이퍼 크기의 칩에 44GB의 SRAM을 패키징하므로, 모델의 가중치는 온칩에 머무르고, 토큰은 웨이퍼에 걸쳐 파이프라인化된 계층을 통해 흐릅니다. 가중치가 실리콘을 떠나지 않기 때문에, 접근 방식은 모델 크기와 함께 확장합니다. 이는 회사가 속도优势가 오픈AI의 프론티어 모델이 성장함에 따라 유지된다는 주장입니다. 추론 경제학을 위해, 이는 전체 게임입니다. 모델을 제공하는 비용과 레이턴시는 컴퓨팅에 가중치를 공급하는 속도에 의해 지배되며, 44GB를 단일 다이에 유지함으로써 직접적으로 공격합니다.
100억 달러 파트너십이 플래그십에 도달한다
울트라패스트는 몇 개월 동안 구축된 관계의 가장 보이는 제품입니다. 오픈AI는 2026년 초에 세레브라스를 100억 달러의 저レイ턴시 컴퓨팅을 위해 선택했습니다. 이 런치는 오픈AI의 상위 모델을 제공하며, 이는 더 작은 모델이나 전문 모델이 아닙니다. 오픈AI는 울트라패스트를 플랫폼에 초저レイ턴시 추론을 제공하기 위한 파트너십의 다음 단계로 설명합니다.
세레브라스에게, 이 배치는 중요합니다. 이 스타트업은 오랫동안 웨이퍼 규모 아키텍처가 추론에 적합하다고 주장해 왔으며, 이는 시장의 중추가 GPU 공급자와 함께 있는 상황에서 발생하는 경쟁입니다. 오픈AI의 플래그십 모델을 제공하는 것은 세레브라스에게 시장의 상위에 생산 참조 계정을 제공합니다. 모델 자체는 오픈AI가 출시한 GPT-5.6 패밀리를錨定하며, 울트라패스트는 세레브라스를 이 라인업의 앞에 위치시킵니다.
누가 얻고, 무엇을 위해 사용하는가
오픈AI는 이 티어를 시간에 민감한, 높은 위험 작업을 위해 위치시키고 있습니다. 예를 들어, 중단이 발생하는 동안 인시던트 응답, 시장 조건이 변경되는 동안 금융 연구, 실시간 고객 지원 및 보이스, 커머스, 라이브 연구 루프가 이전에 밤새 진행되었습니다. 초기 액세스는 코딩, 커머스, 금융을 포함한 회사들에게 제공되었습니다. 제인 스트리트, 포디움, 베이시스, 로고 등이 포함됩니다.
> “세레브라스가 제공하는 속도 향상은 인상적입니다.” 제인 스트리트의 AI 어시스턴트 존 크레페지(John Crepezzi)는 오픈AI의 발표에서 말했습니다. “개발자가 모델과 함께 더 집중적이고 생산적으로 일할 수 있도록 모델을 사용하는 새로운 방법을 가능하게 합니다.”
오픈AI는 의도적으로 롤아웃을 狭く 유지하고 있습니다. 회사는 주문량의 크기에서 가치가 생성되는 것을 배우기 위해 프리뷰 기간을 사용하며, 용량이 증가함에 따라 액세스를 확대할 것입니다. 오픈AI와 세레브라스는 모두 프리뷰가 확대됨에 따라 업데이트를 위해 가입을 받고 있습니다.
다음에 무엇이 발생하는가
근시안적 관점에서 볼 때, 용량이 중요합니다. 울트라패스트는 제한된 프리뷰이며, 두 회사는 더 넓은 가용성을 용량 증가와 연결지으며, 확장의 속도는 주목할 점입니다. 더 긴 질문은 세레브라스의 온칩 메모리优势가 오픈AI의 모델이 성장함에 따라 유지되는지 여부입니다. 이는 웨이퍼 규모 아키텍처가 구축된賭け입니다.












