오픈AI, GPT-5.6 솔 최대 14배 빠른 API 등급 '울트라패스트' 제한 프리뷰
오픈AI가 현지시간 2026년 8월 13일 GPT-5.6 솔용 새 API 등급 '울트라패스트'의 제한적 프리뷰에 들어간다고 발표했다. 오픈AI의 설명으로는 표준 처리 방식과 견줘 최대 14배 빠르며, 출력은 초당 750토큰까지 나온다. 토큰은 언어 모델이 만들어내는 텍스트의 구성 단위다.

무엇이 달라지나
울트라패스트는 GPT-5.6 솔에 적용되는 새 API 등급이다. 오픈AI는 종전에는 실시간 수준의 속도를 얻기 위해 더 작거나 특정 작업에 특화된 모델을 선택하는 경우가 많았다고 설명했다.
울트라패스트에서도 지능 수준이 표준 버전과 동일하게 유지된다는 오픈AI의 설명은
오픈AI가 제시한 활용 분야는 사고 대응, 고객지원과 음성 서비스, 금융·보안 분석, 전자상거래, 실시간 연구·실험이다. 오픈AI는 밤새 실행하던 실험을 업무 시간 안에 여러 차례 반복하고 수정하는 방식으로 바꿀 수 있다고 밝혔다.
속도의 기반
속도는 오픈AI와 세레브라스의 협력에 따른 추론 인프라에서 나온다. 추론은 모델이 요청에 응답하는 처리를 뜻한다.

칩에 44GB SRAM을 얹어 모델 가중치를 담는 세레브라스 하드웨어가 이 인프라의 바탕이며, GPU 기반 추론에서 생기는 메모리 대역폭 병목을 없애는 데 초점을 뒀다는 설명은 ZDNet Korea의 단일 보도다. 메모리 대역폭 병목은 연산 장치가 데이터를 넘겨받는 속도에 막혀 성능이 떨어지는 현상이다. 같은 매체는 울트라패스트가 품질 저하 없이 종단 간 5.6배의 속도 향상을 기록했다고 전했다. 최대 14배와 이 수치는 측정 방식이 서로 다른 값이다.
The Decoder는 오픈AI가 GPT-5.6 솔에 약 두 배 가격으로 최대 2.5배 속도를 제공하는 패스트 모드를 운영하고 있어 울트라패스트가 세 번째 속도 등급이 된다고 보도했다. 같은 매체는 세레브라스가 2026년 오픈AI와 100억달러 규모의 협력을 체결했다고 전했다.
적용 대상과 남은 사항
울트라패스트는 오픈AI API를 통해 선별된 소수 고객에게 먼저 제공된다. 오픈AI는 인프라 용량이 늘어나는 대로 접근 대상을 확대할 계획이라고 밝혔다. AI타임스는 제인 스트리트와 포디움, 베이시스, 로고가 초기 테스트에 참여한 것으로 전해졌다고 보도했으며, 이는 확정된 명단은 아니다.
오픈AI는 사내 사고 대응과 연구 과정에서 울트라패스트를 시험하고 있으며, 실제 시스템의 최종 판단과 배포 책임은 엔지니어에게 있다고 밝혔다. 구체적인 가격과 정식 출시 일정은 공개되지 않았다고

자료사진 출처
총 3건- 벽걸이 거치대에 설치된 아마존 에코닷 3세대 스마트 스피커 · 자료사진
- 2020년 10월 샌프란시스코 4번가의 MemSQL 사무실 · 자료사진
- 파란 링이 켜진 아마존 에코 스마트 스피커 · 자료사진
원문 출처
총 4건- AI타임스 오픈AI, 14배 빠른 '울트라패스트' 모드 공개..."지능과 속도 다 잡았다"
- TechCrunch OpenAI introduces ‘Ultrafast,’ a new mode that makes GPT-5.6 Sol work at 14x the speed
- The Decoder GPT-5.6 Sol goes 14x faster as OpenAI launches Ultrafast mode powered by Cerebras
- ZDNet Korea GPT-5.6 14배 빨라졌다…오픈AI '울트라패스트'의 정체
이 기사는 위 원문들에서 사실만 교차 확인해 재구성했으며, 원문 문장·사진을 전재하지 않았습니다. 집필 단계의 AI는 원문을 열람하지 않고, 별도 검증을 통과한 사실만 사용했습니다. 사실관계에 오류가 있다면 정정을 요청해 주세요(nickpark77@gmail.com).
AI 다른 기사
AI 스트레이트 뉴스 ✓ 4개 출처 교차
머스크 측, 애플 상대 청구 취하…오픈AI 상대로는 계속
AI 해설 ✓ 2개 출처 교차
앤스로픽, 금융 자문가용 클로드 출시…투자 분석·리서치 도구와 연결
AI 스트레이트 뉴스 ✓ 3개 출처 교차


