OpenAI, 엔비디아 블랙웰로 GPT-6 울트라패스트 가속
요약
OpenAI의 GPT-6 Astra Ultrafast가 엔비디아 블랙웰 GPU 기반으로 OpenAI API와 일부 ChatGPT Work·Codex 사용자에게 제공되기 시작했다. OpenAI 측은 이 모드가 기존 Astra Standard 모드보다 토큰 생성 속도가 최대 8배 빠르다고 밝혔다. OpenAI는 자사 모델을 활용해 엔비디아 GPU용 추론 소프트웨어를 직접 최적화했으며, 엔비디아의 프로그래밍 가능한 플랫폼이 이를 뒷받침했다고 설명했다. 코드 작성, 도구 호출, 결과 확인을 반복하는 코딩 에이전트 워크플로에서 응답 속도 개선이 특히 체감된다고 OpenAI는 설명했다.
큐레이터 노트
원문에 없는 맥락입니다
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
AWS가 Amazon SageMaker AI Inference Recommendations에 내장된 '동시성 스윕' 기능을 소개했다. 엔드포인트에 동시 요청 수를 점진적으로 늘리며 처리량과 지연시간을 측정해, 별도의 부하테스트 인프라 없이 최적의 인스턴스 유형과 서빙 구성을 찾을 수 있…
Z.ai(지푸 AI)가 17일(현지시간) 자체 개발한 언어모델 'GLM'을 활용해 차세대 AI 모델의 추론 인프라를 직접 구축하고 최적화한 사례를 공개했다. 회사는 AI가 스스로 후속 모델을 설계·학습하는 '재귀적 자기개선(RSI)' 단계에는 아직 도달하지 않았다고 밝혔다. 다만 GLM…
AWS는 Amazon SageMaker AI에 Hugging Face 모델을 배포할 때 Kiro와 Claude Code 같은 코딩 에이전트가 활용할 수 있는 여섯 가지 에이전트 스킬을 Hugging Face Skills 저장소를 통해 공개했다. 테스트에서 스킬 없이 작동한 에이전트는 서…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-09-18구글, 검색 속도 20배 높이는 R4T 프레임워크 공개AI타임스
- 2026-09-18앤트로픽, '클로드 코드 프로젝트' 공개AI타임스
- 2026-09-13오픈AI, 'GPT-6 아스트라'용 코덱스 프롬프트 지침 공개AI타임스
- 2026-09-10AWS 세이지메이커, 프리픽스 인식 라우팅 도입AWS ML Blog
- 2026-09-07깃허브, AI 코딩 모델 라우팅 시스템 '하이드라퓨전' 공개AI타임스
이 글에 나온 말
이 분야 브리핑
여러 매체가 함께 다룬 사안을 한 번에
- 마이크론 역대 최대 실적, 메모리값 폭등 여파기사 13건
- HBM 이후 AI 메모리 지도가 넓어진다기사 14건
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- NVIDIA DGX Spark 64GB 출시, 두 대 연결해 로컬 AI 확장NVIDIA Blog · 2026-10-02
- 구글, 우주 데이터센터엔 스타십 1800회 발사 필요 분석AI타임스 · 2026-10-02
- 에스티엔인포텍, 美 크레도와 국내 유통 계약 체결AI타임스 · 2026-10-02
- 한전 변전소 AI 관제에 국산 NPU 투입, 리벨리온과 실증ZDNet Korea · 2026-10-02
- 국산 AI 반도체 묶는 마이크로데이터센터 성과 공개ZDNet Korea · 2026-10-02
- 한전, 국산 NPU 성능지표 K-Perf 첫 실증 도입전자신문 SW · 2026-10-02