Groq
Groq · 공식 사이트 ↗

Groq는 자체 개발한 LPU(Language Processing Unit) 칩을 기반으로 대형언어모델을 매우 빠른 속도로 추론(inference)할 수 있게 해주는 클라우드 API 플랫폼입니다. Llama, Mixtral, Whisper 등 오픈소스 계열 모델을 API 호출이나 웹 기반 플레이그라운드를 통해 바로 사용할 수 있으며, 직접 모델을 학습시키는 용도가 아니라 이미 공개된 모델을 얹어 서비스하는 데 초점이 맞춰져 있습니다. 범용 LLM 제공사와 달리 자체 모델을 새로 만들기보다 추론 속도와 응답 지연(latency) 최소화에 특화된 하드웨어·인프라를 내세우는 점이 특징입니다. 실시간 음성 응답, 챗봇, 에이전트 파이프라인처럼 응답 속도가 사용자 경험에 직결되는 애플리케이션을 만드는 개발자에게 적합합니다.
강점
- 체감 가능한 수준의 빠른 응답 속도
- OpenAI API와 유사한 방식으로 손쉬운 연동
- 여러 오픈소스 모델을 한 API에서 선택적으로 사용 가능
- 실시간성이 중요한 서비스에 적합한 저지연 구조
한계
- 자체 파운데이션 모델은 제공하지 않고 오픈소스 모델 호스팅 위주
- 제공 모델 라인업이 원 개발사의 공개 일정에 좌우됨
- 세밀한 파인튜닝·커스터마이징 기능은 제한적
- 비개발자를 위한 완성형 앱보다는 API 중심이라 별도 구현이 필요
주요 기능
LPU 기반 고속 추론 엔진OpenAI 호환 API 인터페이스Llama, Mixtral 등 다양한 오픈소스 모델 지원낮은 응답 지연을 활용한 실시간 애플리케이션 구축웹 기반 플레이그라운드를 통한 즉시 테스트
요금
요금 미확인. 이 서비스의 구독가는 아직 사람이 확인하지 않았습니다. 추정치를 적지 않는 것이 이 사이트의 원칙입니다 — 공식 요금 페이지에서 확인하세요.
정보
| 제공사 | Groq |
|---|---|
| 국가 | US |
| 한국어 | — |
| 무료 플랜 | — |
| 최종 갱신 | 2026-09-25 |