Groq
Groq
자체 프로세서 LPU로 고속 추론을 제공하는 클라우드. 추론 전용 인프라를 대규모로 운영한다.
AI models & APIs문의 필요

공식 사이트 방문
지원 플랫폼
WebAPI
개요
Groq는 “추론에 특화된 최상위 뉴클라우드(the premier neocloud for fast inference)”를 내세우는 추론 기반입니다. 자체 개발한 프로세서 LPU가 중심이며, 차세대 LPX에서는 랙당 256개의 LPU 가속기를 NVIDIA 차세대 GPU와 조합해 저지연·대용량 컨텍스트 추론을 제공한다고 밝힙니다. 제공 형태는 베어메탈 기반의 GroqMetal, 추론 스택을 올린 GroqCore, 기업용 거버넌스와 감사 기능을 더한 GroqAssured의 3계층이며 하위 계층을 포함하는 구성입니다. 4개 대륙 13곳의 데이터센터를 운영한다고 기재되어 있습니다. 요금은 공개되어 있지 않습니다.
주요 기능
- 자체 프로세서 LPU에 의한 고속 추론
- LPX(NVIDIA 차세대 GPU와의 조합)
- 베어메탈 기반 GroqMetal
- 추론 스택 GroqCore
- 기업용 통제의 GroqAssured
- 4개 대륙 13곳의 데이터센터
요금제
Contact sales
영업팀 문의
- GroqMetal / GroqCore / GroqAssured
- No published rate card
- Contact for a quote
사용자의 국가에서 확인된 요금이 아직 없습니다. 현지 제공 여부와 가격은 공식 사이트에서 확인해 주세요.
스크린샷

관련 AI 도구
Together AI
Together AI는 AI 개발 플랫폼·API 서비스로, AI 개발이나 추론에 활용할 수 있는 AI 서비스입니다.
AI models & APIs유료
Fireworks AI
오픈 모델의 추론·학습·전용 배포를 함께 제공하는 AI 기반. 토큰과 GPU 시간 단위 종량 과금.
AI models & APIs유료
Replicate
Replicate는 AI 개발 플랫폼·API 서비스로, AI 개발이나 프로토타입에 활용할 수 있는 AI 서비스입니다.
AI models & APIs유료
OpenRouter
OpenRouter는 AI 개발 플랫폼·API 서비스로, AI 개발이나 모델 비교에 활용할 수 있는 AI 서비스입니다.
AI models & APIs유료