Groq
제공: Groq · groq.com ↗
맞춤형 LPU 하드웨어로 오픈 언어 모델을 매우 낮은 지연으로 서빙하는 AI 추론 플랫폼.
inference llm-hosting infrastructure
- 카테고리
- 플랫폼 및 인프라
- 비즈니스 모델
- 프리미엄(부분 무료)
- 이용 가능성
- 글로벌
- 출시
- 2024-02
- 레코드 업데이트
- 2026-07-29
- 설립
- 2016
- 본사
- US
개요
Groq는 자체 LPU(언어 처리 장치) 하드웨어로 구동되는 AI 추론 플랫폼입니다. Llama 같은 오픈 언어 모델을 매우 낮은 지연으로 서빙하며 고속 토큰 생성에 특화되어 있습니다. 무료 등급과 토큰 단위 유료 사용을 포함한 OpenAI 호환 API를 제공합니다.
주요 기능
- 자체 LPU 하드웨어에서의 매우 낮은 지연 추론
- Llama 같은 오픈 모델을 위한 호스팅 추론
- 쉽은 마이그레이션을 위한 OpenAI 호환 API
- 실시간 애플리케이션을 위한 고속 토큰 생성
활용 사례
- 대화형 애플리케이션을 위한 저지연 응답 제공
- 높은 처리량으로 오픈 모델 실행
- 실시간 경험을 위한 에이전트와 스트리밍 구동
가격
무료 등급이 있는 추론 API를 제공하며, 유료 사용은 토큰 단위로 과금되고 모델마다 가격이 다릅니다.
자주 묻는 질문
Groq는 무엇을 제공하나요?
Groq는 자체 LPU 하드웨어로 구동되는 고속 AI 추론을 제공하며 오픈 언어 모델을 매우 낮은 지연으로 서빙합니다.
LPU란 무엇인가요?
LPU(언어 처리 장치)는 언어 모델의 빠르고 저지연인 추론을 위해 설계된 Groq의 자체 칩입니다.
Groq는 무료인가요?
Groq는 무료 등급이 있는 API를 제공하며, 유료 사용은 각 모델의 토큰당 가격을 따릅니다.
유사 제품
- Amazon Bedrock — 여러 공급자의 파운데이션 모델을 단일 API로 사용해 애플리케이션을 구축하는 AWS 관리형 서비스.
- Amazon Nova — 텍스트, 멀티모달, 음성, 맞춤 모델 구축, UI 자동화 에이전트를 위한 Amazon 자체 기반 모델과 서비스의 AWS 포트폴리오.
- Azure AI Foundry — Azure에서 AI 애플리케이션과 에이전트를 구축·평가·배포하는 Microsoft의 플랫폼.
- Baseten — 머신러닝 모델을 확장 가능한 API로 배포·서빙하는 플랫폼.
- Cerebras — 웨이퍼 스케일 하드웨어에서 오픈 언어 모델을 서빙하는 추론 클라우드를 갖춘 AI 컴퓨팅 기업.
- Civitai — 오픈 이미지 생성 모델, LoRA, 생성 작품을 공유하고 발견하는 커뮤니티 플랫폼.
출처
이 레코드는 2026-07-29에 마지막으로 검토되었습니다.
기계 판독용 레코드: /api/products/groq.json · 오류를 발견하셨나요? 수정 제안