Groq
por Groq · groq.com ↗
Plataforma de inferência de IA com hardware LPU personalizado para servir modelos de linguagem abertos com latência muito baixa.
inference llm-hosting infrastructure
- Categoria
- Plataformas e infraestrutura
- Modelo de negócio
- Freemium
- Disponibilidade
- Global
- Lançado
- 2024-02
- Registro atualizado
- 2026-07-29
- Fundada
- 2016
- Sede
- US
Visão geral
O Groq é uma plataforma de inferência de IA impulsionada por seu hardware LPU (unidade de processamento de linguagem) personalizado. Serve modelos de linguagem abertos como o Llama com latência muito baixa, focada na geração de tokens em alta velocidade. Oferece uma API compatível com OpenAI com um nível gratuito e uso pago por token.
Principais recursos
- Inferência de latência muito baixa em hardware LPU personalizado
- Inferência hospedada para modelos abertos como o Llama
- API compatível com OpenAI para migração fácil
- Geração de tokens em alta velocidade para aplicações em tempo real
Casos de uso
- Oferecer respostas de baixa latência para aplicações conversacionais
- Executar modelos abertos com alta taxa de transferência
- Impulsionar agentes e streaming para experiências em tempo real
Preços
Oferece uma API de inferência com um nível gratuito; o uso pago é cobrado por token e varia conforme o modelo.
Perguntas frequentes
O que o Groq oferece?
O Groq oferece inferência de IA em alta velocidade impulsionada por seu hardware LPU personalizado, servindo modelos de linguagem abertos com latência muito baixa.
O que é uma LPU?
A LPU (unidade de processamento de linguagem) é o chip personalizado do Groq, projetado para inferência rápida e de baixa latência de modelos de linguagem.
O Groq é gratuito?
O Groq oferece uma API com um nível gratuito; o uso pago segue o preço por token de cada modelo.
Produtos similares
- Amazon Bedrock — Serviço gerenciado da AWS para criar aplicações com modelos de fundação de vários provedores por meio de uma única API.
- Amazon Nova — Portfólio da AWS de modelos de fundação e serviços criados pela Amazon para texto, multimodalidade, fala, construção de modelos personalizados e agentes que automatizam a IU.
- Azure AI Foundry — Plataforma da Microsoft para criar, avaliar e implantar aplicações e agentes de IA no Azure.
- Baseten — Plataforma para implantar e servir modelos de machine learning como APIs escaláveis.
- Cerebras — Empresa de computação de IA cuja nuvem de inferência serve modelos de linguagem abertos em hardware em escala de wafer.
- Civitai — Plataforma comunitária para compartilhar e descobrir modelos abertos de geração de imagens, LoRAs e arte gerada.
Todas as alternativas a Groq → · Todos os produtos de Plataformas e infraestrutura →
Fontes
Este registro foi revisado pela última vez em 2026-07-29.
Registro legível por máquina: /api/products/groq.json · Encontrou um erro? Sugerir uma correção