Groq
来自 Groq · groq.com ↗
由自研 LPU 硬件驱动的 AI 推理平台,可以极低延迟托管开放语言模型。
inference llm-hosting infrastructure
- 分类
- 平台与基础设施
- 商业模式
- 免费增值
- 可用性
- 全球
- 发布
- 2024-02
- 记录更新
- 2026-07-29
- 成立时间
- 2016
- 总部所在地
- US
概述
Groq 是一个 AI 推理平台,由其自研的 LPU(语言处理单元)硬件驱动。它以极低延迟托管 Llama 等开放语言模型,专注于高速的 token 生成。提供 OpenAI 兼容 API,含免费档位与按 token 计费的付费用量。
主要功能
- 基于自研 LPU 硬件的极低延迟推理
- 面向 Llama 等开放模型的托管推理
- 便于迁移的 OpenAI 兼容 API
- 面向实时应用的高速 token 生成
适用场景
- 为对话式应用提供低延迟响应
- 以高吞吐量运行开放模型
- 为实时体验提供智能体与流式处理
定价
提供含免费档位的推理 API;付费用量按 token 计费,不同模型价格各异。
常见问题
Groq 提供什么?
Groq 提供由其自研 LPU 硬件驱动的高速 AI 推理,以极低延迟托管开放语言模型。
LPU 是什么?
LPU(语言处理单元)是 Groq 自研的芯片,专为语言模型的高速、低延迟推理而设计。
Groq 免费吗?
Groq 提供含免费档位的 API;付费用量按各模型的每 token 定价计算。
同类产品
- Amazon Bedrock — AWS 的托管服务,可通过单一 API 使用来自多家提供商的基础模型构建应用。
- Amazon Nova — AWS 推出的亚马逊自研基础模型与服务组合,覆盖文本、多模态、语音、定制模型构建以及可自动化界面操作的智能体。
- Azure AI Foundry — 微软的平台,可在 Azure 上构建、评估并部署 AI 应用与智能体。
- Baseten — 将机器学习模型部署并作为可扩展 API 提供服务的平台。
- Cerebras — AI 算力公司,其推理云基于晶圆级硬件托管开放语言模型。
- Civitai — 用于分享与发现开放图像生成模型、LoRA 与生成作品的社区平台。
来源
本记录最近复核于 2026-07-29。
机器可读记录:/api/products/groq.json · 发现错误?提交纠错