跳到内容
API入门

Groq 高速推理 API

Groq 通过自研 LPU 硬件实现超快 LLM 推理,以极低延迟提供热门开源模型的 API 调用。它非常适合聊天机器人和代码助手等对速度有要求的实时应用,按 token 用量计费。

资源概览

《Groq 高速推理 API》是 AI Resource Hub 收录的一份「API」类资源,归属 AI API 分类,适合入门水平的学习者。该资源由 Groq 提供,最近更新于 2026-06-02,本站编辑评分为 4.6/5。点击右侧「访问资源」可前往原始页面。

标签

GroqAPI高速推理LPU

核心特性

  • 基于定制 LPU 硬件,开源模型推理极快
  • OpenAI 兼容 API,迁移简单
  • 低延迟,适合实时对话

优点

  • +token 吞吐速度名列前列
  • +可直接替换现有 OpenAI 代码
  • +极速推理,适合对延迟敏感的应用

不足

  • 模型选择限于所支持的开源模型
  • 前沿模型数量少于多提供商路由
  • 不适合超大规模离线或本地部署

常见问题

访问资源 →

基本信息

价格
按用量计费;有免费版可先试
作者
Groq
编辑评分
4.6 / 5
最近更新
2026年6月2日