본문으로 건너뛰기
API초급

Groq 고속 추론 API

Groq는 자체 LPU 하드웨어를 통해 초고속 LLM 추론을 구현하여, 인기 오픈소스 모델을 놀라울 정도로 낮은 지연시간으로 API 호출할 수 있습니다. 속도가 중요한 챗봇·코드 어시스턴트 등 실시간 애플리케이션에 이상적이며, 토큰 사용량 기반 과금입니다.

개요

"Groq 고속 추론 API"은(는) AI Resource Hub가 선별한 "API" 유형의 리소스로, AI API 카테고리에 속하며 초급 수준의 학습자에게 적합합니다. Groq이(가) 제공하며 2026-06-02에 마지막으로 업데이트되었고, 편집자 평가는 4.6/5입니다. 원본 페이지를 열려면 오른쪽의 "리소스 방문"을 클릭하세요.

태그

그로크API고속 추론LPU

주요 기능

  • 자체 LPU 하드웨어로 오픈 모델을 초고속 추론
  • 손쉬운 전환을 위한 OpenAI 호환 API
  • 실시간 챗에 알맞은 낮은 지연 시간

장점

  • +현존 최고 속도급의 토큰 처리량
  • +기존 OpenAI 코드에 바로 끼워 넣기 가능
  • +지연에 민감한 앱에 이상적인 초고속 추론

단점

  • 지원되는 오픈 모델로 선택지가 제한됨
  • 멀티 제공사 라우터보다 프런티어 모델 수가 적음
  • 대규모 오프라인·온프레미스 워크로드에는 부적합

자주 묻는 질문

리소스 방문 →

세부 정보

가격
사용량 기반; 시작은 무료 등급으로
제작자
Groq
편집자 평가
4.6 / 5
최근 업데이트
2026년 6월 2일