Back to Registry

Groq API Catalog

Comprehensive overview of all groq models available through the LLM Kit

Overview

Provider
groq
Total Models
23
Last Updated
2026-08-03

allam-2-7b

Model ID allam-2-7b
Family
allam-2-7b

Specifications

Context Window: 4,096 tokens
Max Output Tokens: 4,096 tokens

Modalities

Input
text
Output
text

Capabilities

Json output System messages

Pricing (per million tokens)

Text Tokens - Standard

canopylabs/orpheus-arabic-saudi

Model ID canopylabs/orpheus-arabic-saudi
Family
canopylabs/orpheus-arabic-saudi

Specifications

Context Window: tokens

Modalities

Input
text
Output
audio

Pricing (per million tokens)

Text Tokens - Standard

canopylabs/orpheus-v1-english

Model ID canopylabs/orpheus-v1-english
Family
canopylabs/orpheus-v1-english

Specifications

Context Window: 200 tokens

Modalities

Input
text
Output
audio

Pricing (per million tokens)

Text Tokens - Standard

gemma-7b-it

Model ID gemma-7b-it
Family
gemma-7b-it

Specifications

Context Window: 8,192 tokens
Max Output Tokens: 8,192 tokens

Modalities

Input
text
Output
text

Capabilities

Function calling Tool choice

Pricing (per million tokens)

Text Tokens - Standard
Input
$0.049999999999999996
Output
$0.08

groq/compound

Model ID groq/compound
Family
groq/compound

Specifications

Context Window: 131,072 tokens
Max Output Tokens: 8,192 tokens

Modalities

Input
text
Output
text

Capabilities

System messages Code execution Json output

Pricing (per million tokens)

Text Tokens - Standard

groq/compound-mini

Model ID groq/compound-mini
Family
groq/compound-mini

Specifications

Context Window: 131,072 tokens
Max Output Tokens: 8,192 tokens

Modalities

Input
text
Output
text

Capabilities

System messages Code execution

Pricing (per million tokens)

Text Tokens - Standard

llama-3.1-8b-instant

Model ID llama-3.1-8b-instant
Family
llama-3.1-8b-instant

Specifications

Context Window: 131,072 tokens
Max Output Tokens: 131,072 tokens

Modalities

Input
text
Output
text

Capabilities

Function calling Parallel function calling Tool choice Json output

Pricing (per million tokens)

Text Tokens - Standard
Input
$0.049999999999999996
Output
$0.08

llama-3.3-70b-versatile

Model ID llama-3.3-70b-versatile
Family
llama-3.3-70b-versatile

Specifications

Context Window: 131,072 tokens
Max Output Tokens: 32,768 tokens

Modalities

Input
text
Output
text

Capabilities

Function calling Parallel function calling Tool choice System messages Json output

Pricing (per million tokens)

Text Tokens - Standard
Input
$0.59
Output
$0.7899999999999999

meta-llama/llama-4-maverick-17b-128e-instruct

Model ID meta-llama/llama-4-maverick-17b-128e-instruct
Family
meta-llama/llama-4-maverick-17b-128e-instruct

Specifications

Context Window: 131,072 tokens
Max Output Tokens: 8,192 tokens

Modalities

Input
image
Output
text

Capabilities

Structured output Function calling Tool choice

Pricing (per million tokens)

Text Tokens - Standard
Input
$0.19999999999999998
Output
$0.6

meta-llama/llama-4-scout-17b-16e-instruct

Model ID meta-llama/llama-4-scout-17b-16e-instruct
Family
meta-llama/llama-4-scout-17b-16e-instruct

Specifications

Context Window: 131,072 tokens
Max Output Tokens: 8,192 tokens

Modalities

Input
text, image
Output
text

Capabilities

Function calling Parallel function calling Tool choice Structured output Json output

Pricing (per million tokens)

Text Tokens - Standard
Input
$0.11
Output
$0.33999999999999997

meta-llama/llama-guard-4-12b

Model ID meta-llama/llama-guard-4-12b
Family
meta-llama/llama-guard-4-12b

Specifications

Context Window: 131,072 tokens
Max Output Tokens: 1,024 tokens

Modalities

Input
text
Output
text

Pricing (per million tokens)

Text Tokens - Standard
Input
$0.19999999999999998
Output
$0.19999999999999998

meta-llama/llama-prompt-guard-2-22m

Model ID meta-llama/llama-prompt-guard-2-22m
Family
meta-llama/llama-prompt-guard-2-22m

Specifications

Context Window: 512 tokens
Max Output Tokens: 512 tokens

Modalities

Input
text
Output
text

Pricing (per million tokens)

Text Tokens - Standard
Input
$0.03
Output
$0.03

meta-llama/llama-prompt-guard-2-86m

Model ID meta-llama/llama-prompt-guard-2-86m
Family
meta-llama/llama-prompt-guard-2-86m

Specifications

Context Window: 512 tokens
Max Output Tokens: 512 tokens

Modalities

Input
text
Output
text

Capabilities

Json output

Pricing (per million tokens)

Text Tokens - Standard
Input
$0.04
Output
$0.04

moonshotai/kimi-k2-instruct

Model ID moonshotai/kimi-k2-instruct
Family
moonshotai/kimi-k2-instruct

Specifications

Context Window: 131,072 tokens
Max Output Tokens: 16,384 tokens

Modalities

Input
text
Output
text

Pricing (per million tokens)

Text Tokens - Standard

moonshotai/kimi-k2-instruct-0905

Model ID moonshotai/kimi-k2-instruct-0905
Family
moonshotai/kimi-k2-instruct-0905

Specifications

Context Window: 256,000 tokens

Modalities

Input
text
Output
text

Capabilities

Prompt caching

Pricing (per million tokens)

Text Tokens - Standard
Input
$1.0
Output
$3.0
Text Tokens - Cached
Output
$0.5

openai/gpt-oss-120b

Model ID openai/gpt-oss-120b
Family
openai/gpt-oss-120b

Specifications

Context Window: 131,072 tokens
Max Output Tokens: 65,536 tokens

Modalities

Input
text
Output
text

Capabilities

Function calling Tool choice Structured output Prompt caching Code execution Json output

Pricing (per million tokens)

Text Tokens - Standard
Input
$0.15
Output
$0.6
Text Tokens - Cached
Output
$0.075

openai/gpt-oss-20b

Model ID openai/gpt-oss-20b
Family
openai/gpt-oss-20b

Specifications

Context Window: 131,072 tokens
Max Output Tokens: 65,536 tokens

Modalities

Input
text
Output
text

Capabilities

Function calling Tool choice Structured output Prompt caching Json output System messages Code execution

Pricing (per million tokens)

Text Tokens - Standard
Input
$0.075
Output
$0.3
Text Tokens - Cached
Output
$0.0375

openai/gpt-oss-safeguard-20b

Model ID openai/gpt-oss-safeguard-20b
Family
openai/gpt-oss-safeguard-20b

Specifications

Context Window: 131,072 tokens
Max Output Tokens: 65,536 tokens

Modalities

Input
text
Output
text

Capabilities

Function calling System messages Prompt caching Structured output Code execution Json output

Pricing (per million tokens)

Text Tokens - Standard
Input
$0.075
Output
$0.3
Text Tokens - Cached
Output
$0.0375

playai-tts

Model ID playai-tts
Family
playai-tts

Specifications

Context Window: 10,000 tokens
Max Output Tokens: 10,000 tokens

Modalities

Input
text
Output
text

Pricing (per million tokens)

Text Tokens - Standard

qwen/qwen3-32b

Model ID qwen/qwen3-32b
Family
qwen/qwen3-32b

Specifications

Context Window: 131,072 tokens
Max Output Tokens: 40,960 tokens

Modalities

Input
text
Output
text

Capabilities

Function calling Parallel function calling Json output Tool choice

Pricing (per million tokens)

Text Tokens - Standard
Input
$0.29
Output
$0.59

qwen/qwen3.6-27b

Model ID qwen/qwen3.6-27b
Family
qwen/qwen3.6-27b

Specifications

Context Window: 131,072 tokens
Max Output Tokens: 16,384 tokens

Modalities

Input
text, image
Output
text

Capabilities

Function calling Json output System messages

Pricing (per million tokens)

Text Tokens - Standard
Input
$0.6
Output
$3.0

whisper-large-v3

Model ID whisper-large-v3
Family
whisper-large-v3

Specifications

Context Window: 448 tokens
Max Output Tokens: 448 tokens

Modalities

Input
audio
Output
text

Pricing (per million tokens)

Text Tokens - Standard

whisper-large-v3-turbo

Model ID whisper-large-v3-turbo
Family
whisper-large-v3-turbo

Specifications

Context Window: 448 tokens
Max Output Tokens: 448 tokens

Modalities

Input
audio
Output
text

Pricing (per million tokens)

Text Tokens - Standard