Vidu Q3 Pro ya está disponible — pruébalo ahora
meta
meta-llama/llama-guard-4-12b

meta-llama/llama-guard-4-12b

163,840 context · $0.18/M input tokens · $0.18/M output tokens

Llama Guard 4 is a Llama 4 Scout-derived multimodal pretrained model, fine-tuned for content safety classification. Similar to previous versions, it can be used to classify content in both LLM...

Precios

Pago por uso

Sin costos iniciales, paga solo por lo que uses

Entrada$0.18 / M Tokens
Salida$0.18 / M Tokens

Probar el modelo

meta-llama/llama-guard-4-12b
En línea
meta
¡Hola! Soy un asistente de IA útil. ¿En qué puedo ayudarte?

Uso de API

Usa los siguientes ejemplos de código para integrar con nuestra API:

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://llm.wavespeed.ai/v1"
)

response = client.chat.completions.create(
    model="meta-llama/llama-guard-4-12b",
    messages=[
        {"role": "user", "content": "Hello!"}
    ]
)

print(response.choices[0].message.content)

Introducción del modelo

Meta-Llama llama-guard-4-12b

meta-llama llama-guard-4-12b


Why It Looks Great

  • Large Language Model architecture for efficient processing
  • 163840 context window for long document handling
  • Competitive pricing at $0.2/$0.2 per million tokens

Key Features

  • Context Window: 163840 tokens
  • Max Output: 4096 tokens
  • Vision: Supported
  • Function Calling: Supported

Specifications

SpecificationValue
ProviderMeta-Llama
Model TypeLarge Language Model (LLM)
ArchitectureN/A
Context Window163840 tokens
Max Output4096 tokens
InputText
OutputText
VisionSupported
Function CallingSupported

Pricing

Token TypeCost per Million Tokens
Input$0.2
Output$0.2

How to Use

  1. Write your prompt — describe the task, provide context, and specify desired output format.
  2. Submit — the model processes your request and returns the response.

API Integration

Base URL: https://llm.wavespeed.ai/v1 API Endpoint: chat/completions Model ID: meta-llama/llama-guard-4-12b


API Usage

Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://llm.wavespeed.ai/v1"
)

response = client.chat.completions.create(
    model="meta-llama/llama-guard-4-12b",
    messages=[
        {"role": "user", "content": "Hello!"}
    ]
)

print(response.choices[0].message.content)

cURL

curl https://llm.wavespeed.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -d '{
    "model": "meta-llama/llama-guard-4-12b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Notes

  • Model: meta-llama/llama-guard-4-12b
  • Provider: Meta-Llama

Información

Proveedormeta
Tipollm

Funcionalidades compatibles

Entrada
TextoImagen
Salida
Texto
Contexto163,840
Salida máxima4,096
Visión✓ Compatible
Function Calling-

Guía de acceso a la API

Base URLhttps://llm.wavespeed.ai/v1
API Endpointchat/completions
ID del modelometa-llama/llama-guard-4-12b

Llama Guard 4 12b API

meta-llama/llama-guard-4-12b

Llama Guard 4 is a Llama 4 Scout-derived multimodal pretrained model, fine-tuned for content safety classification. Similar to previous versions, it can be used to classify content in both LLM...

Entrada

$0.18 /M

Salida

$0.18 /M

Contexto

164K

Salida máx.

4K

Visión

Compatible

Prueba Llama Guard 4 12b en WaveSpeedAI

Accede a Llama Guard 4 12b mediante nuestra API unificada — compatible con OpenAI, sin arranques en frío, precios transparentes.

Preguntas frecuentes sobre Llama Guard 4 12b

¿Cuánto cuesta Llama Guard 4 12b a través de la API?+

Precios en WaveSpeedAI: $0.18 por millón de tokens de entrada y $0.18 por millón de tokens de salida. El prompt caching y el procesamiento por lotes se facturan por separado y reducen el coste efectivo en cargas largas y repetitivas.

¿Cuál es la ventana de contexto de Llama Guard 4 12b?+

Llama Guard 4 12b admite hasta 164K tokens de contexto y hasta 4K tokens de salida por solicitud.

¿Es Llama Guard 4 12b compatible con OpenAI?+

Sí. WaveSpeedAI expone Llama Guard 4 12b a través de un endpoint compatible con OpenAI en https://llm.wavespeed.ai/v1. Apunta el SDK oficial de OpenAI a esta base URL con tu clave API de WaveSpeedAI — sin más cambios de código.

¿Cómo empiezo con Llama Guard 4 12b?+

Inicia sesión en WaveSpeedAI, crea una clave API en Access Keys y envía una solicitud a https://llm.wavespeed.ai/v1/chat/completions con el id de modelo mostrado arriba. Las cuentas nuevas reciben créditos gratuitos para evaluar Llama Guard 4 12b antes de pagar por token.

APIs LLM relacionadas