Seedream 5.0 Pro ya está aquí | Pruébalo en el Generador de Imágenes →
meta
meta-llama/llama-guard-4-12b

meta-llama/llama-guard-4-12b

Fecha de lanzamiento: 2025-04-30

163,840 context · $0.18/M input tokens · $0.18/M output tokens

Llama Guard 4 is a Llama 4 Scout-derived multimodal pretrained model, fine-tuned for content safety classification. Similar to previous versions, it can be used to classify content in both LLM...

Precios

Pago por uso

Sin costos iniciales, paga solo por lo que uses

Entrada$0.18 / M Tokens
Salida$0.18 / M Tokens

Probar el modelo

meta-llama/llama-guard-4-12b
En línea
meta
¡Hola! Soy un asistente de IA útil. ¿En qué puedo ayudarte?
¿Listo para usar este modelo en un coding agent local?Configurar agent

Uso de API

Usa los siguientes ejemplos de código para integrar con nuestra API:

import OpenAI from 'openai';

if (!process.env.WAVESPEED_API_KEY) throw new Error('Set WAVESPEED_API_KEY');
const client = new OpenAI({
  apiKey: process.env.WAVESPEED_API_KEY,
  baseURL: 'https://llm.wavespeed.ai/v1',
  timeout: 120_000,
  maxRetries: 2,
});

try {
  const response = await client.chat.completions.create({
    model: 'meta-llama/llama-guard-4-12b',
    messages: [{ role: 'user', content: 'Hello!' }],
  });
  console.log(response.choices[0]?.message?.content ?? '');
} catch (error) {
  console.error('LLM request failed:', error);
  process.exitCode = 1;
}

Introducción del modelo

Meta-Llama llama-guard-4-12b

meta-llama llama-guard-4-12b


Why It Looks Great

  • Large Language Model architecture for efficient processing
  • 163840 context window for long document handling
  • Competitive pricing at $0.2/$0.2 per million tokens

Key Features

  • Context Window: 163840 tokens
  • Max Output: 4096 tokens
  • Vision: Supported
  • Function Calling: Supported

Specifications

SpecificationValue
ProviderMeta-Llama
Model TypeLarge Language Model (LLM)
ArchitectureN/A
Context Window163840 tokens
Max Output4096 tokens
InputText
OutputText
VisionSupported
Function CallingSupported

Pricing

Token TypeCost per Million Tokens
Input$0.2
Output$0.2

How to Use

  1. Write your prompt — describe the task, provide context, and specify desired output format.
  2. Submit — the model processes your request and returns the response.

API Integration

Base URL: https://llm.wavespeed.ai/v1 API Endpoint: chat/completions Model ID: meta-llama/llama-guard-4-12b


API Usage

Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://llm.wavespeed.ai/v1"
)

response = client.chat.completions.create(
    model="meta-llama/llama-guard-4-12b",
    messages=[
        {"role": "user", "content": "Hello!"}
    ]
)

print(response.choices[0].message.content)

cURL

curl https://llm.wavespeed.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -d '{
    "model": "meta-llama/llama-guard-4-12b",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Notes

  • Model: meta-llama/llama-guard-4-12b
  • Provider: Meta-Llama

Información

Proveedormeta
Tipollm

Funcionalidades compatibles

Entrada
TextoImagen
Salida
Texto
Contexto163,840
Salida máxima4,096
Visión✓ Compatible
Function Calling-

Guía de acceso a la API

Base URLhttps://llm.wavespeed.ai/v1
API Endpointchat/completions
ID del modelometa-llama/llama-guard-4-12b

Llama Guard 4 12b API

meta-llama/llama-guard-4-12b

Llama Guard 4 is a Llama 4 Scout-derived multimodal pretrained model, fine-tuned for content safety classification. Similar to previous versions, it can be used to classify content in both LLM...

Entrada

$0.18 /M

Salida

$0.18 /M

Contexto

164K

Salida máx.

4K

Visión

Compatible

Prueba Llama Guard 4 12b en WaveSpeedAI

Accede a Llama Guard 4 12b mediante nuestra API unificada — compatible con OpenAI, sin arranques en frío, precios transparentes.

Preguntas frecuentes sobre Llama Guard 4 12b

¿Cuánto cuesta Llama Guard 4 12b a través de la API?+

Precios en WaveSpeedAI: $0.18 por millón de tokens de entrada y $0.18 por millón de tokens de salida. El prompt caching y el procesamiento por lotes se facturan por separado y reducen el coste efectivo en cargas largas y repetitivas.

¿Cuál es la ventana de contexto de Llama Guard 4 12b?+

Llama Guard 4 12b admite hasta 164K tokens de contexto y hasta 4K tokens de salida por solicitud.

¿Es Llama Guard 4 12b compatible con OpenAI?+

WaveSpeedAI ofrece Llama Guard 4 12b en https://llm.wavespeed.ai/v1 mediante la interfaz Chat Completions compatible con OpenAI. En la mayoría de clientes del SDK de OpenAI basta con cambiar la URL base y la clave API; los campos opcionales dependen del modelo.

¿Cómo empiezo con Llama Guard 4 12b?+

Inicia sesión en WaveSpeedAI, crea una clave API en Access Keys y envía una solicitud a https://llm.wavespeed.ai/v1/chat/completions con el id de modelo mostrado arriba. Consulta el catálogo actual para conocer disponibilidad, capacidades y precios.

APIs LLM relacionadas

Llama Guard 4 12b | Meta LLM API | WaveSpeedAI