Seedance 2.0 | Special Offer ✦ 10% OFF NOW
meta
meta-llama/llama-3.2-3b-instruct

meta-llama/llama-3.2-3b-instruct

80,000 context · $0.05/M input tokens · $0.34/M output tokens

Llama 3.2 3B is a 3-billion-parameter multilingual large language model, optimized for advanced natural language processing tasks like dialogue generation, reasoning, and summarization. Designed with the latest transformer architecture, it...

Precios

Pago por uso

Sin costos iniciales, paga solo por lo que uses

Entrada$0.05 / M Tokens
Salida$0.34 / M Tokens

Uso de API

Usa los siguientes ejemplos de código para integrar con nuestra API:

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://llm.wavespeed.ai/v1"
)

response = client.chat.completions.create(
    model="meta-llama/llama-3.2-3b-instruct",
    messages=[
        {"role": "user", "content": "Hello!"}
    ]
)

print(response.choices[0].message.content)

Introducción del modelo

Meta-Llama llama-3.2-3b-instruct

meta-llama llama-3.2-3b-instruct


Why It Looks Great

  • Large Language Model architecture for efficient processing
  • 131072 context window for long document handling
  • Competitive pricing at $0.0/$0.0 per million tokens

Key Features

  • Context Window: 131072 tokens
  • Max Output: 16384 tokens
  • Vision: Supported
  • Function Calling: Supported

Specifications

SpecificationValue
ProviderMeta-Llama
Model TypeLarge Language Model (LLM)
ArchitectureN/A
Context Window131072 tokens
Max Output16384 tokens
InputText
OutputText
VisionSupported
Function CallingSupported

Pricing

Token TypeCost per Million Tokens
Input$0.0
Output$0.0

How to Use

  1. Write your prompt — describe the task, provide context, and specify desired output format.
  2. Submit — the model processes your request and returns the response.

API Integration

Base URL: https://llm.wavespeed.ai/v1 API Endpoint: chat/completions Model ID: meta-llama/llama-3.2-3b-instruct


API Usage

Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://llm.wavespeed.ai/v1"
)

response = client.chat.completions.create(
    model="meta-llama/llama-3.2-3b-instruct",
    messages=[
        {"role": "user", "content": "Hello!"}
    ]
)

print(response.choices[0].message.content)

cURL

curl https://llm.wavespeed.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -d '{
    "model": "meta-llama/llama-3.2-3b-instruct",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Notes

  • Model: meta-llama/llama-3.2-3b-instruct
  • Provider: Meta-Llama

Información

Proveedormeta
Tipollm

Funcionalidades compatibles

Entrada
Texto
Salida
Texto
Contexto80,000
Salida máxima16,384
Visión-
Function Calling-

Guía de acceso a la API

Base URLhttps://llm.wavespeed.ai/v1
API Endpointchat/completions
ID del modelometa-llama/llama-3.2-3b-instruct

Llama 3.2 3b Instruct API

meta-llama/llama-3.2-3b-instruct

Llama 3.2 3B is a 3-billion-parameter multilingual large language model, optimized for advanced natural language processing tasks like dialogue generation, reasoning, and summarization. Designed with the latest transformer architecture, it...

Entrada

$0.051 /M

Salida

$0.34 /M

Contexto

80K

Salida máx.

16K

Prueba Llama 3.2 3b Instruct en WaveSpeedAI

Accede a Llama 3.2 3b Instruct mediante nuestra API unificada — compatible con OpenAI, sin arranques en frío, precios transparentes.

Abrir Playground

Preguntas frecuentes sobre Llama 3.2 3b Instruct

¿Cuánto cuesta Llama 3.2 3b Instruct a través de la API?+

Precios en WaveSpeedAI: $0.05 por millón de tokens de entrada y $0.34 por millón de tokens de salida. El prompt caching y el procesamiento por lotes se facturan por separado y reducen el coste efectivo en cargas largas y repetitivas.

¿Cuál es la ventana de contexto de Llama 3.2 3b Instruct?+

Llama 3.2 3b Instruct admite hasta 80K tokens de contexto y hasta 16K tokens de salida por solicitud.

¿Es Llama 3.2 3b Instruct compatible con OpenAI?+

Sí. WaveSpeedAI expone Llama 3.2 3b Instruct a través de un endpoint compatible con OpenAI en https://llm.wavespeed.ai/v1. Apunta el SDK oficial de OpenAI a esta base URL con tu clave API de WaveSpeedAI — sin más cambios de código.

¿Cómo empiezo con Llama 3.2 3b Instruct?+

Inicia sesión en WaveSpeedAI, crea una clave API en Access Keys y envía una solicitud a https://llm.wavespeed.ai/v1/chat/completions con el id de modelo mostrado arriba. Las cuentas nuevas reciben créditos gratuitos para evaluar Llama 3.2 3b Instruct antes de pagar por token.

APIs LLM relacionadas