OpenAI o4 Mini | Compact Multimodal Reasoning API

Name: o4 Mini API
Brand: openai
Price: 1.1 USD
Availability: InStock

openai/o4-mini

Data de lançamento: 2025-04-17

200,000 context · $1.10/M input tokens · $4.40/M output tokens

OpenAI o4-mini is a compact reasoning model in the o-series, optimized for fast, cost-efficient performance while retaining strong multimodal and agentic capabilities. It supports tool use and demonstrates competitive reasoning...

Preços

Pagamento por uso

Sem custo inicial, pague apenas pelo que usar

Entrada$1.10 / M Tokens

Saída$4.40 / M Tokens

Cache Read$0.28 / M Tokens

Experimentar o modelo

openai/o4-mini

Online

Olá! Sou um assistente de IA útil. Em que posso ajudar?

Pronto para usar este modelo em um coding agent local?Setup do agente

Uso da API

Use os exemplos de código abaixo para integrar com nossa API:

import OpenAI from 'openai';

if (!process.env.WAVESPEED_API_KEY) throw new Error('Set WAVESPEED_API_KEY');
const client = new OpenAI({
  apiKey: process.env.WAVESPEED_API_KEY,
  baseURL: 'https://llm.wavespeed.ai/v1',
  timeout: 120_000,
  maxRetries: 2,
});

try {
  const response = await client.chat.completions.create({
    model: 'openai/o4-mini',
    messages: [{ role: 'user', content: 'Hello!' }],
  });
  console.log(response.choices[0]?.message?.content ?? '');
} catch (error) {
  console.error('LLM request failed:', error);
  process.exitCode = 1;
}

import OpenAI from 'openai';

if (!process.env.WAVESPEED_API_KEY) throw new Error('Set WAVESPEED_API_KEY');
const client = new OpenAI({
  apiKey: process.env.WAVESPEED_API_KEY,
  baseURL: 'https://llm.wavespeed.ai/v1',
  timeout: 120_000,
  maxRetries: 2,
});

try {
  const response = await client.chat.completions.create({
    model: 'openai/o4-mini',
    messages: [{ role: 'user', content: 'Hello!' }],
  });
  console.log(response.choices[0]?.message?.content ?? '');
} catch (error) {
  console.error('LLM request failed:', error);
  process.exitCode = 1;
}

Introdução do modelo

Openai o4-mini

openai o4-mini

Why It Looks Great

Large Language Model architecture for efficient processing
200000 context window for long document handling
Competitive pricing at $1.2/$4.8 per million tokens

Key Features

Context Window: 200000 tokens
Max Output: 100000 tokens
Vision: Supported
Function Calling: Supported

Specifications

Specification	Value
Provider	Openai
Model Type	Large Language Model (LLM)
Architecture	N/A
Context Window	200000 tokens
Max Output	100000 tokens
Input	Text
Output	Text
Vision	Supported
Function Calling	Supported

Pricing

Token Type	Cost per Million Tokens
Input	$1.2
Output	$4.8

How to Use

Write your prompt — describe the task, provide context, and specify desired output format.
Submit — the model processes your request and returns the response.

API Integration

Base URL: https://llm.wavespeed.ai/v1 API Endpoint: chat/completions Model ID: openai/o4-mini

API Usage

Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://llm.wavespeed.ai/v1"
)

response = client.chat.completions.create(
    model="openai/o4-mini",
    messages=[
        {"role": "user", "content": "Hello!"}
    ]
)

print(response.choices[0].message.content)

cURL

curl https://llm.wavespeed.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -d '{
    "model": "openai/o4-mini",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Notes

Model: openai/o4-mini
Provider: Openai

Info

Provedoropenai

Tipollm

Funcionalidades suportadas

Entrada

TextoImagem

Saída

Texto

Contexto200,000

Saída máx.100,000

Vision✓ Suportado

Function Calling✓ Suportado

Guia de acesso à API

Base URLhttps://llm.wavespeed.ai/v1

API Endpointchat/completions

ID do modeloopenai/o4-mini

Perguntas frequentes sobre o4 Mini

Quanto custa o4 Mini via API?+

Preços no WaveSpeedAI: $1.10 por milhão de tokens de entrada e $4.40 por milhão de tokens de saída. Prompt caching e batch processing são cobrados separadamente e reduzem o custo efetivo em cargas longas e repetitivas.

Qual é a janela de contexto do o4 Mini?+

o4 Mini suporta até 200K tokens de contexto e até 100K tokens de saída por requisição.

o4 Mini é compatível com OpenAI?+

O WaveSpeedAI disponibiliza o4 Mini em https://llm.wavespeed.ai/v1 pela interface Chat Completions compatível com OpenAI. Na maioria dos clientes OpenAI SDK, basta alterar a base URL e a chave API; campos opcionais dependem do modelo.

Como começo a usar o o4 Mini?+

Entre no WaveSpeedAI, crie uma chave API em Access Keys e envie uma requisição para https://llm.wavespeed.ai/v1/chat/completions com o model id mostrado acima. Consulte o catálogo atual para disponibilidade, recursos e preços.