Seedream 5.0 Pro est en ligne | Essayez dans le Générateur d'images →
moonshot
moonshotai/kimi-k2.5

moonshotai/kimi-k2.5

Date de publication: 2026-01-27

262,144 context · $0.60/M input tokens · $3.00/M output tokens

Kimi K2.5 is Moonshot AI's native multimodal model, delivering state-of-the-art visual coding capability and a self-directed agent swarm paradigm. Built on Kimi K2 with continued pretraining over approximately 15T mixed...

Tarification

Paiement à l'usage

Aucun coût initial, payez uniquement ce que vous utilisez

Entrée$0.60 / M Tokens
Sortie$3.00 / M Tokens
Cache Read$0.10 / M Tokens

Essayer le modèle

moonshotai/kimi-k2.5
En ligne
moonshot
Bonjour ! Je suis un assistant IA utile. Que puis-je faire pour vous ?
Prêt à utiliser ce modèle dans un coding agent local ?Setup agent

Utilisation de l'API

Utilisez les exemples de code suivants pour intégrer notre API :

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["WAVESPEED_API_KEY"],
    base_url="https://llm.wavespeed.ai/v1",
    timeout=120.0,
    max_retries=2,
)

try:
    response = client.chat.completions.create(
        model="moonshotai/kimi-k2.5",
        messages=[{"role": "user", "content": "Hello!"}],
    )
    print(response.choices[0].message.content or "")
except Exception as exc:
    raise SystemExit(f"LLM request failed: {exc}") from exc

Introduction au modèle

Moonshotai kimi-k2.5

Kimi K2.5 is Moonshot AI's native multimodal model, delivering state-of-the-art visual coding capability and a self-directed agent swarm paradigm. Bui

Kimi K2.5 is Moonshot AI's native multimodal model, delivering state-of-the-art visual coding capability and a self-directed agent swarm paradigm. Built on Kimi K2 with continued pretraining over approximately 15T mixed visual and text tokens, it delivers strong performance in general reasoning, visual coding, and agentic tool-calling.


Why It Looks Great

  • Large Language Model architecture for efficient processing
  • 262144 context window for long document handling
  • Competitive pricing at $0.6/$3.0 per million tokens

Key Features

  • Context Window: 262144 tokens
  • Max Output: N/A tokens
  • Vision: Supported
  • Function Calling: Supported

Specifications

SpecificationValue
ProviderMoonshotai
Model TypeLarge Language Model (LLM)
ArchitectureN/A
Context Window262144 tokens
Max Outputtokens
InputText
OutputText
VisionSupported
Function CallingSupported

Pricing

Token TypeCost per Million Tokens
Input$0.6
Output$3.0

How to Use

  1. Write your prompt — describe the task, provide context, and specify desired output format.
  2. Submit — the model processes your request and returns the response.

API Integration

Base URL: https://llm.wavespeed.ai/v1 API Endpoint: chat/completions Model ID: moonshotai/kimi-k2.5


API Usage

Python SDK

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://llm.wavespeed.ai/v1"
)

response = client.chat.completions.create(
    model="moonshotai/kimi-k2.5",
    messages=[
        {"role": "user", "content": "Hello!"}
    ]
)

print(response.choices[0].message.content)

cURL

curl https://llm.wavespeed.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -d '{
    "model": "moonshotai/kimi-k2.5",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Notes

  • Model: moonshotai/kimi-k2.5
  • Provider: Moonshotai

Infos

Fournisseurmoonshot
Typellm

Fonctionnalités prises en charge

Entrée
TexteImage
Sortie
Texte
Contexte262,144
Sortie max65,535
Vision✓ Pris en charge
Function Calling✓ Pris en charge

Guide d'accès API

Base URLhttps://llm.wavespeed.ai/v1
API Endpointchat/completions
ID du modèlemoonshotai/kimi-k2.5

Kimi K2.5 API

moonshotai/kimi-k2.5

Kimi K2.5 is Moonshot AI's native multimodal model, delivering state-of-the-art visual coding capability and a self-directed agent swarm paradigm. Built on Kimi K2 with continued pretraining over approximately 15T mixed...

Entrée

$0.6 /M

Sortie

$3 /M

Contexte

262K

Sortie max.

66K

Vision

Pris en charge

Utilisation d'outils

Pris en charge

Essayez Kimi K2.5 sur WaveSpeedAI

Accédez à Kimi K2.5 via notre API unifiée — compatible OpenAI, sans démarrages à froid, prix transparents.

Questions fréquentes sur Kimi K2.5

Combien coûte l'API Kimi K2.5 ?+

Tarification sur WaveSpeedAI : $0.60 par million de tokens d'entrée et $3.00 par million de tokens de sortie. Le prompt caching et le traitement par batch sont facturés séparément et réduisent le coût effectif sur les charges longues et répétitives.

Quelle est la fenêtre de contexte de Kimi K2.5 ?+

Kimi K2.5 prend en charge jusqu'à 262K tokens de contexte et jusqu'à 66K tokens de sortie par requête.

Kimi K2.5 est-il compatible avec OpenAI ?+

WaveSpeedAI expose Kimi K2.5 à https://llm.wavespeed.ai/v1 via l’interface Chat Completions compatible OpenAI. La plupart des clients du SDK OpenAI fonctionnent en changeant l’URL de base et la clé API ; les champs facultatifs dépendent du modèle.

Comment démarrer avec Kimi K2.5 ?+

Connectez-vous à WaveSpeedAI, créez une clé API dans Access Keys, puis envoyez une requête à https://llm.wavespeed.ai/v1/chat/completions avec l’id du modèle affiché ci-dessus. Consultez le catalogue actuel pour la disponibilité, les capacités et les tarifs.

APIs LLM associées

Kimi K2.5 | Moonshot AI Multimodal Coding API | WaveSpeedAI