
Detect, identify, and segment objects in images and videos with AI models on WaveSpeed

Moondream3 Point finds objects in images and returns precise coordinate points for computer vision tasks, enabling accurate point localization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

Moondream3 Point finds objects in images and returns precise coordinate points for computer vision tasks, enabling accurate point localization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

Moondream3 Detect: Precise object bounding boxes in images for accurate computer vision localization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

Advanced SAM 3D body generation model for creating detailed 3D human body models from images with optional mask-based segmentation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

Advanced SAM 3D objects generation model for creating detailed 3D object models from images with text prompts and optional mask-based segmentation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

SAM3 Video is a unified foundation model for prompt-based video segmentation. Provide text, point, box, or mask prompts and the model segments and tracks targets across frames with strong temporal consistency. Supports concept-level (“segment anything with concepts”) and multi-object masks for editing, analytics, and VFX. Ready-to-use REST inference API with fast response, no cold starts, and affordable pricing.

SAM 3 is a unified foundation model for promptable image segmentation using text, points, or boxes to detect and segment objects. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

SAM 3 Video RLE is a unified foundation model for prompt-based segmentation in video. Track and segment objects across frames using text, points, or boxes, returning RLE encoded masks for efficient processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

SAM 3 RLE is a unified foundation model for promptable image segmentation using text, points, or boxes to detect and segment objects. Returns RLE (Run-Length Encoding) encoded masks for efficient storage and processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

Bria Embed Product seamlessly integrates product images into scene backgrounds with natural lighting and perspective matching. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

VOID Video Inpainting removes objects from videos using mask-guided inpainting. Supports quad-mask or auto-generated SAM-3 masks, optional Pass 2 refinement for temporal consistency, adjustable denoising steps, guidance scale, and temporal window size. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Запускайте любую модель из коллекции Object Detection and Segmentation через один REST API. Оплата за генерацию — без подписок, без минимумов — с лидирующей в отрасли задержкой на инфраструктуре с аптаймом 99,9%.
Цена за вызов для каждой модели Object Detection and Segmentation. Цена указана на странице каждой модели — без комиссий платформы сверху.
Большинство моделей изображений Object Detection and Segmentation выполняются менее чем за 2 секунды. Видео- и 3D-модели в несколько раз быстрее самостоятельно размещаемых аналогов.
Мультирегиональная отказоустойчивость и автоматические повторы поддерживают ваш продакшен-трафик онлайн — даже при сбоях провайдера.
У каждой модели своя цена за вызов, указанная на странице модели. Мы выставляем счёт за каждую успешную генерацию, без подписок и минимумов.
Модели изображений в этой коллекции обычно выполняются менее чем за 2 секунды. Видео- и 3D-модели зависят от длительности и разрешения, но обычно в несколько раз быстрее самостоятельно размещаемых запусков.
Да — каждый аккаунт получает 1 $ бесплатных кредитов при регистрации — достаточно, чтобы попробовать большинство моделей Object Detection and Segmentation без банковской карты.
Стандартные аккаунты имеют щедрые лимиты на параллельные задачи. Enterprise-планы предлагают индивидуальный RPM, более высокую конкурентность и выделенную мощность — свяжитесь с отделом продаж для подробностей.
Просмотрите наш полный каталог современных AI-моделей — изображения, видео, 3D, аудио, LLM и многое другое.
wavespeed.ai/models →Интегрируйте AI в свои приложения. RESTful API с клиентскими библиотеками — без холодных стартов, оплата по факту использования.
wavespeed.ai/docs →