#model-release
307 articles - Page 22

OpenAI GPT Image 1.5 文字轉圖像现已登陆WaveSpeedAI
GPT Image 1.5 文字轉圖像是 OpenAI 快速、成本高效的文字轉圖像生成器,採用 GPT-5 指導技術。從自然語言提示(可選擇搭配圖像)創建逼真照片、產品渲染、概念藝術和風格化圖形。支援自訂長寬比、種子

Runway Upscale V1 現已登陸WaveSpeedAI
RunwayML Upscale V1 透過簡單檔案上傳將影片升級至 4K,以 $0.02/秒的價格計費,提供快速、高品質的升級。隨時可用的 REST 推論 API、最佳效能、無冷啟動、價格實惠。

Ace Step 提示詞轉音聲现已登陆WaveSpeedAI
ACE-Step 提示詞轉音聲從簡單提示詞創建音樂,自動生成流派標籤和歌詞以快速創建歌曲。開箱即用的 REST 推理 API、最佳性能、無冷啟動、價格實惠。

內容審核員影像现已登陆WaveSpeedAI
影像內容審核員提供自動化影像審核,以檢測和標記違反政策或不適當的影像以供自動化使用。開箱即用的 REST 推理 API、最佳性能、無冷啟動、經濟實惠的定價。

Minicpm V 圖像现已登陆WaveSpeedAI
MiniCPM-V 4.5 是最新、最強大的 MiniCPM-V 圖像模型,用於準確的 AI 圖像理解和視覺任務分析。可立即使用的 REST 推理 API、最佳性能、無冷啟動、價格實惠。

Minicpm V Video 现已登陆WaveSpeedAI
MiniCPM-V 4.5是最新、最強大的MiniCPM-V模型,用於AI視頻理解和分析。即用型REST推理API、最佳性能、無冷啟動、價格實惠。

WAN 2.2 圖像轉圖像现已登陆WaveSpeedAI
WAN 2.2 (14B) 是一個圖像轉圖像模型,用於高分辨率照片寫實圖像編輯,具有卓越的精度和保真度。可立即使用的 REST 推論 API、最佳性能、無冷啟動、價格實惠。

阿里巴巴 Qwen3 TTS Flash 现已登陆WaveSpeedAI
阿里巴巴 Qwen3 TTS Flash:適用於英文和中文的低延遲文字轉語音,支援多種聲音,非常適合即時對話。現成可用的 REST 推論 API、最佳效能、無冷啟動、價格實惠。

ByteDance Latentsync 現已登陸WaveSpeedAI
ByteDance LatentSync 結合 Stable Diffusion 與 TREPA,實現高解析度端對端唇形同步,在生成的影片中呈現精確、逼真的嘴部動作。即用型 REST 推論 API,效能卓越,無冷啟動,定價實惠。

Sam 3d Body 现已登陆WaveSpeedAI
先進的 SAM 3D 人體生成模型,用於從影像創建詳細的 3D 人體模型,支援可選的遮罩式分割。提供即用型 REST 推論 API、最佳效能、無冷啟動、經濟實惠的價格。

Sam 3d Objects 现已登陆WaveSpeedAI
先進的 SAM 3D 物體生成模型,用於從圖像創建詳細的 3D 物體模型,支持文本提示和可選的遮罩式分割。現成可用的 REST 推論 API,最佳效能、無冷啟動、價格實惠。

Any Llm 现已登陆WaveSpeedAI
Any LLM 是一個多功能的大型語言模型,用於文本生成、理解和多樣化的自然語言處理任務,如聊天和摘要。提供開箱即用的 REST 推論 API、最佳性能、無冷啟動、親民的價格。