Google DeepMind Genie 3: 인터랙티브 환경을 생성하는 세계 모델
텍스트 프롬프트에서 실시간으로 인터랙티브하고 탐색 가능한 가상 환경을 생성하는 획기적인 세계 모델인 Google DeepMind의 Genie 3를 살펴보세요.
Bria Fibo Edit, WaveSpeedAI에 출시
FIBO는 의도를 구조화된 제어로 매핑하여 정확한 엔터프라이즈 이미지 생성을 지원하는 오픈소스 JSON 기반 이미지-이미지 모델입니다. 즉시 사용 가능한 REST 추론
MiniMax Speech 2.8 HD, WaveSpeedAI에 출시
MiniMax Speech 2.8 HD는 자연스럽고 표현력 있는 음성 합성으로 프리미엄 오디오 품질을 제공하는 고품질 텍스트-음성 변환 모델입니다. 바로 사용 가능한 REST 인터페이스
MiniMax Speech 2.8 Turbo, WaveSpeedAI에 출시
MiniMax Speech 2.8 Turbo는 자연스럽고 표현력 있는 음성 합성 기능을 갖춘 고정의 텍스트 음성 변환 모델입니다. 즉시 사용 가능한 REST 추론 API, 최고의 성능
PixVerse V5.6 Image-to-Video, WaveSpeedAI에 출시
PixVerse V5.6 Image-to-Video는 단일 이미지를 매끄러운 동작, 선명한 디테일, 강력한 피사체 충실도를 갖춘 영화 같은 클립으로 변환합니다—로고 스팅어에 이상적입니다.
PixVerse V5.6, WaveSpeedAI에 출시
PixVerse V5.6는 텍스트 프롬프트를 매끄러운 모션과 자연스러운 디테일의 현실적인 비디오로 몇 초 안에 변환합니다—스토리, 광고, 소셜 클립에 이상적입니다. 준비 완료
Vidu One Click V2 Mv, WaveSpeedAI에 출시
Vidu One-Click V2 MV는 이미지와 오디오를 카메라 움직임과 자막 지원이 포함된 비디오로 변환합니다. 역동적인 샷으로 전문적인 비디오 콘텐츠를 만들어보세요
Hunyuan Image 3 Instruct Text-to-Image, WaveSpeedAI에 출시
Tencent의 Hunyuan Image 3.0 Instruct 텍스트-이미지 모델로 고품질 이미지 생성. 바로 사용 가능한 REST 추론 API, 최고의 성능, 콜드 스타트 없음
Hunyuan Image 3 Instruct Edit, WaveSpeedAI에 출시
Hunyuan Image 3.0 Instruct Edit – 자연어 프롬프트를 사용한 지시 기반 이미지 편집으로, 최대 2개의 참조 이미지를 지원하여 정확한 수정이 가능합니다
IC-Light V2, WaveSpeedAI에 출시
IC-Light V2는 AI 기반 이미지 재조명 모델입니다. 커스터마이징 가능한 조명 방향으로 모든 이미지를 재조명할 수 있습니다. 즉시 사용 가능한 REST 추론 API, 최고의 성능,
WaveSpeedAI LTX 2 19b LipSync, WaveSpeedAI에 출시
LTX-2 Lipsync는 참고 이미지와 오디오 입력으로부터 동기화된 토킹 헤드 비디오를 생성합니다. 19B DiT 아키텍처로 구동되며 고충실도를 제공합니다
Meshy6 Image To 3D, WaveSpeedAI에 출시
Meshy 6는 2D 이미지를 정확한 기하학적 재구성과 우수한 텍스처 품질로 고품질 3D 모델로 변환합니다. 즉시 사용 가능한 REST 추론 API, 최고의