WaveSpeedAI

Bria FIBO 现已登陆WaveSpeedAI

FIBO 是一個開源的 JSON 原生文字轉圖像模型,將意圖映射到結構化控制項以實現精確的企業級圖像生成。提供即用型 REST 推論 API、最佳性能、無冷啟動、價格實惠。

By WaveSpeedAI2 min read
Bria Fibo
Bria FiboFIBO 是一個開源的 JSON 原生文字轉圖像模型,將意圖映射到結構化控制項以實現精確的企業級圖像生成。提供即用型 R...
Try it
Bria FIBO 现已登陆WaveSpeedAI

介紹 Bria FIBO:WaveSpeedAI 上首個 JSON 原生文字轉圖像模型

WaveSpeedAI 很榮幸宣佈 Bria FIBO 的推出,這是一個革命性的文字轉圖像模型,為 AI 圖像生成帶來了前所未有的精準度和控制力。FIBO 代表了開發者和企業處理視覺內容創建方式的根本轉變——從不可預測的提示詞工程轉變為結構化、可重複且符合法律的圖像生成。

什麼是 Bria FIBO?

FIBO 是由 Bria AI 開發的 80 億參數最先進的文字轉圖像模型,是首個真正 JSON 原生的同類模型。與傳統文字轉圖像模型不同(其輸出可能變化不定),FIBO 將您的提示詞轉換為結構化 JSON 模式,精確指定每個視覺元素——從光照和構圖到相機設置和景深。

FIBO 建立在基於 DiT 的流匹配架構上,採用 SmolLM3-3B 作為文字編碼器,Wan 2.2 作為 VAE。該模型完全使用許可數據進行訓練,每個結構化 JSON 說明文字平均超過 1,000 字。這種獨特的訓練方法使模型能夠以非凡的準確度理解和響應細微的視覺指令。

FIBO 真正與眾不同之處在於其企業級基礎:100% 許可訓練數據、完整的 GDPR 和歐盟 AI 法案合規性、完整的來源追蹤和 C2PA 水印。對於在複雜的 AI 生成內容權利環境中導航的企業,FIBO 完全消除了法律障礙。

主要功能

  • JSON 原生架構:每個提示詞都轉換為機器可讀的結構化模式,實現版本控制、自動化和無縫集成到複雜的生產工作流中

  • 三種強大的工作模式

    • 生成:將簡短提示詞轉換為包含 1,000+ 字描述的完整 JSON 模式,涵蓋光照、相機、構圖等內容
    • 優化:進行有針對性的屬性更改(如「85mm 鏡頭」、「更溫暖的色調」),而不影響無關元素——不再有提示詞漂移
    • 靈感:從參考圖像提取結構化提示詞,並將其與新的創意意圖混合,以實現一致的變化
  • 分離式控制:調整相機角度、光照方向或色板等個別屬性,而不破壞整體場景構圖

  • 企業級合規性:建立在 100% 許可數據基礎上,具有完整的法律保障、GDPR 合規性和歐盟 AI 法案就緒

  • 強大的提示詞遵循:FIBO 在 PRISM-Bench 評估中的文字對齐和美學品質表現都優於同類開源基準

  • 可重複輸出:相同的提示詞、參數和種子總是產生相同的結果——對於品牌一致性和生產管道至關重要

  • VLM 引導提示詞:整合視覺語言模型,自動將簡短描述轉換為豐富的結構化模式

使用案例

品牌和行銷資產

跨渠道創建一致的視覺活動。FIBO 的結構化方法確保您的產品拍攝保持相同的光照風格、背景處理和品牌美感,無論您生成一張圖像還是一千張。可重複性功能對 A/B 測試非常寶貴,因為您只需要改變特定變量。

電子商務產品攝影

大規模生成專業產品圖像。在結構化提示詞中定義一次工作室設置——光照配置、相機角度、背景——然後更換產品同時保持完美一致性。這大大降低了傳統產品攝影的成本和時間。

社群媒體內容創建

生成針對平台優化的視覺效果,內置對 Instagram 方形圖 (1:1)、故事和短影音 (9:16) 或 YouTube 縮圖 (16:9) 的寬高比支持。負面提示詞功能幫助您避免常見的瑕疵,如文字疊加、浮水印或扭曲元素。

廣告和活動開發

優化模式在反覆創意開發中表現出色。從一個概念開始,然後逐步調整元素——「使用日落光照」、「改為 35mm 廣角」、「添加景深」——同時保留核心構圖。每次迭代都可追蹤且可重複。

自動化內容管道

FIBO 的 JSON 原生設計使其非常適合程式化內容生成。將來自您的 CMS、DAM 或電子商務平台的結構化規範直接提供給 API。機器可讀的模式與現有自動化基礎設施自然集成。

概念藝術和視覺開發

使用靈感模式快速探索創意方向。上傳參考圖像,FIBO 的視覺語言元件提取詳細的結構化描述,您可以隨後修改和重新生成——非常適合探索主題的變化。

WaveSpeedAI 入門

通過 WaveSpeedAI 訪問 Bria FIBO 非常簡單,相比自行託管或其他平台提供了多項優勢:

  1. 訪問模型頁面:導航至 https://wavespeed.ai/models/bria/fibo 直接訪問模型

  2. 編寫您的提示詞:從清晰描述您的主題、設置、光照和風格開始。例如:「巴黎夜間舒適的屋頂花園,溫暖的串燈,淺景深,電影般光暈」

  3. 選擇寬高比:根據您的輸出需求選擇 1:1(社群方形)、16:9(橫向/橫幅)、9:16(縱向/短影音)、4:5 或 3:2

  4. 使用選擇性控制進行優化

    • 添加負面提示詞 以避免不需要的元素(「模糊、多餘手指、浮水印、文字瑕疵」)
    • 使用結構化提示詞 獲得模式風格的指導,包含特定的物件列表或佈局約束
    • 設置種子 以獲得可重複的結果
  5. 生成:執行模型,在數秒內接收您的圖像

FIBO 在 WaveSpeedAI 上的價格僅為每張圖像 $0.04,提供了絕佳的價值。結合我們平台的零冷啟動和持續快速的推理時間,您可以將生產級圖像生成集成到您的工作流中,無需基礎設施麻煩或不可預測的延遲。

為什麼選擇 WaveSpeedAI?

通過 WaveSpeedAI 運行 FIBO 意味著您可以獲得:

  • 無冷啟動:您的 API 調用無需等待模型加載即可立即處理
  • 一致性能:可靠的生產應用推理時間
  • 簡單集成:與任何技術堆疊集成的 RESTful API
  • 實惠定價:以具有競爭力的單張圖像費率按使用付費
  • 可擴展性:在無需配置基礎設施的情況下處理突發流量

結論

Bria FIBO 代表了文字轉圖像生成的新典範——一種精準度、可重複性和法律清晰度內置於基礎中而非事後補充的模式。無論您是在構建自動化內容管道、大規模創建行銷資產,還是開發需要一致視覺生成的產品,FIBO 的 JSON 原生架構提供了專業工作流所需的控制力和可預測性。

最先進的圖像質量、企業級合規性和結構化控制的結合使 FIBO 成為認真考慮將 AI 圖像生成集成到其產品和流程中的團隊的必備工具。

準備好體驗結構化圖像生成了嗎? 立即在 WaveSpeedAI 上試用 Bria FIBO,發現當 AI 圖像生成變得真正可控時的無限可能。

分享