智象未來×商湯大裝置:國產算力跑通影片生成規模化應用

4分鐘

國產算力走向規模商用,如何跨過從「適配驗證」到「真實生產」的關鍵一步,正成為行業面對的新課題。
 

近期,商湯大裝置與智象未來以影片生成業務為切入點,跑通了從國產算力適配到規模應用的完整鏈路。

對於以圖像、影片生成模型為核心的AI企業而言,國產化並非簡單地將模型從一種GPU遷移到另一種GPU。尤其是影片生成模型,參數規模大、推理鏈路長、計算密集度高,從底層算力、推理框架到模型性能、生成效果和工具鏈,每一個環節都可能成為國產化落地的「卡點」。

作為全球領先的多模態生成式人工智能創新企業,智象未來(HiDream.ai)致力於打造下一代原生全模態世界模型。依託自主研發的HiDream系列大模型,智象未來持續布局商業營銷、影視創作、內容創作等場景,目前,其產品已覆蓋全球100多個國家和地區,服務超過5,000萬名專業用戶及逾4萬家企業客戶。

ScreenShot_2026-09-01_174419_013.png

作為智象未來重要的AI基礎設施合作夥伴,商湯大裝置持續通過穩定、高效的AI基礎設施,支援其模型快速研發和迭代。此次,雙方進一步將合作延伸至國產算力適配驗證。

圍繞智象未來的重點業務,商湯大裝置從底層算力替代出發,深入模型推理、性能優化、生成效果等關鍵環節,通過全棧技術適配與FDE專家服務,協助智象未來實現在國產算力環境下的平穩運行,為多模態大模型的國產化部署形成可複用樣板。


依託LightX2V多卡並行

實現影片生成加速比達93%
 

對於視覺生成應用而言,性能不足不僅會增加用戶使用成本,也會影響產品體驗和業務規模化應用。因此,此次合作中,智象未來提出了明確的業務指標:在國產算力環境下,實現高清影片的高效生成,並將端到端生成時長優化至業內領先水平。

基於此具體目標,商湯大裝置團隊基於LightX2V進行了多卡並行優化,並進一步探索多機多卡場景下的擴展能力。首先從模型優化入手,基於訓練-推理聯合優化的思路,通過LightX2V步數蒸餾、CFG蒸餾等訓練方案,在保持影片質量的同時顯著提升推理速度。

推理過程中,通過引入CFG雙分支並行、Ulysses序列並行、TP並行等多層次並行策略,對影片生成過程中的計算任務進行拆解與協同調度,在滿足業務效果的基礎上提升多卡資源利用效率和並行加速能力。

最終,在國產芯片運行DiT模型的場景下,多卡並行影片生成加速比達到93%,充分釋放國產算力性能。

ScreenShot_2026-09-01_174753_573.png

效果優化

提升多卡生成效果一致性
 

如果模型遷移到新的算力環境後生成速度提升了,但人物表情、動作、細節等出現明顯變化,那麼這樣的國產化遷移依然難以真正進入生產環境。

在多卡推理過程中,雙方團隊發現,同一模型在單卡和多卡環境下可能存在細微的生成效果差異,例如人物表情等特徵表現不同。針對這一問題,商湯大裝置團隊進一步優化多卡通信過程,通過重新注入Face特徵等方式,加強多卡推理過程中的特徵一致性,使多卡生成效果進一步向單卡效果對齊。

在另一個實際問題中,團隊發現部分影片在尾幀位置出現手指等細節不清晰的情況。經過排查發現,問題與模型訓練階段和實際推理階段的影片幀數存在差異有關。針對這一問題,團隊對推理過程進行相應補齊和優化,使長影片生成過程中的細節表現得到改善。

商湯大裝置團隊通過這些細節調整,逐一解決了國產模型適配國產算力,在邁向真實生產環境過程中遇到的工程挑戰。

支援異構芯片零成本遷移

對於智象未來而言,國產化適配不僅要解決單一芯片的適配問題,還需要應對不同國產芯片之間的異構適配挑戰。

針對這一問題,商湯大裝置構建了統一的硬件抽象體系,通過異構硬件初始化、統一設備抽象層、Registry調度工廠、硬件算子插件等,屏蔽了不同底層硬件之間的差異。基於統一抽象體系,實現「一次開發,多平台適配」,目前已支援10多種異構芯片上的模型零成本遷移。

與此同時,商湯大裝置完成了ComfyUI等主流AI開發工具生態適配,無需改變原有工作流程和開發習慣,即可在國產算力平台完成應用開發與部署,大幅降低遷移和開發成本。

ScreenShot_2026-09-01_174807_707.png

FDE專家服務

深入業務,保障全流程閉環
 

對於智象未來這樣的AI科創企業而言,模型研發和產品迭代本身就需要投入大量資源。如果再投入大量人力完成國產化環境下的適配和遷移,無疑會增加額外的人力成本和時間成本。

為此,商湯大裝置通過FDE(Forward Deployed Engineer)專家服務模式,將專業工程能力深入至智象未來的業務場景。

此次合作中,商湯大裝置並非僅提供底層國產算力和平台能力,而是組織專業工程團隊圍繞智象未來的實際業務需求,深入參與國產化適配全過程:從模型遷移、算子優化、多卡並行,到生成效果調優、工具鏈適配,再到最終的業務效果保障,圍繞實際業務指標逐項排查和解決問題。

這種「算力平台+工程專家」的協同方式,可以協助AI企業減少國產化遷移過程中的大量工程投入,將更多研發資源聚焦於模型創新與產品迭代。


業務落地:

國產算力支撐規模化短片創作
 

在商湯大裝置AI基礎設施能力和FDE專家團隊的支援下,智象未來圖像模型已完成國產算力適配驗證,並進一步支撐規模化線上流量及短片創作。

此次商湯大裝置與智象未來的合作實踐,驗證了國產算力支撐影片生成業務的一條可複用路徑:以底層異構算力為基礎,以統一硬件抽象體系和開發工具適配為連接,以模型性能與生成效果優化為核心,再通過FDE專家服務深入業務現場,最終實現國產算力從全棧適配、技術驗證到規模生產的完整閉環。

未來,雙方還將圍繞更多AI應用場景深化合作,共同探索國產AI基礎設施與生成式AI應用融合發展的更多可能,推動國產算力從「能用」加速邁向「好用」,助力AI創新企業更高效地實現技術創新與業務規模化落地。



 

智象未來×商湯大裝置:國產算力跑通影片生成規模化應用