8 月 27 日,由白鯨技術棧主辦的全球 AI 出海大會在杭州順利舉辦。小影科技業務 VP 李琳琳受邀參會併發表主題演講,分享 AI 如何重塑智能終端影像創作體驗。
小影科技旗下 ToB 智慧視頻創作解決方案於 2021 年發佈,將公司 ToC 服務全球大眾用戶的經驗能力向智能終端輸出,為手機硬體廠商、運營商提供可嵌入的 AI 視頻創作能力,例如基於榮耀 MagicOS 打造系統原生“智慧成片”功能,賦能終端用戶視頻創作與表達。
隨著 AI 視頻模型能力快速提升,Agent 具備理解和規劃任務、執行工作流的能力,終端智能影像創作又會迎來什麼樣的機會?李琳琳基於相關合作實踐,分享了小影科技如何構建用戶願意長期使用、廠商能夠規模化落地的視頻創作能力,推動智慧視頻創作解決方案向 Agent 升級。
1. 終端影像能力升級,AI 打開智能創作新空間
近年來,多形態硬體終端不斷湧現。從手機到可穿戴設備、車載設備,不同終端的拍攝能力越來越強,用戶能夠輕鬆記錄下高清畫面,但沒有專業的剪輯能力,普通用戶依然很難做出可分享的作品。
多模態 AI 和 Agent 技術的發展,則為用戶表達帶來了新可能:AI 不只是內容生成工具,而是能夠理解用戶想表達什麼、並主動完成個性化視頻創作的智能夥伴。
對用戶來說,Agent 讓視頻創作門檻進一步降低;對終端廠商來說,這也是一個新的增長機會。當硬體參數性能趨同,AI Agent 式的創作能力,正在成為終端差異化競爭的新空間。它讓終端不只是記錄和保存影像,更能夠進一步理解用戶需求、參與內容創作,成為用戶日常表達的重要入口。
2. 模型能力夠強,但與終端商用規模化之間仍有鴻溝
在李琳琳看來,如今 AI 模型的生成能力已經足夠成熟,能夠呈現出極具想像力的視頻效果,但一個炫酷的 Demo,離真正的商業化落地還有距離。終端的規模化落地需要同時回答三個問題:技術是否可實現、用戶需求是否普適、規模化後成本和運營是否可持續。
面向海量大眾用戶,單純把雲端 AI 模型接入產品並不足夠。終端廠商真正的壁壘,其實在於長期積累的硬體用戶數據與使用場景——這些數據涉及隱私與合規,不可能所有內容都上傳雲端處理;不同市場用戶的內容偏好也存在明顯差異,需要持續進行用戶洞察、本地化素材生產,以及節日熱點運營。
也正因如此,模型能力的成熟只是起點,真正決定終端體驗和商業化效果的,是廠商能否以 Agent 的形態,把這些已經成熟的模型能力與自己積累的用戶數據結合起來,轉化成更便捷、更優質的創作路徑,而不是單純“調用”一個模型。同時,當創作需求從 Demo 走向海量用戶,算力成本也成為產品能否持續運營的重要因素。
因此,終端真正需要的是一套由長期深耕行業的 Agent 開發合作夥伴支撐、成本可控、可持續運營的本地化視頻創作體系,這也是小影科技智慧視頻創作解決方案向 Agent 形態升級的核心方向。
3. 從模型到落地,小影科技如何讓 AI Agent 真正進入終端
智慧視頻 Agent 創作解決方案通過端雲協同架構,將意圖理解、故事規劃、素材分析與視頻生成等能力組織成完整的創作工作流。雲端負責意圖理解、故事規劃,端側則執行高光識別、素材解析與剪輯渲染等任務,在保障用戶體驗的同時,也讓雲端處理成本更加可控。
與此同時,小影科技還對百萬級範本進行了原子化拆解歸類,讓 AI 能夠根據用戶意圖靈活調用不同的創作元素。相較於過去固定的範本式生成,現有方案可以實現千人千面的成片效果。用戶只需表達“我想做什麼”,Agent 就能判斷“應該怎麼做”、並調用工具“做出來”。
例如,當用戶說“幫我把這次旅行做成一個輕鬆的短視頻”,AI 會先理解意圖,識別用戶素材中的人物、地點、事件和關鍵瞬間進行故事線規劃,再智能組合音樂、轉場、濾鏡、貼紙等原子素材,形成更具個性化的視頻表達。
要讓這樣的 Agent 真正服務於海量用戶,關鍵並不只是模型能力,而是對“用戶想怎麼創作”以及“不同市場用戶喜歡什麼”的長期理解。小影科技將 14 年來積累的大眾用戶創作行為洞察、覆蓋全球 200+ 國家和地區的本地化經驗,與自研 AI 音視頻技術進一步融合,持續優化 Agent 的創作決策與內容供給。
這一能力也已經在終端合作中持續驗證。2022 年,小影科技與榮耀達成合作,2023 年助力榮耀視頻編輯次日留存率提升 185%、視頻製作完成率提升 87%。如今,雙方持續將新一代 AI Agent 能力應用於更多場景。
李琳琳表示,AI 正在把智能終端從影像記錄工具變成真正理解用戶、幫助用戶完成表達的創作夥伴。小影科技期待與更多終端廠商攜手,共建新一代原生影像創作體驗。

