字節跳動開源 Bernini 框架,用於統一的影片生成與編輯
字節跳動的商業化技術團隊已正式發布了一個名為 Bernini 的開源影片生成與編輯框架。該框架的核心採用「先理解,再生成」的協作機制,旨在解決傳統模型因無法準確解讀複雜指令而導致的常見產業挑戰,例如影像不穩定與畫面閃爍等問題。
在字節跳動的內部評估中,Bernini 已取得頂尖成績。其推論程式碼與第二階段模型 Bernini-R 現已公開釋出,功能完整的版本預計將於近期全面開源。

語義與渲染的解耦
Bernini 的工作流程在「語義規劃」與「視覺渲染」之間引入了一種嶄新的分離機制。該流程始於一個多模態大型模型規劃器,它會徹底分析輸入素材以生成「語義草圖」,隨後由渲染器將其轉譯為穩定且連貫的影片幀。
這種明確的職責劃分,使該框架特別適用於可控編輯。使用者可透過簡單指令調整場景屬性(如天氣、季節或視覺風格),並能精確控制鏡頭角度、焦點及主體動作。
豐富的視覺參考功能
除了傳統的文字控制外,Bernini 還支援使用圖像和影片作為視覺參考,顯著提升了創作的一致性。在影片編輯中,它能精準地將特定素材或海報置入目標區域,且不會產生邊界瑕疵或透視失真。
在生成新影片時,該模型可處理單張圖像及多角度參考輸入,並能將關鍵幀演化為連續序列。為避免連接多個視覺片段時產生混淆,團隊導入了專用的位置編碼機制,能明確區分參考素材與輸出目標。
專案頁面:https://bernini-ai.github.io/
相關文章
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI應用開發平臺Lovable宣佈參與丹麥硬體初創公司Atech的80萬美元種子輪融資。該輪由Lovable領投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在內的頂級風險投資機構。此次投資標誌著Lovable將“Vibe Coding”概念從純軟體開發戰略擴充套件至硬體工程領域。Atech旨在透過AI驅動的互動式平臺簡化複雜的硬體原型製作。使用者購買基礎硬體套件,並透過AI聊天機器人以自然語言描述其設計概念;系統
Anthropic 將 Claude AI 編碼工具擴充套件至日本,以推動海外增長
Anthropic,一家美國知名的人工智慧公司,正加強其全球推廣力度。週三,該公司在東京舉辦了一場大型開發者活動“Code with Claude”,吸引了近500名軟體工程師參加。該舉措旨在積極將Claude AI工具及相關產品引入日本市場,強調其自主編碼能力在提升企業生產力方面的核心優勢。強調自動化程式碼生成在活動中,Anthropic展示了其先進的自主編碼系統,該系統能夠獨立處理複雜的程式設計任務並最佳化現有程式碼結構。隨著全球對高效開發工具的需求不斷增長,Anthropic希望透過此類活動加強
相關專題推薦
評論 (0)
0/500
字節跳動的商業化技術團隊已正式發布了一個名為 Bernini 的開源影片生成與編輯框架。該框架的核心採用「先理解,再生成」的協作機制,旨在解決傳統模型因無法準確解讀複雜指令而導致的常見產業挑戰,例如影像不穩定與畫面閃爍等問題。
在字節跳動的內部評估中,Bernini 已取得頂尖成績。其推論程式碼與第二階段模型 Bernini-R 現已公開釋出,功能完整的版本預計將於近期全面開源。

語義與渲染的解耦
Bernini 的工作流程在「語義規劃」與「視覺渲染」之間引入了一種嶄新的分離機制。該流程始於一個多模態大型模型規劃器,它會徹底分析輸入素材以生成「語義草圖」,隨後由渲染器將其轉譯為穩定且連貫的影片幀。
這種明確的職責劃分,使該框架特別適用於可控編輯。使用者可透過簡單指令調整場景屬性(如天氣、季節或視覺風格),並能精確控制鏡頭角度、焦點及主體動作。
豐富的視覺參考功能
除了傳統的文字控制外,Bernini 還支援使用圖像和影片作為視覺參考,顯著提升了創作的一致性。在影片編輯中,它能精準地將特定素材或海報置入目標區域,且不會產生邊界瑕疵或透視失真。
在生成新影片時,該模型可處理單張圖像及多角度參考輸入,並能將關鍵幀演化為連續序列。為避免連接多個視覺片段時產生混淆,團隊導入了專用的位置編碼機制,能明確區分參考素材與輸出目標。
專案頁面:https://bernini-ai.github.io/
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI應用開發平臺Lovable宣佈參與丹麥硬體初創公司Atech的80萬美元種子輪融資。該輪由Lovable領投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在內的頂級風險投資機構。此次投資標誌著Lovable將“Vibe Coding”概念從純軟體開發戰略擴充套件至硬體工程領域。Atech旨在透過AI驅動的互動式平臺簡化複雜的硬體原型製作。使用者購買基礎硬體套件,並透過AI聊天機器人以自然語言描述其設計概念;系統
Anthropic 將 Claude AI 編碼工具擴充套件至日本,以推動海外增長
Anthropic,一家美國知名的人工智慧公司,正加強其全球推廣力度。週三,該公司在東京舉辦了一場大型開發者活動“Code with Claude”,吸引了近500名軟體工程師參加。該舉措旨在積極將Claude AI工具及相關產品引入日本市場,強調其自主編碼能力在提升企業生產力方面的核心優勢。強調自動化程式碼生成在活動中,Anthropic展示了其先進的自主編碼系統,該系統能夠獨立處理複雜的程式設計任務並最佳化現有程式碼結構。隨著全球對高效開發工具的需求不斷增長,Anthropic希望透過此類活動加強





首頁






