Stability AI 發表照片轉 3D 場景模型
Stability AI 推出創新的 Stable Virtual Camera 模型,能將 2D 照片轉換為具有逼真深度與透視效果的沉浸式影片。
根據官方部落格說明,虛擬攝影機技術在數位電影製作中廣泛應用於即時場景導航,而 Stability AI 透過整合生成式 AI,為電影製作人提供更強大的創作控制能力。
這項突破性工具可從上傳影像(最多 32 個輸入)生成多樣視角,支援自訂攝影機運動軌跡,包含「螺旋」、「滑軌變焦」、「平移」等動態拍攝路徑。

圖片來源:Stability AI 目前處於研究預覽階段的 Stable Virtual Camera 可生成最長 1,000 幀的影片,支援正方形、直向或橫向格式。該公司坦承處理人物、動物或流體紋理時可能出現品質限制。
Stability AI 提醒,複雜場景、交錯的攝影機路徑與非常規形體可能導致視覺閃爍,特別是當視角與原始素材差異過大時更為明顯。
研究人員可透過 Hugging Face 平台取得 Stable Virtual Camera,僅限非商業授權使用。
儘管歷經前領導階段的財務挑戰,Stability AI 去年成功獲得新一輪資金。以 Stable Diffusion 聞名的該公司近期完成組織重整,迎來包括導演詹姆斯·卡麥隆在內的新任高管,同時擴充其生成式 AI 產品陣容。
繼近期與 Arm 合作後,Stability AI 正著手開發相容於 Arm 架構裝置的行動版音訊生成技術。
相關文章
蘋果智慧眼鏡或將在WWDC27上首次亮相,重點突出隱私保護
彭博社的馬克·古爾曼報道,蘋果智慧眼鏡(內部代號 N50)計劃於 2027 年 6 月的全球開發者大會(WWDC27)上首次亮相,零售版預計將於 2027 年秋季上市。該裝置原定於今年晚些時候及 2027 年初發布,但現已推遲,以便進行進一步的產品完善並加強隱私保護協議。隱私仍是蘋果智慧眼鏡戰略的核心支柱。從 Meta 等競爭對手的隱私爭議中吸取教訓,蘋果正在實施強有力的功能與政策。目前考慮的方案包括:完全移除攝像頭,專注於人工智慧互動、音訊播放和通話;或保留攝像頭但禁用照片和影片錄製功能,僅
內部細節曝光:下一代 Gemini 算力緊張,內部團隊在開發優先順序和資源分配上存在分歧
報告顯示,谷歌備受期待的下一代 Gemini 模型釋出已被推遲。由於內部在開發優先順序和資源分配上存在分歧,加上計算能力有限以及複雜的審批流程,導致釋出時間延後了兩個月。儘管谷歌擁有定製的 TPU 晶片,但由於模型訓練、Google Cloud 服務以及眾多消費和企業級 AI 應用對計算資源的需求相互競爭,谷歌仍面臨計算資源短缺的問題。目前,高層管理人員正透過組織結構調整來解決這些部門間的衝突。與此同時,領導層也發生了變化,聯合創始人謝爾蓋·布林越來越多地參與到核心模型訓練中,並倡導將資源專門用於
OpenAI 否認增長放緩擔憂,稱多個業務部門加速發展
針對外界對其銷售增長放緩及未達內部基準的質疑,人工智慧領域的領軍企業 OpenAI 於 4 月 28 日(星期二)發表了一份信心十足的宣告。該公司澄清稱,其消費產品和企業服務正在快速推進,直接駁斥了近期關於業務放緩的猜測。針對該公司“未達成多項內部目標”的說法,OpenAI 將這些報道斥為“典型的標題黨”。公司強調了企業對 AI 整合的強勁需求,並指出其廣告業務早期增長前景良好。據 OpenAI 內部人士透露,公司內部情緒依然樂觀。儘管市場競爭日益激烈,但公司正在向投資者傳遞信心,聲稱其商業
相關專題推薦
評論 (0)
0/500
Stability AI 推出創新的 Stable Virtual Camera 模型,能將 2D 照片轉換為具有逼真深度與透視效果的沉浸式影片。
根據官方部落格說明,虛擬攝影機技術在數位電影製作中廣泛應用於即時場景導航,而 Stability AI 透過整合生成式 AI,為電影製作人提供更強大的創作控制能力。
這項突破性工具可從上傳影像(最多 32 個輸入)生成多樣視角,支援自訂攝影機運動軌跡,包含「螺旋」、「滑軌變焦」、「平移」等動態拍攝路徑。

目前處於研究預覽階段的 Stable Virtual Camera 可生成最長 1,000 幀的影片,支援正方形、直向或橫向格式。該公司坦承處理人物、動物或流體紋理時可能出現品質限制。
Stability AI 提醒,複雜場景、交錯的攝影機路徑與非常規形體可能導致視覺閃爍,特別是當視角與原始素材差異過大時更為明顯。
研究人員可透過 Hugging Face 平台取得 Stable Virtual Camera,僅限非商業授權使用。
儘管歷經前領導階段的財務挑戰,Stability AI 去年成功獲得新一輪資金。以 Stable Diffusion 聞名的該公司近期完成組織重整,迎來包括導演詹姆斯·卡麥隆在內的新任高管,同時擴充其生成式 AI 產品陣容。
繼近期與 Arm 合作後,Stability AI 正著手開發相容於 Arm 架構裝置的行動版音訊生成技術。
蘋果智慧眼鏡或將在WWDC27上首次亮相,重點突出隱私保護
彭博社的馬克·古爾曼報道,蘋果智慧眼鏡(內部代號 N50)計劃於 2027 年 6 月的全球開發者大會(WWDC27)上首次亮相,零售版預計將於 2027 年秋季上市。該裝置原定於今年晚些時候及 2027 年初發布,但現已推遲,以便進行進一步的產品完善並加強隱私保護協議。隱私仍是蘋果智慧眼鏡戰略的核心支柱。從 Meta 等競爭對手的隱私爭議中吸取教訓,蘋果正在實施強有力的功能與政策。目前考慮的方案包括:完全移除攝像頭,專注於人工智慧互動、音訊播放和通話;或保留攝像頭但禁用照片和影片錄製功能,僅
內部細節曝光:下一代 Gemini 算力緊張,內部團隊在開發優先順序和資源分配上存在分歧
報告顯示,谷歌備受期待的下一代 Gemini 模型釋出已被推遲。由於內部在開發優先順序和資源分配上存在分歧,加上計算能力有限以及複雜的審批流程,導致釋出時間延後了兩個月。儘管谷歌擁有定製的 TPU 晶片,但由於模型訓練、Google Cloud 服務以及眾多消費和企業級 AI 應用對計算資源的需求相互競爭,谷歌仍面臨計算資源短缺的問題。目前,高層管理人員正透過組織結構調整來解決這些部門間的衝突。與此同時,領導層也發生了變化,聯合創始人謝爾蓋·布林越來越多地參與到核心模型訓練中,並倡導將資源專門用於
OpenAI 否認增長放緩擔憂,稱多個業務部門加速發展
針對外界對其銷售增長放緩及未達內部基準的質疑,人工智慧領域的領軍企業 OpenAI 於 4 月 28 日(星期二)發表了一份信心十足的宣告。該公司澄清稱,其消費產品和企業服務正在快速推進,直接駁斥了近期關於業務放緩的猜測。針對該公司“未達成多項內部目標”的說法,OpenAI 將這些報道斥為“典型的標題黨”。公司強調了企業對 AI 整合的強勁需求,並指出其廣告業務早期增長前景良好。據 OpenAI 內部人士透露,公司內部情緒依然樂觀。儘管市場競爭日益激烈,但公司正在向投資者傳遞信心,聲稱其商業





首頁






