蘋果推出 LiTo 模型,可將單張影像轉為 3D,且光照精準度提升 37%
蘋果的 AI 研究團隊最近推出了一款名為LiTo(Surface Light Field Tokenization)的突破性 3D 生成模型。這項技術透過僅憑一張 2D 影像,即可生成具備逼真光照效果的完整、高保真 3D 物件,從而解決了 3D 重建中的核心難題。

LiTo 的創新核心在於其創新的潛在空間與統一的 3D 表示框架:
高效編碼:將複雜的表面光場數據壓縮為緊湊的向量集,從數學上精準捕捉物體的幾何結構及其與光線的交互作用。
雙向架構:採用編碼器-解碼器結構,編碼器提取基礎的幾何與外觀特徵,解碼器則據此重建數據,精準呈現鏡面高光與菲涅爾反射等進階視覺效果。
效能:跨視角無與倫比的照明一致性
LiTo 是在包含數千個物體的全面 3D 資料集上進行訓練的。關鍵實驗結果包括:
消除方向偏誤:LiTo 嚴格遵循相機座標系,修正了其他模型中常見的方位誤差。
頂尖指標:在多視角光照一致性方面,LiTo 的表現比先前領先的模型 TRELLIS 優異約37%。
這項突破顯著降低了高品質 3D 內容創作的門檻。它有望為未來的擴增實境(AR)和空間運算平台(包括 Vision Pro 等裝置)提供卓越的資產生成能力。
相關文章
科大訊飛釋出訊飛星火大模型 V2.5
9月1日,科大訊飛將開源兩款面向邊緣場景的大語言模型——星火X2.5-4B和星火X2.5-1.7B,據最新官方公告。這兩款模型原生支援高達100萬token的上下文視窗。它們在智慧體互動、數學推理和通用理解等關鍵領域實現了顯著提升,為車載系統、智慧裝置和物聯網生態等邊緣應用提供了強有力的支援。在上述邊緣模型釋出後,科大訊飛計劃於9月7日推出擁有2930億引數的星火X2.5基礎模型。該版本將進一步推進程式碼生成和多智慧體協作等核心技術。在公司2026年年中簡報會上宣佈,一款完全基於國產算力基礎設施
Meta 在使用者強烈反對後取消了 AI 照片編輯功能
Meta,這家社交媒體巨頭,再次捲入關於人工智慧與使用者隱私之間微妙平衡的公開辯論。據 TechCrunch 報道,Meta 的 Superintelligence Labs 本週早些時候推出了一款新的 AI 影象生成器 Muse Image。然而,一個備受好評的關鍵功能——允許使用者透過“@”符號標記來修改和生成來自公開 Instagram 賬戶的影象——由於缺乏適當的通知機制,立即引發了使用者以及 CAA 等機構的強烈反對。面對強烈的批評,Meta 迅速撤銷了該決定,並於週五透過部落格文章宣佈將
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
相關專題推薦
評論 (1)
0/500
蘋果的 AI 研究團隊最近推出了一款名為LiTo(Surface Light Field Tokenization)的突破性 3D 生成模型。這項技術透過僅憑一張 2D 影像,即可生成具備逼真光照效果的完整、高保真 3D 物件,從而解決了 3D 重建中的核心難題。

LiTo 的創新核心在於其創新的潛在空間與統一的 3D 表示框架:
高效編碼:將複雜的表面光場數據壓縮為緊湊的向量集,從數學上精準捕捉物體的幾何結構及其與光線的交互作用。
雙向架構:採用編碼器-解碼器結構,編碼器提取基礎的幾何與外觀特徵,解碼器則據此重建數據,精準呈現鏡面高光與菲涅爾反射等進階視覺效果。
效能:跨視角無與倫比的照明一致性
LiTo 是在包含數千個物體的全面 3D 資料集上進行訓練的。關鍵實驗結果包括:
消除方向偏誤:LiTo 嚴格遵循相機座標系,修正了其他模型中常見的方位誤差。
頂尖指標:在多視角光照一致性方面,LiTo 的表現比先前領先的模型 TRELLIS 優異約37%。
這項突破顯著降低了高品質 3D 內容創作的門檻。它有望為未來的擴增實境(AR)和空間運算平台(包括 Vision Pro 等裝置)提供卓越的資產生成能力。
科大訊飛釋出訊飛星火大模型 V2.5
9月1日,科大訊飛將開源兩款面向邊緣場景的大語言模型——星火X2.5-4B和星火X2.5-1.7B,據最新官方公告。這兩款模型原生支援高達100萬token的上下文視窗。它們在智慧體互動、數學推理和通用理解等關鍵領域實現了顯著提升,為車載系統、智慧裝置和物聯網生態等邊緣應用提供了強有力的支援。在上述邊緣模型釋出後,科大訊飛計劃於9月7日推出擁有2930億引數的星火X2.5基礎模型。該版本將進一步推進程式碼生成和多智慧體協作等核心技術。在公司2026年年中簡報會上宣佈,一款完全基於國產算力基礎設施
Meta 在使用者強烈反對後取消了 AI 照片編輯功能
Meta,這家社交媒體巨頭,再次捲入關於人工智慧與使用者隱私之間微妙平衡的公開辯論。據 TechCrunch 報道,Meta 的 Superintelligence Labs 本週早些時候推出了一款新的 AI 影象生成器 Muse Image。然而,一個備受好評的關鍵功能——允許使用者透過“@”符號標記來修改和生成來自公開 Instagram 賬戶的影象——由於缺乏適當的通知機制,立即引發了使用者以及 CAA 等機構的強烈反對。面對強烈的批評,Meta 迅速撤銷了該決定,並於週五透過部落格文章宣佈將
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20





首頁






