Apple、照明とテクスチャを完全に再現する単一画像3D向け「LiTo Large」モデルを発表――Vision Proの理想的なパートナーとなるか?
Appleは最近、AIを活用した3D再構成という分野において、長らく「極めて解決が困難な課題」とされてきた分野で画期的な技術を発表しました。
最近の報道によると、AppleのAI研究チームは 「LiTo(Surface Light Field Tokenization)」と呼ばれる新しいモデルを公開した。その中核となる画期的な点は、通常の2D画像のみから、物理的なリアリズムに達するほどの詳細度を持つ完全な3Dオブジェクトを再構築できることにある。

長年にわたり、単一の画像から3Dモデルを生成する際の主な課題は、照明の一貫性を維持することでした。 視点を変えると、表面の反射やハイライトが歪んだり不自然になったりすることがよくあります。しかし、LiToモデルは 革新的な「潜在空間」表現を導入することでこの問題を解決しています。単にピクセルを記憶するのではなく、数学的なベクトルを通じて、光が表面とどのように相互作用するかという根本的な法則を理解するのです。
簡単に言えば、LiToは 強力な「想像力」を備えている。正面からの写真だけであっても、さまざまな照明条件下で、物体の裏側にある鏡面のハイライトやフレネル反射を正確に予測できる。公式の比較テストにおいて、LiToは マルチビュー照明の精度において、業界をリードするTRELLISモデルを大幅に上回った。

この細部にこだわるAIを洗練させるため、研究者たちは3つの照明条件下で150の視点からキャプチャされた数千の3Dオブジェクトを用いて学習を行いました。照明の細部に対するこのほぼ執拗とも言えるほどのこだわりは、空間コンピューティングエコシステムの基盤を築こうとするAppleの取り組みを如実に物語っています。

将来を想像してみてください。iPhoneで写真を1枚撮るだけで、LiToが それを瞬時にリアルな3Dモデルに変換し、Vision Proの仮想空間にシームレスに配置してくれるのです。 2Dコンテンツから3Dアセットへのこのスムーズな移行は、AI競争において「後発者の優位性」を確立するための、Appleの重要な切り札となる可能性があります。
関連記事
スーパーインテリジェンスの到来:我々はそれを受け入れるのか?
プレイヤーを読み込み中…AI企業は、スーパーインテリジェントなAIが inevitable(必然的)であるかのように語ってきたが、OpenAIのHugging Face侵害事件といった最近の安全上のインシデントは、人間よりも能力の高いAIシステムを展開することの潜在的な危険性を示している。では、これらのシステムが行うことを確実に制御できなくなった場合、どのようなことが起こるのだろうか?このTechCrunchのEquity podcastのエピソードでは、Rebecca Bellanは、AI
iFLYTEK、Spark X2.5 汎用大規模モデルを公開
9月1日、iFlytekは最新の公式発表によると、エッジ指向の2つの大規模言語モデル「Xinghuo X2.5-4B」と「Xinghuo X2.5-1.7B」をオープンソースで公開する。両モデルは、最大100万トークンのコンテキストウィンドウをネイティブにサポートしている。これらは、インテリジェントエージェントとの対話、数学的推論、一般的な理解などの主要な分野で大幅な強化を実現し、車載システム、スマートデバイス、IoTエコシステムなどのエッジアプリケーションに堅牢なサポートを提供する。これらの
ユーザーからの反発を受け、MetaはAI写真編集機能を削除
Meta、ソーシャルメディアの巨人は、人工知能とユーザープライバシーの微妙なバランスをめぐる公的な論争に再び巻き込まれている。TechCrunch によると、Meta の Superintelligence Labs は今週初めに新しい AI 画像ジェネレーター「Muse Image」を導入した。しかし、ユーザーが「@」記号でタグ付けすることで、公開されている Instagram アカウントから画像を修正・生成できるという、高い評価を受けた主要機能は、適切な通知メカニズムの欠如により、ユーザー
関連特集おすすめ
コメント (0)
0/500
Appleは最近、AIを活用した3D再構成という分野において、長らく「極めて解決が困難な課題」とされてきた分野で画期的な技術を発表しました。
最近の報道によると、

長年にわたり、単一の画像から3Dモデルを生成する際の主な課題は、照明の一貫性を維持することでした。 視点を変えると、表面の反射やハイライトが歪んだり不自然になったりすることがよくあります。しかし、
簡単に言えば、

この細部にこだわるAIを洗練させるため、研究者たちは3つの照明条件下で150の視点からキャプチャされた数千の3Dオブジェクトを用いて学習を行いました。照明の細部に対するこのほぼ執拗とも言えるほどのこだわりは、空間コンピューティングエコシステムの基盤を築こうとするAppleの取り組みを如実に物語っています。

将来を想像してみてください。iPhoneで写真を1枚撮るだけで、
スーパーインテリジェンスの到来:我々はそれを受け入れるのか?
プレイヤーを読み込み中…AI企業は、スーパーインテリジェントなAIが inevitable(必然的)であるかのように語ってきたが、OpenAIのHugging Face侵害事件といった最近の安全上のインシデントは、人間よりも能力の高いAIシステムを展開することの潜在的な危険性を示している。では、これらのシステムが行うことを確実に制御できなくなった場合、どのようなことが起こるのだろうか?このTechCrunchのEquity podcastのエピソードでは、Rebecca Bellanは、AI
iFLYTEK、Spark X2.5 汎用大規模モデルを公開
9月1日、iFlytekは最新の公式発表によると、エッジ指向の2つの大規模言語モデル「Xinghuo X2.5-4B」と「Xinghuo X2.5-1.7B」をオープンソースで公開する。両モデルは、最大100万トークンのコンテキストウィンドウをネイティブにサポートしている。これらは、インテリジェントエージェントとの対話、数学的推論、一般的な理解などの主要な分野で大幅な強化を実現し、車載システム、スマートデバイス、IoTエコシステムなどのエッジアプリケーションに堅牢なサポートを提供する。これらの
ユーザーからの反発を受け、MetaはAI写真編集機能を削除
Meta、ソーシャルメディアの巨人は、人工知能とユーザープライバシーの微妙なバランスをめぐる公的な論争に再び巻き込まれている。TechCrunch によると、Meta の Superintelligence Labs は今週初めに新しい AI 画像ジェネレーター「Muse Image」を導入した。しかし、ユーザーが「@」記号でタグ付けすることで、公開されている Instagram アカウントから画像を修正・生成できるという、高い評価を受けた主要機能は、適切な通知メカニズムの欠如により、ユーザー





家






