Heim
Apple stellt das „LiTo Large“-Modell für 3D-Darstellung aus einem einzigen Bild mit vollständiger Beleuchtung und Texturen vor – ein perfekter Partner für Vision Pro?
Apple hat kürzlich eine bahnbrechende Technologie im Bereich der KI-gestützten 3D-Rekonstruktion vorgestellt – eine Herausforderung, die lange Zeit als besonders schwer zu bewältigen galt.
Jüngsten Berichten zufolge hat das KI-Forschungsteam von Apple ein neues Modell namens LiTo (Surface Light Field Tokenization) veröffentlicht. Der entscheidende Durchbruch besteht darin,ein vollständiges 3D-Objekt allein aus einem gewöhnlichen 2D-Bild zu rekonstruieren – und zwar mit einem Detailgrad, der physikalischen Realismus erreicht.

Seit Jahren besteht die größte Herausforderung bei der Erstellung von 3D-Modellen aus einem einzigen Bild darin, die Konsistenz der Beleuchtung zu gewährleisten. Wenn man den Betrachtungswinkel ändert, wirken Oberflächenreflexionen und Glanzlichter oft verzerrt oder unnatürlich. Das LiTo-Modell löst dieses Problem jedoch durch die Einführung einer innovativen „Latent-Space“-Darstellung. Anstatt lediglich Pixel zu speichern, versteht es die grundlegenden Gesetze der Wechselwirkung von Licht mit Oberflächen mithilfe mathematischer Vektoren.
Einfach ausgedrückt verfügt LiTo über ausgeprägte „Vorstellungskraft“. Selbst mit nur einem Foto von vorne kann es Spiegelreflexe und Fresnel-Reflexionen auf der Rückseite des Objekts unter verschiedenen Lichtbedingungen genau vorhersagen. In offiziellen Vergleichstests hat LiTo das branchenführende TRELLIS-Modell hinsichtlich der Beleuchtungsgenauigkeit bei mehreren Blickwinkeln deutlich übertroffen.

Um diese detailorientierte KI zu verfeinern, trainierten die Forscher sie anhand von Tausenden von 3D-Objekten, die aus 150 Blickwinkeln unter drei Beleuchtungsbedingungen erfasst wurden. Diese fast schon obsessive Aufmerksamkeit für Beleuchtungsdetails zeigt deutlich, wie sehr sich Apple bemüht, die Grundlagen für ein Ökosystem des räumlichen Computings zu schaffen.

Stellen Sie sich die Zukunft vor: Sie müssen lediglich ein Foto mit Ihrem iPhone aufnehmen, und LiTo wandelt es sofort in ein naturgetreues 3D-Modell um, das nahtlos in den virtuellen Raum von Vision Pro eingebettet wird. Dieser nahtlose Übergang von 2D-Inhalten zu 3D-Assets könnte Apples wichtigster Trumpf sein, um im KI-Wettlauf einen „Late-Mover-Vorteil“ zu erzielen.
Verwandter Artikel
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter
Einhaltung der Vorschriften für autonome Fahrzeuge in Kalifornien: Eine neue Ära von Bußgeldern, Geofences und 1 Million Meilen
Guident betreibt einen AuveTech-Shuttle in Südflorida und verwaltet mithilfe seiner Fernüberwachungstechnologie eine vier Meilen lange Strecke in West Palm Beach sowie eine eine Meile lange Strecke in
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Apple hat kürzlich eine bahnbrechende Technologie im Bereich der KI-gestützten 3D-Rekonstruktion vorgestellt – eine Herausforderung, die lange Zeit als besonders schwer zu bewältigen galt.
Jüngsten Berichten zufolge hat das KI-Forschungsteam

Seit Jahren besteht die größte Herausforderung bei der Erstellung von 3D-Modellen aus einem einzigen Bild darin, die Konsistenz der Beleuchtung zu gewährleisten. Wenn man den Betrachtungswinkel ändert, wirken Oberflächenreflexionen und Glanzlichter oft verzerrt oder unnatürlich. Das
Einfach ausgedrückt verfügt

Um diese detailorientierte KI zu verfeinern, trainierten die Forscher sie anhand von Tausenden von 3D-Objekten, die aus 150 Blickwinkeln unter drei Beleuchtungsbedingungen erfasst wurden. Diese fast schon obsessive Aufmerksamkeit für Beleuchtungsdetails zeigt deutlich, wie sehr sich Apple bemüht, die Grundlagen für ein Ökosystem des räumlichen Computings zu schaffen.

Stellen Sie sich die Zukunft vor: Sie müssen lediglich ein Foto mit Ihrem iPhone aufnehmen, und
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter











