Das neue KI -Modell von Anthropic betreibt Computer wie Menschen, enthalten Fehler

Haben Sie jemals von einer KI geträumt, die nahtlos mit Ihrem Computer interagieren kann, genau wie ein Mensch? Nun, dieser Traum ist jetzt Realität, dank der neuesten Innovation von Anthropic. Am Dienstag stellten sie die neue Generation ihres Claude KI-Modells vor, genannt Claude 3.5 Sonnet, das einen Computer mit überraschender Finesse bedienen kann. Derzeit im Beta-Modus, steht diese KI Entwicklern zur Verfügung, um über eine API zu experimentieren.
Anthropic bezeichnet Claude 3.5 Sonnet stolz als das „erste Frontier-KI-Modell, das Computernutzung in der öffentlichen Beta anbietet“. Das bedeutet, Entwickler können es programmieren, um eine Vielzahl von Aufgaben auf einem Computer auszuführen, wie das Betrachten des Bildschirms, das Bewegen des Cursors, das Klicken auf Schaltflächen und sogar das Tippen auf einer virtuellen Tastatur. Das Ziel? Die Art und Weise nachzuahmen, wie wir täglich mit unseren Computern interagieren.
Obwohl diese neue KI noch in der experimentellen Phase ist, ist sie nicht ohne Probleme. Sie kann manchmal etwas ungeschickt und fehleranfällig sein. Aber genau deshalb hat Anthropic sie in der Beta-Version veröffentlicht – um wertvolles Feedback von Entwicklern zu sammeln und das Modell im Laufe der Zeit zu verfeinern.
Warum sollten wir uns für KI interessieren, die Computer verwendet?
Anthropic hat eine klare Antwort auf diese Frage: „Ein Großteil der modernen Arbeit geschieht über Computer.“ Indem KIs ermöglicht wird, mit Software auf die gleiche Weise wie Menschen zu interagieren, eröffnen sie eine Fülle neuer Anwendungen, die aktuelle KI-Assistenten nicht bewältigen können.
Wie können Entwickler und Nutzer profitieren?
Anstatt spezifische Werkzeuge für jede Aufgabe zu erstellen, bringt Anthropic Claude allgemeine Computerfähigkeiten bei. Dies ermöglicht der KI, eine Vielzahl von Standard-Softwareprogrammen zu nutzen, die für Menschen entwickelt wurden. Entwickler können diese Fähigkeit nutzen, um repetitive Aufgaben zu automatisieren, Software zu entwickeln und zu testen und sogar Forschung zu betreiben.
Mehrere Unternehmen nutzen bereits die Computerfähigkeiten von Claude 3.5 Sonnet, darunter Asana, Canva, Cognition, DoorDash, Replit und The Browser Company. Beispielsweise verwendet Replit diese Fähigkeiten, um sein Replit Agent-Produkt zu verbessern.
Wie wurde Claude trainiert, Computer zu bedienen?
Claude zu trainieren, einen Computer zu navigieren, erforderte laut Anthropic viel Trial-and-Error. Der Prozess erfordert, dass die KI Bilder des Computerbildschirms versteht und interpretiert und dann entscheidet, welche Aktionen basierend auf dem Gesehenen ausgeführt werden sollen. Claude 3.5 Sonnet erreicht dies, indem er Screenshots analysiert, Pixel zählt, um den Cursor präzise zu bewegen, und Maus-Befehle ausgibt.
Wie gut funktioniert Claude?
In den OSWorld-Benchmarking-Tests, die die Fähigkeit von KI-Modellen zur Computernutzung bewerten, erreichte Claude 3.5 Sonnet einen Wert von 14,9 %. Obwohl dies deutlich unter der menschlichen Leistung von 70–75 % liegt, ist es fast doppelt so hoch wie die 7,7 %, die das nächstbeste KI-Modell in derselben Kategorie erzielte.
Trotz dieser vielversprechenden Ergebnisse steht die Computernutzung von Claude noch am Anfang. Sie kann noch keine komplexeren Aufgaben wie das Ziehen von Fenstern oder das Zoomen in den Bildschirm ausführen. Außerdem kann sie aufgrund der Abhängigkeit von Screenshots bestimmte Aktionen und Benachrichtigungen übersehen.
Anthropic bleibt optimistisch und erklärt: „Wir erwarten, dass sich die Computernutzung schnell verbessern wird, um schneller, zuverlässiger und nützlicher für die Aufgaben zu werden, die unsere Nutzer erledigen möchten.“ Sie betonen auch, dass die Technologie mit ihrer Weiterentwicklung für Personen mit weniger Softwareentwicklungserfahrung zugänglicher wird, während strenge Sicherheitsmaßnahmen eingehalten werden.
Claude 3.5 Sonnet ist jetzt für alle zugänglich. Entwickler können mit der Computernutzungs-Beta auf der Anthropic API, Amazon Bedrock und Google Cloud’s Vertex AI Anwendungen entwickeln.
Verwandter Artikel
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter
Einhaltung der Vorschriften für autonome Fahrzeuge in Kalifornien: Eine neue Ära von Bußgeldern, Geofences und 1 Million Meilen
Guident betreibt einen AuveTech-Shuttle in Südflorida und verwaltet mithilfe seiner Fernüberwachungstechnologie eine vier Meilen lange Strecke in West Palm Beach sowie eine eine Meile lange Strecke in
Empfehlungen zu verwandten Spezialthemen
Kommentare (9)
Claude 3.5 Sonnet が人間のようにエラーを起こしながらPCを操作するって、なんか怖くない?完璧なAIより、失敗する方が信頼できる気もするけど、セキュリティ面が心配だわ。😅 #Anthropic
Когда ИИ начинает делать те же ошибки, что и я в работе с компьютером, это по-своему успокаивает 😂 Меня беспокоит, насколько мы готовы доверить программному обеспечению такое прямое взаимодействие с интерфейсом. Это ведь прямая дорога как к невероятной производительности, так и к полному хаосу, если что-то пойдет не так. Кажется, пора задуматься о новых 'правилах дорожного движения' для роботов-помощников.
Этот AI, который делает ошибки, как человек, звучит одновременно и забавно, и немного тревожно 😅 Получается, мы создали идеального цифрового стажёра, который тоже путает Ctrl+C и Ctrl+V? Интересно, как это повлияет на безопасность — вдруг он случайно удалит что-то важное, пытаясь 'помочь'?
Wow, Claude 3.5 Sonnet sounds like a game-changer! An AI that mimics human computer use, errors and all? That’s wild. I wonder how it handles my messy desktop and random browser tabs 😅. Super curious to see it in action!

Haben Sie jemals von einer KI geträumt, die nahtlos mit Ihrem Computer interagieren kann, genau wie ein Mensch? Nun, dieser Traum ist jetzt Realität, dank der neuesten Innovation von Anthropic. Am Dienstag stellten sie die neue Generation ihres Claude KI-Modells vor, genannt Claude 3.5 Sonnet, das einen Computer mit überraschender Finesse bedienen kann. Derzeit im Beta-Modus, steht diese KI Entwicklern zur Verfügung, um über eine API zu experimentieren.
Anthropic bezeichnet Claude 3.5 Sonnet stolz als das „erste Frontier-KI-Modell, das Computernutzung in der öffentlichen Beta anbietet“. Das bedeutet, Entwickler können es programmieren, um eine Vielzahl von Aufgaben auf einem Computer auszuführen, wie das Betrachten des Bildschirms, das Bewegen des Cursors, das Klicken auf Schaltflächen und sogar das Tippen auf einer virtuellen Tastatur. Das Ziel? Die Art und Weise nachzuahmen, wie wir täglich mit unseren Computern interagieren.
Obwohl diese neue KI noch in der experimentellen Phase ist, ist sie nicht ohne Probleme. Sie kann manchmal etwas ungeschickt und fehleranfällig sein. Aber genau deshalb hat Anthropic sie in der Beta-Version veröffentlicht – um wertvolles Feedback von Entwicklern zu sammeln und das Modell im Laufe der Zeit zu verfeinern.
Warum sollten wir uns für KI interessieren, die Computer verwendet?
Anthropic hat eine klare Antwort auf diese Frage: „Ein Großteil der modernen Arbeit geschieht über Computer.“ Indem KIs ermöglicht wird, mit Software auf die gleiche Weise wie Menschen zu interagieren, eröffnen sie eine Fülle neuer Anwendungen, die aktuelle KI-Assistenten nicht bewältigen können.
Wie können Entwickler und Nutzer profitieren?
Anstatt spezifische Werkzeuge für jede Aufgabe zu erstellen, bringt Anthropic Claude allgemeine Computerfähigkeiten bei. Dies ermöglicht der KI, eine Vielzahl von Standard-Softwareprogrammen zu nutzen, die für Menschen entwickelt wurden. Entwickler können diese Fähigkeit nutzen, um repetitive Aufgaben zu automatisieren, Software zu entwickeln und zu testen und sogar Forschung zu betreiben.
Mehrere Unternehmen nutzen bereits die Computerfähigkeiten von Claude 3.5 Sonnet, darunter Asana, Canva, Cognition, DoorDash, Replit und The Browser Company. Beispielsweise verwendet Replit diese Fähigkeiten, um sein Replit Agent-Produkt zu verbessern.
Wie wurde Claude trainiert, Computer zu bedienen?
Claude zu trainieren, einen Computer zu navigieren, erforderte laut Anthropic viel Trial-and-Error. Der Prozess erfordert, dass die KI Bilder des Computerbildschirms versteht und interpretiert und dann entscheidet, welche Aktionen basierend auf dem Gesehenen ausgeführt werden sollen. Claude 3.5 Sonnet erreicht dies, indem er Screenshots analysiert, Pixel zählt, um den Cursor präzise zu bewegen, und Maus-Befehle ausgibt.
Wie gut funktioniert Claude?
In den OSWorld-Benchmarking-Tests, die die Fähigkeit von KI-Modellen zur Computernutzung bewerten, erreichte Claude 3.5 Sonnet einen Wert von 14,9 %. Obwohl dies deutlich unter der menschlichen Leistung von 70–75 % liegt, ist es fast doppelt so hoch wie die 7,7 %, die das nächstbeste KI-Modell in derselben Kategorie erzielte.
Trotz dieser vielversprechenden Ergebnisse steht die Computernutzung von Claude noch am Anfang. Sie kann noch keine komplexeren Aufgaben wie das Ziehen von Fenstern oder das Zoomen in den Bildschirm ausführen. Außerdem kann sie aufgrund der Abhängigkeit von Screenshots bestimmte Aktionen und Benachrichtigungen übersehen.
Anthropic bleibt optimistisch und erklärt: „Wir erwarten, dass sich die Computernutzung schnell verbessern wird, um schneller, zuverlässiger und nützlicher für die Aufgaben zu werden, die unsere Nutzer erledigen möchten.“ Sie betonen auch, dass die Technologie mit ihrer Weiterentwicklung für Personen mit weniger Softwareentwicklungserfahrung zugänglicher wird, während strenge Sicherheitsmaßnahmen eingehalten werden.
Claude 3.5 Sonnet ist jetzt für alle zugänglich. Entwickler können mit der Computernutzungs-Beta auf der Anthropic API, Amazon Bedrock und Google Cloud’s Vertex AI Anwendungen entwickeln.
DeepMind-CEO Hassabis: Ich schlafe sechs Stunden pro Tag und fühle mich normalerweise gegen 1 Uhr nachts energiegeladen.
Fortune hat kürzlich ein Interview mit Demis Hassabis, dem CEO von Google DeepMind, veröffentlicht, das seinen unkonventionellen Ansatz zu Erholung und Produktivität offenbart. Hassabis gab bekannt, dass er sehr wenig schläft und seine wachen Stunden
OpenAI und Anthropic kämpfen trotz Umsatzrückgängen um Marktanteile
Obwohl jüngste Berichte darauf hindeuten, dass OpenAI seine Umsatzziele verfehlt hat, was an diesem Dienstag Druck auf die Technologieaktien ausübte, zeigen sich private Investoren in KI-Labore weiter
Claude 3.5 Sonnet が人間のようにエラーを起こしながらPCを操作するって、なんか怖くない?完璧なAIより、失敗する方が信頼できる気もするけど、セキュリティ面が心配だわ。😅 #Anthropic
Когда ИИ начинает делать те же ошибки, что и я в работе с компьютером, это по-своему успокаивает 😂 Меня беспокоит, насколько мы готовы доверить программному обеспечению такое прямое взаимодействие с интерфейсом. Это ведь прямая дорога как к невероятной производительности, так и к полному хаосу, если что-то пойдет не так. Кажется, пора задуматься о новых 'правилах дорожного движения' для роботов-помощников.
Этот AI, который делает ошибки, как человек, звучит одновременно и забавно, и немного тревожно 😅 Получается, мы создали идеального цифрового стажёра, который тоже путает Ctrl+C и Ctrl+V? Интересно, как это повлияет на безопасность — вдруг он случайно удалит что-то важное, пытаясь 'помочь'?
Wow, Claude 3.5 Sonnet sounds like a game-changer! An AI that mimics human computer use, errors and all? That’s wild. I wonder how it handles my messy desktop and random browser tabs 😅. Super curious to see it in action!





Heim






