Post Thumbnail

Neuestes Claude 3.7 Sonnet-Modell stürmt die Pokémon-Welt

Anthropic, einer der führenden Anbieter im Bereich künstlicher Intelligenz, hat einen ungewöhnlichen Ansatz zur Erprobung seines neuesten Modells Claude 3.7 Sonnet vorgestellt, indem es das kultische Game Boy-Spiel Pokémon Red verwendete.

Laut Informationen, die am 24. Februar im offiziellen Blog des Unternehmens veröffentlicht wurden, statteten die Forscher das Modell mit grundlegendem Speicher, der Fähigkeit zur Verarbeitung von Pixel-Eingaben vom Bildschirm und funktionalen Aufrufen zum Drücken von Tasten und zur Navigation aus. Dies ermöglichte es der KI, kontinuierlich Pokémon ohne zusätzliche Hilfe zu spielen.

Ein wichtiger Vorteil von Claude 3.7 Sonnet ist die Funktion “erweitertes Denken” (extended thinking), ähnlich den Fähigkeiten von OpenAI o3-mini und DeepSeek R1. Diese Technologie ermöglicht es dem Modell, bei der Lösung komplexer Aufgaben zu “denken”, indem es zusätzliche Rechenressourcen einsetzt und mehr Zeit für die Analyse aufwendet.

Die Ergebnisse des Experiments waren beeindruckend. Während die vorherige Version des Modells, Claude 3.0 Sonnet, nicht einmal das Starthaus in Alabastia verlassen konnte, wo das Spiel beginnt, kämpfte Claude 3.7 Sonnet erfolgreich gegen drei Arenaleiter und erhielt ihre Orden.

Um diese Ergebnisse zu erzielen, führte die KI 35.000 Spielaktionen durch, um den letzten Arenaleiter Major Bob zu erreichen. Das Unternehmen hat jedoch keine genauen Daten über die Rechenleistung und die Zeit offengelegt, die für den Durchlauf des Spiels aufgewendet wurden.

Obwohl Pokémon Red eher als Unterhaltungs-Benchmark angesehen werden kann, hat die Verwendung von Spielen für KI-Tests eine lange Tradition in der Forschungsgemeinschaft. In den letzten Monaten sind eine Reihe neuer Anwendungen und Plattformen entstanden, um die Spielfähigkeiten von KI-Modellen bei verschiedenen Spielen zu testen – von Street Fighter bis Pictionary.

Dieses Experiment demonstriert die wachsende Fähigkeit von Modellen künstlicher Intelligenz, sich in komplexen interaktiven Umgebungen zurechtzufinden, Regeln zu verstehen und strategisch Aktionen zu planen, um langfristige Ziele zu erreichen – Fähigkeiten, die über die Spieleindustrie hinaus breite praktische Anwendungen haben.

Autor: AIvengo
Seit 5 Jahren arbeite ich mit maschinellem Lernen und künstlicher Intelligenz. Und dieser Bereich hört nicht auf, mich zu überraschen, zu begeistern und zu interessieren.
Latest News
KI-Chatbots generieren Inhalte, die Essstörungen verschlimmern

Eine gemeinsame Studie der Stanford University und des Center for Democracy and Technology zeigte ein beunruhigendes Bild. Chatbots mit künstlicher Intelligenz stellen ein ernsthaftes Risiko für Menschen mit Essstörungen dar. Wissenschaftler warnen, dass neuronale Netze schädliche Ratschläge zu Diäten verteilen. Sie schlagen Wege vor, die Störung zu verbergen und generieren "inspirierenden Abnehm-Content", der das Problem verschlimmert.

OpenAGI veröffentlichte das Modell Lux, das Google und OpenAI überholt

Das Startup OpenAGI veröffentlichte das Modell Lux zur Computersteuerung und behauptet, dass dies ein Durchbruch ist. Nach Benchmarks überholt das Modell um eine ganze Generation Analoga von Google, OpenAI und Anthropic. Außerdem arbeitet es schneller. Etwa 1 Sekunde pro Schritt statt 3 Sekunden bei Konkurrenten. Und 10 Mal günstiger in den Kosten pro Verarbeitung von 1 Token.

Altman rief bei OpenAI rote Alarmstufe aus wegen der Erfolge von Google

Sam Altman rief bei OpenAI "rote Alarmstufe" aus, und das ist nicht nur ein Firmendrama. Das ist ein Eingeständnis, dass der Marktführer den Atem der Konkurrenten im Nacken spürte. Laut einer internen Dienstnotiz mobilisiert er zusätzliche Ressourcen zur Verbesserung von ChatGPT angesichts der wachsenden Bedrohung durch Google.

Nutzer verbringen mehr Zeit mit Gemini als mit ChatGPT

OpenAI führt immer noch bei der Nutzerzahl, aber Menschen beginnen mehr Zeit mit Konkurrenten zu verbringen. Und das schafft ein ernstes Problem.

Unternehmen holen 5% der wegen KI-Versagens entlassenen Mitarbeiter zurück

Viele Unternehmen begannen, wegen künstlicher Intelligenz entlassene Mitarbeiter zurückzuholen. Die Analysegesellschaft Visier untersuchte Beschäftigungsdaten von 2,5 Millionen Mitarbeitern aus 142 Unternehmen weltweit. Etwa 5% der entlassenen Mitarbeiter kehrten anschließend zum vorherigen Arbeitgeber zurück. Dieser Indikator blieb mehrere Jahre stabil, begann aber kürzlich zu steigen.