Lernpfad
Wir erleben eine aufregende Zeit für KI. Seit der Veröffentlichung von ChatGPT Ende 2022 hat die KI-Branche eine Entwicklung eingeschlagen, die unser Leben und Arbeiten rasant verändert. Big-Tech-Unternehmen wie Google, Microsoft, Meta, Apple und Amazon spielen eine Schlüsselrolle in dieser laufenden KI-Revolution. Dank ihrer enormen Budgets, Rechenressourcen und Talente treiben sie die Spitzenforschung voran, um im KI-Wettlauf vorne mitzuspielen.
Das bisher wohl bedeutendste KI-Highlight im Jahr 2024 – neben OpenAI’s Sora – ist DeepMinds AlphaGeometry. Entwickelt von DeepMind, Googles Einheit für allgemein einsetzbare KI, kombiniert AlphaGeometry ein neuronales Sprachmodell mit einer symbolischen Deduktions-Engine, um komplexe Geometrieaufgaben zu lösen. Das Modell, als KI-System auf Olympiaden-Niveau für Geometrie beschrieben, ist ein wichtiger Schritt hin zu dem langfristigen Ziel, fortgeschrittene KI-Systeme zu entwickeln, die über mathematische Disziplinen hinweg generalisieren können.
In diesem Artikel stellen wir dir AlphaGeometry vor. Wir beleuchten die Motivation dahinter, wie es funktioniert und welche Anwendungsfälle besonders relevant sind. Zum Schluss geben wir Hinweise, was AlphaGeometry für die Zukunft der KI-Forschung bedeutet.
Was ist AlphaGeometry?
AlphaGeometry ist ein KI-System der nächsten Generation, das für das Lösen komplexer Geometrie entwickelt wurde. Das System verfolgt einen neuartigen Ansatz für logisches Schlussfolgern und übertrifft damit den bisherigen Stand der Technik bei geometriebezogenen Aufgaben.
Im Gegensatz zu KI-Tools wie OpenAI’s ChatGPT und Googles Gemini, die als allgemeine KI-Modelle gelten können, ist AlphaGeometry ein domänenspezifisches KI-Modell.
Der Code und das Modell sowie die Methoden zur Generierung synthetischer Daten und zum Training (siehe nächster Abschnitt) sind unter einer Open-Source-Lizenz veröffentlicht.
Um die Leistungsfähigkeit von AlphaGeometry zu testen, erstellten Forschende von Google DeepMind einen Benchmark aus Geometrieaufgaben, die aus verschiedenen Jahrgängen der International Mathematical Olympiads (IMO) zwischen 2000 und 2022 zusammengestellt wurden.
Die IMO ist ein jährlicher Wettbewerb, bei dem brillante Schülerinnen und Schüler aus aller Welt mathematische Probleme lösen, darunter auch Aufgaben aus der Geometrie.
AlphaGeometry konnte 25 von 30 ausgewählten Aufgaben innerhalb der Wettbewerbszeit lösen und übertraf damit frühere KI-Systeme. Es näherte sich dem Durchschnittsergebnis menschlicher Goldmedaillengewinner an, wie in der folgenden Grafik zu sehen ist. Aufbau und Ergebnisse des Benchmarks sind in einem eigenen Paper in Nature dokumentiert.

Quelle: Google
Wie funktioniert AlphaGeometry?
Der Schlüssel zum Erfolg von AlphaGeometry liegt im hybriden Ansatz zur (geometrischen) Problemlösung. Moderne große Sprachmodelle (LLMs) wie OpenAI’s ChatGPT und Googles Gemini erkennen zwar gut Muster, können aber häufig nicht präzise schlussfolgern.
Google DeepMind begegnet dieser Einschränkung, indem ein neuronales Sprachmodell mit einer symbolischen Deduktions-Engine kombiniert wird, die auf algebraisches und geometrisches Denken spezialisiert ist. Das neuronale Sprachmodell liefert schnelle, intuitive Ideen und Lösungsansätze. Das symbolische Modell hingegen, das auf formaler Logik basiert und sich leicht erklären und prüfen lässt, trifft durchdachte, rationale Entscheidungen auf Basis der Vorarbeit des ersten Modells.
Um zu verstehen, wie AlphaGeometry arbeitet, lohnt ein Blick auf die Natur der IMO-Geometrieaufgaben. Diese Aufgaben basieren auf Diagrammen, die erst durch das Hinzufügen neuer geometrischer Elemente wie Punkte, Geraden und Kreise lösbar werden.
Wenn AlphaGeometry auf eine solche Aufgabe trifft, setzt es zunächst sein Sprachmodell ein, um aus unendlich vielen Möglichkeiten die nützlichsten neuen Konstrukte vorherzusagen. Diese Hinweise schließen Lücken und ermöglichen es der symbolischen Engine, weitere Schlüsse über das Diagramm zu ziehen und sich der Lösung zu nähern. Der gesamte Prozess ist unten dargestellt:

Quelle: Google
Dieser innovative Doppelansatz ermöglicht es AlphaGeometry nicht nur, sinnvolle Konstrukte vorherzusagen, sondern seine Entscheidungen auch zu erklären und zu validieren.
Synthetische Daten nutzen
Eine der größten Herausforderungen bei der Entwicklung von AlphaGeometry war das Training. Die Eigenschaften und Beziehungen geometrischer Objekte (z. B. Raum, Abstand, Form, Lagebeziehungen) in ein maschinenlesbares Format zu übersetzen, ist komplex, da geometriespezifische Programmiersprachen eng definiert sind und menschliche Beweise, die auf Methoden außerhalb der Geometrie beruhen (etwa komplexe Zahlen), nur schwer abbilden können.
Dadurch entsteht ein Datenengpass, der den Einsatz von Machine-Learning-Verfahren für Geometrie erschwert.
Um diese Hürde zu überwinden, entwickelten die Forschenden von Google DeepMind eine neue Methode, die mit Parallelrechenverfahren einen großen Pool synthetischer Trainingsdaten erzeugt – insgesamt 100 Millionen einzigartige Diagramme geometrischer Objekte. Lies in unserem separaten Artikel, was synthetische Daten sind.
Diese Trainingsdaten nutzte das Modell, um Eigenschaften und Beziehungen sowie geometrische Lehrsätze und zugehörige Beweise zu erlernen – ganz ohne menschliche Demonstrationen. Der Prozess zur Generierung synthetischer Daten ist in der folgenden Grafik illustriert:

Quelle: Nature
Die breite Verfügbarkeit synthetischer Daten ermöglicht es dem Sprachmodell von AlphaGeometry, bei neuen Geometrieproblemen gute Vorschläge für zusätzliche Konstrukte zu machen.
Was bedeutet AlphaGeometry für die Zukunft der KI-Forschung?
AlphaGeometry ist ein Forschungsmodell, das gezielt für die Lösung abstrakter Geometrieprobleme entwickelt wurde. Trotz seiner außergewöhnlichen Leistung ist AlphaGeometry ausschließlich auf IMO-Aufgaben trainiert (und auch nur auf einen Teil davon, denn die IMO umfasst zudem Aufgaben aus Algebra, Zahlentheorie und Kombinatorik).
AlphaGeometry zielt nicht darauf ab, direkt zu Disziplinen beizutragen, in denen Geometrie grundlegend ist, etwa Architektur, Ingenieurwesen oder Kunst. Es ist vielmehr ein vielversprechendes Beispiel dafür, wie neuronale Sprach- und symbolische Modelle kombiniert werden können, um die Fähigkeit zum begründeten Denken in künftigen KI-Systemen zu stärken.
Die Entwicklung neuartiger Ansätze zur Erzeugung großskaliger synthetischer Daten, wie beim Training von AlphaGeometry gezeigt, bringt uns dieser neuen Grenze der KI-Forschung näher.
Das übergeordnete Ziel ist, eine neue Generation von KI-Systemen zu bauen, die die Grenzen und Schwächen aktueller großer Sprachmodelle überwindet. Das gelingt, indem neue Modelle mit fortgeschrittenen Fähigkeiten für Schlussfolgern und Problemlösen ausgestattet werden, die Wissen über mathematische Felder hinaus verallgemeinern können.
Mehr erfahren
Wir hoffen, dir hat dieser Artikel über DeepMind AlphaGeometry gefallen. Wir stehen erst am Anfang der KI-Revolution, die unsere Welt rasch verändert. Die Einsätze sind hoch – umso wichtiger ist es, am Puls der aktuellen Entwicklungen zu bleiben.
DataCamp hilft dir, dich in der KI-Revolution zurechtzufinden. Sieh dir unsere Artikel und Kurse zu generativer KI an.
- AI Fundamentals Skill Track
- Generative AI Concepts Course
- How to Learn AI From Scratch in 2024: A Complete Expert Guide
- The OpenAI API in Python Cheat Sheet
- Fine-Tuning LLaMA 2: A Step-by-Step Guide to Customizing the Large Language Model
- Mistral 7B Tutorial: A Step-by-Step Guide to Using and Fine-Tuning Mistral 7B
- How to Fine Tune GPT 3.5: Unlocking AI's Full Potential
Ich bin freiberufliche Datenanalystin und arbeite mit Unternehmen und Organisationen auf der ganzen Welt an Data-Science-Projekten zusammen. Ich bin auch Ausbilder für Data Science mit mehr als 2 Jahren Erfahrung. Ich schreibe regelmäßig datenwissenschaftliche Artikel in englischer und spanischer Sprache, von denen einige auf etablierten Websites wie DataCamp, Towards Data Science und Analytics Vidhya veröffentlicht wurden. Als Datenwissenschaftlerin mit einem Hintergrund in Politik- und Rechtswissenschaften ist es mein Ziel, an der Schnittstelle von Politik, Recht und Technologie zu arbeiten und die Macht der Ideen zu nutzen, um innovative Lösungen und Erzählungen voranzutreiben, die uns dabei helfen können, dringende Herausforderungen wie die Klimakrise anzugehen. Ich betrachte mich als Autodidakt, der ständig lernt und ein überzeugter Verfechter der Multidisziplinarität ist. Es ist nie zu spät, neue Dinge zu lernen.


