Zurück zu OpenClaw
AIDevelopment · TECH // GUIDE

AI Engineering from Scratch Lernpfad: Wie lernt man 523 Lektionen? Python, LLM, RAG und Projektpraxis – welche Ausstattung ist nötig?

2026.09.30 · ca. 12 Min. Lesezeit

Der offizielle Kurskatalog führt 523 Lektionen auf; daraus folgt aber nicht, dass jeder Lernende alles linear absolvieren muss. Dieser Leitfaden ordnet den Lernpfad nach Python-Vorkenntnissen und Zielen wie LLM, RAG oder Agenten, beschreibt überprüfbare Projektziele und hilft bei der Wahl zwischen lokalem Rechner und Cloud-Umgebung.

AI Engineering from Scratch Lernpfad: Wie lernt man 523 Lektionen? Python, LLM, RAG und Projektpraxis – welche Ausstattung ist nötig?

Der offizielle Kurskatalog führt 523 Lektionen auf (Kursverzeichnis). Das ist ein Umfangshinweis, keine Pflicht, jede Einheit der Reihe nach abzuschließen. Für den Lernpfad für AI Engineering from Scratch gilt: Wählen Sie zuerst ein Projektziel und gleichen Sie es mit Ihren Vorkenntnissen ab. Grundlagen und kleine Codeübungen lassen sich in der Regel lokal bearbeiten; bei Modellbetrieb, Training oder Produktionsversuchen entscheidet dagegen die konkrete Versuchsanleitung, ob eine entfernte Umgebung sinnvoll ist.

Dieser Leitfaden ist für Python-Entwickler gedacht, die gezielt in LLM Engineering einsteigen möchten.
Einsteiger ohne Python-Erfahrung finden Kriterien, um Programmier- und Mathematikgrundlagen einzuordnen.
Projektorientierte Lernende können prüfen, ob Kursaufgaben tatsächlich zu einem vorzeigbaren Portfolio beitragen.

Lernziele statt Kurslänge als Maßstab setzen

Die Kursbezeichnung und der Umfang beantworten nicht automatisch die wichtigste Lernfrage: Welche Fähigkeiten werden für das eigene Vorhaben gebraucht? Der offizielle Katalog und die beschriebenen Lernpfade sind dafür die maßgeblichen Orientierungspunkte; sie sollten vor der Planung gemeinsam gelesen werden (offizielle Lernpfade). Daraus lässt sich ein individueller Einstieg ableiten, ohne den Kursinhalt mit nicht bestätigten Versprechen zu ergänzen.

Ein belastbarer Lernplan verbindet drei Dinge: den aktuellen Kenntnisstand, ein konkretes Anwendungsszenario und ein Ergebnis, das sich später vorführen und erklären lässt. Wer etwa eine RAG-Anwendung bauen will, muss nicht zwangsläufig jede Einführungseinheit erledigen, sofern die darin behandelten Grundlagen bereits sicher beherrscht werden. Umgekehrt sollte ein Kursabschnitt nicht allein deshalb übersprungen werden, weil sein Titel vertraut klingt: Entscheidend ist, ob die zugehörigen Übungen ohne Nachschlagen gelöst und die Entscheidungen im Code begründet werden können.

Auch die veröffentlichte Versionshistorie gehört zur Prüfung. Ein Lernpfad kann sich durch neue Inhalte oder geänderte Experimente verschieben; prüfen Sie deshalb vor dem Start das offizielle Änderungsprotokoll, statt sich auf eine ältere Kursbeschreibung oder eine fremde Zusammenfassung zu verlassen.

Für Python-Entwickler: Lücken schließen, nicht Grundlagen wiederholen

Wer bereits regelmäßig Python-Code schreibt, sollte die Grundlagen nicht pauschal nochmals absolvieren. Sinnvoller ist ein kurzer Selbsttest: Kann die Person Daten aus einer Datei einlesen und bereinigen, Funktionen und Module strukturieren, Abhängigkeiten in einer isolierten Umgebung verwalten und Fehler anhand einer nachvollziehbaren Meldung eingrenzen? Die Python-Tutorials der offiziellen Dokumentation bieten eine Referenz, um einzelne Wissenslücken zu überprüfen, statt den gesamten Einstieg erneut zu durchlaufen.

Anschließend lässt sich die eigene Erfahrung mit den Themen des Kursverzeichnisses abgleichen. Bei vorhandenem Verständnis für Datenstrukturen und Modellierungsgrundlagen kann der Einstieg näher an den LLM- und Projektinhalten liegen. Wer zwar Python beruflich nutzt, aber kaum mit Datensätzen, Evaluierung oder maschinellem Lernen gearbeitet hat, sollte diese Lücke zuerst an kleinen Übungen testen. Das verhindert, dass ein späteres Problem beim Modellaufruf fälschlich als komplizierter LLM-Fehler interpretiert wird, obwohl eigentlich Datenaufbereitung oder Python-Umgebung die Ursache sind.

Für Lernende ohne Python-Erfahrung: erst arbeitsfähige Grundlagen schaffen

Eignet sich AI Engineering from Scratch auch ohne Python-Vorkenntnisse?
Der Kurskatalog ist keine Garantie dafür, dass ein kompletter Neuling ohne Vorbereitung jede spätere Aufgabe bewältigen kann. Wer noch nicht programmiert hat, sollte zuerst grundlegende Python-Arbeitsschritte üben: Werte und Sammlungen verarbeiten, Funktionen schreiben, Dateien einlesen, Fehler untersuchen und ein kleines Programm in einer sauberen Entwicklungsumgebung ausführen. Für die Verwaltung projektbezogener Abhängigkeiten sollte eine isolierte Python-Umgebung eingerichtet werden; so lassen sich Konflikte zwischen unterschiedlichen Übungen leichter nachvollziehen und beheben.

Mathematik und maschinelles Lernen müssen nicht vorab auf Hochschulniveau abgeschlossen sein; relevant ist, die Begriffe und Auswertungen zu verstehen, die in späteren Übungen tatsächlich vorkommen. Dazu zählen je nach Lernpfad etwa Vektoren, Wahrscheinlichkeiten, Trainings- und Testdaten sowie die Bedeutung einer Modellbewertung. Die Einstiegsdokumentation zu scikit-learn zeigt, wie ein grundlegender Machine-Learning-Ablauf aufgebaut ist. Sie eignet sich als Referenz für fehlende Konzepte, nicht als Behauptung, dass jedes Kursprojekt genau dieselben Werkzeuge nutzt.

Ein einfacher Eignungstest ist eine kleine Übung ohne großes Modell: Daten laden, eine Transformation durchführen, ein Ergebnis prüfen und den Code erneut ausführen können. Wenn bereits dieser Ablauf nur mit einer Schritt-für-Schritt-Anleitung gelingt, ist es meist effizienter, die Programmiergrundlagen zuerst zu festigen. Wer ihn erklären und variieren kann, kann gezielter in die nächste passende Kurseinheit einsteigen.

Vier Startpunkte nach Ziel und Vorkenntnis vergleichen

Die folgende Gegenüberstellung ist eine Auswahlhilfe, keine starre Kursreihenfolge. Die Bezeichnungen der offiziellen Lernpfade und Experimente sollten vor dem jeweiligen Einstieg mit dem aktuellen Verzeichnis abgeglichen werden.

Ausgangspunkt Schwerpunkt Lokale Umgebung Sinnvolles Ergebnis
Python-Anfänger Programmierpraxis und benötigte Mathematik- beziehungsweise ML-Grundlagen Editor, Python-Umgebung und kleine Datensätze; zunächst kein großes Modell erforderlich Ein reproduzierbares Skript, dessen Ein- und Ausgaben erklärt werden können
Python-erfahren, wenig ML-Praxis Datenverarbeitung, Modellgrundlagen und ausgewählte LLM-Inhalte Lokale Übungen und bei Bedarf API-basierte Versuche, entsprechend der jeweiligen Anleitung Ein kleiner, dokumentierter Modellversuch mit nachvollziehbarer Auswertung
RAG-orientiert Modellverständnis, Datenaufbereitung, Abruf und Anwendungsschicht Kleine lokale Datenbasis und zunächst ein begrenzter, messbarer Anwendungsfall Eine RAG-Anwendung, deren Antworten anhand festgelegter Beispiele geprüft werden
Agenten- oder produktionsorientiert Werkzeugaufrufe, Kontrollfluss, Fehlerbehandlung und Betriebsfragen Erst reproduzierbare lokale Tests; entfernte Ressourcen nur, wenn das konkrete Experiment sie verlangt Ein lauffähiger Agent mit Tests, Protokollierung und dokumentierten Grenzen

Für RAG ist die Dokumentation zum RAG-Modell in Transformers ein technischer Bezugspunkt für die Verbindung von Abruf und Generierung. Sie ersetzt nicht die Prüfung, welche konkrete Umsetzung der Kurs behandelt. Ebenso ist die lokale Installationsübersicht für PyTorch hilfreich, wenn ein Experiment dieses Framework voraussetzt. Daraus folgt jedoch keine pauschale Hardwareanforderung für den gesamten Kurs.

Für RAG-Lernende: vom Datenfluss zu überprüfbaren Antworten

Wo sollte der Einstieg für LLM und RAG liegen?
Wer eine RAG-Anwendung als Ziel hat, sollte den Lernweg anhand der Verarbeitungskette planen, nicht allein anhand von Schlagwörtern. Zunächst muss klar sein, wie das verwendete Modell Eingaben verarbeitet und welche Grenzen die Generierung hat. Darauf folgen Datenaufbereitung und ein nachvollziehbarer Abrufschritt. Erst wenn diese Teile getrennt geprüft werden können, lohnt es sich, sie in einer Anwendung zusammenzuführen.

Für ein erstes Projekt genügt ein eng begrenzter Bestand an Dokumenten. Halten Sie fest, welche Fragen beantwortbar sein sollen, welche Textstellen als passende Belege gelten und wie unzureichende Treffer sichtbar werden. Prüfen Sie bei jedem Testfall, ob das System relevante Inhalte findet, ob die Antwort durch diese Inhalte gestützt wird und ob es bei fehlender Grundlage angemessen reagiert. Diese Prüfungen sind aussagekräftiger als eine bloße Demonstration mit einer einzelnen gelungenen Antwort.

Wenn die Qualität nicht stimmt, ändern Sie nicht gleichzeitig Datenaufbereitung, Abruflogik und Modellparameter. Trennen Sie die Ursachen: Wird der passende Text überhaupt gefunden? Ist er für das Modell verständlich aufbereitet? Entsteht der Fehler erst bei der Formulierung? So entsteht ein Projekt, das sich erklären und verbessern lässt, statt einer schwer reproduzierbaren Demo. Erst nach diesem Durchlauf sollte der Umfang erweitert werden.

Für Agenten und Produktion: Funktion nicht mit Betriebssicherheit verwechseln

Ein Agentenprojekt verlangt mehr als eine erfolgreiche Werkzeugausführung im Notebook. Zu den relevanten Fragen gehören: Welche Werkzeuge darf das System aufrufen? Was geschieht bei ungültigen Eingaben oder ausbleibenden Antworten? Lassen sich Schritte nachvollziehen und Ergebnisse reproduzieren? Welche Daten werden an externe Dienste übermittelt? Für personenbezogene oder vertrauliche Daten müssen Lernende zusätzlich die Datenschutzanforderungen ihrer Organisation und die Bedingungen der jeweiligen Umgebung prüfen.

Die Kursinhalte sollten deshalb nach Abhängigkeiten gewählt werden: Erst muss der grundlegende Ablauf verständlich sein, anschließend lassen sich Werkzeugaufrufe und Kontrollfluss untersuchen; Produktionsfragen werden dann anhand des konkreten Projekts ergänzt. Diese Reihenfolge ist eine Arbeitslogik, keine Behauptung über eine feste offizielle Kursreihenfolge. Als Nachweis des Lernfortschritts dient nicht die Zahl erledigter Lektionen, sondern etwa ein Agent, der einen begrenzten Auftrag bearbeitet, Fehlerfälle dokumentiert und seine Berechtigungen nicht stillschweigend ausweitet.

Bei einer Produktionsnähe zählen außerdem Stabilität und Datenschutz der Entwicklungsumgebung. Prüfen Sie, wo Quellcode, Protokolle und Schlüssel gespeichert werden, wer Zugriff darauf hat und ob die Umgebung nach einem Neustart wiederherstellbar ist. Geheimnisse gehören nicht in ein öffentliches Repository oder in ungeschützte Notebooks. Diese Punkte sind keine besondere Eigenschaft eines bestimmten Kurses, sondern grundlegende Prüfungen, sobald echte Zugangsdaten oder nicht öffentliche Daten im Spiel sind.

Lokal, API oder Cloud anhand des Experiments wählen

Benötigt jedes Kursprojekt eine eigene GPU?
Nein. Die Zahl der Lektionen lässt sich nicht in eine notwendige GPU-Konfiguration umrechnen. Codeübungen, Datenverarbeitung und API-Aufrufe können andere Anforderungen haben als das lokale Laden eines Modells oder ein Trainingsexperiment. Maßgeblich ist daher die jeweilige Versuchsanleitung: Welche Abhängigkeiten werden installiert, welche Daten werden geladen, wird ein Modell heruntergeladen, und nennt die Dokumentation eine konkrete Speicher- oder Hardwareanforderung?

Das offizielle Installationsdokument für PyTorch hilft bei der Wahl einer passenden Softwareinstallation, liefert aber keinen Nachweis, dass ein beliebiger Rechner sämtliche Kursversuche ausführen kann. Für Experimente mit einem gehosteten Notebook erläutert die offizielle FAQ zu Colab die Bedingungen dieser Umgebung. Verfügbarkeit, Laufzeit und Ressourcenzugang sind von den jeweils geltenden Regeln abhängig; deshalb sollte ein Projekt nicht auf eine dauerhaft unveränderte kostenlose Ressource angewiesen sein.

Praktisch lassen sich die Optionen so abwägen:

  • Lokaler Rechner: passend für Programmierung, kleinere Datensätze und Experimente, die innerhalb der dokumentierten Ressourcen laufen. Vorteil: Code und Daten bleiben leichter unter eigener Kontrolle. Grenzen entstehen durch vorhandenen Arbeitsspeicher, Speicherplatz, installierte Software und mögliche Wärme- oder Stabilitätsprobleme bei längeren Läufen.
  • API-basierter Modellaufruf: nützlich, wenn ein Versuch den Modellzugriff über einen Dienst vorsieht und kein lokales Modell ausgeführt werden muss. Vorher sollten Schlüsselverwaltung, Datenweitergabe, Nutzungsbedingungen und mögliche variable Nutzungskosten geprüft werden. Ein API-Aufruf ersetzt außerdem nicht die Lernziele rund um lokale Modellinstallation oder Training.
  • Gehostete Notebook- oder Cloud-Umgebung: erwägenswert, wenn die konkrete Anleitung lokale Ressourcen überfordert oder einen entfernten Laufzeitkontext voraussetzt. Zu prüfen sind Zugang, Sitzungskontinuität, Dateispeicherung, Übertragung von Daten, Berechtigungen und Wiederholbarkeit. Ein verfügbarer Beschleuniger allein garantiert weder, dass das Experiment funktioniert, noch dass die Umgebung für sensible Daten geeignet ist.

Beginnen Sie mit den Teilen, die lokal zuverlässig laufen. Sobald ein konkretes Experiment an einer dokumentierbaren Ressourcenbegrenzung scheitert, notieren Sie den Fehler und die benötigte Abweichung; erst dann vergleichen Sie eine entfernte Entwicklungsumgebung. Bei einem solchen Vergleich sollten Sie auch klären, wie der Anbieter mit Quellcode und gegebenenfalls personenbezogenen Daten umgeht. Weiterführende Angaben zu Zugang und Nutzung finden Sie im Zutcloud-Hilfebereich. Eine konkrete Konfiguration oder ein Preis lässt sich ohne Prüfung des jeweiligen Angebots und des Experiments nicht seriös aus der Kurslänge ableiten.

Schrittweise vom Kursverzeichnis zum eigenen Lernplan

  1. Ein Zielprojekt festlegen. Beschreiben Sie in einem Satz, was am Ende vorführbar sein soll: beispielsweise eine RAG-Suche über einen kleinen Dokumentbestand oder ein Agent, der eine begrenzte Aufgabe mit einem Werkzeug erledigt. Ein allgemeines Ziel wie „LLM lernen“ ist zu unscharf, um Kurseinheiten auszuwählen.

  2. Vorkenntnisse an den benötigten Aufgaben testen. Prüfen Sie, ob Python-Code, Datenstrukturen, Dateioperationen und grundlegende Auswertungen ohne dauernde Anleitung gelingen. Markieren Sie nicht „bekannt“, sondern „selbstständig ausführbar und erklärbar“. Bei Unsicherheit bearbeiten Sie eine Grundlagenübung, bevor Sie den entsprechenden Abschnitt überspringen.

  3. Kursverzeichnis und Lernpfade gegen das Ziel lesen. Suchen Sie nach den Themen, die zum geplanten Ergebnis gehören, und prüfen Sie ihre Voraussetzungen im offiziellen Material. Notieren Sie, was verpflichtend wirkt, was bereits durch eigene Erfahrung abgedeckt ist und welche Abschnitte gezielt nachgearbeitet werden müssen.

  4. Die Versuchsumgebung pro Experiment erfassen. Prüfen Sie Installationshinweise, benötigte Daten, Modellzugriff und Hardwareangaben, sofern die Anleitung solche Angaben macht. Trennen Sie Softwareprobleme von Ressourcenproblemen: Ein fehlendes Paket ist kein Beleg für eine zu schwache GPU.

  5. Zuerst den kleinsten vollständigen Durchlauf bauen. Verwenden Sie den kleinsten sinnvollen Datenumfang und führen Sie den Ablauf vom Eingang bis zum Ergebnis aus. Halten Sie Abhängigkeiten, Konfiguration und bekannte Grenzen fest, damit der Versuch später reproduzierbar bleibt.

  6. Tests vor Erweiterungen ergänzen. Legen Sie Beispiele fest, bei denen das erwartete Verhalten bekannt ist. Bei RAG gehören dazu passende und unpassende Suchanfragen; bei Agenten auch ungültige Eingaben oder nicht verfügbare Werkzeuge. Prüfen Sie Fehler, nicht nur den Idealfall.

  7. Erst bei nachgewiesener Begrenzung die Umgebung wechseln. Dokumentieren Sie, was lokal nicht funktioniert und welche Anforderung die Versuchsanleitung nennt. Vergleichen Sie danach API, gehostetes Notebook und entfernte Rechenumgebung nach Datenschutz, Stabilität, Kostenmodell und Zugriff, statt vorsorglich die leistungsstärkste Option zu wählen.

  8. Den Lernplan anhand des Ergebnisses anpassen. Wenn das Projekt ausführbar, erklärbar und wiederholbar ist, verschieben Sie den Schwerpunkt auf die nächste belegte Wissenslücke. Wenn nicht, kehren Sie zu der Komponente zurück, deren Verhalten sich nicht erklären lässt, anstatt einfach weitere Lektionen abzuhaken.

Checkliste: Fortschritt am Werkstück statt am Zähler messen

  • [ ] Das Zielprojekt ist so begrenzt beschrieben, dass ein Außenstehender das erwartete Ergebnis prüfen kann.
  • [ ] Die übersprungenen Grundlagen wurden durch eine konkrete Fähigkeit ersetzt, die selbstständig vorgeführt werden kann.
  • [ ] Daten, Modellzugriff und Laufzeitumgebung sind getrennt dokumentiert.
  • [ ] Das Projekt lässt sich mit beschriebenen Schritten erneut ausführen.
  • [ ] Mindestens ein Fehler- oder Grenzfall ist dokumentiert und nicht nur der erfolgreiche Idealfall.
  • [ ] Verwendete Schlüssel und sensible Daten sind nicht versehentlich in Code, Protokollen oder öffentlichen Dateien abgelegt.
  • [ ] Ein Wechsel zu einer Cloud-Umgebung ist mit einem konkreten Ressourcen- oder Zugriffsproblem begründet.
  • [ ] Der nächste Lernabschnitt schließt eine beobachtete Lücke oder verbessert ein benanntes Projektergebnis.

Ein Portfolio-Eintrag sollte neben dem Ergebnis auch die Entscheidungen sichtbar machen: Welche Daten wurden verwendet, warum wurde dieser Abruf- oder Modellschritt gewählt, welche Fehler traten auf und wie wurden sie getestet? Damit wird aus einem Kursprojekt ein nachvollziehbarer Arbeitsnachweis. Die Kurslänge allein garantiert weder eine bestimmte Kompetenz noch einen beruflichen Erfolg; die Qualität der Erklärung und die Reproduzierbarkeit des Ergebnisses sind die belastbareren Kriterien.

Zuletzt geprüft am 30.09.2026 anhand des offiziellen Kursverzeichnisses, der offiziellen Lernpfade und der Versionshinweise. Änderungen an Verzeichnis, Experimenten oder dokumentierten Voraussetzungen können die Auswahl der passenden Einstiegspunkte verändern.

Wenn lokale Übungen bereits stabil laufen, aber ein bestimmtes Experiment an der dokumentierten Laufzeit oder am Modellzugriff scheitert, ist eine entfernte Umgebung eine mögliche nächste Option — nicht automatisch die Voraussetzung für den Kurs. Prüfen Sie vor diesem Wechsel, ob Datenübertragung, Zugangskontrolle und Sitzungsstabilität zu Ihrem Projekt passen; als nächster Orientierungsschritt kann die Zutcloud-Übersicht für Entwickler dienen. Für dauerhaft hohe, gleichmäßige Rechenlast oder spezielle physische Anschlüsse ist eine eigene lokale Maschine oft geeigneter; für kurze, klar begrenzte Versuche kann eine temporäre Umgebung dagegen den Aufwand für eigene Hardware vermeiden.

Ihr nächster Schritt im AI-Engineering-Lernpfad

Prüfen Sie zunächst Ihre Python-Grundlagen und wählen Sie die Kursabschnitte, die zu Ihrem Vorwissen und Lernziel passen.

Vertiefen Sie LLM-Anwendungen anhand eines kleinen Projekts und prüfen Sie systematisch, ob die Antworten Ihren Anforderungen entsprechen. Jetzt bestellen

CI/CD

iOS CI/CD auf stabilem M4-Knoten

Dediziertes M4 · globale Regionen · monatlich · OpenClaw-ready

Jetzt bestellen
Mac Cloud Angebot · tippen