Informatik

Generative KI verstehen und sicher nutzen

Generative KI verstehen und sicher nutzen
Generative KI verstehen und sicher nutzen
Für Quiz, Lückentext, Lernkarten und Fortschritt ist JavaScript nötig. Alle Inhalte und Lösungen bleiben direkt lesbar.

Generative KI erzeugt auf einen Prompt hin neue Inhalte, zum Beispiel Texte, Bilder, Audio, Videos oder Programmcode. Sie setzt dabei gelernte Muster aus Trainingsdaten fort. Das Ergebnis kann nützlich und überzeugend wirken, ist aber nicht automatisch richtig, aktuell oder fair.

Auf dieser Seite erfährst du, wie generative KI grundsätzlich funktioniert. Du lernst außerdem, ihre Ausgaben systematisch zu prüfen und verantwortungsvoll zu verwenden.

Deine Lernziele

Hake ab, was du schon kannst — und komm am Ende hierher zurück!

Woran erkennst du generative KI?

Nicht jedes KI-System erzeugt neue Inhalte. Manche Systeme ordnen Eingaben einer vorhandenen Kategorie zu oder treffen eine Vorhersage. Ein Spamfilter entscheidet beispielsweise, ob eine Nachricht wahrscheinlich Spam ist.

Generative KI erzeugt dagegen eine neue Ausgabe. Ein Textgenerator formuliert eine Antwort, ein Bildgenerator erzeugt ein Bild und ein Codegenerator schlägt Programmcode vor.

Definition

Generative KI

Generative KI ist ein Teilgebiet der künstlichen Intelligenz. Ihre Modelle lernen Muster und Beziehungen aus großen Datenmengen und erzeugen daraus neue Inhalte mit ähnlichen Strukturen.

Neu bedeutet dabei nicht automatisch originell, wahr oder noch nie dagewesen. Die Ausgabe entsteht aus gelernten Mustern.

Beispiel

Du gibst zwei Systemen dieselbe Beschreibung eines Tierfotos:

  • System A wählt das vorhandene Label Hund aus. Es klassifiziert.
  • System B schreibt eine neue kurze Bildergeschichte über den Hund. Es generiert.

Der Unterschied liegt im Hauptergebnis: vorhandene Kategorie bei A, neu zusammengesetzter Inhalt bei B.

Teste dich
Frage 1 von 1LeichtWelche Aufgabe ist eindeutig generativ?
Lösung: Aus Stichworten einen neuen Dialog verfassen — Generative KI erzeugt Inhalte. Klassifikation ordnet eine Eingabe dagegen einer vorgegebenen Kategorie zu.
Wie wird aus Daten eine Ausgabe?

Der vereinfachte Lernweg besteht aus vier Schritten:

  1. Das Modell verarbeitet viele Trainingsdaten, etwa Texte oder Bilder.
  2. Beim Training erkennt es darin statistische Muster und Beziehungen.
  3. Diese Muster werden in zahlreichen veränderbaren Parametern des Modells kodiert.
  4. Nach einem Prompt erzeugt das trainierte Modell eine dazu passende Ausgabe.
Definition

Trainingsdaten

Trainingsdaten sind die Beispiele, aus denen ein Lernverfahren Muster ableitet. Auswahl, Qualität und Zusammensetzung dieser Daten beeinflussen, was das Modell lernen kann.

Textmodelle zerlegen Text in Token. Ein Token kann ein Wort, ein Wortteil oder eine andere Zeichenfolge sein. Das Modell berechnet mögliche Fortsetzungen und erzeugt schrittweise weitere Token. Jedes bereits erzeugte Token wird dabei Teil des folgenden Kontexts.

Merke

Ein Textmodell schlägt nicht in einem eingebauten Lexikon die einzig richtige Antwort nach. Es erzeugt eine statistisch passende Fortsetzung aus erlernten Mustern und dem aktuellen Kontext.

Beispiel

Der Satzanfang „Im Winter fällt manchmal …“ lässt mehrere sprachlich passende Fortsetzungen zu. Ein Textmodell bewertet mögliche nächste Token und wählt eine Fortsetzung aus. Danach setzt es den Vorgang mit dem erweiterten Text fort.

So können zusammenhängende Texte entstehen. Derselbe Mechanismus garantiert aber nicht, dass jede enthaltene Behauptung wahr ist.

Lückentext

Wähle in jeder Lücke die passende Form und prüfe anschließend deine Antworten.

Ein Modell lernt aus statistische Muster. Eine Nutzereingabe heißt . Textmodelle verarbeiten Text in Einheiten, die heißen. Die erzeugte Fortsetzung ist .

Lösungen: Lücke 1: Trainingsdaten; Lücke 2: Prompt; Lücke 3: Token; Lücke 4: wahrscheinlichkeitsbasiert. Trainingsdaten prägen das Modell. Der Prompt steuert die konkrete Aufgabe. Token sind Verarbeitungseinheiten; ihre wahrscheinlichkeitsbasierte Auswahl ist keine Wahrheitsprüfung.
Welche Modelle erzeugen welche Inhalte?

Generative KI ist keine einzelne Technik. Verschiedene Modellfamilien eignen sich für unterschiedliche Daten und Aufgaben.

Transformer und Sprachmodelle

Transformer können Beziehungen zwischen Teilen einer Sequenz gewichten. Ihr Attention-Mechanismus hilft dabei, für die Verarbeitung wichtige Stellen des Kontexts zu berücksichtigen. Transformer bilden die Grundlage vieler großer Sprachmodelle, kurz LLMs.

Weitere Modellfamilien

  • Variational Autoencoder, kurz VAE: Ein Encoder verdichtet Merkmale in einer Repräsentation. Ein Decoder rekonstruiert daraus Inhalte und kann ähnliche Varianten erzeugen.
  • Generative Adversarial Networks, kurz GAN: Ein Generator erzeugt Inhalte, während ein Diskriminator sie beurteilt. Der Wettbewerb kann besonders realistisch wirkende Bilder hervorbringen.
  • Diffusionsmodelle: Beim Training wird mit verrauschten Daten gearbeitet. Das Modell lernt, Rauschen schrittweise zu entfernen und daraus etwa ein gewünschtes Bild zu erzeugen.

Ein breit trainiertes Foundation Model kann viele Aufgaben bearbeiten. Für einen bestimmten Einsatz lässt es sich mit geeigneten Daten, menschlichem Feedback oder anderen Verfahren anpassen.

Gut zu wissen

Ein generatives Modell erzeugt hauptsächlich Inhalte. Ein KI-Agent geht darüber hinaus: Er kann ein Ziel verfolgen, Arbeitsschritte planen und Werkzeuge oder Dienste verwenden. Ein guter Textgenerator ist deshalb nicht automatisch ein selbstständig handelnder Agent.

Teste dich
Frage 1 von 1MittelEin System enthält einen Generator und einen Prüfer, die im Training miteinander konkurrieren. Welche Modellfamilie passt dazu?
Lösung: GAN — GAN steht für Generative Adversarial Network. Generator und Diskriminator verbessern sich durch ihren Wettbewerb.
Wie nutzt und prüfst du eine Ausgabe?

Ein Prompt kann kurz oder ausführlich sein. Für die Zuverlässigkeit entscheidend ist jedoch nicht nur seine Formulierung, sondern auch die anschließende Prüfung.

Ein sinnvoller Arbeitsablauf:

  1. Aufgabe festlegen: Entscheide, welche Ausgabe du brauchst und wofür du sie verwenden willst.
  2. Prompt eingeben: Beschreibe Aufgabe, nötigen Kontext und gewünschte Form so eindeutig wie möglich.
  3. Ausgabe untersuchen: Markiere Behauptungen, Zahlen, Namen und Schlussfolgerungen, die falsch oder veraltet sein könnten.
  4. Verbessern: Präzisiere den Prompt oder korrigiere die Ausgabe.
  5. Verantwortung übernehmen: Verwende das Ergebnis erst, wenn du die entscheidenden Aussagen geprüft hast.
Beispiel

Du lässt einen Textgenerator eine Erklärung für ein Referat formulieren. Der Text klingt flüssig, nennt aber eine konkrete Jahreszahl.

Du übernimmst sie nicht allein wegen des überzeugenden Stils. Du trennst zunächst die verständliche Formulierung von der überprüfbaren Tatsachenbehauptung. Erst nach der Prüfung verwendest oder korrigierst du die Jahreszahl.

Retrieval-Augmented Generation, kurz RAG, ergänzt einen Prompt automatisch um gefundene Dokumente. Das kann aktuellere und fachlich passendere Antworten ermöglichen. Es garantiert aber keine Fehlerfreiheit: Unpassende Dokumente, ein fehlerhafter Abruf oder eine falsche Schlussfolgerung können weiterhin zu einer schlechten Antwort führen.

Teste dich
Frage 1 von 1MittelWas ist nach einer überzeugend klingenden KI-Antwort der wichtigste nächste Schritt?
Lösung: Lernzielrelevante Behauptungen und Angaben prüfen — Prüfe besonders Namen, Zahlen, aktuelle Angaben, Begründungen und Aussagen mit möglichen Folgen. Der Mensch bleibt für die Verwendung verantwortlich.
Welche Fehler und Risiken musst du kennen?

Halluzinationen

Eine Halluzination ist eine plausible wirkende, aber falsche oder unsinnige KI-Ausgabe. Sie kann entstehen, weil das Modell eine sprachlich passende Fortsetzung erzeugt, ohne die Aussage zuverlässig zu belegen.

Bias und Automation Bias

Bias bedeutet hier eine systematische Verzerrung. Sind bestimmte Gruppen in den Trainingsdaten einseitig dargestellt, kann das Modell diese Schieflage übernehmen oder verstärken.

Automation Bias ist ein anderer Fehler: Menschen vertrauen einer technischen Ausgabe zu schnell, weil sie von einem automatischen System stammt.

Beispiel

In einem erfundenen Test erzeugt ein Bildmodell zu zehn Prompts mit dem Wort „Pflegekraft“ neun Bilder von Frauen und eines von einem Mann. Dieses kleine Ergebnis beweist noch nicht die Ursache. Es ist aber ein prüfbarer Hinweis auf eine mögliche systematische Verzerrung.

Ein sinnvoller nächster Schritt wäre, weitere gleich aufgebaute Prompts zu testen, die Ergebnisse zu dokumentieren und mögliche Folgen der Darstellung zu bewerten.

Datenschutz, Rechte und Missbrauch

Vertrauliche, personenbezogene oder geschützte Informationen können durch Prompts, Trainings- oder Anpassungsdaten offengelegt werden. Generative Systeme können außerdem für Phishing, Deepfakes, falsche Identitäten und Desinformation missbraucht werden.

Merke

Gib keine sensiblen Daten in ein System ein, dessen Regeln für Speicherung und Nutzung du nicht kennst. Prüfe außerdem, ob du Texte, Bilder oder Daten überhaupt verwenden darfst.

Teste dich
Frage 1 von 2MittelWelche Beobachtung spricht am stärksten für einen möglichen Bias?
Lösung: Ein gleich aufgebauter Test zeigt wiederholt eine einseitige Darstellung bestimmter Gruppen. — Bias zeigt sich als systematisches Muster. Deshalb brauchst du vergleichbare Fälle und dokumentierte Kriterien statt nur eines auffälligen Einzelbeispiels.
Frage 2 von 2SchwerEin Chatbot nennt zu einer wichtigen Entscheidung eine unbelegte Zahl. Was ist die verantwortungsvollste Reaktion?
Lösung: Zahl nicht übernehmen, Herkunft und Bedeutung prüfen und die Entscheidung nicht allein dem Chatbot überlassen — Bei folgenreichen Entscheidungen sind belegbare Informationen, eine Prüfung des Kontexts und menschliche Verantwortung erforderlich.
Wie bewertest du eine Anwendung verantwortlich?

Eine KI-Anwendung besteht nicht nur aus einem Modell. Zu ihr gehören Daten, Betreiber, Nutzerinnen und Nutzer, betroffene Personen, Regeln und mögliche Folgen. Deshalb hilft eine Akteurs- und Datenflussanalyse.

Frage in dieser Reihenfolge:

  1. Ziel: Welches Problem soll das System lösen?
  2. Akteure: Wer entwickelt, betreibt und verwendet es? Wer ist von seinen Ausgaben betroffen?
  3. Datenfluss: Welche Daten werden eingegeben, gespeichert, abgerufen oder weitergegeben?
  4. Fehlerfolgen: Wer trägt den Schaden bei falschen oder verzerrten Ausgaben?
  5. Alternativen: Kann ein weniger riskantes Verfahren dasselbe Ziel erreichen?
  6. Anforderung: Welche technische oder organisatorische Maßnahme soll das Risiko begrenzen?
  7. Prüfkriterium: Woran lässt sich erkennen, ob die Maßnahme tatsächlich wirkt?
Beispiel

Eine Schule erwägt einen Textgenerator für Rückmeldungen zu Aufsätzen.

Analyse: Lehrkräfte verwenden das System, Lernende erhalten die Rückmeldungen und der Betreiber verarbeitet die Eingaben. Vollständige Aufsätze können persönliche Informationen enthalten. Fehlerhafte Rückmeldungen könnten Lernende unfair beurteilen.

Anforderung: Namen und andere personenbezogene Angaben werden vor der Eingabe entfernt. Keine Rückmeldung wird ungeprüft als Bewertung übernommen.

Prüfkriterium: Eine dokumentierte Stichprobe wird darauf kontrolliert, ob sie noch identifizierende Angaben enthält und ob jede verwendete Rückmeldung von einer Lehrkraft fachlich geprüft wurde.

Teste dich
Frage 1 von 1SchwerWelche Formulierung ist eine überprüfbare Gestaltungsanforderung?
Lösung: Vor der Eingabe werden personenbezogene Angaben entfernt; eine Stichprobe wird regelmäßig auf verbliebene Angaben geprüft. — Eine gute Anforderung nennt eine Handlung und ein beobachtbares Kriterium. So lässt sich kontrollieren, ob der Schutz tatsächlich umgesetzt wird.
Karteikasten
Karteikasten

Überlege zuerst selbst und drehe die Karte anschließend zum Prüfen um.

Alles auf einen Blick
Mindmap
  • Generative KI
    • lernt Muster aus Trainingsdaten
    • erzeugt Inhalte nach einem Prompt
    • nutzt Modellfamilien wie Transformer, VAE, GAN und Diffusionsmodelle
    • ermöglicht Entwürfe, Varianten, Analysen und Unterstützung
    • kann halluzinieren oder Verzerrungen übernehmen
    • verlangt Schutz sensibler Daten
    • braucht menschliche Prüfung und Verantwortung
    • lässt sich mit Maßnahmen und Prüfkriterien gestalten
Abschluss-Check
Teste dich
Frage 1 von 3LeichtWelche Aussage beschreibt generative KI am besten?
Lösung: Sie erzeugt aus gelernten Mustern neue Inhalte. — Das zentrale Merkmal ist die Erzeugung neuer Inhalte. Selbstständiges Planen und Handeln gehört dagegen zu KI-Agenten.
Frage 2 von 3MittelWarum kann eine Antwort trotz eines guten Prompts falsch sein?
Lösung: Das Modell erzeugt eine statistisch passende Ausgabe, ohne Wahrheit zu garantieren. — Gute Prompts können Relevanz und Form verbessern. Eine fachliche Prüfung ersetzen sie nicht.
Frage 3 von 3SchwerEin Generator erstellt aus unausgewogenen Daten Bewerbungsprofile. Welche Kombination ist am sinnvollsten?
Lösung: Ausgaben nach festgelegten Fairnesskriterien testen, Daten und Fehlerfolgen untersuchen und Entscheidungen menschlich prüfen — Verantwortliche Gestaltung verbindet Datenprüfung, vergleichbare Tests, die Bewertung möglicher Folgen und menschliche Kontrolle.

Wenn du alle drei Entscheidungen begründen kannst, hast du den Kern verstanden: Generative KI ist ein leistungsfähiges Werkzeug zur Inhaltserzeugung, aber keine automatische Wahrheits- oder Fairnessmaschine.

Passend dazu