<?xml version="1.0"?>
<feed xmlns="http://www.w3.org/2005/Atom" xml:lang="de">
	<id>https://staging.moocwiki.org/index.php?action=history&amp;feed=atom&amp;title=Daten_als_Grundlage_von_KI_verstehen</id>
	<title>Daten als Grundlage von KI verstehen - Versionsgeschichte</title>
	<link rel="self" type="application/atom+xml" href="https://staging.moocwiki.org/index.php?action=history&amp;feed=atom&amp;title=Daten_als_Grundlage_von_KI_verstehen"/>
	<link rel="alternate" type="text/html" href="https://staging.moocwiki.org/index.php?title=Daten_als_Grundlage_von_KI_verstehen&amp;action=history"/>
	<updated>2026-09-13T07:31:21Z</updated>
	<subtitle>Versionsgeschichte dieser Seite in MOOCsWiki Staging</subtitle>
	<generator>MediaWiki 1.46.0</generator>
	<entry>
		<id>https://staging.moocwiki.org/index.php?title=Daten_als_Grundlage_von_KI_verstehen&amp;diff=52343&amp;oldid=prev</id>
		<title>Glanz: aiMOOC über GPT aiMOOC Action erstellt</title>
		<link rel="alternate" type="text/html" href="https://staging.moocwiki.org/index.php?title=Daten_als_Grundlage_von_KI_verstehen&amp;diff=52343&amp;oldid=prev"/>
		<updated>2026-09-12T13:27:52Z</updated>

		<summary type="html">&lt;p&gt;aiMOOC über GPT aiMOOC Action erstellt&lt;/p&gt;
&lt;p&gt;&lt;b&gt;Neue Seite&lt;/b&gt;&lt;/p&gt;&lt;div&gt;{{T}}&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Einleitung =&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Daten als Grundlage von KI verstehen&amp;#039;&amp;#039;&amp;#039; bedeutet: Du untersuchst, womit viele heutige Systeme der [[Künstliche Intelligenz|Künstlichen Intelligenz]] arbeiten, bevor sie überhaupt eine Antwort, Empfehlung oder Einordnung erzeugen. Viele moderne KI-Systeme beruhen auf [[Maschinelles Lernen|maschinellem Lernen]]. Dabei werden aus Beispielen in [[Daten|Daten]] Muster abgeleitet. Die Daten können zum Beispiel Texte, Bilder, Messwerte, Töne oder Tabellen sein.&lt;br /&gt;
&lt;br /&gt;
Wichtig ist: Eine KI „weiß“ nicht automatisch, was wahr, fair oder sinnvoll ist. Was sie aus Daten ableiten kann, hängt davon ab, &amp;#039;&amp;#039;&amp;#039;welche Daten ausgewählt wurden, wie gut sie sind, welche Labels vergeben wurden und ob wichtige Fälle fehlen&amp;#039;&amp;#039;&amp;#039;. Deshalb gehört zum Verstehen von KI immer auch das Prüfen der Datengrundlage.&lt;br /&gt;
&lt;br /&gt;
Dieser Lernkurs ist für die Schule, besonders für &amp;#039;&amp;#039;&amp;#039;Klasse 5&amp;#039;&amp;#039;&amp;#039;, gedacht. Du brauchst keine technischen Vorkenntnisse. Du arbeitest mit kleinen Datensätzen, sortierst Beispiele, zeichnest einfache [[Diagramm|Diagramme]], prüfst Fehler und überlegst, wann Menschen einer KI vertrauen dürfen und wann nicht.&lt;br /&gt;
&lt;br /&gt;
[[Datei:Machine learning workflow diagram.png|500px|rahmenlos|center]]&lt;br /&gt;
&lt;br /&gt;
Die Grafik zeigt einen typischen Ablauf beim maschinellen Lernen: Daten werden gesammelt und verarbeitet, ein Modell wird erstellt und anschließend geprüft. Für diesen Kurs reicht zunächst die einfache Idee: &amp;#039;&amp;#039;&amp;#039;Beispiele hinein – Muster finden – mit neuen Beispielen prüfen&amp;#039;&amp;#039;&amp;#039;.&lt;br /&gt;
&lt;br /&gt;
{{#ev:youtube|   https://www.youtube.com/watch?v=_80pKGuyKWc   |500|center}}&lt;br /&gt;
&lt;br /&gt;
Das Video der Sendung mit der Maus erklärt kindgerecht, wie KI aus großen Datenmengen Muster ableiten kann. Achte beim Anschauen besonders auf die Frage: &amp;#039;&amp;#039;&amp;#039;Woher kommen die Beispiele, aus denen die KI ihre Muster gewinnt?&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Lernziele ==&lt;br /&gt;
&lt;br /&gt;
Am Ende des Kurses kannst Du erklären, warum Daten für viele KI-Systeme wichtig sind. Du kannst an neuen Beispielen erkennen, ob ein Datensatz wahrscheinlich hilfreich oder problematisch ist. Du kannst typische Fehlerquellen benennen, einfache Daten visualisieren und Vorschläge machen, wie Daten besser ausgewählt oder geprüft werden können.&lt;br /&gt;
&lt;br /&gt;
Du sollst außerdem die folgenden Fehlvorstellungen korrigieren können: „Mehr Daten sind immer besser“, „KI ist automatisch neutral“, „ein einziges gutes Testergebnis beweist, dass ein System zuverlässig ist“ und „ein Label ist immer eindeutig richtig“.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Zeitrahmen und Unterrichtsplan ==&lt;br /&gt;
&lt;br /&gt;
Der Kurs passt in etwa &amp;#039;&amp;#039;&amp;#039;60 bis 90 Minuten&amp;#039;&amp;#039;&amp;#039; und kann auf ein oder zwei Unterrichtsstunden verteilt werden.&lt;br /&gt;
&lt;br /&gt;
{| class=&amp;quot;wikitable&amp;quot;&lt;br /&gt;
! Phase&lt;br /&gt;
! Zeit&lt;br /&gt;
! Aktivität&lt;br /&gt;
! Ziel&lt;br /&gt;
|-&lt;br /&gt;
| Aktivierung und Diagnose&lt;br /&gt;
| 5–10 Minuten&lt;br /&gt;
| Schnelltest „Welche Daten würdest Du nehmen?“&lt;br /&gt;
| Vorwissen und Fehlvorstellungen sichtbar machen&lt;br /&gt;
|-&lt;br /&gt;
| Verständliche Einführung&lt;br /&gt;
| 10–15 Minuten&lt;br /&gt;
| Daten, Trainingsdaten, Labels und Muster&lt;br /&gt;
| Grundidee verstehen&lt;br /&gt;
|-&lt;br /&gt;
| Experiment&lt;br /&gt;
| 15–20 Minuten&lt;br /&gt;
| Vogel-Detektiv: schlechter und verbesserter Datensatz&lt;br /&gt;
| Auswahl, Repräsentativität und Testdaten untersuchen&lt;br /&gt;
|-&lt;br /&gt;
| Anwendung&lt;br /&gt;
| 15–20 Minuten&lt;br /&gt;
| Schulbibliothek: Empfehlungen aus kleinen Daten&lt;br /&gt;
| Visualisieren, Datenqualität und Fairness prüfen&lt;br /&gt;
|-&lt;br /&gt;
| Reflexion und Transfer&lt;br /&gt;
| 10–20 Minuten&lt;br /&gt;
| Fehlerdiagnose, Quiz, 3-2-1-Reflexion&lt;br /&gt;
| Verständnis sichern und auf neue Situationen übertragen&lt;br /&gt;
|}&lt;br /&gt;
&lt;br /&gt;
Wenn nur eine kurze Stunde zur Verfügung steht, nutze die Aktivierung, das Vogel-Experiment, die Bibliotheks-Anwendung und eine kurze Selbstkontrolle. Die Videos und Vertiefungen können dann als Zusatz eingesetzt werden.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Aktivierung: Daten-Detektiv in drei Minuten ==&lt;br /&gt;
&lt;br /&gt;
Stell Dir vor, eine KI soll erkennen, ob ein Tier ein Vogel ist. Du darfst ihr nur vier Beispiele zeigen. Welche vier würdest Du auswählen?&lt;br /&gt;
&lt;br /&gt;
# Wähle bewusst verschiedene Beispiele aus und begründe Deine Auswahl.&lt;br /&gt;
# Vergleiche Deine Auswahl mit einer anderen Person.&lt;br /&gt;
# Markiert Fälle, bei denen Ihr unterschiedlich entschieden habt.&lt;br /&gt;
# Formuliert eine Vermutung: Was könnte passieren, wenn die KI nur sehr ähnliche Beispiele bekommt?&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Diagnosefrage:&amp;#039;&amp;#039;&amp;#039; Würdest Du für eine Vogel-KI nur Spatzenfotos verwenden, wenn sie später auch Pinguine erkennen soll? Wenn Du „nein“ sagst, hast Du bereits eine wichtige Idee entdeckt: Trainingsdaten müssen zur späteren Aufgabe passen.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Daten, Muster und maschinelles Lernen =&lt;br /&gt;
&lt;br /&gt;
Bei [[Maschinelles Lernen|maschinellem Lernen]] wird nicht jede einzelne Regel von Menschen vorgegeben. Stattdessen werden viele Beispiele genutzt, damit ein System Regelmäßigkeiten erkennen kann. Das Ergebnis des Trainings nennt man oft ein &amp;#039;&amp;#039;&amp;#039;Modell&amp;#039;&amp;#039;&amp;#039;. Dieses Modell wird anschließend auf neue Eingaben angewendet.&lt;br /&gt;
&lt;br /&gt;
Das bedeutet nicht, dass ein Computer so lernt wie ein Mensch. „Lernen“ ist hier ein Fachwort: Das System verändert während des Trainings interne Einstellungen so, dass es bei einer bestimmten Aufgabe bessere Ergebnisse liefert.&lt;br /&gt;
&lt;br /&gt;
[[Datei:EVA Lernen Training.svg|500px|rahmenlos|center]]&lt;br /&gt;
&lt;br /&gt;
Die deutschsprachige Commons-Grafik veranschaulicht überwachtes Lernen. Dabei gibt es Beispiele mit bekannten Zielangaben. Solche Zielangaben heißen &amp;#039;&amp;#039;&amp;#039;Labels&amp;#039;&amp;#039;&amp;#039;.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Was sind Trainingsdaten? ==&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Trainingsdaten&amp;#039;&amp;#039;&amp;#039; sind Beispiele, die beim Aufbau eines Modells verwendet werden. Für eine Bilderkennung können das Bilder sein, für eine Spracherkennung Tonaufnahmen, für eine Text-KI Texte und für eine Wettervorhersage Messwerte.&lt;br /&gt;
&lt;br /&gt;
Ein Datensatz ist nicht automatisch gut, nur weil er groß ist. Er muss vor allem &amp;#039;&amp;#039;&amp;#039;zur Aufgabe passen&amp;#039;&amp;#039;&amp;#039;. Eine KI, die Tierarten erkennen soll, braucht andere Daten als eine KI, die Wetterdaten auswertet.&lt;br /&gt;
&lt;br /&gt;
{{#ev:youtube|   https://www.youtube.com/watch?v=YfIlGxtXcYE   |500|center}}&lt;br /&gt;
&lt;br /&gt;
Dieses englischsprachige Video wird von Kindern im Alter von etwa 10 bis 12 Jahren erklärt und behandelt die Frage, wie KI Daten nutzt. Du kannst es auch ohne vollständiges Sprachverständnis beobachten: Welche Arten von Daten werden gezeigt und welche Entscheidungen treffen Menschen dabei?&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Labels: Namen für das gewünschte Ergebnis ==&lt;br /&gt;
&lt;br /&gt;
Ein &amp;#039;&amp;#039;&amp;#039;Label&amp;#039;&amp;#039;&amp;#039; ist eine Zielbezeichnung an einem Beispiel. Bei einem Tierbild könnte das Label „Vogel“ oder „kein Vogel“ lauten. Bei einer Tonaufnahme könnte das Label das gesprochene Wort sein.&lt;br /&gt;
&lt;br /&gt;
[[Datei:Machine learning nutshell -- Gather labeled observations.svg|500px|rahmenlos|center]]&lt;br /&gt;
&lt;br /&gt;
Labels werden häufig von Menschen vergeben oder aus vorhandenen Informationen übernommen. Deshalb können Labels falsch, unklar oder zu grob sein. Ein Tippfehler ist ein einfacher Fehler. Schwieriger wird es bei Begriffen, die Menschen unterschiedlich beurteilen, zum Beispiel „schön“, „lustig“ oder „angemessen“.&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Merke:&amp;#039;&amp;#039;&amp;#039; Ein Label ist keine Naturwahrheit. Es ist eine Zuordnung für eine bestimmte Aufgabe.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Mini-Experiment: Die Vogel-KI ohne Computer ==&lt;br /&gt;
&lt;br /&gt;
Du spielst jetzt eine sehr vereinfachte KI. In Wirklichkeit verarbeitet eine Bild-KI Pixel und sehr viele Rechenschritte. Hier nutzen wir nur wenige Merkmale, damit Du die Datenidee sichtbar untersuchen kannst.&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Trainingssatz A:&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
&lt;br /&gt;
{| class=&amp;quot;wikitable&amp;quot;&lt;br /&gt;
! Tier&lt;br /&gt;
! Kann fliegen?&lt;br /&gt;
! Hat Federn?&lt;br /&gt;
! Label&lt;br /&gt;
|-&lt;br /&gt;
| Spatz&lt;br /&gt;
| ja&lt;br /&gt;
| ja&lt;br /&gt;
| Vogel&lt;br /&gt;
|-&lt;br /&gt;
| Amsel&lt;br /&gt;
| ja&lt;br /&gt;
| ja&lt;br /&gt;
| Vogel&lt;br /&gt;
|-&lt;br /&gt;
| Schwalbe&lt;br /&gt;
| ja&lt;br /&gt;
| ja&lt;br /&gt;
| Vogel&lt;br /&gt;
|-&lt;br /&gt;
| Katze&lt;br /&gt;
| nein&lt;br /&gt;
| nein&lt;br /&gt;
| kein Vogel&lt;br /&gt;
|-&lt;br /&gt;
| Hund&lt;br /&gt;
| nein&lt;br /&gt;
| nein&lt;br /&gt;
| kein Vogel&lt;br /&gt;
|-&lt;br /&gt;
| Frosch&lt;br /&gt;
| nein&lt;br /&gt;
| nein&lt;br /&gt;
| kein Vogel&lt;br /&gt;
|}&lt;br /&gt;
&lt;br /&gt;
Eine einfache, aber schlechte Abkürzung wäre: &amp;#039;&amp;#039;&amp;#039;„Wenn es fliegt, ist es ein Vogel.“&amp;#039;&amp;#039;&amp;#039; Diese Regel passt zufällig gut zu diesem kleinen Trainingssatz. Prüfe sie jetzt an neuen Fällen.&lt;br /&gt;
&lt;br /&gt;
{| class=&amp;quot;wikitable&amp;quot;&lt;br /&gt;
! Testfall&lt;br /&gt;
! Kann fliegen?&lt;br /&gt;
! Hat Federn?&lt;br /&gt;
! Richtiges Label&lt;br /&gt;
! Ergebnis der schlechten Abkürzung&lt;br /&gt;
|-&lt;br /&gt;
| Pinguin&lt;br /&gt;
| nein&lt;br /&gt;
| ja&lt;br /&gt;
| Vogel&lt;br /&gt;
| falsch&lt;br /&gt;
|-&lt;br /&gt;
| Fledermaus&lt;br /&gt;
| ja&lt;br /&gt;
| nein&lt;br /&gt;
| kein Vogel&lt;br /&gt;
| falsch&lt;br /&gt;
|-&lt;br /&gt;
| Schmetterling&lt;br /&gt;
| ja&lt;br /&gt;
| nein&lt;br /&gt;
| kein Vogel&lt;br /&gt;
| falsch&lt;br /&gt;
|}&lt;br /&gt;
&lt;br /&gt;
Die schlechte Regel ist nicht entstanden, weil der Computer „dumm“ wäre, sondern weil der Datensatz eine gefährliche Abkürzung zugelassen hat. Es fehlten wichtige Gegenbeispiele.&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Trainingssatz B&amp;#039;&amp;#039;&amp;#039; würde zusätzlich Pinguin und Strauß als Vögel sowie Fledermaus und Schmetterling als Nicht-Vögel enthalten. Dadurch wird deutlicher, dass „fliegen können“ kein zuverlässiges Kennzeichen für die Kategorie Vogel ist.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Trainingsdaten und Testdaten sind nicht dasselbe ==&lt;br /&gt;
&lt;br /&gt;
Wenn Du nur mit den Beispielen prüfst, die ein Modell bereits gesehen hat, weißt Du nicht, ob es auch mit neuen Fällen zurechtkommt. Deshalb trennt man Daten häufig in einen Teil zum Trainieren und einen anderen Teil zum Testen.&lt;br /&gt;
&lt;br /&gt;
[[Datei:Machine learning nutshell -- Split into train-test set.svg|500px|rahmenlos|center]]&lt;br /&gt;
&lt;br /&gt;
Für Klasse 5 genügt die Grundidee: &amp;#039;&amp;#039;&amp;#039;Trainingsdaten helfen beim Lernen, Testdaten prüfen das Gelernte an neuen Beispielen.&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
&lt;br /&gt;
Ein guter Test enthält nicht nur einfache Fälle. Er sollte auch Beispiele enthalten, die sich von den Trainingsdaten unterscheiden, aber trotzdem zur Aufgabe gehören.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Datenqualität prüfen =&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Datenqualität&amp;#039;&amp;#039;&amp;#039; bedeutet hier: Wie gut eignen sich die vorhandenen Daten für die Aufgabe? Gute Daten sind nicht einfach „sauber“ oder „schön“, sondern &amp;#039;&amp;#039;&amp;#039;passend, möglichst korrekt, vielfältig genug und nachvollziehbar ausgewählt&amp;#039;&amp;#039;&amp;#039;.&lt;br /&gt;
&lt;br /&gt;
Prüfe einen Datensatz mit diesen sechs Fragen:&lt;br /&gt;
&lt;br /&gt;
# [[Passung]]: Gehören die Daten wirklich zur Aufgabe?&lt;br /&gt;
# [[Korrektheit]]: Sind Messwerte, Texte oder Labels wahrscheinlich richtig?&lt;br /&gt;
# [[Vielfalt]]: Kommen unterschiedliche wichtige Fälle vor?&lt;br /&gt;
# [[Repräsentativität]]: Fehlen Gruppen oder Situationen, die später wichtig sind?&lt;br /&gt;
# [[Quelle]]: Weißt Du, woher die Daten stammen und ob sie verwendet werden dürfen?&lt;br /&gt;
# [[Prüfung]]: Gibt es neue Testfälle, an denen Fehler sichtbar werden können?&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Typische Fehlerquellen ==&lt;br /&gt;
&lt;br /&gt;
Fehler können an vielen Stellen entstehen. Ein Sensor kann falsch messen. Ein Mensch kann ein Label vertauschen. Ein Bild kann zu dunkel sein. Eine Umfrage kann nur eine bestimmte Gruppe erreichen. Ein Datensatz kann viele fast gleiche Beispiele enthalten und trotzdem wichtige Fälle auslassen.&lt;br /&gt;
&lt;br /&gt;
Nicht jeder Fehler führt zu demselben Problem. Zufällige Fehler machen Daten ungenauer. Eine &amp;#039;&amp;#039;&amp;#039;systematische Verzerrung&amp;#039;&amp;#039;&amp;#039; sorgt dagegen dafür, dass bestimmte Fälle immer wieder benachteiligt, übersehen oder falsch eingeschätzt werden.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Repräsentativität: Passt die Auswahl zur Wirklichkeit? ==&lt;br /&gt;
&lt;br /&gt;
Ein Datensatz ist &amp;#039;&amp;#039;&amp;#039;repräsentativ&amp;#039;&amp;#039;&amp;#039; für eine Aufgabe, wenn die wichtigen Fälle der späteren Anwendung angemessen vorkommen. Vollständig muss er nicht sein. Aber er sollte nicht so einseitig sein, dass die KI eine falsche Vorstellung von der Aufgabe bekommt.&lt;br /&gt;
&lt;br /&gt;
Beispiel: Eine Spracherkennung, die nur mit Erwachsenenstimmen in sehr deutlichem Hochdeutsch trainiert wurde, kann bei Kinderstimmen, Dialekten oder Hintergrundgeräuschen mehr Fehler machen. Das bedeutet nicht automatisch, dass das System absichtlich unfair ist. Es zeigt aber, dass die Auswahl der Daten Folgen hat.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Visualisieren: Was fehlt, wird im Diagramm sichtbar ==&lt;br /&gt;
&lt;br /&gt;
Einfache [[Balkendiagramm|Balkendiagramme]] helfen, Datensätze zu prüfen. Du kannst zum Beispiel zählen, wie viele Beispiele aus verschiedenen Gruppen vorkommen.&lt;br /&gt;
&lt;br /&gt;
[[Datei:Simple bar chart.svg|500px|rahmenlos|center]]&lt;br /&gt;
&lt;br /&gt;
Für den Vogel-Datensatz A könntest Du zählen:&lt;br /&gt;
&lt;br /&gt;
{| class=&amp;quot;wikitable&amp;quot;&lt;br /&gt;
! Gruppe&lt;br /&gt;
! Anzahl im Training&lt;br /&gt;
|-&lt;br /&gt;
| fliegende Vögel&lt;br /&gt;
| 3&lt;br /&gt;
|-&lt;br /&gt;
| nicht fliegende Vögel&lt;br /&gt;
| 0&lt;br /&gt;
|-&lt;br /&gt;
| fliegende Nicht-Vögel&lt;br /&gt;
| 0&lt;br /&gt;
|-&lt;br /&gt;
| nicht fliegende Nicht-Vögel&lt;br /&gt;
| 3&lt;br /&gt;
|}&lt;br /&gt;
&lt;br /&gt;
Schon die Tabelle zeigt die Lücke. Zeichne daraus ein Balkendiagramm. Welche zwei Balken fehlen vollständig? Genau diese fehlenden Gruppen verursachen die problematische Abkürzung.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Verzerrung und Fairness =&lt;br /&gt;
&lt;br /&gt;
Eine [[Bias|Verzerrung]] liegt vor, wenn Daten oder Verfahren systematisch in eine bestimmte Richtung schief sind. Bei KI kann eine Verzerrung unter anderem durch Auswahl, Messung, Labels oder bereits vorhandene gesellschaftliche Muster entstehen.&lt;br /&gt;
&lt;br /&gt;
{{#ev:youtube|   https://www.youtube.com/watch?v=x2mRoFNm22g   |500|center}}&lt;br /&gt;
&lt;br /&gt;
Das Video „AI: Training Data &amp;amp; Bias“ zeigt, warum die Auswahl von Trainingsdaten Einfluss auf Ergebnisse haben kann. Nutze es als Vertiefung und notiere danach ein Beispiel für eine Verzerrung und eine mögliche Gegenmaßnahme.&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Fairness&amp;#039;&amp;#039;&amp;#039; bedeutet nicht immer, dass alle exakt gleich behandelt werden. Bei einer konkreten Aufgabe muss geklärt werden, welche Unterschiede sachlich wichtig sind und welche zu ungerechten Nachteilen führen könnten. Diese Entscheidung darf nicht einfach einem System überlassen werden.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Menschen treffen Entscheidungen über Daten ==&lt;br /&gt;
&lt;br /&gt;
Menschen entscheiden, welche Aufgabe ein KI-System lösen soll, welche Daten gesammelt werden, welche Labels genutzt werden und wie Fehler bewertet werden. Deshalb ist KI nicht automatisch neutral.&lt;br /&gt;
&lt;br /&gt;
Gute Fragen sind: Wer wurde in den Daten berücksichtigt? Wer fehlt? Wer kann einen Fehler bemerken und melden? Welche Folgen hat ein falsches Ergebnis? Wer trägt die Verantwortung?&lt;br /&gt;
&lt;br /&gt;
Bei wichtigen Entscheidungen über Menschen sollten KI-Ausgaben nicht ungeprüft übernommen werden. Besonders in Schule, Gesundheit oder anderen sensiblen Bereichen müssen Menschen nachvollziehen können, wo Grenzen und Unsicherheiten liegen.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Realistische Anwendung: Eine Empfehlung für die Schulbibliothek =&lt;br /&gt;
&lt;br /&gt;
Die Schulbibliothek möchte neue Bücher einkaufen. Ein kleines Empfehlungssystem soll anhand früherer Ausleihen Vorschläge machen. Zur Verfügung stehen zunächst nur anonyme Zählwerte aus einem Leseclub einer einzigen Klasse.&lt;br /&gt;
&lt;br /&gt;
{| class=&amp;quot;wikitable&amp;quot;&lt;br /&gt;
! Buchbereich&lt;br /&gt;
! Ausleihen im Leseclub&lt;br /&gt;
|-&lt;br /&gt;
| Comics&lt;br /&gt;
| 18&lt;br /&gt;
|-&lt;br /&gt;
| Fantasy&lt;br /&gt;
| 14&lt;br /&gt;
|-&lt;br /&gt;
| Tiere&lt;br /&gt;
| 10&lt;br /&gt;
|-&lt;br /&gt;
| Sport&lt;br /&gt;
| 2&lt;br /&gt;
|-&lt;br /&gt;
| Naturwissenschaften&lt;br /&gt;
| 1&lt;br /&gt;
|}&lt;br /&gt;
&lt;br /&gt;
Die Zahlen sind korrekt gezählt. Trotzdem wäre es problematisch, daraus direkt die Einkäufe für alle fünften Klassen abzuleiten.&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Arbeitsauftrag:&amp;#039;&amp;#039;&amp;#039; Zeichne ein Balkendiagramm. Beschreibe, was der Datensatz zeigt und was er &amp;#039;&amp;#039;&amp;#039;nicht&amp;#039;&amp;#039;&amp;#039; zeigt. Formuliere anschließend einen Plan für bessere Daten.&lt;br /&gt;
&lt;br /&gt;
Ein sinnvoller Plan könnte Daten aus mehreren Klassen, unterschiedlichen Zeiträumen und verschiedenen Formen der Rückmeldung enthalten. Außerdem sollte die Bibliothek nicht nur häufige Wünsche berücksichtigen. Sie hat auch den Auftrag, vielfältige Angebote bereitzustellen.&lt;br /&gt;
&lt;br /&gt;
Hier zeigt sich ein wichtiger Unterschied: &amp;#039;&amp;#039;&amp;#039;Daten können eine Entscheidung unterstützen, aber sie ersetzen nicht automatisch pädagogische oder faire Abwägungen.&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Fächerübergreifende Verbindungen ==&lt;br /&gt;
&lt;br /&gt;
{| class=&amp;quot;wikitable&amp;quot;&lt;br /&gt;
! Fach&lt;br /&gt;
! Verbindung zum Thema&lt;br /&gt;
! Mögliche Aktivität&lt;br /&gt;
|-&lt;br /&gt;
| [[Informatik]]&lt;br /&gt;
| Trainingsdaten, Labels, Testdaten, Muster&lt;br /&gt;
| Datensätze vergleichen und Fehlerfälle testen&lt;br /&gt;
|-&lt;br /&gt;
| [[Deutsch]]&lt;br /&gt;
| Sprache als Daten, Bedeutungen, mehrdeutige Labels, Quellenkritik&lt;br /&gt;
| Wörter oder kurze Texte nach selbst gewählten Kategorien sortieren und Grenzfälle diskutieren&lt;br /&gt;
|-&lt;br /&gt;
| [[Mathematik]]&lt;br /&gt;
| Häufigkeiten, Tabellen, Balkendiagramme, Stichproben&lt;br /&gt;
| Verteilungen visualisieren und fehlende Gruppen erkennen&lt;br /&gt;
|-&lt;br /&gt;
| [[Biologie]] und [[Naturwissenschaften]]&lt;br /&gt;
| Beobachtungsdaten, Merkmale, Messfehler, Klassifikation&lt;br /&gt;
| Tier- oder Pflanzendaten untersuchen und Messfehler simulieren&lt;br /&gt;
|-&lt;br /&gt;
| [[Kunst]]&lt;br /&gt;
| Bilder als Daten, Farbe, Form, Hintergrund, Gestaltung&lt;br /&gt;
| Untersuchen, ob ein Bild-Hintergrund eine falsche Abkürzung ermöglicht&lt;br /&gt;
|-&lt;br /&gt;
| [[Ethik]]&lt;br /&gt;
| Fairness, Verantwortung, Folgen von Fehlern&lt;br /&gt;
| Entscheiden, wann Menschen eine KI-Empfehlung überstimmen sollten&lt;br /&gt;
|-&lt;br /&gt;
| [[Medienbildung]]&lt;br /&gt;
| Quellen, Datenschutz, Transparenz und verantwortlicher KI-Einsatz&lt;br /&gt;
| Herkunft und Zweck eines Datensatzes kritisch prüfen&lt;br /&gt;
|}&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Ein zweites Experiment: Der Hintergrund-Trick =&lt;br /&gt;
&lt;br /&gt;
Stell Dir vor, alle Katzenfotos im Training wurden auf einer roten Decke aufgenommen und alle Hundefotos auf einer blauen Decke. Ein Modell könnte dann lernen, die &amp;#039;&amp;#039;&amp;#039;Hintergrundfarbe&amp;#039;&amp;#039;&amp;#039; als Abkürzung zu verwenden, statt Merkmale der Tiere zu nutzen.&lt;br /&gt;
&lt;br /&gt;
Teste die Idee gedanklich: Was passiert bei einer Katze auf einer blauen Decke? Was passiert bei einem Hund auf einer roten Decke?&lt;br /&gt;
&lt;br /&gt;
Dieses Beispiel zeigt, dass ein KI-System ein Muster verwenden kann, das für Menschen nebensächlich wirkt. Deshalb reicht es nicht, nur die Gesamtzahl der Daten zu betrachten. Du musst auch fragen, &amp;#039;&amp;#039;&amp;#039;welche Muster in den Daten stecken&amp;#039;&amp;#039;&amp;#039;.&lt;br /&gt;
&lt;br /&gt;
[[Datei:Supervised machine learning in a nutshell.svg|500px|rahmenlos|center]]&lt;br /&gt;
&lt;br /&gt;
Die Grafik fasst den Datenfluss beim überwachten Lernen zusammen: gelabelte Beispiele werden zum Training genutzt, das trainierte Modell erhält neue Eingaben und erzeugt eine Vorhersage.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Datenschutz, Sicherheit und Human Agency =&lt;br /&gt;
&lt;br /&gt;
Für die Übungen dieses Kurses brauchst Du keine persönlichen Daten. Das ist Absicht. Verwende für eigene Experimente bevorzugt Gegenstände, Tierbilder aus freien Quellen, selbst erfundene Datensätze oder anonyme Zählwerte.&lt;br /&gt;
&lt;br /&gt;
# Lade keine Fotos von Mitschülerinnen oder Mitschülern in öffentliche KI-Dienste hoch, wenn dafür keine klare schulische Regelung und Erlaubnis besteht.&lt;br /&gt;
# Teile keine Namen, Adressen, Gesundheitsdaten, Passwörter oder andere private Informationen für ein Experiment.&lt;br /&gt;
# Prüfe, ob ein verwendetes Werkzeug für die Schule freigegeben ist.&lt;br /&gt;
# Behalte die Entscheidungshoheit: Eine KI-Ausgabe ist ein Vorschlag oder Ergebnis eines Systems, keine automatische Wahrheit.&lt;br /&gt;
# Dokumentiere, welche Daten Du benutzt hast und welche Grenzen Dein Experiment hat.&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Human Agency&amp;#039;&amp;#039;&amp;#039; bedeutet hier: Menschen behalten Handlungsmacht. Du entscheidest mit, welche Frage untersucht wird, welche Daten geeignet sind, wie Ergebnisse geprüft werden und wann ein System nicht verwendet werden sollte.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Typische Fehlvorstellungen korrigieren =&lt;br /&gt;
&lt;br /&gt;
{| class=&amp;quot;wikitable&amp;quot;&lt;br /&gt;
! Fehlvorstellung&lt;br /&gt;
! Bessere Erklärung&lt;br /&gt;
|-&lt;br /&gt;
| „Mehr Daten sind immer besser.“&lt;br /&gt;
| Viele falsche, einseitige oder unpassende Daten können ein Problem vergrößern. Qualität und Passung sind entscheidend.&lt;br /&gt;
|-&lt;br /&gt;
| „Eine KI ist neutral, weil sie ein Computer ist.“&lt;br /&gt;
| Daten, Labels, Ziele und Prüfregeln beruhen auf menschlichen Entscheidungen und können Verzerrungen enthalten.&lt;br /&gt;
|-&lt;br /&gt;
| „Wenn die KI Trainingsdaten richtig erkennt, funktioniert sie.“&lt;br /&gt;
| Entscheidend ist, ob sie auch neue und vielfältige Testfälle sinnvoll verarbeitet.&lt;br /&gt;
|-&lt;br /&gt;
| „Ein Label ist immer eindeutig.“&lt;br /&gt;
| Manche Labels sind klar, andere hängen von Definitionen, Sprache oder Bewertung ab.&lt;br /&gt;
|-&lt;br /&gt;
| „Die KI versteht automatisch, warum ein Muster wichtig ist.“&lt;br /&gt;
| Ein Modell kann auch unwichtige Abkürzungen lernen, zum Beispiel Hintergrundfarben.&lt;br /&gt;
|-&lt;br /&gt;
| „Ein Fehler ist nur Pech.“&lt;br /&gt;
| Manche Fehler sind zufällig, andere treten systematisch bei bestimmten Fällen auf.&lt;br /&gt;
|}&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Selbstkontrolle und Reflexion =&lt;br /&gt;
&lt;br /&gt;
Beantworte am Ende ohne Hilfe die folgenden drei Sätze und vergleiche Deine Antworten anschließend mit einer Lernpartnerin oder einem Lernpartner:&lt;br /&gt;
&lt;br /&gt;
# &amp;#039;&amp;#039;&amp;#039;Ich kann erklären&amp;#039;&amp;#039;&amp;#039;, warum Trainingsdaten und Testdaten unterschiedliche Aufgaben haben.&lt;br /&gt;
# &amp;#039;&amp;#039;&amp;#039;Ich kann an einem neuen Datensatz prüfen&amp;#039;&amp;#039;&amp;#039;, ob wichtige Fälle fehlen oder Labels fragwürdig sind.&lt;br /&gt;
# &amp;#039;&amp;#039;&amp;#039;Ich kann begründen&amp;#039;&amp;#039;&amp;#039;, warum Menschen bei wichtigen KI-Entscheidungen Verantwortung behalten müssen.&lt;br /&gt;
&lt;br /&gt;
Nutze zusätzlich die 3-2-1-Methode: Nenne drei Dinge, die einen Datensatz besser machen, zwei mögliche Fehlerquellen und eine Frage, die Du künftig vor dem Einsatz einer KI stellen möchtest.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Medien- und Quellenhinweise =&lt;br /&gt;
&lt;br /&gt;
Die eingebundenen Grafiken stammen von Wikimedia Commons. Dort findest Du auf den jeweiligen Dateiseiten Angaben zu Urheber, Lizenz und Weiterverwendung. Mehrere der hier verwendeten Grafiken stehen unter freien Lizenzen wie CC0 oder CC BY-SA. Prüfe bei einer eigenen Weiterverwendung immer die konkrete Dateiseite.&lt;br /&gt;
&lt;br /&gt;
Die YouTube-Videos dienen als ergänzende Lernmedien. Sie sind nicht automatisch Open Educational Resources. Für eigene Bearbeitungen oder Veröffentlichungen gelten die jeweiligen Rechte der Anbieter.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Interaktive Aufgaben =&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Quiz: Teste Dein Wissen ==&lt;br /&gt;
&lt;br /&gt;
{{MC}}&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Eine KI soll Vögel erkennen. Warum ist ein Trainingssatz nur mit fliegenden Vögeln problematisch?&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
(Wichtige Vogelarten ohne Flugfähigkeit fehlen)&lt;br /&gt;
(!Weil Vögel nie fliegen)&lt;br /&gt;
(!Weil Trainingsdaten keine Tiere enthalten dürfen)&lt;br /&gt;
(!Weil Testdaten immer identisch sein müssen)&lt;br /&gt;
&lt;br /&gt;
{{E}}&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{MC}}&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Wozu dienen Testdaten am besten?&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
(Sie prüfen ein Modell an neuen Beispielen)&lt;br /&gt;
(!Sie ersetzen alle Trainingsdaten)&lt;br /&gt;
(!Sie machen Labels überflüssig)&lt;br /&gt;
(!Sie garantieren automatisch Fairness)&lt;br /&gt;
&lt;br /&gt;
{{E}}&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{MC}}&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Was ist bei überwachtem Lernen ein Label?&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
(Eine Zielbezeichnung für ein Beispiel)&lt;br /&gt;
(!Ein geheimer Programmcode)&lt;br /&gt;
(!Eine Zahl für die Dateigröße)&lt;br /&gt;
(!Ein Name für den Computer)&lt;br /&gt;
&lt;br /&gt;
{{E}}&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{MC}}&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Welche Änderung verbessert einen einseitigen Tierdatensatz am ehesten?&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
(Fehlende und unterschiedliche wichtige Fälle ergänzen)&lt;br /&gt;
(!Alle vorhandenen Beispiele mehrfach kopieren)&lt;br /&gt;
(!Nur die einfachsten Beispiele behalten)&lt;br /&gt;
(!Die Testfälle vorher entfernen)&lt;br /&gt;
&lt;br /&gt;
{{E}}&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{MC}}&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Eine Bibliotheks-KI nutzt nur Ausleihen eines einzigen Leseclubs. Was ist die wichtigste Frage?&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
(Ob diese Gruppe für alle Lernenden repräsentativ ist)&lt;br /&gt;
(!Ob die Tabelle bunt genug ist)&lt;br /&gt;
(!Ob jedes Buch gleich viele Seiten hat)&lt;br /&gt;
(!Ob der Computer besonders schnell ist)&lt;br /&gt;
&lt;br /&gt;
{{E}}&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{MC}}&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Was zeigt der Hintergrund-Trick mit roten und blauen Decken?&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
(Ein Modell kann unwichtige Abkürzungen aus Daten lernen)&lt;br /&gt;
(!Ein Modell erkennt Farben grundsätzlich nicht)&lt;br /&gt;
(!Mehr Farben machen jede KI perfekt)&lt;br /&gt;
(!Hintergründe sind immer wichtiger als Objekte)&lt;br /&gt;
&lt;br /&gt;
{{E}}&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{MC}}&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Welche Aussage zu Datenqualität trifft zu?&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
(Passende und korrekte Daten sind wichtiger als bloße Menge)&lt;br /&gt;
(!Ein sehr großer Datensatz ist automatisch gut)&lt;br /&gt;
(!Labels können niemals falsch sein)&lt;br /&gt;
(!Fehlende Gruppen verändern Ergebnisse nie)&lt;br /&gt;
&lt;br /&gt;
{{E}}&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{MC}}&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Warum kann eine KI systematisch verzerrte Ergebnisse liefern?&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
(Weil Auswahl oder Labels in den Daten schief sein können)&lt;br /&gt;
(!Weil Computer immer absichtlich unfair handeln)&lt;br /&gt;
(!Weil Diagramme keine Daten zeigen)&lt;br /&gt;
(!Weil Testdaten grundsätzlich falsch sind)&lt;br /&gt;
&lt;br /&gt;
{{E}}&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{MC}}&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Was ist bei einem KI-Experiment mit Klasse 5 eine gute Datenschutzregel?&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
(Möglichst mit nicht personenbezogenen Übungsdaten arbeiten)&lt;br /&gt;
(!Private Fotos ungefragt hochladen)&lt;br /&gt;
(!Passwörter als Trainingsbeispiele verwenden)&lt;br /&gt;
(!Namen aller Beteiligten veröffentlichen)&lt;br /&gt;
&lt;br /&gt;
{{E}}&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{MC}}&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Welche Haltung unterstützt Human Agency beim Einsatz von KI?&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
(Menschen prüfen Ergebnisse und behalten die Verantwortung)&lt;br /&gt;
(!KI-Ausgaben werden immer ungeprüft übernommen)&lt;br /&gt;
(!Nur die schnellste Antwort zählt)&lt;br /&gt;
(!Menschen dürfen Daten nicht hinterfragen)&lt;br /&gt;
&lt;br /&gt;
{{E}}&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Memory ==&lt;br /&gt;
&lt;br /&gt;
&amp;lt;div class=&amp;quot;memo-quiz&amp;quot;&amp;gt;&lt;br /&gt;
{|&lt;br /&gt;
|-&lt;br /&gt;
| Trainingsdaten || Beispiele zum Aufbau eines Modells&lt;br /&gt;
|-&lt;br /&gt;
| Testdaten || Neue Fälle zur Prüfung&lt;br /&gt;
|-&lt;br /&gt;
| Label || Zielbezeichnung eines Beispiels&lt;br /&gt;
|-&lt;br /&gt;
| Repräsentativität || Angemessene Abbildung wichtiger Fälle&lt;br /&gt;
|-&lt;br /&gt;
| Verzerrung || Systematische Schieflage&lt;br /&gt;
|-&lt;br /&gt;
| Datenqualität || Eignung und Verlässlichkeit der Datengrundlage&lt;br /&gt;
|-&lt;br /&gt;
| Human Agency || Menschliche Handlungsmacht und Verantwortung&lt;br /&gt;
|}&lt;br /&gt;
{{E}}&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Drag and Drop ==&lt;br /&gt;
&lt;br /&gt;
&amp;lt;div class=&amp;quot;lueckentext-quiz&amp;quot;&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{| class=&amp;quot;wikitable&amp;quot; &lt;br /&gt;
! Ordne die richtigen Begriffe zu.&lt;br /&gt;
! Thema&lt;br /&gt;
|-&lt;br /&gt;
| &amp;#039;&amp;#039;&amp;#039;Trainingsdaten&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
| Beispiele zum Lernen&lt;br /&gt;
|-&lt;br /&gt;
| &amp;#039;&amp;#039;&amp;#039;Testdaten&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
| Neue Beispiele zur Prüfung&lt;br /&gt;
|-&lt;br /&gt;
| &amp;#039;&amp;#039;&amp;#039;Label&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
| Vorgegebene Zielbezeichnung&lt;br /&gt;
|-&lt;br /&gt;
| &amp;#039;&amp;#039;&amp;#039;Repräsentativität&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
| Wichtige Fälle sind angemessen vertreten&lt;br /&gt;
|-&lt;br /&gt;
| &amp;#039;&amp;#039;&amp;#039;Verzerrung&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
| Systematische Schieflage in Daten oder Ergebnissen&lt;br /&gt;
|-&lt;br /&gt;
| &amp;#039;&amp;#039;&amp;#039;Datenqualität&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
| Passung, Korrektheit und Nutzbarkeit von Daten&lt;br /&gt;
&lt;br /&gt;
|}&lt;br /&gt;
{{E}}&lt;br /&gt;
&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
...&lt;br /&gt;
&amp;lt;br /&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Kreuzworträtsel ==&lt;br /&gt;
&lt;br /&gt;
&amp;lt;div class=&amp;quot;kreuzwort-quiz&amp;quot;&amp;gt;&lt;br /&gt;
{|&lt;br /&gt;
|-&lt;br /&gt;
| Daten || Woraus bestehen die Beispiele, mit denen viele KI-Systeme arbeiten?&lt;br /&gt;
|-&lt;br /&gt;
| Label || Wie heißt die Zielbezeichnung eines Trainingsbeispiels?&lt;br /&gt;
|-&lt;br /&gt;
| Muster || Was sucht ein Modell in vielen Beispielen?&lt;br /&gt;
|-&lt;br /&gt;
| Stichprobe || Wie heißt eine ausgewählte Teilmenge aus einer größeren Menge?&lt;br /&gt;
|-&lt;br /&gt;
| Verzerrung || Wie heißt eine systematische Schieflage?&lt;br /&gt;
|-&lt;br /&gt;
| Datenschutz || Welcher Begriff bezeichnet den Schutz personenbezogener Informationen?&lt;br /&gt;
|}&lt;br /&gt;
{{E}}&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== LearningApps ==&lt;br /&gt;
&lt;br /&gt;
&amp;lt;iframe&amp;gt; https://learningapps.org/index.php?s=Daten+als+Grundlage+von+KI+verstehen &amp;lt;/iframe&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
== Lückentext ==&lt;br /&gt;
&lt;br /&gt;
&amp;lt;quiz display=simple&amp;gt;&lt;br /&gt;
{&amp;#039;&amp;#039;&amp;#039;Vervollständige den Text.&amp;#039;&amp;#039;&amp;#039;&amp;lt;br&amp;gt;&lt;br /&gt;
|type=&amp;quot;{}&amp;quot;}&lt;br /&gt;
Viele Systeme des maschinellen Lernens nutzen { Trainingsdaten } als Beispiele für das Lernen.&lt;br /&gt;
Eine Zielbezeichnung an einem Beispiel nennt man { Label }.&lt;br /&gt;
Mit { Testdaten } wird geprüft, wie ein Modell bei neuen Fällen arbeitet.&lt;br /&gt;
Ein Datensatz sollte wichtige Situationen möglichst { repräsentativ } abbilden.&lt;br /&gt;
Falsche Messwerte oder vertauschte Labels verschlechtern die { Datenqualität }.&lt;br /&gt;
Eine systematische Schieflage nennt man { Verzerrung }.&lt;br /&gt;
Ein { Balkendiagramm } kann sichtbar machen, welche Gruppen häufig oder selten vorkommen.&lt;br /&gt;
Menschen behalten bei wichtigen Anwendungen die { Verantwortung } für Entscheidungen.&lt;br /&gt;
&amp;lt;/quiz&amp;gt;&lt;br /&gt;
&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Offene Aufgaben =&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
=== Leicht ===&lt;br /&gt;
# [[Daten-Safari]]: Suche in Deinem Klassenraum fünf Dinge, die man als Daten beschreiben könnte, zum Beispiel Wörter, Farben, Messwerte oder Anzahlen. Erkläre jeweils, welche KI-Aufgabe damit denkbar wäre.&lt;br /&gt;
# [[Label-Werkstatt]]: Sortiere zehn selbst gewählte Alltagsgegenstände in zwei Kategorien. Tausche Deine Kategorien mit einer anderen Person und prüft, ob alle Labels eindeutig sind.&lt;br /&gt;
# [[Balkendiagramm]]: Erfinde einen kleinen Datensatz mit vier Gruppen und zeichne ein Balkendiagramm. Markiere anschließend, welche Gruppe möglicherweise unterrepräsentiert ist.&lt;br /&gt;
# [[Fehlerdetektiv]]: Baue absichtlich drei Fehler in eine kleine Tabelle ein. Gib die Tabelle an eine andere Gruppe und lasse die Fehler finden und begründen.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
=== Standard ===&lt;br /&gt;
# [[Vogel-Datensatz]]: Entwickle einen verbesserten Trainings- und Testsatz für die Aufgabe „Vogel oder kein Vogel“. Begründe jede Auswahl mit Blick auf Vielfalt und schwierige Fälle.&lt;br /&gt;
# [[Schulbibliothek]]: Plane eine faire Datenerhebung, mit der die Bibliothek Wünsche aller fünften Klassen besser erfassen könnte. Vermeide persönliche Daten, wenn sie nicht nötig sind.&lt;br /&gt;
# [[Bild-Hintergrund-Experiment]]: Zeichne zwei Objektklassen mit auffällig unterschiedlichen Hintergründen. Erkläre, welche falsche Abkürzung ein Modell daraus lernen könnte, und gestalte anschließend bessere Beispiele.&lt;br /&gt;
# [[Quellencheck]]: Suche einen frei nutzbaren Datensatz oder eine frei lizenzierte Bildsammlung. Dokumentiere Quelle, Lizenz, Zweck und mindestens eine erkennbare Grenze der Daten.&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
=== Schwer ===&lt;br /&gt;
# [[Bias-Audit]]: Entwickle eine Prüfliste mit mindestens sechs Fragen, mit der eine Klasse einen Datensatz auf mögliche Verzerrungen untersuchen kann. Teste die Liste an einem selbst erstellten Beispiel.&lt;br /&gt;
# [[Messfehler-Labor]]: Simuliere Naturwissenschaftsdaten mit einem fehlerhaften Messgerät. Zeige in einer Tabelle und einem Diagramm, wie ein systematischer Messfehler ein Ergebnis verändert.&lt;br /&gt;
# [[Daten-Debatte]]: Bereite eine kurze Pro-und-Kontra-Debatte zur Frage vor: „Soll eine KI allein entscheiden, welche Bücher eine Schulbibliothek kauft?“ Nutze dabei Datenqualität, Fairness und Human Agency als Argumente.&lt;br /&gt;
# [[Erklärvideo]]: Produziere ein 60- bis 90-sekündiges Erklärvideo mit eigenen Zeichnungen zum Satz „Eine KI ist nur so gut wie ihre Daten – aber gute Daten allein reichen nicht.“ Zeige mindestens ein Gegenbeispiel und eine menschliche Kontrollentscheidung.&lt;br /&gt;
&lt;br /&gt;
{{:Offene Aufgabe - MOOC erstellen}}&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Lernkontrolle =&lt;br /&gt;
&lt;br /&gt;
# [[Transferfall Spracherkennung]]: Eine Spracherkennung wurde fast nur mit Erwachsenenstimmen in ruhigen Räumen trainiert. Erkläre zwei Probleme, die bei einer lauten Schulklasse entstehen könnten, und schlage zwei Verbesserungen des Datensatzes vor.&lt;br /&gt;
# [[Transferfall Pflanzen-App]]: Eine Pflanzen-App erkennt nur Pflanzen, die bei Sonnenschein fotografiert wurden. Entwickle Testfälle, mit denen Du herausfinden kannst, ob die App auch bei Schatten, Regen oder unterschiedlichen Hintergründen zuverlässig arbeitet.&lt;br /&gt;
# [[Fehlerursache oder Zufall]]: In einer Messreihe zeigt ein Sensor immer zwei Grad zu viel an. Erkläre, warum das kein zufälliger Fehler ist und welche Folgen solche Daten für ein KI-Modell haben könnten.&lt;br /&gt;
# [[Label-Konflikt]]: Zwei Gruppen sollen kurze Kommentare als „freundlich“ oder „unfreundlich“ labeln und sind sich häufig uneinig. Erkläre, was das über das Label verrät und wie man die Aufgabe transparenter machen könnte.&lt;br /&gt;
# [[Repräsentativität prüfen]]: Eine Schule möchte aus einer Umfrage von zwölf freiwilligen Kindern auf die Interessen von 400 Lernenden schließen. Bewerte die Aussagekraft und entwirf eine bessere Auswahlstrategie.&lt;br /&gt;
# [[Verantwortungskette]]: Entwirf für eine KI-Anwendung Deiner Wahl eine Verantwortungskette: Wer sammelt Daten, wer prüft Labels, wer testet Ergebnisse, wer entscheidet am Ende und wer kann Fehler melden?&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Lernnachweis =&lt;br /&gt;
&lt;br /&gt;
Für einen Lernnachweis zu diesem Thema ist wichtig, dass Du nicht nur Fachwörter nennst, sondern Zusammenhänge erklären und auf neue Fälle übertragen kannst.&lt;br /&gt;
&lt;br /&gt;
# Du erklärst mit eigenen Worten, wie Trainingsdaten, Labels, Modell und Testdaten zusammenhängen.&lt;br /&gt;
# Du erkennst in einem kleinen Datensatz fehlende Gruppen, mögliche Fehler und fragwürdige Labels.&lt;br /&gt;
# Du stellst einfache Häufigkeiten in einer Tabelle oder einem Balkendiagramm dar und leitest daraus eine begründete Aussage ab.&lt;br /&gt;
# Du unterscheidest zwischen zufälligen Fehlern und möglichen systematischen Verzerrungen.&lt;br /&gt;
# Du schlägst konkrete Verbesserungen für Datenqualität und Repräsentativität vor.&lt;br /&gt;
# Du begründest, warum Datenschutz, Transparenz, Fairness und menschliche Verantwortung zum KI-Einsatz gehören.&lt;br /&gt;
# Du korrigierst mindestens zwei typische Fehlvorstellungen über Daten und KI anhand eigener Beispiele.&lt;br /&gt;
&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= OERs zum Thema =&lt;br /&gt;
&lt;br /&gt;
Als frei zugängliche Hintergrundtexte eignen sich besonders die Wikipedia-Artikel zu [[Maschinelles Lernen|Maschinellem Lernen]] und [[Künstliche Intelligenz|Künstlicher Intelligenz]]. Für Klasse 5 müssen einzelne Abschnitte gemeinsam vereinfacht werden.&lt;br /&gt;
&lt;br /&gt;
&amp;lt;iframe&amp;gt; https://de.m.wikipedia.org/wiki/Maschinelles_Lernen &amp;lt;/iframe&amp;gt;&lt;br /&gt;
&lt;br /&gt;
&amp;lt;iframe&amp;gt; https://de.m.wikipedia.org/wiki/K%C3%BCnstliche_Intelligenz &amp;lt;/iframe&amp;gt;&lt;br /&gt;
&lt;br /&gt;
Weitere frei lizenzierte Grafiken findest Du auf Wikimedia Commons in den Kategorien zu Machine Learning, Artificial intelligence training data, Datasets und Charts.&lt;br /&gt;
&lt;br /&gt;
&amp;lt;br&amp;gt;&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= Verknüpfte Lernbereiche =&lt;br /&gt;
&lt;br /&gt;
{| align=center&lt;br /&gt;
{{:D-Tab}}&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;[[Daten als Grundlage von KI verstehen]]&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
# [[Daten]]&lt;br /&gt;
# [[Künstliche Intelligenz]]&lt;br /&gt;
# [[Maschinelles Lernen]]&lt;br /&gt;
# [[Trainingsdaten]]&lt;br /&gt;
# [[Datenqualität]]&lt;br /&gt;
# [[Repräsentativität]]&lt;br /&gt;
# [[Bias]]&lt;br /&gt;
# [[Balkendiagramm]]&lt;br /&gt;
# [[Datenschutz]]&lt;br /&gt;
# [[Medienkompetenz]]&lt;br /&gt;
# [[Ethik]]&lt;br /&gt;
|}&lt;br /&gt;
&lt;br /&gt;
[[Kategorie:Informatik]]&lt;br /&gt;
[[Kategorie:Deutsch]]&lt;br /&gt;
[[Kategorie:Mathematik]]&lt;br /&gt;
[[Kategorie:Biologie]]&lt;br /&gt;
[[Kategorie:Naturwissenschaften]]&lt;br /&gt;
[[Kategorie:Kunst]]&lt;br /&gt;
[[Kategorie:Ethik]]&lt;br /&gt;
[[Kategorie:Medienbildung]]&lt;br /&gt;
[[Kategorie:Künstliche Intelligenz]]&lt;br /&gt;
[[Kategorie:Daten]]&lt;br /&gt;
[[Kategorie:Klasse 5]]&lt;br /&gt;
[[Kategorie:Klasse 5-6]]&lt;br /&gt;
&lt;br /&gt;
{{BR}}&lt;br /&gt;
= aiMOOC-Projekte =&lt;br /&gt;
[[Kategorie:AI_MOOC]] [[Kategorie:GPT aiMOOC]]&lt;br /&gt;
{{MT}}&lt;/div&gt;</summary>
		<author><name>Glanz</name></author>
	</entry>
</feed>