Entwickler Künstlicher Intelligenzen stehen vor einer Herausforderung: Für das Training ihrer Sprachmodelle benötigen sie enorme Mengen an Daten. Woher nehmen, wenn nicht stehlen? Beim Facebook-Konzern Meta entschied man sich offenbar für Letzteres.
Ob es um die Erstellung von Bildern, Videos, Musik oder Text geht: KI kann nur generieren, was ihr zuvor beigebracht wurde – mit riesigen Mengen von Bildern, Videos, Musik oder Text. Dabei lernt die KI, wie die jeweiligen Ausdrucksmittel funktionieren. Im Falle von OpenAIs ChatGPT also etwa, wie Grammatik, Stil, Bedeutung und Kontext letztlich Sprache formen, um dann, basierend auf Nutzereingaben und den gelernten Mustern, einen Text zu erstellen.
Als Mitarbeiter des Facebook-Mutterkonzerns Meta sich an die Entwicklung ihres Sprachmodells Llama 3 machten, standen sie vor einer ethischen Herausforderung: Um mit Produkten wie ChatGPT konkurrieren zu können, müsste das Programm mittels enormer Mengen hochwertiger Texte trainiert werden, die legal zu erwerben einige Zeit in Anspruch nehmen könnte. Sollte man die Daten daher besser raubkopieren?
Da dieser Artikel älter als 18 Monate ist, ist zum jetzigen Zeitpunkt kein Kommentieren mehr möglich.
Wir laden Sie ein, bei einer aktuelleren themenrelevanten Story mitzudiskutieren: Themenübersicht.
Bei Fragen können Sie sich gern an das Community-Team per Mail an forum@krone.at wenden.