R Code

Farmhack 2019: zusammenhängende Signale, Peaks und Earth-Mover-Distance

Im Beitrag zum Farmhack 2019 hatte ich bereits über die von mir bearbeitete Challenge berichtet. Wir waren insgesamt sieben Teammitglieder und hatten die Entwicklungsaufgaben aufgesplittet. Hier eine kurze Skizze meines Lösungsbeitrags mit R Code:

Statistik im Masterstudium Digitale Technologien: Zentraler Grenzwertsatz

Sept 5, 2019

Allgemein, Data Science, R Code

Central Limit Theorem, Lehrveranstaltung, R, Rcode, Simulation, Statistik, Zentraler Grenzwert Satz

Statistik im Masterstudium Digitale Technologien: Zentraler Grenzwertsatz

Zur Vorbereitung meiner Vorlesung Statistik der Datenanalyse im Masterstudium Digitale Technologien an der FH Bielefeld habe ich heute u.a. die Vermittlung des Zentralen Grenzwertsatzes (ZGW) vorbereitet und einige Grafiken dazu in R erstellt.

Warenkorbinhalte clustern: Customer Analytics mit finite mixture models

Aug 1, 2019

Allgemein, R Code, Referenzprojekt, Referenzprojekte

clustering, customeranalytics, finitemixturemodel, flexmix, Rcode

Die Inhalte der Warenkörbe lassen Rückschlüsse auf die eigenen Kunden zu. Gibt es Warenkorbinhalte, die häufig zusammengekauft werden? Kann ich Informationen über meine Kundengruppen ableiten? Eine Möglichkeit ist die Assoziationsanalysen. Aufgrund der Häufigkeiten von gemeinsam gekauften Produkten werden Regeln abgeleitet: Wenn X gekauft wird, dann wird auch Y gekauft. Das lässt allerdings die Heterogenität der…

Windy gridworld: klassisches RL Problem mit R gelöst

Jun 21, 2019

Allgemein, Data Science, Data Science Bielefeld, R Code

Data Science Bielefeld Meetup, datascicencebielefeld, datascience, example, MachineLearning, R, Rcode, ReinforcementLearning, westphaliadatalab, windygridworld

Machine Learning versucht, basierend auf Erfahrungen Wissen über Entscheidungen zu generieren mit dem Ziel selbständig Entscheidungen treffen zu können. Erfahrungen sind dabei i.d.R. Daten aus der Vergangenheit, sogenannte Trainingsdaten. Die gewählten Trainingsdaten beeinflussen stark die Qualität der Entscheidungen, die der ML Algorithmus nach dem Training selbständig trifft. Nur so gut, wie die vergangenen Entscheidungen waren,…

Daten aus Google BigQuery mit R analysieren

Jan 12, 2019

Data Science, R Code

BigQuery, bigrquery, Error, Google, Job not found, R, RPaket

Daten aus Google BigQuery mit R analysieren

BigQuery ist ein leicht skalierbares Data Warehouse in der Google Cloud. Mit Standard SQL Abfragen kann auf Daten zugegriffen werden und mittels R-Paket bigrquery kann ich Daten aus BigQuery auch leicht in R verwenden. BigQuery, der Hidden Champion von Google 🙂

Optimierungsalgorithmen: Anwendungsbeispiele des genetischen Algorithmus

Jan 6, 2019

Allgemein, Data Science, R Code

GA, Genetischer Algorithmus, Machine Learning, Optimierung, OR, R, RPaket, Travelling Salesman

Machine Learning (ML) Methoden sind eng verknüpft mit Optimierungsverfahren. Im ML wird in der Regel eine Zielfunktion definiert, deren Optimum mittels Optimierungsalgorithmus ermittelt werden muss. Auch zur Verbesserung von ML Methoden kann Optimierung verwendet werden, z.B. bei der Feature Selection (ein Anwendungsbeispiel gibt es unten im Beitrag). Daneben können Optimierungsmethoden auch im Operations Research eingesetzt…