Ich wollte Shiny kennenlernen und die Twitter-API ausprobieren. Als Datengrundlage habe ich die Feeds von fünf österreichischen Parteichefs genommen.
Ein Python-Skript hängt sich über tweepy an die Streaming-API von Twitter und filtert auf die IDs der fünf Accounts. Jede Statusmeldung geht unverändert in eine MongoDB.
Ein R-Skript holt die Daten aus der Datenbank, ordnet jeden Eintrag einem der fünf Accounts zu und stuft ihn als Tweet, Retweet oder Kommentar ein. Das Ergebnis wird als CSV abgespeichert.
Mithilfe von Shiny wird daraus ein Dashboard gebaut. Das Dashboard kann die Daten über den gesamten Zeitraum filtern. Als grafische Repräsentation habe ich eine Wordcloud, ein Netzwerkdiagramm und ein Liniendiagramm gewählt.
Die Anwendung ist weiterhin erreichbar. Neue Daten kommen keine mehr dazu. Der Datensatz reicht vom 18.02.2019 bis zum 30.04.2019. Der Quellcode liegt auf Github.
