YahtzeeRL
Ein Agent, der durch Self-Play lernt, langfristige Entscheidungen in einem Würfelspiel mit expliziten Zufallsknoten zu treffen.
81,1 % Gewinnrate gegen eine heuristische Baseline in 512 Spielen
JAX · Flax · RLax · MCTS · self-play
Applied Data Scientist
Ich studiere Mathematik im Master und arbeite an Machine-Learning-Projekten, von Zeitreihenprognosen bis zu Agenten, die durch Spielen lernen.
Ein Agent, der durch Self-Play lernt, langfristige Entscheidungen in einem Würfelspiel mit expliziten Zufallsknoten zu treffen.
81,1 % Gewinnrate gegen eine heuristische Baseline in 512 Spielen
JAX · Flax · RLax · MCTS · self-play
Mehrstufige Vorhersage der Solarstrahlung über kurze und lange Zeithorizonte, geprüft gegen saisonale und persistente Baselines.
GRU senkte den RMSE gegenüber der stärksten naiven Baseline um ca. 34 % bei 4 h und 21 % bei 24 h
GRU · LSTM · time series · baselines
Vergleich von Ridge- und Kernel-Ridge-Regression einschließlich eines algebraischen Äquivalenzbeweises.