<?xml version="1.0" encoding="utf-8" standalone="yes"?><urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9" xmlns:xhtml="http://www.w3.org/1999/xhtml"><url><loc>https://ppsantos.github.io/posts/risk-aware-gumdps/</loc><lastmod>2026-08-26T00:00:00+00:00</lastmod></url><url><loc>https://ppsantos.github.io/tags/general-utility-markov-decision-process/</loc><lastmod>2026-08-26T00:00:00+00:00</lastmod></url><url><loc>https://ppsantos.github.io/tags/markov-decision-process/</loc><lastmod>2026-08-26T00:00:00+00:00</lastmod></url><url><loc>https://ppsantos.github.io/</loc><lastmod>2026-08-26T00:00:00+00:00</lastmod></url><url><loc>https://ppsantos.github.io/posts/</loc><lastmod>2026-08-26T00:00:00+00:00</lastmod></url><url><loc>https://ppsantos.github.io/tags/reinforcement-learning/</loc><lastmod>2026-08-26T00:00:00+00:00</lastmod></url><url><loc>https://ppsantos.github.io/tags/risk-aware-decision-making/</loc><lastmod>2026-08-26T00:00:00+00:00</lastmod></url><url><loc>https://ppsantos.github.io/tags/</loc><lastmod>2026-08-26T00:00:00+00:00</lastmod></url><url><loc>https://ppsantos.github.io/posts/from-mdps-to-gumdps/</loc><lastmod>2026-08-07T00:00:00+00:00</lastmod></url><url><loc>https://ppsantos.github.io/contacts/</loc><lastmod>2026-02-07T00:00:00+00:00</lastmod></url><url><loc>https://ppsantos.github.io/tags/data-distribution/</loc><lastmod>2024-06-13T00:00:00+00:00</lastmod></url><url><loc>https://ppsantos.github.io/posts/concentrability-coeficients-max-ent-exploration/</loc><lastmod>2024-06-13T00:00:00+00:00</lastmod></url><url><loc>https://ppsantos.github.io/tags/q-learning/</loc><lastmod>2024-06-13T00:00:00+00:00</lastmod></url></urlset>