<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Publications | Florent Delgrange</title><link>https://delgrange.me/publication/</link><atom:link href="https://delgrange.me/publication/index.xml" rel="self" type="application/rss+xml"/><description>Publications</description><generator>Wowchemy (https://wowchemy.com)</generator><language>en-us</language><image><url>https://delgrange.me/media/icon_hu55be7e40e5cc7772513f5d192dadedff_14178_512x512_fill_lanczos_center_3.png</url><title>Publications</title><link>https://delgrange.me/publication/</link></image><item><title>It's a matter of timescale: non-linear utility in successor features and multi-objective planning and learning</title><link>https://delgrange.me/publication/mertens-2026-timescale/</link><pubDate>Tue, 14 Jul 2026 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/mertens-2026-timescale/</guid><description/></item><item><title>Foundation World Models for Agents that Learn, Verify, and Adapt Reliably Beyond Static Environments</title><link>https://delgrange.me/publication/delgrange-2026-foundation-world-models/</link><pubDate>Mon, 25 May 2026 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/delgrange-2026-foundation-world-models/</guid><description>&lt;p>This paper received the &lt;strong>Best Blue Sky Paper Award&lt;/strong> at AAMAS 2026.&lt;/p>
&lt;a target="_blank" rel="noopener" href="https://verified.sertifier.com/en/verify/59844677800545/?ref=email">
&lt;img class="award-certificate" src="https://storage.googleapis.com/verified-storage/cert/59844677800545.png" alt="Best Blue Sky Paper Award certificate">
&lt;/a></description></item><item><title>Deep SPI: Safe Policy Improvement via World Models</title><link>https://delgrange.me/publication/delgrange-2025-deepspisafepolicy/</link><pubDate>Thu, 23 Apr 2026 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/delgrange-2025-deepspisafepolicy/</guid><description/></item><item><title>CTDE2: Continuous Training Discrete Execution</title><link>https://delgrange.me/publication/rowies-2026-ctde2/</link><pubDate>Wed, 22 Apr 2026 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/rowies-2026-ctde2/</guid><description/></item><item><title>Composing Reinforcement Learning Policies, with Formal Guarantees</title><link>https://delgrange.me/publication/delgrange-2025-synthesis/</link><pubDate>Fri, 23 May 2025 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/delgrange-2025-synthesis/</guid><description>&lt;p>This work received the &lt;strong>Best Poster Award&lt;/strong> at &lt;a href="https://www.benerl.org/workshop/2025-eindhoven#h.1145sba7zrwi" target="_blank" rel="noopener">BeNeRL 2025&lt;/a>.&lt;/p></description></item><item><title>Integrating RL and Planning through Optimal Transport World Models</title><link>https://delgrange.me/publication/ropke-2025-integrating-rl-planning-ot-world-models/</link><pubDate>Tue, 01 Apr 2025 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/ropke-2025-integrating-rl-planning-ot-world-models/</guid><description/></item><item><title>Activating Formal Verification of Deep Reinforcement Learning Policies by Model Checking Bisimilar Latent Space Models</title><link>https://delgrange.me/publication/thesis/</link><pubDate>Tue, 20 Aug 2024 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/thesis/</guid><description/></item><item><title>The Wasserstein Believer: Learning Belief Updates for Partially Observable Environments through Reliable Latent Space Models</title><link>https://delgrange.me/publication/https-doi-org-10-48550-arxiv-2303-03284/</link><pubDate>Wed, 29 May 2024 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/https-doi-org-10-48550-arxiv-2303-03284/</guid><description/></item><item><title>WAE-PCN: Wasserstein-autoencoded Pareto Conditioned Networks</title><link>https://delgrange.me/publication/wae-pcn/</link><pubDate>Mon, 29 May 2023 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/wae-pcn/</guid><description/></item><item><title>Wasserstein Auto-encoded MDPs: Formal Verification of Efficiently Distilled RL Policies with Many-sided Guarantees</title><link>https://delgrange.me/publication/delgrange-2023-wasserstein/</link><pubDate>Sun, 01 Jan 2023 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/delgrange-2023-wasserstein/</guid><description/></item><item><title>Distillation of RL Policies with Formal Guarantees via Variational Abstraction of Markov Decision Processes</title><link>https://delgrange.me/publication/dblp-journalscorrabs-2112-09655/</link><pubDate>Tue, 28 Jun 2022 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/dblp-journalscorrabs-2112-09655/</guid><description/></item><item><title>A Framework for Flexibly Guiding Learning Agents</title><link>https://delgrange.me/publication/elbarbari-2022/</link><pubDate>Wed, 01 Jun 2022 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/elbarbari-2022/</guid><description/></item><item><title>Life is Random, Time is Not: Markov Decision Processes with Window Objectives</title><link>https://delgrange.me/publication/dblp-journalslmcs-brihaye-dor-20/</link><pubDate>Mon, 14 Dec 2020 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/dblp-journalslmcs-brihaye-dor-20/</guid><description/></item><item><title>Simple Strategies in Multi-Objective MDPs</title><link>https://delgrange.me/publication/dblp-conftacas-delgrange-kqr-20/</link><pubDate>Thu, 30 Apr 2020 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/dblp-conftacas-delgrange-kqr-20/</guid><description/></item><item><title>Life Is Random, Time Is Not: Markov Decision Processes with Window Objectives</title><link>https://delgrange.me/publication/dblp-confconcur-brihaye-dor-19/</link><pubDate>Fri, 30 Aug 2019 00:00:00 +0000</pubDate><guid>https://delgrange.me/publication/dblp-confconcur-brihaye-dor-19/</guid><description/></item></channel></rss>