<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>CentraleSupélec | Etienne Chassaing</title><link>http://etiennechassaing.com/teaching/centralesupelec/</link><atom:link href="http://etiennechassaing.com/teaching/centralesupelec/index.xml" rel="self" type="application/rss+xml"/><description>CentraleSupélec</description><generator>Hugo Blox Builder (https://hugoblox.com)</generator><language>en-us</language><lastBuildDate>Thu, 01 Jan 2026 00:00:00 +0000</lastBuildDate><image><url>http://etiennechassaing.com/media/sharing.jpg</url><title>CentraleSupélec</title><link>http://etiennechassaing.com/teaching/centralesupelec/</link></image><item><title>Reinforcement Learning</title><link>http://etiennechassaing.com/teaching/centralesupelec/reinforcement-learning/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>http://etiennechassaing.com/teaching/centralesupelec/reinforcement-learning/</guid><description>&lt;p>An introductory course on Reinforcement Learning, structured as &lt;strong>four lectures&lt;/strong>, each followed by a tutorial.&lt;/p>
&lt;h3 id="lectures">Lectures&lt;/h3>
&lt;details class="pdf-card"
style="margin:0.4rem 0;border:1px solid var(--color-border,#d4d4d8);border-radius:8px;overflow:hidden;">
&lt;summary style="cursor:pointer;list-style:none;padding:0.65rem 1rem;display:flex;align-items:center;gap:0.6rem;">
&lt;span style="flex:1 1 auto;font-weight:600;">Lecture 1: Introduction and MDPs&lt;/span>
&lt;a href="https://cdn.jsdelivr.net/gh/cetiennec/cours-pdf@main/centralesupelec/reinforcement-learning/cours/01-introduction-mdp/diffusion/01-introduction-mdp.pdf" target="_blank" rel="noopener" onclick="event.stopPropagation()"
style="font-weight:400;font-size:0.85em;white-space:nowrap;">open ↗&lt;/a>
&lt;/summary>
&lt;div style="position:relative;padding-top:129%;border-top:1px solid var(--color-border,#d4d4d8);">
&lt;iframe loading="lazy" src="https://cdn.jsdelivr.net/gh/cetiennec/cours-pdf@main/centralesupelec/reinforcement-learning/cours/01-introduction-mdp/diffusion/01-introduction-mdp.pdf"
style="position:absolute;top:0;left:0;width:100%;height:100%;border:0;"
title="Lecture 1: Introduction and MDPs">&lt;/iframe>
&lt;/div>
&lt;/details>
&lt;details class="pdf-card"
style="margin:0.4rem 0;border:1px solid var(--color-border,#d4d4d8);border-radius:8px;overflow:hidden;">
&lt;summary style="cursor:pointer;list-style:none;padding:0.65rem 1rem;display:flex;align-items:center;gap:0.6rem;">
&lt;span style="flex:1 1 auto;font-weight:600;">Lecture 2: Dynamic Programming&lt;/span>
&lt;a href="https://cdn.jsdelivr.net/gh/cetiennec/cours-pdf@main/centralesupelec/reinforcement-learning/cours/02-programmation-dynamique/diffusion/02-programmation-dynamique.pdf" target="_blank" rel="noopener" onclick="event.stopPropagation()"
style="font-weight:400;font-size:0.85em;white-space:nowrap;">open ↗&lt;/a>
&lt;/summary>
&lt;div style="position:relative;padding-top:129%;border-top:1px solid var(--color-border,#d4d4d8);">
&lt;iframe loading="lazy" src="https://cdn.jsdelivr.net/gh/cetiennec/cours-pdf@main/centralesupelec/reinforcement-learning/cours/02-programmation-dynamique/diffusion/02-programmation-dynamique.pdf"
style="position:absolute;top:0;left:0;width:100%;height:100%;border:0;"
title="Lecture 2: Dynamic Programming">&lt;/iframe>
&lt;/div>
&lt;/details>
&lt;details class="pdf-card"
style="margin:0.4rem 0;border:1px solid var(--color-border,#d4d4d8);border-radius:8px;overflow:hidden;">
&lt;summary style="cursor:pointer;list-style:none;padding:0.65rem 1rem;display:flex;align-items:center;gap:0.6rem;">
&lt;span style="flex:1 1 auto;font-weight:600;">Lecture 3: Model-Free Prediction&lt;/span>
&lt;a href="https://cdn.jsdelivr.net/gh/cetiennec/cours-pdf@main/centralesupelec/reinforcement-learning/cours/03-model-free-learning/diffusion/03-model-free-learning.pdf" target="_blank" rel="noopener" onclick="event.stopPropagation()"
style="font-weight:400;font-size:0.85em;white-space:nowrap;">open ↗&lt;/a>
&lt;/summary>
&lt;div style="position:relative;padding-top:129%;border-top:1px solid var(--color-border,#d4d4d8);">
&lt;iframe loading="lazy" src="https://cdn.jsdelivr.net/gh/cetiennec/cours-pdf@main/centralesupelec/reinforcement-learning/cours/03-model-free-learning/diffusion/03-model-free-learning.pdf"
style="position:absolute;top:0;left:0;width:100%;height:100%;border:0;"
title="Lecture 3: Model-Free Prediction">&lt;/iframe>
&lt;/div>
&lt;/details>
&lt;details class="pdf-card"
style="margin:0.4rem 0;border:1px solid var(--color-border,#d4d4d8);border-radius:8px;overflow:hidden;">
&lt;summary style="cursor:pointer;list-style:none;padding:0.65rem 1rem;display:flex;align-items:center;gap:0.6rem;">
&lt;span style="flex:1 1 auto;font-weight:600;">Lecture 4: Model-Free Control &amp;amp; Deep RL Applications&lt;/span>
&lt;a href="https://cdn.jsdelivr.net/gh/cetiennec/cours-pdf@main/centralesupelec/reinforcement-learning/cours/04-deep-rl-applications/diffusion/04-deep-rl-applications.pdf" target="_blank" rel="noopener" onclick="event.stopPropagation()"
style="font-weight:400;font-size:0.85em;white-space:nowrap;">open ↗&lt;/a>
&lt;/summary>
&lt;div style="position:relative;padding-top:129%;border-top:1px solid var(--color-border,#d4d4d8);">
&lt;iframe loading="lazy" src="https://cdn.jsdelivr.net/gh/cetiennec/cours-pdf@main/centralesupelec/reinforcement-learning/cours/04-deep-rl-applications/diffusion/04-deep-rl-applications.pdf"
style="position:absolute;top:0;left:0;width:100%;height:100%;border:0;"
title="Lecture 4: Model-Free Control &amp;amp; Deep RL Applications">&lt;/iframe>
&lt;/div>
&lt;/details>
&lt;ul>
&lt;li>Session 1: Markov decision processes, return, value functions, Bellman equations.&lt;/li>
&lt;li>Session 2: policy evaluation, policy iteration, value iteration.&lt;/li>
&lt;li>Session 3: Monte-Carlo methods, temporal differences TD(0).&lt;/li>
&lt;li>Session 4: Monte-Carlo control, SARSA, Q-learning, and a look at deep RL.&lt;/li>
&lt;/ul>
&lt;h3 id="written-exercises">Written exercises&lt;/h3>
&lt;details class="pdf-card"
style="margin:0.4rem 0;border:1px solid var(--color-border,#d4d4d8);border-radius:8px;overflow:hidden;">
&lt;summary style="cursor:pointer;list-style:none;padding:0.65rem 1rem;display:flex;align-items:center;gap:0.6rem;">
&lt;span style="flex:1 1 auto;font-weight:600;">Exercises: Introduction and MDPs&lt;/span>
&lt;a href="https://cdn.jsdelivr.net/gh/cetiennec/cours-pdf@main/centralesupelec/reinforcement-learning/TD-2026-2027/01-introduction-mdp/diffusion/exercises.pdf" target="_blank" rel="noopener" onclick="event.stopPropagation()"
style="font-weight:400;font-size:0.85em;white-space:nowrap;">open ↗&lt;/a>
&lt;/summary>
&lt;div style="position:relative;padding-top:129%;border-top:1px solid var(--color-border,#d4d4d8);">
&lt;iframe loading="lazy" src="https://cdn.jsdelivr.net/gh/cetiennec/cours-pdf@main/centralesupelec/reinforcement-learning/TD-2026-2027/01-introduction-mdp/diffusion/exercises.pdf"
style="position:absolute;top:0;left:0;width:100%;height:100%;border:0;"
title="Exercises: Introduction and MDPs">&lt;/iframe>
&lt;/div>
&lt;/details>
&lt;details class="pdf-card"
style="margin:0.4rem 0;border:1px solid var(--color-border,#d4d4d8);border-radius:8px;overflow:hidden;">
&lt;summary style="cursor:pointer;list-style:none;padding:0.65rem 1rem;display:flex;align-items:center;gap:0.6rem;">
&lt;span style="flex:1 1 auto;font-weight:600;">Exercises: Dynamic Programming&lt;/span>
&lt;a href="https://cdn.jsdelivr.net/gh/cetiennec/cours-pdf@main/centralesupelec/reinforcement-learning/TD-2026-2027/02-programmation-dynamique/diffusion/exercises.pdf" target="_blank" rel="noopener" onclick="event.stopPropagation()"
style="font-weight:400;font-size:0.85em;white-space:nowrap;">open ↗&lt;/a>
&lt;/summary>
&lt;div style="position:relative;padding-top:129%;border-top:1px solid var(--color-border,#d4d4d8);">
&lt;iframe loading="lazy" src="https://cdn.jsdelivr.net/gh/cetiennec/cours-pdf@main/centralesupelec/reinforcement-learning/TD-2026-2027/02-programmation-dynamique/diffusion/exercises.pdf"
style="position:absolute;top:0;left:0;width:100%;height:100%;border:0;"
title="Exercises: Dynamic Programming">&lt;/iframe>
&lt;/div>
&lt;/details>
&lt;blockquote>
&lt;p>Exercise sheets for sessions 3 and 4, and the notebook tutorials, are in preparation.&lt;/p>
&lt;/blockquote>
&lt;p>See also the &lt;a href="http://etiennechassaing.com/teaching/companies/drl/">Deep Reinforcement Learning training&lt;/a> I delivered
in companies: same fundamentals, geared towards hands-on practice with Stable-Baselines3
and Gym.&lt;/p></description></item><item><title>Robotics elective</title><link>http://etiennechassaing.com/teaching/centralesupelec/robotics-elective/</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>http://etiennechassaing.com/teaching/centralesupelec/robotics-elective/</guid><description>&lt;p>I am designing the CentraleSupélec elective &lt;strong>Robotics Systems, from Motion to Embodied AI&lt;/strong>,
taught from April 2027.&lt;/p>
&lt;p>It will cover kinematics, dynamic modelling, trajectory planning and torque control; then
biomimetic versus learned locomotion, learning and formal guarantees; and ends with a
Python project in MuJoCo.&lt;/p>
&lt;p>The course material will be published here once the course has started.&lt;/p></description></item><item><title>Robotics project supervision</title><link>http://etiennechassaing.com/teaching/centralesupelec/robotics-project/</link><pubDate>Thu, 01 Jan 2026 00:00:00 +0000</pubDate><guid>http://etiennechassaing.com/teaching/centralesupelec/robotics-project/</guid><description>&lt;p>
&lt;figure >
&lt;div class="flex justify-center ">
&lt;div class="w-100" >&lt;img alt="Image alt" srcset="
/teaching/centralesupelec/robotics-project/featured_hu02aa61ae1d9de35cbe238d2676170cb9_91877_a5a2ee39ef2e4b72a64f5a85b440b1d9.webp 400w,
/teaching/centralesupelec/robotics-project/featured_hu02aa61ae1d9de35cbe238d2676170cb9_91877_ad4e73914ad08b81c569f11e94975126.webp 760w,
/teaching/centralesupelec/robotics-project/featured_hu02aa61ae1d9de35cbe238d2676170cb9_91877_1200x1200_fit_q80_h2_lanczos.webp 1200w"
src="http://etiennechassaing.com/teaching/centralesupelec/robotics-project/featured_hu02aa61ae1d9de35cbe238d2676170cb9_91877_a5a2ee39ef2e4b72a64f5a85b440b1d9.webp"
width="403"
height="529"
loading="lazy" data-zoomable />&lt;/div>
&lt;/div>&lt;/figure>
&lt;em>Robotics project - CentraleSupélec&lt;/em>&lt;/p>
&lt;h2 id="summary">Summary&lt;/h2>
&lt;p>Since January 2026, I supervise robotics projects for CentraleSupélec students.&lt;/p></description></item></channel></rss>