RSS-Spitzenpapier FlashSAC mit TU Darmstadt und DFKI: Humanoiden lernen das Laufen auf einer GPU in 20 Minuten
Das Reinforcement-Learning-Verfahren FlashSAC, entwickelt unter anderem von Holiday Robotics, KAIST, KRAFTON, der TU Darmstadt, hessian.AI, dem DFKI und der KTH, hat auf der Robotics: Science and Systems 2026 in Sydney den Outstanding Paper Award gewonnen. Die Autoren berichten, dass ein Laufregler für den Unitree G1 auf einer einzigen RTX 5090 in etwa 20 Minuten trainiert war, gegenüber etwa drei Stunden mit dem Standardverfahren PPO.