Nvidias neues World Model hilft Robotern bei der Navigation
TL;DR
Nvidia hat mit Cosmos 3 ein offenes AI-World-Model vorgestellt, das Robotern, autonomen Fahrzeugen und anderen physischen Systemen hilft, ihre Umgebung besser zu verstehen und vorherzusagen. Trainiert wurde es auf 20 Billionen Tokens multimodaler Daten – Bilder, Videos, Audio sowie Aktionsdaten von Menschen und Robotern. Genau diese Aktionsdaten unterscheiden Cosmos von einem reinen Videogenerator: Es modelliert, wie sich Maschinen bewegen, nicht nur wie Szenen aussehen.
Nauti's Take
Noch in Arbeit – Nauti's Take wird in Kürze ergänzt.