Jak modele językowo-wizualne uczą roboty przewidywać intencje ludzkie w realistycznych środowiskach
Nowa metoda HINT-Plan umożliwia robotom w realistycznych środowiskach przewidywanie intencji ludzkich na podstawie obrazów z trzeciej osoby. W symulacji fotorealistycznej osiągnęła skuteczność 69,71% w...

