Berita NexaRob/Laporan dan penelitian

Bagaimana robot dapat secara mandiri memperbaiki kode kontrol mereka selama operasi?

Metode VLCP baru memungkinkan robot untuk secara mandiri memperbaiki kode kontrol mereka saat melakukan tugas - tanpa penyesuaian model, tanpa contoh, dan tanpa perlu mengubah tujuan. Dalam pengujian pada 57 tugas, ia mencapai efektivitas yang jauh lebih tinggi daripada pendekatan terbuka tradisional. Kuncinya adalah menutup loop kontrol pada tingkat keputusan.

Di halaman ini

Loop tertutup pada tingkat kode - filosofi robotika baru

Banyak sistem robot modern didasarkan pada model bahasa-visual (VLM), yang menghasilkan keputusan kontrol. Secara tradisional, agar model ini berfungsi dalam praktiknya, mereka harus disesuaikan dengan tugas tertentu - proses yang dikenal sebagai fine-tuning. Ini membutuhkan kumpulan data dan waktu yang besar. VLCP mengambil pendekatan yang berbeda: alih-alih memodifikasi model, ia membiarkannya tidak berubah (beku) dan menggunakannya untuk menghasilkan fungsi kontrol dalam bahasa Python. Yang penting, ia tidak memerlukan contoh atau gangguan dalam pelatihan.

Inovasi utama adalah menutup loop kontrol pada tingkat kode itu sendiri, bukan pada tingkat keputusan atau sub-tugas. Ketika robot membuat kesalahan - misalnya, gagal mengambil objek - sistem tidak memilih tugas baru atau mengulangi fungsi yang sama. Sebaliknya, setiap beberapa langkah, model menganalisis kembali adegan dari berbagai perspektif dan menulis ulang kode kontrol yang baru saja gagal. Ini memungkinkan perbaikan kesalahan selama satu episode, sebelum menjadi tidak dapat diubah.

Efektivitas: sepuluh kali lebih banyak keberhasilan daripada pendekatan tradisional

Penelitian yang dilakukan pada kumpulan tugas MuJoCo/RoboVerse, yang mencakup 57 aktivitas manipulasi berbeda, menunjukkan peningkatan efektivitas yang dramatis. Sistem VLCP mencapai hasil yang jauh lebih baik daripada sistem identik yang beroperasi dalam mode terbuka (dengan satu permintaan per episode). Perbedaan ini tidak kebetulan - interval kepercayaan bahkan tidak tumpang tindih untuk keluarga adegan tunggal.

Peningkatan utama berasal dari peningkatan kesalahan intra-episode. Penelitian menunjukkan bahwa sistem dapat memulihkan sebagian kasus cengkeraman yang gagal - yaitu, situasi yang dianggap oleh sistem terbuka tradisional sebagai akhir episode. Ketika robot gagal mengambil objek, VLCP tidak bereaksi pada tingkat keputusan, tetapi menulis ulang kode kontrol, yang mungkin sudah berfungsi dengan benar dalam situasi baru.

Efisiensi komputasi: biaya rendah dan efisiensi tinggi

Meskipun memiliki fungsi perencanaan ulang yang canggih, VLCP bukanlah beban komputasi. Penelitian menunjukkan bahwa sebagian besar token input masuk ke cache, yang secara signifikan mengurangi waktu respons. Hanya sekitar 10 permintaan singkat yang diperlukan per episode - tidak lebih dari yang dibutuhkan untuk satu pemrosesan penuh.

Selain itu, fungsi kontrol yang dihasilkan selama perencanaan ulang disimpan dalam perpustakaan keterampilan yang digunakan dalam episode berikutnya. Ini berarti bahwa sistem tidak hanya meningkatkan dirinya sendiri selama operasi, tetapi juga belajar dari pengalamannya sendiri - yang dapat menyebabkan pengembangan kompetensi jangka panjang tanpa perlu pelatihan baru.

Batasan dan signifikansi untuk masa depan robotika

Hasil VLCP menjanjikan, tetapi penting untuk diingat bahwa hasil tersebut diperoleh dalam simulasi - pada platform MuJoCo/RoboVerse. Ini berarti bahwa belum ada konfirmasi tentang kinerja di dunia nyata dengan robot fisik dan noise sensorik. Perlu juga ditekankan bahwa sistem hanya berfungsi untuk tugas-tugas yang dapat dijelaskan sebagai fungsi Python pendek - yang membatasi penerapannya pada jenis manipulasi tertentu.

Namun, signifikansi dari karya ini sangat besar. Ini menunjukkan bahwa robot tidak hanya dapat melakukan tugas, tetapi juga menganalisis dan memperbaiki kode mereka sendiri secara real time. Ini adalah langkah menuju sistem otonom yang tidak terbatas pada tindakan yang telah diprogram sebelumnya, tetapi dapat beradaptasi pada tingkat kontrol itu sendiri.

Transparansi editorial

Sumber dan materi referensi

Artikel ini dikembangkan oleh NexaRob berdasarkan analisis materi sumber yang tersedia. Materi berikut digunakan untuk memverifikasi informasi dan memperluas konteks.

1sumber material
1awal
1ditampilkan secara publik
  1. Sumber primerPenelitianVerifikasi informasi

    VLCP: Vision Language Control Policy Closed-Loop Code Replanning for Robot Manipulation

    arXiv tentang )arxiv.org

Bagaimana cara membaca bagian ini? Sumber adalah materi yang digunakan selama penelitian dan verifikasi. Artikel ini adalah pengembangan asli oleh NexaRob, bukan reproduksi publikasi yang ditunjukkan.

Bagikan materi
Buka sumber
Bahasa IndonesiaID