Revolusi Robotika: Model Baru dengan Kemampuan Generalisasi seperti LLM!
Physical Intelligence, sebuah perusahaan rintisan AS, baru saja meluncurkan model robot baru yang dapat menggeneralisasi tugas-tugas kompleks seperti model bahasa besar (LLM). Model ini, yang disebut π0.7, dapat menggabungkan keterampilan yang dipelajari selama pelatihan untuk menyelesaikan tugas-tugas baru.
Detail Teknis
π0.7 dibangun di atas model bahasa terbuka Gemma3 dari Google dengan empat miliar parameter, dipasangkan dengan model aksi yang lebih kecil dengan 860 juta parameter yang menghasilkan gerakan robot sebenarnya. Menurut Physical Intelligence, faktor penentu bukanlah arsitektur, melainkan resep pelatihan.
Fitur Utama
- Generalisasi Komposisional: π0.7 dapat menggeneralisasi tugas-tugas kompleks dengan menggabungkan keterampilan yang dipelajari selama pelatihan.
- Pelatihan dengan Data yang Beragam: Model ini dapat dilatih dengan data yang beragam, termasuk data yang gagal atau lambat.
- Pemindahan Pengetahuan: π0.7 dapat mentransfer pengetahuan dari satu tugas ke tugas lainnya.
Pendapat Geek
Model ini menunjukkan bahwa robotika telah mencapai skala di mana efek-efek yang serupa dengan model bahasa besar menjadi terlihat. Namun, masih perlu dibahas apakah model ini benar-benar menggeneralisasi tugas-tugas baru atau hanya mengingat data pelatihan yang serupa.



