SmolVLA: Model Penglihatan-Bahasa-Tindakan Cekap dari Komuniti Lerobot
SmolVLA ialah model penglihatan-bahasa-tindakan yang direka untuk cekap, dan dilatih menggunakan data komuniti Lerobot. Butiran teknikal dan matlamat rekaannya diterbitkan di blog Hugging Face.