Issue del repository
kyegomez/primus
A multimodal foundation model for humanoid robotics that integrates multiple input modalities—text, speech, vision (images and videos), and outputs both actions and speech simultaneously like a transformer.
Issue
Nessuna issue indicizzata aperta trovata per questo repository.