倉庫議題
kyegomez/primus
A multimodal foundation model for humanoid robotics that integrates multiple input modalities—text, speech, vision (images and videos), and outputs both actions and speech simultaneously like a transformer.
議題
此倉庫沒有已索引議題。
倉庫議題
A multimodal foundation model for humanoid robotics that integrates multiple input modalities—text, speech, vision (images and videos), and outputs both actions and speech simultaneously like a transformer.
此倉庫沒有已索引議題。