仓库议题
kyegomez/primus
A multimodal foundation model for humanoid robotics that integrates multiple input modalities—text, speech, vision (images and videos), and outputs both actions and speech simultaneously like a transformer.
议题
此仓库没有已关闭的已索引议题。
仓库议题
A multimodal foundation model for humanoid robotics that integrates multiple input modalities—text, speech, vision (images and videos), and outputs both actions and speech simultaneously like a transformer.
此仓库没有已关闭的已索引议题。