基于 MiniMax 的多模态插件,为无视觉能力的模型提供图像识别、媒体生成与实时语音通话能力。
guide_dog_speak
guide_dog_image
guide_dog_video
guide_dog_vision
guide_dog_inspect
guide_dog_voices
guide_dog_music
guide_dog_text
guide_dog_search
在 GitHub 阅读完整 README