MiniMax multimodal model skill — use MiniMax Multi-Modal models for speech, music, video, and image. Create voice, music, video, and images with MiniMax AI: TTS (text-to-speech, voice cloning, voice design, multi-segment), music (songs, instrumentals), video (text-to-video, image-to-video, start-end frame, subject reference, templates, long-form multi-scene), image (text-to-image, image-to-image with character reference), and media processing (convert, concat, trim, extract). Use when the user m
mdr add martgueritainaccurate875/skills/minimax-multimodal-toolkit@v1.0mdr add martgueritainaccurate875/skills/minimax-multimodal-toolkit@sha256:d3db8a843cb0c33a[](https://markdownregistry.com/a/art_eafuyqmelojtqfhf)
0 badge views in 30 days
| version | committed | commit | size | audit | |
|---|---|---|---|---|---|
| v1.0 latest | 2026-03-27 | 5361adc | 30,906 B | A | view · diff |
| v1.0 | 2026-03-26 | 6ec1c6a | 30,220 B | A | view · diff |
| git:20260325.bb821d6 | 2026-03-25 | bb821d6 | 30,136 B | A | view |
martgueritainaccurate875/skills · 6 stars · license MIT · pushed 2026-09-05 · branch main
GET https://markdownregistry.com/api/v1/artifacts/art_eafuyqmelojtqfhf GET https://markdownregistry.com/api/v1/resolve?ref=martgueritainaccurate875/skills/minimax-multimodal-toolkit GET https://markdownregistry.com/api/v1/blob/d3db8a843cb0c33a244249ae8427e932086441234051f567e4e00d432e930926