MU

music-generation

Generates AI-powered music and audio soundtracks.

Install

mkdir -p .claude/skills/music-generation && curl -L -o skill.zip "https://agentskills.codes/api/skills/download/10726" && unzip -o skill.zip -d .claude/skills/music-generation && rm skill.zip

Installs to .claude/skills/music-generation

Activation

This is the description your AI agent reads to decide when to run this skill — the better it matches your request, the more reliably it fires.

AI music generation via Replicate — 5 models for background tracks, lyrics, and sound design
92 charsno explicit “when” trigger
Intermediate

Key capabilities

  • Generate background tracks
  • Create vocal tracks
  • Design sound effects
  • Match audio styles

How it works

The skill provides access to 5 AI music generation models via Replicate, supporting lyrics, instrumental tracks, and professional sound design.

Inputs & outputs

You give it
Music generation prompt
You get back
AI-generated audio file

When to use music-generation

  • Creating background music for apps
  • Generating sound effects
  • Composing soundtracks for videos
  • Synthesizing vocal tracks

About this skill

Music Generation Skill

Domain: AI Music Generation
Version: 1.0.0
Last Updated: 2026-04-15
Author: Alex (Master Alex)
Source: Patterns from AlexVideos CLI toolkit
Related: text-to-speech (voice), video-generation (video)

Overview

Generate AI music and soundtracks via Replicate. 5 models covering lyrics-based songs, instrumental tracks, and professional sound design.


Model Catalog (5 Models)

KeyModelReplicate IDCostFeatures
music15MiniMax Music 1.5minimax/music-1.5$0.03/fileLyrics with [verse], [chorus] tags
music01MiniMax Music 01minimax/music-01$0.035/fileReference audio input
stableaudioStable Audio 2.5stability-ai/stable-audio-2.5$0.20/fileDiffusion-based, 1–190s
elevenmusicElevenLabs Musicelevenlabs/music$8.30/1k secProfessional, vocals toggle
lyria2Google Lyria 2google/lyria-2$2/1k secNegative prompt support

Parameter Support Matrix

Modelpromptlyricsdurationreferencenegativevocals
music15✅ auto
music01
stableaudio1–190s
elevenmusicvariable✅ toggle
lyria2variable

Model Selection Guide

NeedModelWhy
Song with lyricsmusic15Structured lyrics with verse/chorus
Match existing stylemusic01Reference audio input
Budget instrumentalstableaudioCheapest per-file
Professional productionelevenmusicHighest quality, vocal toggle
Exclude unwanted elementslyria2, stableaudioNegative prompt support

Lyrics Format (MiniMax Music 1.5)

Use structured tags for song sections:

[intro]
(Soft piano melody)

[verse]
Walking through the city lights at night
Every shadow tells a different story
Searching for a meaning in the dark
Finding hope in unexpected places

[chorus]
We rise above the noise
Breaking through the silence
Every heart beating as one
Together we are stronger

[bridge]
When the world falls apart around us
We'll find our way back home

[outro]
(Fade out with gentle strings)

Generation Examples

Song with Lyrics (MiniMax)

const output = await replicate.run("minimax/music-1.5", {
  input: {
    prompt: "Uplifting pop rock song about finding hope",
    lyrics: `
[verse]
Walking through the rain...
[chorus]
We are the dreamers...
    `,
  },
});

Instrumental (Stable Audio)

const output = await replicate.run("stability-ai/stable-audio-2.5", {
  input: {
    prompt: "Epic cinematic orchestral score, heroic theme, brass and strings",
    duration: 60, // seconds
    negative_prompt: "vocals, singing, speech, drums",
  },
});

Reference-Based (MiniMax 01)

const output = await replicate.run("minimax/music-01", {
  input: {
    prompt: "Upbeat electronic dance track",
    reference_audio: referenceAudioDataURI, // Sample to match style
  },
});

Professional with Vocals Toggle (ElevenLabs)

const output = await replicate.run("elevenlabs/music", {
  input: {
    prompt: "Energetic pop song with catchy hook",
    include_vocals: true, // or false for instrumental
  },
});

Prompt Engineering

ElementGood ExampleAvoid
Genre"lo-fi hip hop", "orchestral cinematic""good music"
Mood"melancholic", "uplifting", "tense""nice"
Instruments"acoustic guitar, soft piano, strings""instruments"
Tempo"slow ballad 60 BPM", "upbeat 120 BPM"
Structure"builds to crescendo", "ambient loops"

Cost Comparison (60s track)

ModelCostQualityNotes
stableaudio~$0.20GoodBudget, diffusion-based
music15~$0.03GoodBest for lyrics
music01~$0.035GoodStyle matching
lyria2~$0.12HighNegative prompts
elevenmusic~$0.50PremiumProfessional quality

Integration with Studio Agents

  • Video Generation: Background music for generated videos
  • Text-to-Speech: Combine speech with background tracks
  • Video Editing: Merge music with video via avmerge

Common Use Cases

Use CaseRecommended Flow
YouTube video musicstableaudio → descriptive prompt → 60–120s
Song demomusic15 → structured lyrics → review
Brand audio logostableaudio → 5–10s → specific style prompt
Podcast introstableaudio → 15–30s → upbeat, no vocals
Film scorelyria2/elevenmusic → cinematic prompt → long form

Output Handling

import { writeFileSync } from "fs";

// Music typically returns MP3 or WAV
const response = await fetch(output);
const buffer = await response.arrayBuffer();
writeFileSync("output.mp3", Buffer.from(buffer));

When not to use it

  • General music composition
  • Non-AI audio generation

Limitations

  • Requires Replicate access
  • Cost varies by model

How it compares

It offers a curated catalog of models with specific strengths, allowing users to choose the best tool for their audio needs.

Compared to similar skills

music-generation side by side with the closest alternatives in the catalog.

SkillInstallsUpdatedSafetyDifficulty
music-generation (this skill)04moReviewIntermediate
generate04moNo flagsIntermediate
social-video-creative01moNo flagsIntermediate
rendervid06moReviewIntermediate

Try saying

Example prompts that trigger this skill in your AI assistant.

Search skills

Search the agent skills registry