Skip to main content

Overview

AudioPod AI’s AudioMusic V2 is a state-of-the-art music generation engine that transforms text descriptions into original musical compositions. Powered by a Transformer Model with Chain-of-Thought reasoning, AudioMusic V2 delivers studio-quality results.

Key Capabilities

  • Text-to-Music: Generate complete songs with vocals from prompts and lyrics
  • Simple Mode: Describe what you want in natural language — AudioMusic V2 handles everything
  • Cover / Style Transfer: Transform existing audio into different styles and genres
  • Reference Audio: Guide generation using a reference track’s timbre and mixing style
  • Audio Analysis: Extract metadata (BPM, key, lyrics, caption) from any audio
  • Stem Extraction: Isolate specific instruments (vocals, drums, bass, guitar, and more)
  • Repaint / Edit / Extend: Modify specific sections, edit with new prompts, or extend tracks
  • Batch Generation: Generate 1-8 variations in a single request
  • LRC Timestamps: Synchronized lyric timestamps for karaoke-style playback
  • Quality Scoring: Automatic quality assessment for every generation
  • 50+ Languages: Generate music with vocals in over 50 languages
  • Multiple Formats: Output in WAV, MP3, FLAC, or OGG
  • Royalty-Free: All generated music is 100% royalty-free for commercial use

Authentication

All music endpoints require authentication. Use one of these methods:
  • API Key (Recommended): X-API-Key: your_api_key header
  • JWT Token: Authorization: Bearer your_jwt_token (for session-based auth)

Quick Start — Simple Mode

The fastest way to generate music. Just describe what you want:

Complete Parameters Reference

All music generation endpoints inherit from a common base. Here are all available parameters:

Core Parameters

Diffusion Parameters

Language Model Parameters

AudioMusic V2 includes a language model that can auto-generate and refine metadata, captions, lyrics, and more.

Music Metadata Parameters

These are auto-detected when thinking: true, but can be specified manually.

Output & Quality Parameters

LoRA Parameters

Genre Presets

Pre-configured genre settings for quick generation:

Output Formats

Job Lifecycle

All music generation is asynchronous:
  1. Submit a generation request → receive a job with status: "PENDING"
  2. Poll the job status endpoint → "PROCESSING" while generating
  3. Completestatus: "COMPLETED" with output_url and output_urls (multiple formats)
  4. Failedstatus: "FAILED" with error_message (use retry endpoint to re-queue)

Pricing

Music generation is billed per minute of audio generated. Two billing paths apply depending on how you authenticate:
AudioMusic Premium (dit_variant: "xl") is a higher-fidelity variant that bills at 2× the base rate — 1,980 credits/minute or $0.08/minute. Requires a Pro-tier or higher subscription; calls from Free/Basic tiers return 402 PREMIUM_TIER_REQUIRED.
Credits are reserved when the job is created and refunded if generation fails.

Best Practices

  1. Use Simple Mode for quick results — describe what you want in natural language and let AudioMusic V2 handle the details
  2. Enable thinking: true (default) for best quality — Chain-of-Thought reasoning significantly improves output
  3. Use caption over prompt — AudioMusic V2 uses caption internally; prompt is a legacy alias
  4. Set inference_steps: 64 for production quality. Use 32 for fast drafts, 8 for turbo previews
  5. Default guidance_scale: 7.0 works well for most cases. Increase to 10-15 for stronger prompt adherence
  6. Use structure tags in lyrics[verse], [chorus], [bridge], [intro], [outro], [Instrumental]
  7. Use batch_size > 1 to generate multiple variations and pick the best one
  8. Enable generate_lrc: true when you need synchronized lyric timestamps

Error Handling

“Insufficient credits” — Your wallet balance is too low. Top up at Dashboard.“Job must be completed” — You tried to retake/extend/edit a job that hasn’t finished yet. Wait for completion first.“Original music job not found” — The source job ID doesn’t exist or doesn’t belong to your account.“Rate limit exceeded” — You’ve exceeded the rate limit. Wait a moment and try again.

Next Steps

Music Generation

Text-to-Music, Instrumental, Rap, Vocals, Samples, Simple Mode

Audio Tools

Cover, Reference Audio, Analysis, Stem Extraction, Edit, Extend

Job Management

Job status, listing, filtering, retry, presets