Overview
AudioPod AI’s AudioMusic V2 is a state-of-the-art music generation engine that transforms text descriptions into original musical compositions. Powered by a Transformer Model with Chain-of-Thought reasoning, AudioMusic V2 delivers studio-quality results.Key Capabilities
- Text-to-Music: Generate complete songs with vocals from prompts and lyrics
- Simple Mode: Describe what you want in natural language — AudioMusic V2 handles everything
- Cover / Style Transfer: Transform existing audio into different styles and genres
- Reference Audio: Guide generation using a reference track’s timbre and mixing style
- Audio Analysis: Extract metadata (BPM, key, lyrics, caption) from any audio
- Stem Extraction: Isolate specific instruments (vocals, drums, bass, guitar, and more)
- Repaint / Edit / Extend: Modify specific sections, edit with new prompts, or extend tracks
- Batch Generation: Generate 1-8 variations in a single request
- LRC Timestamps: Synchronized lyric timestamps for karaoke-style playback
- Quality Scoring: Automatic quality assessment for every generation
- 50+ Languages: Generate music with vocals in over 50 languages
- Multiple Formats: Output in WAV, MP3, FLAC, or OGG
- Royalty-Free: All generated music is 100% royalty-free for commercial use
Authentication
All music endpoints require authentication. Use one of these methods:- API Key (Recommended):
X-API-Key: your_api_keyheader - JWT Token:
Authorization: Bearer your_jwt_token(for session-based auth)
Quick Start — Simple Mode
The fastest way to generate music. Just describe what you want:- Python
- Node.js
- cURL
Complete Parameters Reference
All music generation endpoints inherit from a common base. Here are all available parameters:Core Parameters
Diffusion Parameters
Language Model Parameters
AudioMusic V2 includes a language model that can auto-generate and refine metadata, captions, lyrics, and more.Music Metadata Parameters
These are auto-detected whenthinking: true, but can be specified manually.
Output & Quality Parameters
LoRA Parameters
Genre Presets
Pre-configured genre settings for quick generation:Output Formats
Job Lifecycle
All music generation is asynchronous:- Submit a generation request → receive a job with
status: "PENDING" - Poll the job status endpoint →
"PROCESSING"while generating - Complete →
status: "COMPLETED"withoutput_urlandoutput_urls(multiple formats) - Failed →
status: "FAILED"witherror_message(use retry endpoint to re-queue)
Pricing
Music generation is billed per minute of audio generated. Two billing paths apply depending on how you authenticate:AudioMusic Premium (
dit_variant: "xl") is a higher-fidelity variant that
bills at 2× the base rate — 1,980 credits/minute or $0.08/minute. Requires
a Pro-tier or higher subscription; calls from Free/Basic tiers return
402 PREMIUM_TIER_REQUIRED.Best Practices
- Use Simple Mode for quick results — describe what you want in natural language and let AudioMusic V2 handle the details
- Enable
thinking: true(default) for best quality — Chain-of-Thought reasoning significantly improves output - Use
captionoverprompt— AudioMusic V2 usescaptioninternally;promptis a legacy alias - Set
inference_steps: 64for production quality. Use 32 for fast drafts, 8 for turbo previews - Default
guidance_scale: 7.0works well for most cases. Increase to 10-15 for stronger prompt adherence - Use structure tags in lyrics —
[verse],[chorus],[bridge],[intro],[outro],[Instrumental] - Use
batch_size > 1to generate multiple variations and pick the best one - Enable
generate_lrc: truewhen you need synchronized lyric timestamps
Error Handling
Common Errors
Common Errors
“Insufficient credits” — Your wallet balance is too low. Top up at Dashboard.“Job must be completed” — You tried to retake/extend/edit a job that hasn’t finished yet. Wait for completion first.“Original music job not found” — The source job ID doesn’t exist or doesn’t belong to your account.“Rate limit exceeded” — You’ve exceeded the rate limit. Wait a moment and try again.
Next Steps
Music Generation
Text-to-Music, Instrumental, Rap, Vocals, Samples, Simple Mode
Audio Tools
Cover, Reference Audio, Analysis, Stem Extraction, Edit, Extend
Job Management
Job status, listing, filtering, retry, presets
