# AudioPod AI > AudioPod AI is an AI audio platform with an API and SDKs for audiobook production, stem separation (up to a 45-instrument catalog), voice cloning and design, transcription, speaker diarization, music generation, and text-to-speech. Free tier; pay-as-you-go and subscription plans. - [Audio AI Platform for Developers](https://docs.audiopod.ai/index.md): AI-powered audio processing APIs. Audiobook production, stem separation, transcription, voice cloning, music generation, and more. - [Quick Start](https://docs.audiopod.ai/quickstart.md): Go from zero to your first API call in under 5 minutes - [API Keys](https://docs.audiopod.ai/account/api-keys.md): Create and manage your AudioPod AI API keys - [API Wallet & Pricing](https://docs.audiopod.ai/account/api-wallet.md): Pay-as-you-go pricing. Add funds and pay only for what you use. - [Webhooks](https://docs.audiopod.ai/account/webhooks.md): Receive a signed HTTP callback the moment an AudioPod job finishes — no polling. Register an endpoint, verify the signature, and handle retries. - [Official SDKs](https://docs.audiopod.ai/sdks/overview.md): Get started quickly with AudioPod AI's official SDKs for Python and Node.js - [Python SDK](https://docs.audiopod.ai/sdks/python.md): Official Python SDK for AudioPod AI - Professional Audio Processing powered by AI - [Node.js SDK](https://docs.audiopod.ai/sdks/nodejs.md): Official Node.js SDK for AudioPod AI - Professional Audio Processing powered by AI - [CLI](https://docs.audiopod.ai/sdks/cli.md): Generate music, voiceover, transcribe, separate stems, and clone voices from your terminal. - [MCP Server](https://docs.audiopod.ai/sdks/mcp.md): Connect any agent to AudioPod via Model Context Protocol — music generation, TTS, voice cloning, transcription, and more from one endpoint. - [OpenAI Compatibility](https://docs.audiopod.ai/api-reference/openai-compatibility.md): Point your existing OpenAI audio code at AudioPod by changing only the base URL and API key. Drop-in /v1/audio/speech, /v1/audio/transcriptions and /v1/audio/translations. - [Audiobook](https://docs.audiopod.ai/api-reference/audiobook.md): Turn a manuscript into a finished, ACX-compliant audiobook through a fully automated API: create a project, upload a PDF or EPUB, narrate it, and download a retail-ready package — with completion webhooks for hands-off, backlog-scale production. - [Podcast](https://docs.audiopod.ai/api-reference/podcast.md): Generate multi-speaker podcast episodes from your source material — outline, transcript, and narrated audio — then publish a public RSS feed. - [Stem Separation](https://docs.audiopod.ai/api-reference/stem-splitter.md): Extract individual audio components from mixed recordings using AI-powered audio source separation. - [Audio to MIDI](https://docs.audiopod.ai/api-reference/audio-to-midi.md): Convert audio — or stems you already separated — into MIDI using AudioPod's audio-to-MIDI engine. - [Noise Reduction](https://docs.audiopod.ai/api-reference/noise-reduction.md): Remove background noise, enhance audio quality, and clean up recordings using AudioPod AI's advanced noise reduction technology. - [Speaker Extraction](https://docs.audiopod.ai/api-reference/speaker-separation.md): Extract individual speakers from multi-speaker audio recordings into separate, clean audio files using advanced AI-powered speaker separation technology. - [Speech-to-Text](https://docs.audiopod.ai/api-reference/speech-to-text.md): Convert audio and video to accurate text transcriptions with speaker identification, timestamps, and multi-language support. - [Live Transcription (Streaming)](https://docs.audiopod.ai/api-reference/live-transcription.md): Real-time speech-to-text over a WebSocket — stream microphone or system audio and receive interim and final transcripts with sub-second latency. - [Text to Speech](https://docs.audiopod.ai/api-reference/text-to-speech.md): Generate natural-sounding speech from text using AudioPod AI's unified voice generation technology with support for custom and standard voices. - [Audio Reader](https://docs.audiopod.ai/api-reference/reader.md): Turn any article, blog post, or pasted text into natural-sounding narrated audio — from a URL or raw content — and share it with a public link. - [Voice Management](https://docs.audiopod.ai/api-reference/voice-management.md): Manage custom voices, browse available voices, and control voice collections using AudioPod AI's Voice Management API. - [Voice Changer](https://docs.audiopod.ai/api-reference/voice-changer.md): Transform voice characteristics in audio recordings using AudioPod AI's advanced voice-to-voice conversion technology. - [AudioMusic V2](https://docs.audiopod.ai/api-reference/music/overview.md): Generate original music, instrumentals, covers, and audio transformations using AudioPod AI's AudioMusic V2 engine. - [Music Generation](https://docs.audiopod.ai/api-reference/music/generation.md): Generate songs, instrumentals, rap, vocals, samples, and more using AudioMusic V2 endpoints. - [Audio Tools](https://docs.audiopod.ai/api-reference/music/audio-tools.md): Cover generation, reference audio, audio analysis, stem extraction, and music editing with AudioMusic V2. - [Job Management](https://docs.audiopod.ai/api-reference/music/jobs.md): Query, filter, manage, and retry music generation jobs. - [Media Extraction](https://docs.audiopod.ai/api-reference/media-extraction.md): Extract audio and video from online platforms including YouTube, TikTok, Instagram, and more using AudioPod AI's media extraction service. - [Authentication API](https://docs.audiopod.ai/api-reference/auth.md): Register, login, and manage API keys programmatically - [Account API](https://docs.audiopod.ai/api-reference/account.md): Manage your AudioPod AI account and profile ## Optional - [AudioPod AI](https://www.audiopod.ai) - [Support](mailto:support@audiopod.ai)