New model category

AI Music and Audio Model Catalog

Browse music and audio generation models such as Suno, Udio, Stable Audio, ElevenLabs, MiniMax Audio and Seed Audio. Track duration, vocals, instrumentals, stems, voice cloning, commercial rights and API availability.

What makes music models different

Music models are priced in songs, minutes, credits or subscription allowances, not text tokens.

Text-to-Music

Generate songs from prompts. Track vocals, style control, lyrics, song length and commercial rights.

SongVocalsLyrics

Audio Generation

Generate sound effects, background music, voiceover and audio clips. Track duration, formats and API access.

SFXBGMAPI

Voice / Stems

Voice cloning, stem export, editing and remix ability determine professional workflow value.

VoiceStemsEditing

Priority products

4

Catalog tracker

Each model row tracks modalities, access paths, pricing unit, price confidence, official sources and last verification date.

9
Product
Modalities / Source
Suno
Suno
music generationvocals
text, audio โ†’ music, audio
Verified: 2026-09-15
Udio
Udio
music generationextend
text, audio โ†’ music, audio
Verified: 2026-09-15
ElevenLabs Music
ElevenLabs
musicvoice
text, audio โ†’ music, audio
Verified: 2026-09-15
Stable Audio
Stability AI
musicsound effects
text, audio โ†’ music, audio
Verified: 2026-09-15
MiniMax Audio
MiniMax
speechvoice
text, audio โ†’ audio
Verified: 2026-09-15
Seed Audio
ByteDance
audio generationspeech
text, audio โ†’ audio, music
Verified: 2026-09-15
Google MusicFX / Lyria
Google DeepMind
music generationresearch
text โ†’ music, audio
Verified: 2026-09-15
Mureka
Mureka
music generationvocals
text, audio โ†’ music, audio
Verified: 2026-09-15
Meta MusicGen
Meta
music generationopen weights
text, audio โ†’ music, audio
Verified: 2026-09-15

Fields to track

Pricing unit: song / minute / credit
Max song length
Vocals and instrumental support
Lyrics and style control
Stem export and voice cloning
Commercial rights and copyright limits

Why this is its own category

Music buyers care about publishable songs, rights, stems and audio duration. Text-model benchmarks and token prices do not answer that purchase question.