
Bài hát hoàn chỉnh có vocals
Model viết, hòa âm và trình diễn trong một lần chạy — đúng thứ đa số người ta gọi là “AI music”.
Mô hình nhạc tốt nhất thay đổi vài tuần một lần, nên bị khóa vào một mô hình là một thế bất lợi. Đây là 28 các mô hình chúng tôi theo dõi — mỗi mô hình thực sự giỏi ở đâu, hụt ở đâu, và giấy phép của nó cho bạn làm gì với đầu ra.
Hai trong số các mô hình mở nổi tiếng nhất không thể dùng để làm thứ bạn đem bán. MusicGen dùng CC BY-NC — hạn chế gắn với đầu ra, nên tự host cũng không thay đổi gì — và Stable Audio Open phát hành theo một giấy phép cộng đồng không phải là quyền thương mại chung. Nhiều đội biết điều này quá muộn, sau khi đã xây dựng dựa trên chúng. ACE-Step và YuE dùng Apache 2.0, một tình huống khác hẳn. Giấy phép mô hình và nguồn gốc dữ liệu huấn luyện là hai chuyện riêng, và không điều nào ở đây là tư vấn pháp lý.

Thước đo giọng hát mà mọi mô hình bài hát khác đều bị đem ra so.
Weights: see page
Lời, giai điệu, phối khí và phần hát — tất cả trong một lượt.
Suno
Thước đo giọng hát mà mọi mô hình bài hát khác đều bị đem ra so.
Udio
Mô hình bài hát cho phép bạn tiếp tục chỉnh sửa sau lần tạo đầu tiên.
Google DeepMind
Mô hình bài hát của DeepMind, được phân phối qua Google thay vì bán trực tiếp.
ElevenLabs
Mẫu bài hát cho phép bạn định rõ cấu trúc trước khi nó viết.
MiniMax
Full song với chi phí mỗi lần generate chỉ bằng một phần nhỏ của gói premium.
MiniMax
Điều kiện hóa phong cách từ một clip tham chiếu thay vì mô tả bằng văn bản.
MiniMax
Model nháp — đủ nhanh và rẻ để bạn thử ý tưởng ngay tức thì.
Kunlun Tech
Tạo bài hát ưu tiên API với nhịp ra phiên bản nhanh bất thường.
Riffusion
Thí nghiệm spectrogram đã hóa thành một nền tảng bài hát.
Nhạc không vocals — beds, loops, textures và effects.
Mô hình có thể tải về để tự host. Điều khoản cấp phép khác nhau đáng kể.
ACE Studio & StepFun
Mô hình bài hát mở với giấy phép bạn thật sự có thể xây dựng doanh nghiệp trên đó.
Phép chiếu Nghệ thuật Đa phương thức
Mô hình mở thực sự hát đúng những gì bạn đưa cho nó.
ASLP Lab
Bài hát đủ độ dài, chỉ tốn một phần nhỏ thời gian thường lệ.
Stability AI
Mô hình mở với tập huấn luyện mà nó thực sự có thể nêu đích danh
Meta AI
Hum một ý tưởng và nhận bản phối — mô hình gốc có melody conditioning.
Meta AI
Mô hình nhanh của Meta — chất lượng tương đương mà không phải chờ tuần tự.
Tách một bản mix đã hoàn chỉnh thành các stems.
Công cụ cho người dùng và nhà sáng tạo xây trên các mô hình tạo sinh.
Musicfy
Một nền tảng chuyển đổi giọng hát chứ không phải trình tạo song.
Soundful
Các track theo template dành cho nhà sáng tạo muốn thứ dễ đoán, không phải gây bất ngờ.
Loudly
Tạo cộng với thư viện, dành cho lúc chỉ tạo thôi là thiếu.
Soundraw
Chỉnh bản phối theo từng đoạn thay vì tạo lại.
Boomy
Con đường ngắn nhất từ số 0 đến một track trên dịch vụ streaming.
Mubert
Nhạc liên tục, không lặp, được tạo để nhúng.
AIVA Technologies
Cái đưa cho bạn MIDI thay vì một file hoàn chỉnh.
LALAL.AI
Tách stem cho người không muốn cài đặt gì cả.
MusicGenerate được xây để định tuyến giữa nhiều mô hình thay vì đặt cược vào một cái. Danh mục phía trên là thứ chúng tôi theo dõi và đánh giá; mô hình nào đang được nối vào sản phẩm ở bất kỳ thời điểm nào là chuyện khác, và câu trả lời đổi theo nhịp của ngành. Các con số trên mỗi trang kèm ngày xác minh, vì benchmark trong mảng này cũ đi chỉ sau một quý.
Bên trong
So sánh theo cái chúng xuất ra, bạn điều khiển được đến đâu, và giấy phép cho phép gì.

Model viết, hòa âm và trình diễn trong một lần chạy — đúng thứ đa số người ta gọi là “AI music”.
1 / 5
Vì sao nó tồn tại
Chất lượng đầu ra thì nghe là biết. Điều khoản mới quyết định thật sự là bạn có được phát hành hay không.
Tạo nhạc miễn phíHai model có thể nghe giống hệt nhưng khác hẳn ở chỗ bạn có được xuất bản kết quả hay không. Đó là câu hỏi đầu tiên, không phải cuối cùng.
Một model có thể tải xuống vẫn có điều khoản phi thương mại. Tự host không làm thay đổi những gì giấy phép cho phép.
Mỗi mục đều ghi ngày kiểm tra thông tin, vì một trang trông có vẻ cập nhật mà không phải còn tệ hơn trang thừa nhận mình đã cũ.
Trang model mà không có mục giới hạn thì chỉ là tờ rơi. Giới hạn mới là phần người ta đi tìm.
Còn tùy việc. Suno dẫn đầu về độ chân thực của giọng hát, Udio về chỉnh sửa sau khi tạo, ElevenLabs về kiểm soát cấu trúc, Stable Audio về chất liệu instrumental và tự lưu trữ, còn AIVA về MIDI có thể chỉnh sửa.
Stable Audio Open, ACE-Step, YuE, MusicGen, MAGNeT và DiffRhythm đều phát hành open weights. Giấy phép của chúng khác nhau rõ rệt — ACE-Step và YuE theo Apache 2.0, còn các mô hình khác hạn chế triển khai thương mại.
Mô hình là hệ thống tạo ra âm thanh; nền tảng là sản phẩm bọc quanh nó. Suno và Udio là nền tảng với mô hình đóng; MusicGen là mô hình bạn có thể tự chạy.
Chỉ một số. Các mô hình Apache 2.0 cho phép thẳng thừng; vài giấy phép nghiên cứu thì không. Giấy phép áp cho weights và không nói gì về dữ liệu dùng huấn luyện, đó là một rủi ro khác.
Hiện Suno v5 đặt ra chuẩn mực — hơi thở, vibrato và nhấn nhá động đều được thể hiện thực sự chứ không chỉ xấp xỉ, và đó là lợi thế đơn lẻ rõ ràng nhất mà bất kỳ mô hình nào trong thư mục này có.
Mỗi mục có ngày xác minh lần cuối. Lĩnh vực này thay đổi rất nhanh, nên bất kỳ thông số nào quá vài tháng đều đáng kiểm tra lại với nhà cung cấp.