Menurut Beating, Seed Audio 1.0 milik ByteDance diluncurkan pada 22 Juli. Model ini memungkinkan pembuatan dialog, efek suara, dan audio ambient hanya dengan satu prompt, dengan presisi timing 100 ms. Model ini mendukung input teks dan audio referensi, dapat menghasilkan sekitar dua menit audio per generasi, serta memiliki kemampuan yang diperluas untuk menjaga konsistensi suara karakter di seluruh output.
Audio tersebut menunjukkan tingkat kegunaan lebih dari 90% dalam sebagian besar skenario, dengan Mean Opinion Score (MOS) melebihi 4 di sebagian besar bahasa yang didukung. Seed Audio 1.0 mendukung lebih dari 20 bahasa, termasuk transfer suara lintas-bahasa, serta kustomisasi nada. Model ini kini tersedia melalui pusat pengalaman Volcano Ark dengan integrasi API terbuka.