同意優先的設計
為你擁有、或握有書面許可建模的聲音而生。你自己的聲音是最典型的用法,而冒充他人是一條紅線,不是一個功能。
用你自己的聲音訓練私人模型——同意永遠是第一步——然後唱出你所有的點子。
請錄製至少 15 秒的歌聲(最長 30 秒),或上傳音訊檔案。沒有背景音樂的清晰人聲效果最好。
登入以查看您的克隆聲音。
一個聲音,唱很多首歌
把你有明確許可使用的聲音錄音——通常是你自己的——變成一個能隨時演唱新作品的私人模型。
訓練萃取的是讓一個聲音可被辨認的特質——音色、母音色彩、轉音習慣——裝進一個能把它們套用到新旋律與新歌詞上的模型。它不是把錄音重播一遍,而是把一個聲音的性格,變成可演出的能力。
模型保持在你的帳號內私有,並在整個工作區通用:在翻唱裡選它上場、拿它寫主旋律,讓相隔數月寫的作品仍保有一致的聲音。它的威力,正是它的使用權只屬於你的原因。

聲音模型是一件用「人」做成的樂器。用得對,它讓音樂人不必進錄音室一百次就能唱一百支 demo、跨專案維持一致的聲音辨識度、用還在學的語言演唱。用得錯,它就是未經詢問就拿走別人的身分——所以在這裡,「同意」不是一個勾選框,而是整個功能站立的地基。
技術面很直白:模型學的就是你餵的。一致、乾淨、無伴奏的單一聲音錄音,訓練出能抓住其特質的複製;混著音樂串音的髒樣本,訓練出一團模糊的平均值。把力氣預算花在錄音階段,訓練會加倍奉還。
為你擁有、或握有書面許可建模的聲音而生。你自己的聲音是最典型的用法,而冒充他人是一條紅線,不是一個功能。
訓練管線獎勵乾淨一致的樣本,回報一個留得住聲音指紋的模型——它的色彩、它的起音、它離開一個音的方式。
訓練好的模型住在你的帳號裡,接進翻唱與生成工具,把一次錄音變成一件耐用的創作資產。

三個階段:取得許可地蒐集、有紀律地錄音、多樣化地驗證。一個都不能省。
你自己的聲音——直接開始。任何其他人的——取得書面、知情、涵蓋模型用途的許可,並留存下來。這是第一步,不是沒有原因的。
安靜的房間、穩定的麥克風距離、自然的唱法、涵蓋多種樂句。只收乾聲——底下不要有音樂,效果也不要先烤進去。
讓複製唱它沒聽過的樂句和音域。它在哪裡站不穩,就告訴你下一輪訓練該補哪些樣本。
不必為每個點子預約自己進棚,就能用自己的聲音 demo 新歌,並讓整個作品目錄的聲音辨識度保持連貫。
把你的聲音錄一次;用你還在精進的語言發行,發音交給模型,聲音的主人仍然是你。
工作室與故事型頻道讓角色的歌聲跨集數、跨年份保持一致——在聲音主人持續同意的前提下。
名人的聲音、朋友的聲音、前團員的聲音——沒有明確許可就通通不行。許可終止時,讓模型退役。
十分鐘均勻乾淨的錄音,勝過一小時品質混雜的碎片。一支麥克風、一個房間、一種聲音狀態。
平台與合作者對合成人聲的透明度要求越來越高。事先說明不花一毛錢;事後被發現,賠上的是信任。
可以——這正是整個功能的重心。錄下自己乾淨的樣本、訓練模型,你的聲音就隨時供翻唱和生成工具調用。
品質遠比時長重要:幾分鐘乾淨、多樣又一致的演唱,勝過幾小時的粗糙素材。涵蓋不同音高和樂句形狀,模型才學得到這個聲音的完整行為。
模型對你的帳號私有。要不要分享由你決定——而如果你是別人專案裡的那個聲音,在訓練開始前就把條款白紙黑字寫下來。
讓模型退役,停止發布用它做的新作品。在被撤回的聲音上繼續蓋東西不只是倫理問題——在越來越多地方,它也是法律問題。
錄一次、練得對,此後唱出你所有的點子——不是你自己的聲音,就先拿到許可。
開始聲音複製