メインコンテンツへスキップ
無限のワンショットを生成するオーディオモデルをトレーニングし、テキストプロンプトを完全に演奏可能なシンセに変換。モデルだけでなく、その方法(およびテキストベースシンセを作成するための推論パイプライン)に関するビデオも公開。 — Cernoval