Qwen3-TTS-VC ・ Qwen3-TTS-VC-Realtime の音声クローンを試す|npaka
参照音声を登録し、Qwen の音声クローン API でファイル生成と逐次再生を試した実装記事。
著者が通常版と Realtime 版の Python スクリプトを作成し、音声の登録、識別子の保存、合成結果の取得までを掲載している。通常版は完成した WAV のダウンロード、Realtime 版は受信した PCM の再生と WAV 保存を扱う。
学習・通常版の合成:参照音声を登録した後、文章を指定して音声を生成し、ファイルとして取得する。/確認 2026-09-14/https://note.com/npaka/n/n98557f21b253
学習・逐次再生:WebSocket で届く音声片を PyAudio で再生し、同時に保存する例を示す。/確認 2026-09-14/https://note.com/npaka/n/n98557f21b253
学習・登録情報の再利用:モデル別の音声識別子をローカルファイルに保存し、登録を繰り返さない構成を示す。/確認 2026-09-14/https://note.com/npaka/n/n98557f21b253
対象:AIの開発・導入・活用を検討する担当者。形式:企業・著者による公開記事。言語:日本語(公開本文で確認)。利用条件:公開記事(本文をログインなしで確認)
確認事項(編集部):参照音声はクラウドへ送信する構成。本人の許可と送信条件を確認し、モデル別の登録や料金を元サービスで確かめる。ローカル識別子の削除はクラウド側の音声削除を意味しない。
出典:npaka「Qwen3-TTS-VC ・ Qwen3-TTS-VC-Realtime の音声クローンを試す」/公開・更新情報:2026-06-07/確認日:2026-09-14/https://note.com/npaka/n/n98557f21b253
株式会社世良(Sera, Inc.)/ お問い合わせ: info@sera-inc.co.jp