Nexdata マイク収録の日本語話者別自由会話音声|Datatang株式会社(Nexdata)
マイク収録の日本語話者別自由会話音声を収録し、リアルタイム日本語対話AI開発に利用するAI学習用データセット。
データ仕様・収録内容:静かな室内でコンデンサーマイクを使い、自由会話を話者ごとのファイルとして収録。同時発話や相槌を含む構成。/確認 2026-09-14/https://nexdata.jp/datasets/speechrecog/1971
データ仕様・形式・注釈:48kHz・32bitの非圧縮モノラルWAV。文字起こし、発話時刻、話者IDを提供。/確認 2026-09-14/https://nexdata.jp/datasets/speechrecog/1971
対象:リアルタイム日本語対話AI開発に取り組むAI開発・データ調達担当。形式:AI学習用データセット。言語:日本語の公式商品説明を確認。収録言語・注釈言語は商品仕様による。。利用条件:公式商品ページから仕様・サンプル・見積もりを相談。納品範囲と利用許諾は個別条件を確認。
確認事項(編集部):学習目的、収録条件、権利処理、第三者への提供可否、評価用データとの分離を導入前に確認する。
出典:Nexdata「48kHz・579時間高音質・話者分離日本語自然会話音声データセット」/公開・更新日:ページで特定せず/確認日:2026-09-14/https://nexdata.jp/datasets/speechrecog/1971
株式会社世良(Sera, Inc.)/ お問い合わせ: info@sera-inc.co.jp