Nexdata 日本語の児童口語音声

Nexdata 日本語の児童口語音声|Datatang株式会社(Nexdata)

日本語の児童口語音声を収録し、児童の日本語音声認識に利用するAI学習用データセット。

データ仕様・収録内容:12歳以下の児童による会話、バラエティ、ゲームなどの日本語音声を96時間収録。既存の教材朗読商品とは収録内容が異なる。/確認 2026-09-15/https://nexdata.jp/datasets/speechrecog/1328

データ仕様・形式・注釈:16kHz・16bitのモノラルWAV。文字起こし、文の時刻、話者ID、性別、雑音の注釈を案内。/確認 2026-09-15/https://nexdata.jp/datasets/speechrecog/1328

対象:児童の日本語音声認識に取り組むAI開発・データ調達担当。形式:AI学習用データセット。言語:日本語の公式商品説明を確認。収録言語・注釈言語は商品仕様による。。利用条件:公式商品ページから仕様・サンプル・見積もりを相談。納品範囲と利用許諾は個別条件を確認。

確認事項(編集部):児童・保護者の同意範囲、配信等の収録元に関する権利、利用可能な学習目的を契約資料で確認する。話者が評価用データと重複しないよう分離する。

出典:Nexdata「96時間日本日本語子供音声データセット」/公開・更新日:ページで特定せず/確認日:2026-09-15/https://nexdata.jp/datasets/speechrecog/1328

関連ページ


株式会社世良(Sera, Inc.)/ お問い合わせ: info@sera-inc.co.jp