Nexdata ヒンディー語の番組・配信口語音声|Datatang株式会社(Nexdata)
ヒンディー語の番組・配信口語音声を収録し、ヒンディー語の自然発話認識に利用するAI学習用データセット。
データ仕様・収録内容:インタビュー・トークショー・バラエティ番組などのヒンディー語を1,003時間収録。実際の発話を対象とする学習用商品。/確認 2026-09-15/https://nexdata.jp/datasets/speechrecog/1269
データ仕様・形式・注釈:16kHz・16bitのモノラルWAV。発話テキスト、文の時刻、話者IDなどの注釈を案内。/確認 2026-09-15/https://nexdata.jp/datasets/speechrecog/1269
対象:ヒンディー語の自然発話認識に取り組むAI開発・データ調達担当。形式:AI学習用データセット。言語:日本語の公式商品説明を確認。収録言語・注釈言語は商品仕様による。。利用条件:公式商品ページから仕様・サンプル・見積もりを相談。納品範囲と利用許諾は個別条件を確認。
確認事項(編集部):収録元の番組・配信に関する権利、話者・内容の利用許諾を契約資料で確認する。同じ番組や話者が学習・評価の両方へ入らないよう分離する。
出典:Nexdata「1003時間分のヒンディー語音声データ_口語形式」/公開・更新日:ページで特定せず/確認日:2026-09-15/https://nexdata.jp/datasets/speechrecog/1269
株式会社世良(Sera, Inc.)/ お問い合わせ: info@sera-inc.co.jp