Nexdata ヒンディー語のスマートフォン朗読|Datatang株式会社(Nexdata)
ヒンディー語のスマートフォン朗読を収録し、ヒンディー語音声認識に利用するAI学習用データセット。
データ仕様・収録内容:1,425人がヒンディー語の台本を読んだ音声を759時間収録。日常文・対話用文・家庭で使う指示・数字・ニュースなどを対象にする。/確認 2026-09-15/https://nexdata.jp/datasets/speechrecog/946
データ仕様・形式・注釈:16kHz・16bitの非圧縮モノラルWAVと文字起こしを案内。静かな室内でAndroid端末やiPhoneを使う収録。/確認 2026-09-15/https://nexdata.jp/datasets/speechrecog/946
対象:ヒンディー語音声認識に取り組むAI開発・データ調達担当。形式:AI学習用データセット。言語:日本語の公式商品説明を確認。収録言語・注釈言語は商品仕様による。。利用条件:公式商品ページから仕様・サンプル・見積もりを相談。納品範囲と利用許諾は個別条件を確認。
確認事項(編集部):同じ言語の小規模な旧商品も存在するため、導入時には納品版と既存保有データとの重複範囲を確認する。収録者・素材の権利と学習・評価の分離も確認する。
出典:Nexdata「759時間インドヒンディー語音声データ_音読(スマートフォン)」/公開・更新日:ページで特定せず/確認日:2026-09-15/https://nexdata.jp/datasets/speechrecog/946
株式会社世良(Sera, Inc.)/ お問い合わせ: info@sera-inc.co.jp