Nexdata 21言語の文書・看板・画面OCR画像

Nexdata 21言語の文書・看板・画面OCR画像|Datatang株式会社(Nexdata)

21言語の文書・看板・画面OCR画像を収録し、多言語OCR開発に利用するAI学習用データセット。

データ仕様・収録内容:日本語を含む21言語の文書、自然場面、電子画面を収録。書籍、レシート、看板、PC画面などを含む。/確認 2026-09-14/https://nexdata.jp/datasets/ocr/1862

データ仕様・形式・注釈:一般的な画像形式とJSON注釈。行・列の四辺形または多角形領域と文字転写を提供。/確認 2026-09-14/https://nexdata.jp/datasets/ocr/1862

対象:多言語OCR開発に取り組むAI開発・データ調達担当。形式:AI学習用データセット。言語:日本語の公式商品説明を確認。収録言語・注釈言語は商品仕様による。。利用条件:公式商品ページから仕様・サンプル・見積もりを相談。納品範囲と利用許諾は個別条件を確認。

確認事項(編集部):学習目的、収録条件、権利処理、第三者への提供可否、評価用データとの分離を導入前に確認する。

出典:Nexdata「21言語・50万枚 多言語OCR データセット(自然画像・文書画像・スクリーン)」/公開・更新日:ページで特定せず/確認日:2026-09-14/https://nexdata.jp/datasets/ocr/1862

関連ページ


株式会社世良(Sera, Inc.)/ お問い合わせ: info@sera-inc.co.jp