DeepSeek-OCRを試す|shi3z
A100 で DeepSeek-OCR を動かし、長い画像、単一ページ、PDF の読み取りを試した著者の記録。Markdown 出力や画像領域の抽出を確認し、入力形式と実行経路による違いを報告している。
Hugging Face 版でファイル名と出力先を変更して実行。縦長画像では誤読や画像抽出の欠落が目立ち、ページを分けると改善したと記述する。続いて vLLM 版に PDF を渡した結果も紹介している。
学習・比較対象:縦長画像・単一ページ・PDF の入力/確認 2026-09-15/https://note.com/shi3zblog/n/n99bb0c642f1e
学習・実行調整:依存ライブラリ、入力パス、出力先の設定/確認 2026-09-15/https://note.com/shi3zblog/n/n99bb0c642f1e
対象:AIの開発・導入・活用を検討する担当者。形式:企業・著者による公開記事。言語:日本語(公開本文で確認)。利用条件:公開記事(本文をログインなしで確認)
確認事項(編集部):著者の文書での観察であり、文字正解率や長文理解性能を測定したものではない。出力には誤読があるため内容の照合が必要。
出典:shi3z「DeepSeek-OCRを試す」/公開・更新情報:2025-10-30/確認日:2026-09-15/https://note.com/shi3zblog/n/n99bb0c642f1e
株式会社世良(Sera, Inc.)/ お問い合わせ: info@sera-inc.co.jp