手書き帳票の番号をOCRで自動読み取り・Excel化するColabスクリプトの開発支援

予算
1万
3万
納品希望日
ご相談
募集期限
募集終了 締切日 2025年5月21日 /
掲載日 2025年5月14日
応募状況
応募人数 3
契約人数 1
閲覧数 144
用途・種類
作業自動化・効率化、その他
依頼工程
設計、テスト
用意してあるもの
開発環境
開発言語
Python

募集内容

募集内容
【 募集詳細 】 特定の帳票PDFから、手書きで記入された番号情報(数字)を読み取り、整列・抽出してExcelに出力するGoogle Colab上のPythonスクリプトの開発を依頼します。 現在、構想段階の処理フローと試作的なコードは一部ありますが、全体として機能するものではなく、根本的に設計・実装を見直す必要がある状態です。 AI-OCRや画像処理に習熟したエンジニアの方と一緒に構築を進めていきたいと考えています。 【 開発内容(想定) 】 ・スキャン済みのPDF帳票(複数ページ)をページごとに画像化 ・テンプレート画像と比較して、画像の位置ズレ・回転ズレを自動で補正 ・特定の領域に記入された 手書きのID番号(5~8桁)や1~2桁の数字 をOCRで読み取る処理 ・抽出した情報を表形式で整理し、Google Drive 上に Excel ファイルとして保存 ・領域レイアウトの再設計、読み取り精度の向上、エラー補完、画像デバッグ機能なども含めてご相談しながら進めたいです 【 現在の状況とお願い 】 ・OCRと画像整列処理については、EasyOCRやOpenCVなどのライブラリを用いて試行しています。 ・しかし現時点では、読み取り精度・整列精度ともに十分とは言えず、帳票構造に最適化された処理設計が必要と考えています。 ・そのため、現状のコードを参考にしつつ、処理フロー全体を根本から見直していただける方を募集しています。 ・処理環境としては Google Colab Pro(GPU使用可能) を使用しており、ライブラリの導入やリソース制限などの心配は少ない状態です。 ・現在は EasyOCR を用いて試行中ですが、必要に応じて他の無償OCRエンジン(例:PaddleOCR等)の活用も検討しています。 ※商用OCRサービスについては、従量課金制のものは予算の都合上、原則として利用できません。  買い切り型、または無償で利用可能なエンジンを前提に構築をお願いしたいと考えています。 【 重視するスキル・ご経験 】 ・Google Colab/Python での実装経験 ・OCR(特に手書き文字)や画像処理、帳票処理の開発経験 ・EasyOCR、OpenCV、pymupdf、pandas、openpyxl の活用経験 【 応募時のお願い 】 ・関連するご経験・実績、過去に関わったOCRや画像処理プロジェクトなどをご提示いただけると助かります ・Colab上での作業や、柔軟な仕様すり合わせに対応いただける方を歓迎します ご不明な点はお気軽にご質問ください。 応募をお待ちしております!
添付ファイル
参考URL
求めるスキル
特記事項

応募者一覧

応募者
応募日時
2025/05/15 08:35
2025/05/15 13:55
ARato_615
2025/05/15 22:25

募集内容についての質問

質問と回答の履歴

質問はまだありません。不明なことがあれば質問してみましょう。
募集終了
ブックマーク
予算
1万
3万
募集終了

募集者情報

Hir0shi13
5.0 (4)
1
発注件数
100%
発注率
100%
取引完了率
認証状況
本人確認
機密保持契約(NDA)

この募集内容に似ている仕事

予算
1万
3万
応募者数 8
募集期限 あと 1 日 (9月21日まで)
user
空 神
投稿日時:4時間前
予算
見積り希望
応募者数 72
募集期限 あと 3 日 (9月23日まで)
user
keiji1103
投稿日時:7時間前
予算
3万
5万
応募者数 129
募集期限 あと 1 日 (9月21日まで)
user
マンマンマーン
投稿日時:5日前
予算
5千
1万
応募者数 14
募集期限 あと 2 日 (9月22日まで)
user
らっきー777
投稿日時:7日前