Docspellと同じ用途で使える、当社の製品
OSSを自分で立てて日本語化する代わりに、日本語で作った当社の製品を自社のサーバーに置く方法もあります。ソースコード付きで、月額はかかりません。
Docspellとは?
Docspellとは、スキャンした書類・メール添付・PDFを自動で取り込み、OCRと全文検索で整理する書類管理OSS。メールボックスの定期取り込みと、複数担当者で書庫を共有する設計が特徴です。OCR・書類の読み取りの用途に使えるオープンソースで、ソースコードが公開されているため自社のサーバーに置いて動かせます。ソフト自体の費用はかかりません。
GitHubでの公開は2019年7月、主な開発言語はElm、GitHubスターは2,306、最終更新は2026年8月です(当社がGitHubの公開情報から確認した値、2026年10月08日時点)。
Docspellの日本語対応は当社が実際に立てて確かめました。本家は英独仏のみで日本語なし。当社が1,056語を訳しElm 158モジュールにjaを生成、ビルド検証済み。docspell-jp(github.com/katsushi2441/docspell-jp)で公開・本家へPR提案中。
OCR・書類の読み取りとは?
OCR・書類の読み取りとは、紙やPDFの入力を手でやっているという状態を、仕組みで解消することです。Docspellは、この用途に使えるオープンソースのひとつです。
- 請求書・契約書のスキャン管理
- メール添付の請求書を自動取り込み
- OCR+全文検索で書類を探す
Docspellを使うと何が変わるのか
DocspellはElm+Scala製の書類管理OSS(AGPL-3.0・GitHubスター約2,300)。スキャナ・監視フォルダ・メール(IMAP)から書類を自動取り込みし、OCR(日本語可)と全文検索(Solr)、取引先・日付・タグ・カスタム項目の自動推定、期限通知、共有リンクを備えます。docker compose(公式 docspell/docker)で本体・処理役・PostgreSQL・Solr・監視フォルダの5コンテナ。UI言語は英独仏のみで日本語がありませんでしたが、当社が画面の1,056語を訳し、Elmの159ファイルに日本語定義を自動生成して本家と同じビルドで型検査を通し、日本語UIを実装しました(本家へPR提案・翻訳データと生成スクリプトは docspell-jp で公開)。導入・日本語UI・メール取り込み設計までを実録記事にまとめています: https://katsushi2441.github.io/vwork/articles/2026-09-04-docspell-japanese-guide.html
すでに世界で使われている完成品を土台にするので、同じものをゼロから作るより短い期間で済みます。当社は、この土台に対して日本語化、画面や項目の変更、権限、帳票、既存システムとの連携を加えて、御社の業務に合う状態にします。
Docspellの日本語対応(実測)
Docspellの日本語対応は当社が実際に立てて確かめました。本家は英独仏のみで日本語なし。当社が1,056語を訳しElm 158モジュールにjaを生成、ビルド検証済み。docspell-jp(github.com/katsushi2441/docspell-jp)で公開・本家へPR提案中。
| ライセンス | AGPL-3.0 |
|---|---|
| 主な言語 | Elm |
| GitHubスター | 2,306 |
| 日本語ロケール | 本家は英独仏のみで日本語なし。当社が1,056語を訳しElm 158モジュールにjaを生成、ビルド検証済み。docspell-jp(github.com/katsushi2441/docspell-jp)で公開・本家へPR提案中。(0ファイル) |
| 公開開始 | 2019年7月 |
| 最終更新 | 2026年8月 |
GitHubの公開ファイル一覧から日本語ロケールの実ファイルを数えた結果です。配布用のビルド成果物は除いています。技術的な詳細はDocspellのOSS情報にまとめています。
Docspellを自分で入れるなら(導入キット)
当社が実際に立てて詰まった箇所まで含めた手順書・設計テンプレート・docker構成・バックアップスクリプトの一式です。開発を依頼せず自社で立てたい場合の早道です。税込5,500円(オンプレミス)。
進め方は?
進め方とは、現場を見て対象を決め、動くものを見ていただきながら作り、御社の環境へ導入するまでの流れのことです。書類で仕様を固めてから作る進め方はしません。
1日目(無料)
現場に伺い、いまのやり方を見せていただきます。OCR・書類の読み取りのどこから手を付けるかを決めます。
2〜4日目
Docspellを土台に、御社のPCで目の前で開発します。動くものを見ながらその場で直します。
5日目
御社の環境へ導入し、ソースコードと開発ノウハウをお渡しします。以後は自社で改造できます。
その後
追加の作り込みが必要なら、範囲を決めてあらためてお見積もりします。延長を前提にした進め方はしません。
この方法が向かないのは?
向かないのは、基幹システムの全面刷新や、複数部門にまたがる大規模な仕組みのことです。15時間という枠では作り切れません。また、決まった手順を正確に繰り返すだけの処理は、AIを使わないほうが速く確実です。当社ではその部分は普通のプログラムとして作ります。
OCR・書類の読み取りを、まず15時間で試す
名古屋市内なら、1日3時間×5日間の計15時間・税別15万円で試せます。初日3時間のヒアリングと提案は無料です。御社のPCと御社名義のAIエージェントで目の前で開発するので、作り方ごと社内に残ります。成果物とソースコードはお客様のものです。
AI導入お試し実験を見る 動くデモを先に見る(110,000円〜) Docspellについて相談する開発会社・IT販売の方へ
Docspellの日本語化・改修・導入(バイブOSS)を、御社のお客様に販売できます。導入作業は当社が行い、販売手数料は1件9万円(税別)です。ソースコードは MIT ライセンスで、御社のブランドでの販売もできます。登録無料・ノルマなし。販売代理店の条件を見る
OCR・書類の読み取りに使える他のオープンソース
同じ用途に使える土台は他にもあります。ライセンス、日本語対応、規模を比べて選べます。
| 名前 | できること | 日本語 | デモ |
|---|---|---|---|
| PaddleOCR | 帳票や書類の画像・PDFから、文字と表を構造化データとして取り出すOCRの基盤。商用利用が自由なApache-2.0で、日本語を含む多言語に対応します。 | 日本語ファイルなし(読み取り対象として日本語に対応) | — |
| Tesseract | 長く使われているオープンソースのOCRエンジン。日本語を含む多言語に対応し、他の道具の内部でも広く使われています。商用可のApache-2.0です。 | 日本語ファイルなし(読み取り対象として日本語に対応) | — |
| papermerge | スキャンした書類をデジタルアーカイブ化するためのオープンソース文書管理システムです。 | 日本語ファイルなし | — |
| OCRmyPDF | OCRmyPDFの使いどころの案内。スキャンしたPDFに文字層を足して、検索・コピーできるPDFに変えます。日本語は言語データを足せば読めます。導入手順、ライセンス、大量の書類をまとめて処理する相談まで。 | 日本語ファイルなし(読み取り対象として日本語に対応) | — |
| YomiToku | 日本語の文書画像に特化したAI解析エンジン。手書き・縦書き・表の構造まで読み取れますが、ライセンスは非商用で、商用利用には別途の契約が必要です。 | 日本語で開発・提供(日本語文書に特化) | — |