社内文書のAI検索(RAG)とは?
社内文書のAI検索(RAG)とは、社内文書をAIに答えさせたいという状態を、仕組みで解消することです。QuicKBは、この用途に使えるオープンソースのひとつです。文書検索に用いる知識ベースをファインチューニングによって最適化する開発者向けツールです
- 社内文書を対象とするRAGの検索精度改善
- 特定の知識ベースに合わせた埋め込みモデルのファインチューニング
- 文書検索モデルの学習に用いる合成データセットの生成
- Sentence Transformersを利用した検索処理の最適化検討程序
- 問い合わせ対応や社内検索システムに組み込む検索基盤の開発
QuicKBを使うと何が変わるのか
QuicKBは、検索拡張生成(RAG)などで利用する文書検索の改善を目的としたPython製の開発ツールです。埋め込みモデルやSentence Transformersを扱い、合成データセットの生成とファインチューニングを通じて、知識ベースから関連文書を取り出す仕組みの最適化に活用できます。業務担当者が単体で利用する完成済みの業務アプリではなく、開発者が文書検索システムやRAGを構築・改善する際に使う位置付けです。
すでに世界で使われている完成品を土台にするので、同じものをゼロから作るより短い期間で済みます。当社は、この土台に対して日本語化、画面や項目の変更、権限、帳票、既存システムとの連携を加えて、御社の業務に合う状態にします。
QuicKBの日本語対応(実測)
QuicKBには日本語のファイルがありません。日本語化から始める必要があります。
| ライセンス | MIT |
|---|---|
| 主な言語 | Python |
| GitHubスター | 186 |
| 日本語ロケール | 日本語ファイルなし(0ファイル) |
GitHubの公開ファイル一覧から日本語ロケールの実ファイルを数えた結果です。配布用のビルド成果物は除いています。技術的な詳細はQuicKBのOSS情報にまとめています。
進め方は?
進め方とは、現場を見て対象を決め、動くものを見ていただきながら作り、御社の環境へ導入するまでの流れのことです。書類で仕様を固めてから作る進め方はしません。
1日目(無料)
現場に伺い、いまのやり方を見せていただきます。社内文書のAI検索(RAG)のどこから手を付けるかを決めます。
2〜4日目
QuicKBを土台に、御社のPCで目の前で開発します。動くものを見ながらその場で直します。
5日目
御社の環境へ導入し、ソースコードと開発ノウハウをお渡しします。以後は自社で改造できます。
その後
追加の作り込みが必要なら、範囲を決めてあらためてお見積もりします。延長を前提にした進め方はしません。
この方法が向かないのは?
向かないのは、基幹システムの全面刷新や、複数部門にまたがる大規模な仕組みのことです。15時間という枠では作り切れません。また、決まった手順を正確に繰り返すだけの処理は、AIを使わないほうが速く確実です。当社ではその部分は普通のプログラムとして作ります。
社内文書のAI検索(RAG)を、まず15時間で試す
名古屋市内なら、1日3時間×5日間の計15時間・税別15万円で試せます。初日3時間のヒアリングと提案は無料です。御社のPCと御社名義のAIエージェントで目の前で開発するので、作り方ごと社内に残ります。成果物とソースコードはお客様のものです。
AI導入お試し実験を見る 動くデモを先に見る(110,000円〜) QuicKBについて相談する社内文書のAI検索(RAG)に使える他のオープンソース
同じ用途に使える土台は他にもあります。ライセンス、日本語対応、規模を比べて選べます。
| 名前 | できること | 日本語 | デモ |
|---|---|---|---|
| KnowledgeBase-RAG-LLM-System | StreamlitとLangChainを用いた軽量なRAG学習プロジェクトです。 | 日本語ファイルなし | — |
| vector-graph-rag | ベクトル検索のみでGraph RAGを構成し、複数段階の推論を伴う質問応答を支援する開発ツールです | 日本語ファイルなし | — |
| dify | AIエージェントやRAGパイプラインを構築するための統合開発プラットフォームです。 | 未調査 | — |
| WeKnora | 生の文書を検索可能なRAGや自律型エージェントに変換するLLM知識プラットフォームです。 | 未調査 | — |
| Yuxi | RAGや知識グラフ、マルチエージェント機能を備えたセルフホスト型の知能エージェントプラットフォームです。 | 日本語ファイルなし | — |