基礎知識

AI エージェントのための知識ベースとは?

エージェントが答えてよい文書。agent4.io は二種類を保つ——あなたの会社の検証済み資料と、各顧客自身のファイル——同時に検索されるが、決して互いに混同されない。

別の呼び方KBRAG検索拡張生成文書ストア

知識ベースは、エージェントを汎用ではなくあなたのものにするものです。「それはどこから来たのか」への答えであり——答えがそこにないなら、エージェントはそう言うべきです。

knowledge base
QuestionAnswerYour documents
The answer is grounded in the matching passages from your own documents.

一つではなく、二つの知識ベース

たいていのプラットフォームは一つの文書の山を与えます。FAQ に答えるサポートボットにはそれで十分ですが、現実のビジネスには遠く及びません。顧客が実際に尋ねる二つの質問が、種類として異なるからです。

「あなたの条件は何で、私は対象になりますか?」——それはあなたの資料です。料金表、適格性ルール、現行規制、製品シート。尋ねる誰にとっても同じで、あなたが検証しており、権威あるものです。

「これが私の卒業証書と在職証明書です——それで私はどうなりますか?」——それは彼らの資料です。一人の顧客に属し、しばしばデリケートで、他の誰にとっても意味を持ちません。

agent4.io はこれらを、意図的に実装を共有しない二つの別々のシステムとして保ちます。

テナントの知識ベース顧客の知識ベース
所有者あなた、ビジネス一人のエンド顧客
内容規制、価格、方針、製品条件彼らの文書、証明書、やり取り
隔離API でテナント単位にフィルターデータベースで、顧客とスペースごとに強制
保存時暗号化なし——それはあなたの公開済み資料その顧客自身の鍵で暗号化
整備者あなたの管理者、公開前にレビュー顧客が進めながらアップロード

なぜ現実の答えには両方が同時に必要か

移民の問い合わせを取り上げます。「私はこのルートの給与要件を満たしますか?」

要件はあなたのテナント知識ベースにあります——あなたの事務所が検証した現行ルール。彼らの給与は彼ら自身のものにあります——先週アップロードした在職証明書。どちらの半分も質問に答えません。あなたの文書だけを持つエージェントはルールを暗唱し、それから顧客に比較させます。彼らの文書だけを持つエージェントは彼らの給与を知りますが、それが超えるべきものについては何も知りません。

両方が同じ質問で検索され、答えはその比較です。

両者が混同されるのを止める部分

検索された一節は一つのバケツに注がれるのではありません。各情報源は、独自の枠付けを持つ独自のブロックとして届きます。

  • あなたの資料は権威あるもの——従うべきものとして導入され、各知識ベースは、あなたが書いたモデルへの独自の指示を携えます。規制ベースはこう言えます:これは検証済みの現行ルールである。これから答え、事前知識に頼らず、ここで扱われていないなら、そう言うこと。
  • 顧客の資料は参照用として導入されます——彼らのもの、有用だが、方針の源ではない。

その区別が、「あなたの事務所の料金は X です」と「顧客は料金が X だと信じている、アップロードした文書にそう書いてあるから」の違いです。それらを区別できないエージェントは、いつか顧客に、彼ら自身の間違いをあなたの方針として引用し返すことになります。

関連する一節のない知識ベースは、何も寄与しません——ヘッダーさえも。関連性はモデルが何かを見る前にベクトル距離で決められるので、無関係なベースがそこに座ってその注意を消費することはありません。

知識ベースごとに厳格さを調整する

各知識ベースは独自の関連性の下限を持ちます。適切な慎重さの水準はどこでも同じではないからです。規制ベースは厳格であるべきです——下限を下回れば、何も返さず「それは持ち合わせていません」と答えるのが正しく、別のルートについての惜しいだけの段落よりはるかに優れています。一般 FAQ はもっと緩くてよく、そこでは大まかに関連する答えでも役に立ちます。

知識ベースは学習セットではありません。アップロードするものはモデルを変えません。それは、モデルが答える瞬間に何を読んでよいかを変えます。だからこそ文書を訂正すれば、あらゆる将来の答えが即座に訂正されます——再学習も、再デプロイもなし。

よくある質問

エージェントが役に立つまでに、どれくらいの量の資料が必要ですか?
多くの人が思うより少なくて済みます。顧客が実際に尋ねることに答える数ページ——料金の考え方、サービス範囲、手順、よくある反論——のほうが、文書アーカイブ丸ごとより良い結果を出します。検索は最も大きいファイルではなく、その質問に答える一節を見つけるからです。
文書同士が矛盾していたり、古くなっていたりしたらどうなりますか?
エージェントは検索して取り出したものから答えるため、古い文書は古い答えを生みます。知識ベースを正しく保つのは、あなたが担う整備作業です。置き換えられた文書は、新しいものを横に並べるのではなく差し替えてください。答えがおかしいときは、エージェントが何を引用したかを確認してください。
文書を作り直す必要がありますか?
ありません。ファイルは自動的に取り込まれ、検索用に分割されます。PDF やスキャンされたページも対象で、テキスト層がない場合は画像として読み取られます。短く、質問の形に沿った節を書くと検索の助けになりますが、それは改善であって前提条件ではありません。
顧客ごとに見える知識を変えられますか?
できます。知識はエージェントに紐づき、各エンド顧客自身のアップロードと履歴は、その人自身のスペースに保たれます。ある顧客の文書が別の顧客に見えることはありません。
中の仕組みも知りたいですか?検索と引用の詳細