マニュアル
RAG対象となるデータです。
検索エンジンの内容となるデータを作成、参照、検索することができます。
メニューから データセット を選択するとデータセットの一覧を確認できます。
※ データセットの上限数は、プランによって異なります。

+データセットを作成 をクリックします。
データ追加するには、ドキュメントを含む zip ファイルまたは単一ファイルを用意します。
サポートしているファイル形式は、PDF / PPT / Excel / Wordとなります。
※ zip ファイルの中身にフォルダが含まれている場合でも、構造化処理は可能です。各ファイルが格納されているフォルダは以下にてご確認いただけます。

※100〜150ページを超えるドキュメント/ファイルの処理は、タイムアウトが発生する可能性があります。タイムアウトした場合は自動で再実行しますが、頻発する場合にはドキュメント/ファイルを分割するなどの対応もご検討ください
zipファイルの中身の例

ご契約プランによって処理できる総ページ数やデータセット数が異なりますのでご注意ください。
詳しくは担当までお問い合わせください。
ファイルを構造化
構造化済みデータのアップロード
PDFバックエンドおよび図表の説明抽出モデルの推奨は以下となります。

データセットを作成ボタンをクリックしてデータをアップロードし、データセットを作成します。
データは順次処理されますので、処理が完了するまでお待ちください。
<aside> 💡
エラーが頻発する場合や、ステータスが progress や処理中から長時間 変化しない場合は、お手数ですが担当までご連絡ください。
</aside>
検索するには、画面上部の入力エリアを使います。
ファイル名やコンテンツ(ページや要素)で絞り込むことができます。

データ追加するには、ドキュメントを含む zip ファイルを用意します。
サポートしているファイル形式は、PDF / PPT / Excel / Wordとなります。
※ zip ファイルの中身にフォルダが含まれている場合でも、構造化処理は可能です。


アップロードされたファイルは自動的にデータセットに取り込まれます。
データセットの中身をプレビューできます。
各行の[プレビュー]からチャンクの該当箇所をプレビューできます。


左側に該当ページ/要素のプレビューと、対応するチャンクのbounding box が表示されます。
右側にはチャンクのレコードの内容がjsonで確認できます。
| --- | --- |
修正するチャンクの[プレビュー]をクリックし、プレビューを表示します。
プレビューが表示された状態で、修正する枠をダブルクリックすることで、修正・編集可能となります。
修正・編集が完了したら、Enterで保存することができます。
修正・編集できる枠は、以下となります。