गाइड
नॉलेज बेस (RAG)
दस्तावेज़ अपलोड करें, embeddings बनाएं, और AI को आपकी वास्तविक सामग्री उद्धृत करने दें।
नॉलेज बेस फीचर आपके AI एजेंट को आपके वास्तविक दस्तावेज़ों का उपयोग करके सवालों के जवाब देने देता है, जैसे रिलीज़ नोट्स, सहायता लेख, नीतियां, कुछ भी जो टेक्स्ट-आधारित हो।
समर्थित प्रारूप
- Markdown, सादा टेक्स्ट
- Word (.docx) · CSV
- JSON (टेक्स्ट के रूप में निकाला गया)
अपलोड प्रवाह
- नॉलेज → दस्तावेज़ अपलोड करें पर जाएं
- एक फ़ाइल चुनें (अधिकतम 25 MB)। यह presigned POST के माध्यम से सीधे S3 पर अपलोड होती है
- worker इस काम को उठाता है: टेक्स्ट निकालता है → लगभग 800 tokens पर chunks में बांटता है → इसके साथ embeddings बनाता है OpenAI
text-embedding-3-small→ pgvector में संग्रहीत करता है - पूरा होने पर स्थिति
READYमें बदल जाती है
ट्रेनिंग सेंटर
एकल फ़ाइल को मैन्युअल रूप से अपलोड करना कई तरीकों में से केवल एक है। AI एजेंट → ट्रेनिंग सेंटर खोलें और नॉलेज बेस को कई तरीकों से भरें:
- वेबसाइट क्रॉल करें: एक URL दें, यह पेज लाता है, टेक्स्ट निकालता है, और उन्हें अपलोड की गई फ़ाइल की तरह शामिल करता है
- फ़ाइलों की बल्क अपलोड: PDF, Word (.docx) और अन्य टेक्स्ट दस्तावेज़ जोड़ें, जो स्वचालित रूप से पार्स और chunks में विभाजित होते हैं
- प्रश्न-उत्तर जोड़े: उन्हें हाथ से टाइप करें या CSV से एक साथ कई आयात करें
- Playground: एक सैंडबॉक्स चैट जहां आप लाइव होने से पहले अपने नॉलेज बेस के साथ एजेंट को आज़मा सकते हैं
पुनर्प्राप्ति कैसे काम करती है
प्रत्येक विज़िटर संदेश पर, worker क्वेरी के embeddings बनाता है और आपके टेनेंट के chunks पर कोसाइन-दूरी खोज चलाता है। Top-K (डिफ़ॉल्ट 5) chunks जो समानता सीमा पार करते हैं सिस्टम प्रॉम्प्ट में इनलाइन कर दिए जाते हैं।
प्लेटफ़ॉर्म-होस्टेड AI, या आपके अपने embeddings
डिफ़ॉल्ट रूप से प्लेटफ़ॉर्म आपके लिए AI होस्ट करता है, अपनी कुंजी की ज़रूरत नहीं: embeddings और जवाब प्रबंधित कुंजियों पर चलते हैं, वास्तविक token उपयोग के अनुसार बिल होते हैं, क्रेडिट से स्वचालित रूप से टॉप-अप होते हैं, और बैलेंस कम होने पर मानव एजेंट को सौंप दिए जाते हैं। यदि आप स्वयं होस्ट करना चाहें तोAI एजेंट → Embeddings में आप एक कस्टम embedding API endpoint सेट कर सकते हैं, यह उपयोगी है यदि आप Azure OpenAI, एक स्थानीय Ollama, या DuckLLM का उपयोग करना चाहते हैं। चैट कम्प्लीशन endpoint, embedding endpoint से अलग हो सकता है, क्योंकि एग्रीगेटर सेवाएं अक्सर embeddings का समर्थन नहीं करतीं।
कैशिंग
समान क्वेरी टेक्स्ट 24-घंटे की Redis कैश से टकराता है, इसलिए वही FAQ हर विज़िट पर embeddings दोबारा नहीं बनाता। Anthropic प्रॉम्प्ट कैशिंग सिस्टम प्रॉम्प्ट + पुनर्प्राप्त chunks पर लागू होती है ताकि लागत में और बचत हो।
RAG को कब छोड़ें
RAG enabled को बंद कर दें यदि आपका AI एजेंट केवल एक सामान्य बातचीत / लीड योग्यता बॉट है जिसे दस्तावेज़ों का हवाला देने की आवश्यकता नहीं है।