गार्डरेल्स
गार्डरेल्स
प्रोडक्शन में एजेंट्स के व्यवहार को सुरक्षित, अनुपालक और भरोसेमंद जवाबों के लिए सुरक्षा उपायों के साथ नियंत्रित करें।
ओवरव्यू
गार्डरेल्स टीम्स को प्रोडक्शन में एजेंट्स के व्यवहार को नियंत्रित करने का एक शक्तिशाली तरीका देते हैं, ताकि वे एंटरप्राइज़ स्तर पर विषय पर बने रहें, ब्रांड के अनुरूप हों और हेरफेर से सुरक्षित रहें।
Guardrails 2.0 के साथ, हमने सुरक्षा लेयर को फिर से डिज़ाइन किया है, ताकि टीम्स के लिए सामान्य भाषा में कस्टम नीतियां तय करना, पहले से बने सुरक्षा उपाय चालू करना, गार्डरेल ट्रिगर होने पर क्या हो इसे नियंत्रित करना और महत्वपूर्ण workflows में भरोसे के साथ एजेंट्स डिप्लॉय करना आसान हो।
गार्डरेल्स एजेंट्स को सही जवाबों की ओर ले जाते हैं और गलत जवाबों को यूज़र तक पहुंचने से पहले रोक देते हैं। वे बातचीत को कई स्तरों पर सुरक्षित रखते हैं: एजेंट के जवाब देने के तरीके को आकार देकर, यूज़र इनपुट को वैलिडेट करके और बिना लेटेंसी बढ़ाए हर जवाब का स्वतंत्र रूप से मूल्यांकन करके। इससे हर बातचीत में ब्रांड और अनुपालन का जोखिम कम होता है।
गार्डरेल्स कैसे काम करते हैं
गार्डरेल्स बातचीत को तीन स्तरों पर सुरक्षित रखते हैं:
सिस्टम प्रॉम्प्ट हार्डनिंग: एजेंट के व्यवहार को नियंत्रित करने का मुख्य तरीका। सिस्टम प्रॉम्प्ट में अनुमत और निषिद्ध व्यवहार के बारे में स्पष्ट निर्देश जोड़ें और पूरी बातचीत में उन निर्देशों को मज़बूत करने के लिए Focus Guardrail चालू करें। ज़्यादातर इंटरैक्शन में यह आपके एजेंट को सही दिशा में रखता है।
यूज़र इनपुट वैलिडेशन: एजेंट के जवाब देने से पहले ही विरोधी कोशिशों को पकड़ने वाला सुरक्षा जाल। गार्डरेल्स यूज़र की बात का विश्लेषण करते हैं, प्रॉम्प्ट इंजेक्शन और हेरफेर की कोशिशों का पता लगाते हैं और सुरक्षा जोखिम वाली बातचीत को समाप्त कर सकते हैं।
एजेंट रिस्पॉन्स वैलिडेशन: आपके कॉन्फ़िगर किए गए नियमों के आधार पर रीयल-टाइम में हर एजेंट जवाब का स्वतंत्र मूल्यांकन करने वाली अंतिम जांच। अगर सिस्टम प्रॉम्प्ट के बावजूद एजेंट कुछ ऐसा कहने वाला है जो आपके नियमों का उल्लंघन करता है, तो रिस्पॉन्स वैलिडेटर्स उसे डिलीवरी से पहले ब्लॉक कर देते हैं।
सिस्टम प्रॉम्प्ट हार्डनिंग आधार है। इनपुट और रिस्पॉन्स वैलिडेशन, छूट जाने वाली किसी भी चीज़ के लिए सुधार करते हैं। अपने सबसे महत्वपूर्ण नियमों को सिस्टम प्रॉम्प्ट और स्वतंत्र कस्टम गार्डरेल, दोनों में शामिल करें—इससे बहुस्तरीय सुरक्षा बनती है। इसलिए, LLM के निर्देशों से भटकने पर भी रिस्पॉन्स वैलिडेटर उसे डिलीवरी से पहले पकड़ लेता है।
सिस्टम प्रॉम्प्ट हार्डनिंग
अपने एजेंट से इच्छित व्यवहार कराने का सबसे प्रभावी तरीका है एक बेहतरीन सिस्टम प्रॉम्प्ट लिखना और Focus Guardrail चालू करना। साथ मिलकर, वे शुरुआत से ही एजेंट्स को सही जवाबों की ओर निर्देशित करते हैं।
सिस्टम प्रॉम्प्ट का इस्तेमाल करके आप अपने एजेंट को यह स्पष्ट निर्देश दे सकते हैं कि उसे क्या करना चाहिए और क्या नहीं। मॉडल्स को # Guardrails हेडिंग पर विशेष ध्यान देने के लिए ट्यून किया जाता है। अपने सबसे महत्वपूर्ण व्यवहार संबंधी नियमों के लिए इस हेडिंग का इस्तेमाल करें।
प्रभावी सिस्टम प्रॉम्प्ट लिखने के बारे में विस्तृत मार्गदर्शन के लिए हमारी प्रॉम्प्टिंग गाइड देखें। आपकी ElevenLabs अकाउंट टीम उच्च-गुणवत्ता वाले सिस्टम प्रॉम्प्ट बनाने में भी मदद कर सकती है।
Focus Guardrail: Focus Guardrail आपके एजेंट के सिस्टम प्रॉम्प्ट को मज़बूत करता है, जिससे जवाब केंद्रित, प्रासंगिक और आपके तय किए गए लक्ष्यों व निर्देशों के अनुरूप रहते हैं। यह खास तौर पर लंबी या जटिल बातचीत में उपयोगी है, जहां एजेंट के अपने इच्छित उद्देश्यों से भटकने की संभावना अधिक होती है।
सिस्टम प्रॉम्प्ट हार्डनिंग और Focus Guardrail चालू करने का संयोजन, एजेंट्स को सही जवाबों की ओर निर्देशित करने का सबसे प्रभावी तरीका है।
यूज़र इनपुट वैलिडेशन
मैनिपुलेशन गार्डरेल्स
यूज़र्स द्वारा एजेंट को उसके निर्देशों को बायपास करने के लिए हेरफेर करने की कोशिशों का पता लगाता है और उन्हें ब्लॉक करता है। चालू होने पर, सिस्टम यूज़र इनपुट में इंजेक्शन या निर्देश ओवरराइड की कोशिशों के पैटर्न का विश्लेषण करता है और सुरक्षा जोखिम वाली बातचीत को समाप्त कर सकता है।
एजेंट रिस्पॉन्स वैलिडेशन
कंटेंट गार्डरेल्स
यूज़र तक पहुंचने से पहले एजेंट के रिस्पॉन्स में अनुचित कंटेंट को फ़्लैग करता है और रोकता है, जैसे राजनीतिक रूप से संवेदनशील, यौन रूप से स्पष्ट या हिंसक सामग्री। इससे रिस्पॉन्स आपके एजेंट के तय इस्तेमाल और ऑडियंस के लिए उपयुक्त बने रहते हैं।
कस्टम गार्डरेल्स
जब एजेंट ज़्यादा असरदार काम संभालते हैं, तो टीम्स को उनके व्यवहार पर स्पष्ट नियंत्रण चाहिए। कस्टम गार्डरेल्स आपको अपने बिज़नेस की सबसे ज़रूरी नीतियां कॉन्फ़िगर करने देते हैं। उदाहरण के लिए:
- रिटेल असिस्टेंट को अयोग्य आइटम के लिए रिफ़ंड जारी नहीं करना चाहिए।
- हेल्थकेयर रिसेप्शनिस्ट को मेडिकल सलाह नहीं देनी चाहिए।
- बैंकिंग एजेंट को निवेश की सलाह नहीं देनी चाहिए।
कस्टम गार्डरेल्स LLM-आधारित नियम हैं, जिनसे आप नेचुरल लैंग्वेज प्रॉम्प्ट का इस्तेमाल करके अपने ब्लॉक करने के मानदंड तय कर सकते हैं। हर चालू कस्टम गार्डरेल एजेंट रिस्पॉन्स को एक हल्के मॉडल पर भेजता है, जो उन्हें आपके नियम के आधार पर जांचता है और ब्लॉक या अनुमति का फ़ैसला देता है। इससे आपको अपने एजेंट के कहने और न कहने की बातों पर लचीला, डोमेन-विशिष्ट नियंत्रण मिलता है।
हर कस्टम गार्डरेल के लिए आप ये तय कर सकते हैं:
कस्टम गार्डरेल्स का इस्तेमाल आपके बिज़नेस से जुड़े खास विषयों को ब्लॉक करने, इंडस्ट्री-विशिष्ट कंप्लायंस ज़रूरतों को लागू करने और मालिकाना सुरक्षा उपाय लागू करने के लिए किया जा सकता है। हर एक को हटाए बिना अलग-अलग चालू या बंद किया जा सकता है, और जब कई गार्डरेल्स चालू हों, तो वे दूसरे गार्डरेल्स के साथ समानांतर चलते हैं। ट्रिगर हुए सभी उल्लंघन समीक्षा के लिए लॉग किए जाते हैं।
एक्ज़ीक्यूशन मोड
एक्ज़ीक्यूशन मोड तय करता है कि यूज़र को जवाब दिखने या सुनाई देने से पहले गार्डरेल्स इंतज़ार का समय जोड़ते हैं या नहीं।
streaming मोड में, गार्डरेल ट्रिगर होने से पहले एजेंट का रिस्पॉन्स शुरू हो सकता है; वॉइस के लिए, कॉल खत्म करने वाले ब्लॉक से पहले ऑडियो का छोटा हिस्सा (अक्सर 500 ms से कम) पहुंच सकता है। टेक्स्ट एजेंट्स के लिए, अगर डिलीवरी से पहले मूल्यांकन पूरा नहीं होता है, तो यूज़र को आंशिक या पूरा रिस्पॉन्स दिख सकता है।
Blocking मोड में, एजेंट गार्डरेल्स के वैलिडेट होने के बाद ही जवाब देता है। इससे आमतौर पर 200–500 ms की अतिरिक्त लेटेंसी जुड़ती है।
एग्ज़िट स्ट्रैटेजीज़
एग्ज़िट स्ट्रैटेजीज़ से आप तय कर सकते हैं कि गार्डरेल ट्रिगर होने पर आपका एजेंट क्या करेगा। आप इनमें से चुन सकते हैं:
end_call(डिफ़ॉल्ट): कॉल तुरंत खत्म करता हैretry: बातचीत छोड़ने के बजाय आपके फ़ीडबैक का इस्तेमाल करके रिस्पॉन्स दोबारा जनरेट करता है। एजेंट रिस्पॉन्स को अधिकतम तीन बार फिर से आज़माया जाता है और अगर हर कोशिश गार्डरेल का उल्लंघन करती है, तो कॉल खत्म हो जाती है।
Retry सिर्फ़ blocking मोड में काम करता है। streaming मोड में, कॉल खत्म करना ही उपलब्ध एग्ज़िट स्ट्रैटेजी है।
रिट्राई फ़ीडबैक
Retry फ़ीडबैक में वे कोई भी निर्देश हो सकते हैं जिन्हें आप अगली बारी में लागू करना चाहते हैं - मॉडल के दोबारा जनरेट करने से पहले इसे सिस्टम गाइडेंस के रूप में इंजेक्ट किया जाता है। इसमें transfer_to_agent या transfer_to_number जैसे सिस्टम टूल्स को कॉल करना भी शामिल है। रिट्राई फ़ीडबैक कॉन्फ़िगर करने के कुछ उदाहरण यहां दिए गए हैं:
- सामान्य अस्वीकरण (डिफ़ॉल्ट)
आपका रिस्पॉन्स उस गार्डरेल ने ब्लॉक कर दिया है जो इस शर्त/श्रेणी से मेल खाने वाले कंटेंट को ब्लॉक करता है: ‘{{trigger_reason}}’। अपनी अगली बारी में आपको यूज़र को बताना होगा “माफ़ कीजिए, मैं उस सवाल का जवाब नहीं दे सकता, क्या आप कुछ और जानना चाहेंगे?” - सुधारात्मक निर्देशों के साथ रिट्राई
आपका पिछला रिस्पॉन्स एक गार्डरेल ने ब्लॉक कर दिया था। आपका ब्लॉक किया गया रिस्पॉन्स था: ‘{{agent_message}}’। अपनी अगली बारी में आपको नया जवाब देना होगा और उसे इसका उल्लंघन नहीं करना चाहिए: ‘{{trigger_reason}}’ - दूसरे एजेंट को ट्रांसफ़र करें
आपका पिछला रिस्पॉन्स गार्डरेल ने ब्लॉक कर दिया था। अपनी अगली बारी में आपको transfer_to_agent टूल का इस्तेमाल करके किसी एजेंट को ट्रांसफ़र करना होगा। आपका ब्लॉक किया गया रिस्पॉन्स था: ‘{{agent_message}}’। गार्डरेल इस शर्त/श्रेणी से मेल खाने वाले कंटेंट को ब्लॉक करता है: ‘{{trigger_reason}}’। - किसी व्यक्ति को ट्रांसफ़र करें
आपका रिस्पॉन्स उस गार्डरेल ने ब्लॉक कर दिया है जो इस शर्त/श्रेणी से मेल खाने वाले कंटेंट को ब्लॉक करता है: ‘{{trigger_reason}}’। अपनी अगली बारी में आपको transfer_to_number टूल का इस्तेमाल करके कॉल को किसी मानव ऑपरेटर को MUST ट्रांसफ़र करना होगा।
रिट्राई फ़ीडबैक में सिस्टम टूल्स का इस्तेमाल करने के लिए, एजेंट की सेटिंग्स में संबंधित टूल्स चालू और कॉन्फ़िगर करें। सिर्फ़ एजेंट पर सेट अप किए गए टूल्स को ही कॉल किया जा सकता है।
आप फ़ीडबैक टेक्स्ट में इन प्लेसहोल्डर्स का इस्तेमाल कर सकते हैं:
Streaming एक्ज़ीक्यूशन मोड वॉइस एजेंट्स के लिए सुझाया जाता है; blocking एक्ज़ीक्यूशन मोड टेक्स्ट एजेंट्स के लिए सुझाया जाता है।
Blocking (retry के साथ खासकर) वॉइस पर कम अनुमानित तरीके से काम कर सकता है। अगर आप वॉइस पर blocking इस्तेमाल करते हैं, तो अच्छी तरह वैलिडेट करें या retry के बजाय end call चुनें, जब तक आपको व्यवहार पर भरोसा न हो।
कीमत
Focus, Manipulation, और Content गार्डरेल्स सभी ElevenAgents यूज़र्स के लिए बिना किसी अतिरिक्त लागत के शामिल हैं।
कस्टम गार्डरेल्स इस्तेमाल-आधारित हैं और ElevenAgents में दूसरे मॉडल कॉल्स की तरह ही अतिरिक्त LLM लागत लगती है। हर चालू कस्टम गार्डरेल मूल्यांकन के लिए हर एजेंट रिस्पॉन्स को एक हल्के मॉडल पर भेजता है, इसलिए लागत प्रॉम्प्ट की लंबाई, औसत बातचीत की लंबाई और बातचीत की संख्या पर निर्भर करती है। अगर आप कई कस्टम गार्डरेल्स चालू करते हैं, तो हर एक हर रिस्पॉन्स के लिए अपना अलग मूल्यांकन चलाता है। हम प्रोडक्शन में कई कस्टम गार्डरेल्स चालू करने से पहले अपने अनुमानित ट्रैफ़िक और मॉडल विकल्प की समीक्षा करने की सलाह देते हैं।
कस्टम गार्डरेल बनाते या एडिट करते समय आप अनुमानित लागत (प्रॉम्प्ट के नीचे) देख सकते हैं।
रिट्राई और लागत: हर कोशिश में एक अतिरिक्त एजेंट जनरेशन और एक अन्य गार्डरेल मूल्यांकन होता है, इसलिए retry, end_call की तुलना में इस्तेमाल-आधारित बिलिंग बढ़ाता है (हर ब्लॉक की गई बारी में अधिकतम तीन कोशिशें)।
कॉन्फ़िगरेशन
डैशबोर्ड से कॉन्फ़िगर करें
CLI से कॉन्फ़िगर करें
API से कॉन्फ़िगर करें
गार्डरेल्स चालू करें
जिन गार्डरेल श्रेणियों को चालू करना है, उन्हें टॉगल करें। सभी श्रेणियां तुरंत चालू या बंद करने के लिए आप प्रीसेट बटन इस्तेमाल कर सकते हैं।
एक्ज़ीक्यूशन मोड और एग्ज़िट स्ट्रैटेजी कॉन्फ़िगर करें (कस्टम और कंटेंट गार्डरेल्स)
हर कस्टम या कंटेंट गार्डरेल के लिए streaming या blocking एक्ज़ीक्यूशन मोड चुनें।
Blocking, टेक्स्ट एजेंट्स के लिए उपयुक्त है; streaming, वॉइस एजेंट्स के लिए उपयुक्त है। Action on
guardrail violation सेट करें (trigger_action से मैप होता है): किसी भी मोड में **end call **, या सिर्फ़ retry
जब blocking चुना गया हो (streaming में retry उपलब्ध नहीं है)। अगर आप
retry चुनते हैं, तो मॉडल को निर्देशित करने के लिए Feedback to inject when retrying एडिट करें। प्लेसहोल्डर्स
{{trigger_reason}} (ब्लॉक करने वाला कस्टम प्रॉम्प्ट या कंटेंट श्रेणी) और टेम्पलेट में {{agent_message}} का इस्तेमाल करें।
गार्डरेल ट्रिगर होने पर व्यवहार उसके प्रकार और कॉन्फ़िगरेशन पर निर्भर करता है:
- कॉल खत्म करें: सेशन तुरंत खत्म हो जाता है (वॉइस के लिए कॉल ड्रॉप हो जाती है, टेक्स्ट के लिए चैट खत्म हो जाती है)। ट्रिगर बातचीत के इतिहास में लॉग होता है।
- रिट्राई (ब्लॉकिंग कस्टम या कंटेंट गार्डरेल्स): उल्लंघन करने वाली असिस्टेंट बारी हटा दी जाती है, सिस्टम फ़ीडबैक इंजेक्ट किया जाता है, और मॉडल फिर से कोशिश करता है - अधिकतम तीन बार - गार्डरेल के फिर भी ट्रिगर होने पर सेशन खत्म होने से पहले।
end call के लिए, एंड यूज़र्स को कॉल ड्रॉप होने या चैट खत्म होने का अनुभव होता है। उल्लंघन की जानकारी आपके लिए बातचीत लॉग्स में उपलब्ध है और एंड यूज़र को ज्यों की त्यों नहीं दिखाई जाती।
end call के बाद, यूज़र नई बातचीत शुरू कर सकते हैं। गार्डरेल यूज़र को स्थायी रूप से ब्लॉक नहीं करता
- यह उस खास रिस्पॉन्स (या सेशन) को ब्लॉक करता है जिसने नीति का उल्लंघन किया।
सर्वोत्तम तरीके
कस्टमर सपोर्ट एजेंट्स
बिज़नेस-विशिष्ट नीतियां लागू करने के लिए कस्टम गार्डरेल्स का इस्तेमाल करें। उदाहरण: - टूल्स से पात्रता की पुष्टि होने तक रिफ़ंड, क्रेडिट या सब्सक्रिप्शन बदलाव जारी करना ब्लॉक करें। - स्पष्ट रूप से अनुमति मिलने तक डिस्काउंट या प्रमोशनल कोड देना ब्लॉक करें। - रोडमैप आइटम या रिलीज़ न हुए फीचर्स के बारे में अनुमान लगाने वाले रिस्पॉन्स ब्लॉक करें।
हेल्थकेयर एप्लिकेशन
मेडिकल सीमाओं को सख्ती से नियंत्रित करने के लिए कस्टम गार्डरेल्स इस्तेमाल करें। उदाहरण: - स्थितियों का निदान करने या विशेष उपचार सुझाने को ब्लॉक करें। - दवाओं के लिए खुराक की सलाह को ब्लॉक करें।
- लाइसेंस प्राप्त मेडिकल प्रोफ़ेशनल की सलाह को बदलने से ब्लॉक करें।
शैक्षिक कंटेंट
संवेदनशील अकादमिक विषयों को नियंत्रित करने के लिए कस्टम गार्डरेल्स इस्तेमाल करें। उदाहरण: - हानिकारक प्रयोगों या असुरक्षित प्रक्रियाओं के लिए चरण-दर-चरण निर्देश ब्लॉक करें। - चल रहे असेसमेंट या परीक्षाओं के लिए उत्तर-कुंजी जनरेट करना ब्लॉक करें। - ऐसे कंटेंट को ब्लॉक करें जो अकादमिक बेईमानी में मदद कर सकता हो।
इंटरनल एंटरप्राइज़ टूल्स
कंपनी के कामकाज और डेटा की सुरक्षा के लिए कस्टम गार्डरेल्स इस्तेमाल करें। उदाहरण: - सिर्फ़ आंतरिक उपयोग वाले दस्तावेज़ या गोपनीय प्रक्रियाएं साझा करना ब्लॉक करें। - निजी APIs, सिस्टम प्रॉम्प्ट्स या इन्फ़्रास्ट्रक्चर विवरण उजागर करना ब्लॉक करें। - ऐसे कार्यों का सिमुलेशन ब्लॉक करें जिनके लिए एग्ज़ीक्यूटिव या एडमिनिस्ट्रेटिव अधिकार चाहिए।
वास्तविक स्थितियों के साथ टेस्ट करें
डिप्लॉय करने से पहले, अपने गार्डरेल कॉन्फ़िगरेशन को इनसे टेस्ट करें:
- यह सुनिश्चित करने के लिए सामान्य बातचीत फ़्लो कि कोई गलत पॉज़िटिव न हो
- ऐसे एज केस जो सुरक्षा सीमाओं के करीब हों, लेकिन उन्हें पार न करते हों
- हानिकारक रिस्पॉन्स निकलवाने की कोशिश करने वाले विरोधी प्रॉम्प्ट्स
अक्सर पूछे जाने वाले सवाल
क्या गार्डरेल्स लेटेंसी को प्रभावित करते हैं?
कस्टम और कंटेंट गार्डरेल्स के लिए, streaming मोड कोई अतिरिक्त लेटेंसी नहीं जोड़ता, लेकिन गार्डरेल ट्रिगर होने से पहले रिस्पॉन्स शुरू हो सकता है। Blocking मोड में एजेंट के जवाब देने से पहले गार्डरेल का इंतज़ार होता है, जिसमें आमतौर पर करीब 200–500 ms की देरी होती है। Retry हर कोशिश पर पूरी अतिरिक्त जनरेशन (और दोबारा मूल्यांकन) जोड़ता है, हर ब्लॉक की गई बारी में अधिकतम तीन बार, जिससे इस्तेमाल-आधारित लागत भी बढ़ती है।
streaming और blocking एक्ज़ीक्यूशन मोड में क्या अंतर है?
Streaming कोई अतिरिक्त लेटेंसी नहीं जोड़ता, लेकिन गार्डरेल
ट्रिगर होने से पहले एजेंट का रिस्पॉन्स शुरू हो सकता है। Blocking में एजेंट के जवाब देने से पहले गार्डरेल के नतीजे का इंतज़ार होता है (आमतौर पर
200–500 ms की देरी)। एग्ज़िट स्ट्रैटेजी के रूप में Retry (trigger_action) सिर्फ़
blocking मोड में उपलब्ध है; streaming मोड में गार्डरेल
ट्रिगर होने पर आप end call इस्तेमाल करते हैं। Blocking तुरंत बातचीत खत्म करने के बजाय इंजेक्ट किए गए सिस्टम फ़ीडबैक के साथ retry
सक्षम करता है - लेकिन रिट्राई होने पर अतिरिक्त मॉडल इस्तेमाल और अतिरिक्त बिलिंग की कीमत पर।
Blocking, टेक्स्ट एजेंट्स के लिए सुझाया जाता है; streaming, वॉइस एजेंट्स के लिए सुझाया जाता है।
क्या मैं गार्डरेल्स को पूरी तरह बंद कर सकता हूं?
हां, लेकिन हम सभी गार्डरेल्स चालू रखने की पुरज़ोर सलाह देते हैं - खासकर Focus Guardrail। वे आपके ब्रांड, यूज़र्स और कंप्लायंस स्थिति की सुरक्षा करते हैं, और हम उन्हें इंटरनल टूल्स समेत सभी प्रोडक्शन एप्लिकेशन्स के लिए सुझाते हैं। दुर्लभ मामलों में, अगर कोई खास गार्डरेल आपके एजेंट के तय इस्तेमाल में बाधा डालता है, तो आप उसे बंद करना चाह सकते हैं। उदाहरण के लिए, कुछ एप्लिकेशन्स में ऐसे विषय हो सकते हैं जिन्हें कंटेंट गार्डरेल अन्यथा फ़्लैग करता, या बहुत ज़्यादा कस्टमाइज़ किया गया सिस्टम प्रॉम्प्ट Focus Guardrail चालू होने पर ठीक से काम नहीं कर सकता। हर गार्डरेल को अलग-अलग चालू या बंद किया जा सकता है।
क्या यूज़र गार्डरेल के फ़ैसलों के खिलाफ़ अपील कर सकते हैं?
गार्डरेल ट्रिगर लॉग होते हैं और आपके बातचीत एनालिटिक्स में उनकी समीक्षा की जा सकती है। अगर आप गलत पॉज़िटिव पहचानते हैं, तो अपने गार्डरेल प्रॉम्प्ट्स एडजस्ट करें। कोई ऑटोमेटेड अपील प्रक्रिया नहीं है - यूज़र को बस नई बातचीत शुरू करनी चाहिए।
मुझे कैसे पता चलेगा कि कौन-सा गार्डरेल ट्रिगर हुआ?
किस गार्डरेल ने ट्रिगर किया, इसकी जानकारी आपके बातचीत लॉग्स में उपलब्ध है।
क्या मुझे गार्डरेल्स और सिस्टम प्रॉम्प्ट हार्डनिंग, दोनों इस्तेमाल करने चाहिए?
हां। वे एक-दूसरे के पूरक उद्देश्य पूरे करते हैं। सिस्टम प्रॉम्प्ट हार्डनिंग व्यवहार संबंधी मार्गदर्शन देता है और निर्देशों का पालन करके ज़्यादातर समस्याओं को रोकता है। प्लेटफ़ॉर्म गार्डरेल्स एक सुरक्षा परत के रूप में स्वतंत्र प्रवर्तन देते हैं। दोनों का इस्तेमाल बहुस्तरीय सुरक्षा बनाता है।
अगले कदम
- प्रॉम्प्टिंग गाइड: व्यवहार संबंधी गार्डरेल्स के साथ प्रभावी सिस्टम प्रॉम्प्ट लिखना सीखें
- प्राइवेसी: डेटा रिटेंशन और प्राइवेसी सेटिंग्स कॉन्फ़िगर करें
- टेस्टिंग: अलग-अलग स्थितियों में अपने एजेंट को टेस्ट करें
- बातचीत सिमुलेट करें: प्रोग्रामेटिक रूप से गार्डरेल कॉन्फ़िगरेशन टेस्ट करें
- बातचीत इतिहास रिडैक्शन: बातचीत इतिहास से नाम और बैंक विवरण जैसी संवेदनशील जानकारी रिडैक्ट करें
रिलीज़ स्थिति
Guardrails अभी Alpha में है, और हम प्रोडक्ट को लगातार बेहतर बना रहे हैं और इसकी क्षमताओं का विस्तार कर रहे हैं। आप उम्मीद कर सकते हैं कि सामान्य उपलब्धता से पहले फीचर सेट, डिफ़ॉल्ट सेटिंग्स, डैशबोर्ड कंट्रोल और API फ़ील्ड में बदलाव होते रहेंगे, और कुछ बदलाव breaking हो सकते हैं।
Guardrails को बेहतर बनाते हुए, हम सुझाव देते हैं कि आप अपने सेटअप को वैलिडेट करें और अपने लॉग्स में guardrail के व्यवहार पर नज़र रखें। अपडेट जारी होने पर अपने कॉन्फ़िगरेशन को दोबारा देखने की भी सलाह देते हैं।