एकाइहरू
1. मोबाइल विकासमा AI को परिचय: भूमिका, सीमा, प्रमाणीकरण र सुरक्षा 2. कृत्रिम बुद्धिमत्ताको साथ मोबाइल कोड जेनेरेसन: कोटलिन, स्विफ्ट र क्रस-प्लेटफर्म विकास 3. इन्टरफेस डिजाइन र कृत्रिम बुद्धिमत्ता संग UI कोड जेनेरेसन 4. अन-डिभाइस एआई: कोर एमएल, टेन्सरफ्लो लाइट र एमएल किट 5. क्लाउड एआई र LLM API एकीकरण: च्याट, प्रवाह र सुरक्षा 6. कृत्रिम बुद्धिमत्ताको साथ परीक्षण उत्पादन: एकाई, इन्टरफेस र स्वचालन परीक्षणहरू 7. कृत्रिम बुद्धिमत्ताको साथ डिबगिङ र क्र्यास विश्लेषण 8. प्रदर्शन र ब्याट्री अप्टिमाइजेसन: कृत्रिम बुद्धिमत्ता संग छिटो र कुशल अनुप्रयोग 9. गोपनीयता, अनुमति र सुरक्षित प्रयोग 10. स्टोर रिलीज: एप स्टोर, गुगल प्ले र एआई अनुकूलता 11. अन्त-देखि-अन्त परियोजना, कृत्रिम बुद्धिमत्ताको जिम्मेवार प्रयोग र पेशामा रोडम्याप
एकाइ 5 / 11

क्लाउड एआई र LLM API एकीकरण: च्याट, प्रवाह र सुरक्षा

लाभ:

  • एक सुरक्षित क्लाउड LLM आर्किटेक्चर स्थापना गर्ने क्षमता जसले ग्राहकमा API कुञ्जी राख्दैन तर ब्याक-एन्ड प्रोक्सी मार्फत जान्छ।
  • बलियो एकीकरणहरू लेख्ने क्षमता जसले स्ट्रिमिङको साथ कथित गति बढाउँछ र टाइमआउटहरू, नेटवर्क त्रुटिहरू र गति सीमाहरू जस्ता परिस्थितिहरूलाई हल्का रूपमा ह्यान्डल गर्दछ।
  • पठाइएको टोकन छोटो गरेर लागत घटाउने क्षमता र क्लाउडमा जानु अघि व्यक्तिगत डाटाको आवश्यकतालाई प्रश्न गर्नुहोस्।

अन-डिभाइस एआई शक्तिशाली तर सीमित छ। जब तपाइँ एक साँच्चै "स्मार्ट च्याट सहायक", लामो पाठ सारांश, वा एक एपमा जटिल रचनात्मक उत्पादन थप्न चाहानुहुन्छ, तपाइँलाई फोनमा फिट गर्न धेरै ठूला मोडेलहरू चाहिन्छ। यो जहाँ क्लाउड एआई खेलमा आउँछ: तपाईंको एप्लिकेसन एपीआई मार्फत ठूलो भाषा मोडेल (LLM) मा जडान हुन्छ (एप्लिकेशन प्रोग्रामिङ इन्टरफेस - मानक इन्टरफेस जहाँ दुई सफ्टवेयरले एकअर्कालाई डेटा पठाउँछन् र प्राप्त गर्छन्)। यस इकाईमा हामी क्लाउड LLM लाई कसरी सुरक्षित, छिटो र लागत-सचेत तरिकामा मोबाइल अनुप्रयोगमा एकीकृत गर्ने भनेर सिक्नेछौं। सुरक्षामा महत्त्वपूर्ण जोड दिइनेछ: गलत रूपमा स्थापित LLM एकीकरणले तपाईंको API कुञ्जी लीक गर्न सक्छ र हजारौं पाउन्डको बिलहरू निम्त्याउन सक्छ।

वास्तुकलाको सुनौलो नियम: ग्राहकमा कुञ्जी राख्नुहोस्

क्लाउड एआई एकीकरणमा गर्न सकिने सबैभन्दा खतरनाक गल्ती भनेको एपीआई कुञ्जी (सेवा प्रयोग गर्ने अनुमति दिने गोप्य पासवर्ड) लाई सीधा मोबाइल अनुप्रयोग कोडमा इम्बेड गर्नु हो। मोबाइल एपहरू प्रयोगकर्ताको यन्त्रमा डाउनलोड हुन्छन् र कोड रिभर्स इन्जिनियरिङद्वारा पढ्न सकिन्छ — कम्पाइल गरिएको एप्लिकेसनलाई पार्स गरेर र भित्र के छ भनेर हेरेर। यदि तपाईंको कुञ्जी एप भित्र छ भने, कसैले यसलाई निकाल्न र तपाईंको खाताबाट असीमित अनुरोधहरू गर्न सक्छ।

सही वास्तुकला यो हो: मोबाइल अनुप्रयोगले तपाईंको आफ्नै ब्याकएन्ड सर्भरमा अनुरोधहरू पठाउँछ (तपाईंले नियन्त्रण गर्ने प्रोक्सी सर्भर); कुञ्जी सर्भरमा मात्र रहन्छ; सर्भर LLM सेवामा जान्छ र अनुप्रयोगमा प्रतिक्रिया फर्काउँछ। यो मिडलवेयरले गति क्यापिङ, दुरुपयोग रोकथाम, र लागत नियन्त्रण पनि प्रदान गर्दछ।

दृष्टिकोण

चाबी कहाँ छ

सुरक्षा

कुञ्जी अनुप्रयोगमा छ (FALSE)

ग्राहक मा, सार्वजनिक

यो लीक हुन्छ, बिल विस्फोट हुन्छ

कुञ्जी ब्याकइन्डमा छ (TRUE)

सर्भरमा, लुकेको छ

सुरक्षित, नियन्त्रण योग्य

सावधानी: जब तपाइँ क्लाउड LLM एकीकरणको लागि AI लाई सोध्नुहुन्छ, यसले तपाइँको सुविधाको लागि अनुप्रयोग कोडमा कुञ्जी सिधै लेख्ने उदाहरण सिर्जना गर्न सक्छ। यो लाइभ कहिल्यै नलिनुहोस्। प्रम्प्टमा "एपीआई कुञ्जी ग्राहकमा हुनु हुँदैन, ब्याकएन्ड प्रोक्सी मार्फत जानुहोस्" वाक्य समावेश गर्न निश्चित हुनुहोस्।

स्ट्रिमिङ: कथित गति बढ्दै

LLM जवाफहरू लामो हुन सक्छन् र तिनीहरूको पूर्णतामा उत्पादन गर्न सेकेन्ड लाग्न सक्छ। प्रयोगकर्तालाई खाली स्क्रिनमा पर्खनु भनेको खराब अनुभव हो। समाधान स्ट्रिमिङ हो - शब्द द्वारा जवाफ शब्द प्रदर्शन, यो उत्पन्न भएको रूपमा। प्रयोगकर्ताले पाठको हिज्जे निगरानी गर्दछ, जस्तै ChatGPT; यसले नाटकीय रूपमा कथित गति र प्रवाह बढाउँछ। मोबाइलमा प्रवाह भनेको सर्भरबाट इन्टरफेसमा आइपुग्दा टुक्राहरू (टोकनहरू - मोडेलद्वारा उत्पादित पाठको टुक्रा) थप्नु हो। AI मा एकीकरण मुद्रण गर्दा स्पष्ट रूपमा प्रवाह अनुरोध गर्नुहोस्।

सुझाव: स्ट्रिमिङ प्रतिक्रियामा "पज" बटन थप्नुहोस्। प्रयोगकर्ताले आफूले चाहेको जवाफ पाउँदा उत्पादन रोक्न सक्षम हुनुपर्छ; यसले अनुभवलाई सुधार गर्छ र अनावश्यक टोकन उत्पादन कटौती गरेर लागत घटाउँछ। लामो जवाफको बीचमा, प्रयोगकर्ताले पहिले नै उनीहरूको जवाफ फेला पारेको हुन सक्छ।

लागत, ढिलाइ र त्रुटि व्यवस्थापन

क्लाउड LLM ले प्रत्येक अनुरोधको साथ पैसा लागत (प्रति टोकन शुल्क) र समय लागत (विलम्बता) बोक्छ। तीनवटा अनुशासन आवश्यक छ। Cost: limit prompt and response length, do not send unnecessarily long system instructions, default to small and cheap model if possible. विलम्बता: स्ट्रिमिङ प्रयोग गर्नुहोस्, टाइमआउट सेट गर्नुहोस्, यदि नेटवर्क ढिलो छ भने प्रयोगकर्तालाई सूचित गर्नुहोस्। त्रुटि: नेटवर्क आउटेज, सेवाले 429 (धेरै अनुरोधहरू) वा 500 (सर्भर त्रुटि) फर्काउन सक्छ; प्रत्येकलाई बिस्तारै ह्यान्डल गर्नुहोस्, एप क्र्यास नगर्नुहोस्। साथै, LLM ले कहिलेकाहीं अर्थहीन वा गलत (भ्रम) जवाफ दिन्छ; महत्वपूर्ण क्षेत्रहरूमा जवाफको प्रमाणीकरणको तह थप्नुहोस्।

तीन मिनी केसहरू

केस 1 - लीक कुञ्जी। एक स्टार्टअपले ओपनएआई कुञ्जीलाई सीधै यसको प्रतिक्रिया नेटिभ एपमा इम्बेड गर्यो। एप रिलिज भएको तीन हप्ता पछि, कुञ्जी रिभर्स इन्जिनियर गरिएको थियो र $ 2,400 मूल्यको उपयोग रातारात गरिएको थियो। टोलीले कुञ्जी रद्द गर्न र ब्याकएन्ड प्रोक्सी सेट अप गर्नुपर्‍यो। पाठ: सुविधाको लागि लिइएको सर्टकट सबैभन्दा महँगो मार्ग बन्यो।

केस 2 - प्रवाहको साथ ड्रपआउट घट्यो। एउटा शिक्षा एपले पहिलो पटक स्ट्रिमिङ बिना नै यसको प्रश्नोत्तर सुविधा जारी गर्‍यो; प्रयोगकर्ताहरू 6 सेकेन्डको निष्क्रिय प्रतीक्षा पछि बाहिर निस्किरहेका थिए। जब प्रवाह थपियो, पहिलो शब्द 0.8 सेकेन्डमा देखा पर्न थाल्यो, र परित्याग दर 48% बाट 12% मा झर्यो। उही मोडेल, उही गति - प्रस्तुतिमा मात्र फरक।

केस 3 - लागत नियन्त्रण। एउटा अनुप्रयोगले प्रत्येक प्रयोगकर्ता सन्देशको साथ मोडेलमा सम्पूर्ण च्याट इतिहास पठाउँदै थियो; लामो कुराकानीमा, एकल अनुरोध 8,000 टोकन पुग्यो, लागत बढाउँदै। अन्तिम केही सन्देशहरू र सारांशहरू पठाएर, टोलीले प्रति अनुरोध टोकनहरू 70% ले घटायो, मासिक बिल एक तिहाइमा घटाएर। पाठ: तपाईले पठाउनु भएको मापन गर्नुहोस्।

कमजोर प्रम्प्ट / बलियो प्रम्प्ट

कमजोर प्रम्प्ट: "मेरो एपमा ChatGPT जस्तै च्याट थप्नुहोस्।"

शक्तिशाली प्रम्प्ट: "मेरो iOS/Swift अनुप्रयोगमा च्याट सहायक थप्नुहोस्। वास्तुकला: अनुप्रयोगले मेरो आफ्नै ब्याकइन्डमा अनुरोध पठाउँछ, LLM API कुञ्जी क्लाइन्टमा छैन, यो प्रोक्सी मार्फत जान्छ। - प्रतिक्रिया स्ट्रिमिङ आउँछ, शब्दद्वारा शब्द प्रदर्शित हुन्छ - 'रोक्नुहोस्' बटनले उत्पादनमा अवरोध गर्छ - त्रुटि टाइमआउट, नेटवर्क 50000 स्थिति ह्यान्डल गर्नुहोस् - त्रुटि 500 स्थिति च्याट इतिहास छोटो पार्नुहोस्: अन्तिम 6 सन्देशहरू पठाउनुहोस् + सारांश (लागत नियन्त्रण) पहिले वास्तु रेखाचित्रको व्याख्या गर्नुहोस्, त्यसपछि ग्राहक र प्रोक्सी कोड छुट्टै दिनुहोस्।"

प्रतिलिपि गर्न मिल्ने टेम्प्लेटहरू

सुरक्षित आर्किटेक्चर टेम्प्लेट: "मेरो [प्लेटफर्म] अनुप्रयोगमा क्लाउड LLM एकीकरण डिजाइन गर्नुहोस्। नियम: एपीआई कुञ्जी ब्याकइन्डमा मात्र। क्लाइन्ट -> मेरो प्रोक्सी -> LLM। प्रोक्सीमा: प्रमाणीकरण, प्रति-प्रयोगकर्ता दर सीमा, लगिङ अनुरोध। ग्राहक र प्रोक्सी जिम्मेवारीहरू अलग-अलग सूचीबद्ध गर्नुहोस्, त्यसपछि कोड निर्यात गर्नुहोस्।"

स्ट्रिमिङ टेम्प्लेट: "यस च्याट स्क्रिनमा स्ट्रिमिङ प्रतिक्रिया थप्नुहोस्:- सन्देश बबलमा स्निपेटहरू थप्नुहोस् तिनीहरू आइपुग्दा- टाइप गर्दा कर्सर/एनिमेसन देखाउनुहोस्- 'रोक्नुहोस्' बटन स्ट्रिम रद्द गर्नुहोस्- आंशिक पाठ सुरक्षित गर्नुहोस् र स्ट्रिम समाप्त हुँदा त्रुटि भएमा चेतावनी दिनुहोस् [अवस्थित कोड]"

लागत-विलम्बता टेम्प्लेट: "यस LLM एकीकरणमा लागत र विलम्बता घटाउनुहोस्: - मैले पठाएको टोकन कसरी घटाउने (इतिहास संक्षिप्त नाम, सारांश)? - कुन अवस्थामा सानो/सस्तो मोडेल पर्याप्त छ? - टाइमआउट सुझाव दिनुहोस् र रणनीति पुन: प्रयास गर्नुहोस् [कोड]"

गल्ती सहिष्णुता टेम्प्लेट: "यस LLM कललाई लचिलो बनाउनुहोस्: - कुनै नेटवर्कको लागि अलग व्यवहार, टाइमआउट, 429 (दर सीमा), 500 (सर्भर)- प्रयोगकर्तालाई गैर-प्राविधिक, विनम्र सन्देश- महत्वपूर्ण जवाफहरूमा भ्रमको जोखिम विरुद्ध प्रमाणीकरण नोट [कोड]"

सामान्य गल्तीहरू

  • एपमा एपीआई कुञ्जी इम्बेड गर्दै। सबैभन्दा महँगो र सामान्य सुरक्षा बग; कुञ्जी पक्कै पछाडिको छेउमा छ।
  • प्रवाह प्रयोग गर्दैन। प्रयोगकर्तालाई लामो जवाफको लागि प्रतीक्षा गर्न छोड्दा प्रयोगकर्तालाई टाढा लैजान्छ।
  • प्रत्येक अनुरोधको साथ सम्पूर्ण च्याट इतिहास पठाउँदै। यसले टोकन लागत र विलम्बतालाई गुणा गर्छ।
  • त्रुटि सर्तहरू बाइपास गर्दै। यदि 429/500/टाइमआउट सम्बोधन गरिएन भने अनुप्रयोग क्र्यास वा फ्रिज हुनेछ।
  • बिना प्रश्न LLM को उत्तर सहि मानेर। भ्रम वास्तविक छ; महत्वपूर्ण क्षेत्रमा प्रमाणीकरण तह थप्नुहोस्।
  • अनावश्यक LLM मा प्रयोगकर्ता डाटा पठाउँदै। क्लाउडमा जानु अघि व्यक्तिगत डेटा आवश्यक छ वा मास्क गर्नुपर्छ भनेर सोध्नुहोस्।

संक्षेपमा

क्लाउड LLM ले उत्कृष्ट क्षमताहरू ल्याउँछ जुन मोबाइलमा उपकरणमा फिट हुँदैन, तर सुरक्षा र लागत अनुशासन चाहिन्छ। सुनौलो नियम: API कुञ्जी ग्राहकमा कहिल्यै हुँदैन, यो ब्याकइन्ड प्रोक्सी मार्फत जान्छ। प्रवाहले कथित गति र अवधारणलाई धेरै बढाउँछ; "रोक्नुहोस्" बटन द्वारा समर्थित। पठाइएको टोकन छोटो गरेर लागत निर्धारण गरिन्छ; लचिलोपन सबै त्रुटि केसहरूलाई राम्रोसँग ह्यान्डल गरेर प्राप्त गरिन्छ। LLM उत्तरहरूमा भ्रमहरू समावेश हुन सक्छन्; महत्वपूर्ण क्षेत्रहरूमा, प्रमाणीकरण आवश्यक छ र क्लाउडमा पठाउनु अघि व्यक्तिगत डेटा समीक्षा गरिन्छ।

आवेदन कार्य

"पाठ सारांश" वा "च्याट" सुविधाको लागि "सुरक्षित आर्किटेक्चर टेम्प्लेट" प्रयोग गरेर AI बाट ग्राहक + ब्याकएन्ड प्रोक्सी डिजाइन अनुरोध गर्नुहोस्। प्रमाणित गर्नुहोस् कि API कुञ्जी उत्पन्न गरिएको डिजाइनमा ब्याकइन्डमा मात्र रहन्छ। त्यसपछि "लागत-ढिलाइ ढाँचा" को साथ पठाइएको टोकन कम गर्न कम्तिमा दुई तरिकाहरू निकाल्नुहोस् र त्रुटि अवस्था (जस्तै 429) को लागि प्रयोगकर्तालाई देखाइने विनम्र सन्देश लेख्नुहोस्।

चेकलिस्ट

  • [ ] मैले प्रमाणित गरें कि API कुञ्जी ब्याकइन्डमा रहन्छ र क्लाइन्टमा होइन
  • [ ] मैले प्रतिक्रिया स्ट्रिमिङ गरें र 'पज' बटन थपे
  • [ ] मैले टाइमआउट, नेटवर्क त्रुटि, 429 र 500 परिस्थितिहरू ह्यान्डल गरें
  • [] मैले विगतको संक्षिप्त/सारांशको साथ पेश गरिएको टोकन घटाएँ
  • [ ] मैले LLM उत्तरमा भ्रमको जोखिम विरुद्ध प्रमाणीकरणलाई विचार गरें
  • [] मैले क्लाउडमा जानु अघि व्यक्तिगत डाटाको आवश्यकता/मास्किङ जाँच गरें