ब्लॉग
पोस्ट-क्वेरी और आर्टिकल-डायरेक्टरी अनुरोध के बीच मुख्य अंतर यह है कि पोस्ट-क्वेरी अनुरोध स्फिंक्स द्वारा फ़ाइलें प्राप्त करते ही तेज़ी से काम करता है, लेकिन फिर भी किसी अन्य कारण से इंडेक्सिंग विफल हो सकती है। ज़ाहिर है, 2000-लाइन वाली टेबल के लिए यह कोई सकारात्मक बदलाव नहीं है, लेकिन जब दस मिलियन-लाइन वाली MyISAM टेबल की इंडेक्सिंग की बात आती है, तो विभिन्न प्रश्न कुछ हद तक मददगार साबित होते हैं। SQL ऑटोमैटिक ऑपरेटरों की सहायता से, इंडेक्सिंग यहाँ आसानी से हो जाती है।
विंडोज़, लिनक्स और ऑपरेटिंग सिस्टम X पर स्फिंक्स पर काम करें, जिसमें एक ही दस्तावेज़ वाला स्टैंडअलोन डिजिटल प्रोग्राम हो। यदि सब कुछ ठीक रहा, तो आपको स्फिंक्स का एक उत्कृष्ट संस्करण मिल सकता है और इसके लिए आवश्यक विकल्पों की एक सूची भी मिल जाएगी। पायथन में एक बेहद उपयोगी simple_install कमांड है जो एक ही कमांड से तृतीय-पक्ष लाइब्रेरी डाउनलोड और रन कर सकता है। चूंकि स्फिंक्स पायथन कोड में बनाया गया है, इसलिए आपको पायथन स्थापित करना होगा (आवश्यक संस्करण कम से कम DOS.5 था) और फिर आप स्फिंक्स चला सकते हैं।
उदाहरण के लिए, यदि इंडेक्स पर अंग्रेज़ी स्टेमिंग की अनुमति है, तो कीवर्ड "जूता" होने पर भी "जूते" पर ज़ोर दिया जा सकता है। शब्दावली नवीनतम शब्दों का एक क्रम निर्धारित करती है जिस पर ध्यान केंद्रित किया जाता है। हैश और यह मैप्स शब्दों (केस-संक्षिप्त, स्टेम किए गए, और अन्य प्रकार से तैयार) को एक छोटे हैश में मैप करते हैं जिसमें प्रति-की वाक्यांश विश्लेषण ("दस्तावेज़", "हिट्स") होता है। इस प्रकार, ऊपर दिए गए उदाहरण से, "डेल्टा" निर्देशिका से मिलान हमेशा "मुख्य" निर्देशिका से मिलान पर भारी पड़ेगा।
- हमारे पास प्राथमिक निवेश निर्देशिका में एक प्रीमियम-पीक दस्तावेज़ सूची है।
- ऐच्छिक, मानक प्रयास 0 (mlock() को कॉल न करें)।
- इंडेक्सर एक ऐसा मोड प्रदान करता है जो खोज शब्द की मात्रा के आधार पर क्रमबद्ध निर्देशिका का एक बड़ा वॉल्यूम शब्दकोश बनाता है, बिंदु 7.चरण एक, "इंडेक्सर कमांड संसाधन" के अंदर –buildstops और –buildfreqs कुंजी देखें।
- उदाहरण के लिए, यह इस तरह से नहीं जुड़ेगा कि आप अक्सर बड़ी मात्रा में रैम बचा सकें, जिससे यह केवल कुछ पंक्तियों के संपत्ति मूल्य की स्थिति बन जाती है।
सामग्री की तालिका

libstemmer द्वारा प्रदान की गई अतिरिक्त मान्यताएँ 'libstemmer_XXX' प्रारूप में हैं, जिसमें libstemmer फ़ॉर्मूला कोडनाम शामिल हैं (पूरी सूची के लिए libstemmer_c/libstemmer/segments.txt देखें)। Soundex का निष्पादन MySQL के समान है। साथ ही, एक lemmatizer_cache निर्देश है जो आपको लेम्माटाइज़िंग (और इंडेक्सिंग) को तेज़ करने की अनुमति देता है, जिससे मूल रूप से एक डिक्शनरी के लिए एक त्वरित अनकंप्रेस्ड कैश के लिए अधिक RAM खर्च नहीं होती है।
इंडेक्सिंग को सीमित करने से आपको कुछ
हद तक मदद मिलेगी, जिससे इंडेक्सिंग के कारण लुकअप परिणामों में होने वाली गिरावट को दूर करने में सहायता मिलेगी। कम इंडेक्सिंग दर भी प्रभावित हो सकती है, लेकिन 256M से 1024M तक की सीमा अधिकांश डेटासेट के लिए पर्याप्त होगी। इससे इंडेक्सिंग पर कोई असर नहीं पड़ता, बस डेमॉन को फिर से शुरू करने की आवश्यकता होती है। यदि इसकी अनुमति दी जाती है, तो सभी एट्रिब्यूट पोजीशन बाधित हो जाएंगी, और RT स्पाइडर्स द्वारा डिस्क के सभी हिस्सों का उपयोग पहले से कहीं अधिक विस्तार से किया जाएगा।
हालांकि, इंडेक्सिंग इन्फिक्स से नई डायरेक्टरी का आकार काफी बढ़ सकता है (अतिरिक्त सूचीबद्ध शब्दों के कारण), और इससे इंडेक्सिंग और सर्चिंग दोनों में लगने वाला समय बढ़ जाएगा। वहीं दूसरी ओर, इंडेक्सिंग प्रीफिक्स से नई डायरेक्टरी का आकार थोड़ा बढ़ सकता है (अतिरिक्त नोट किए गए वाक्यांश के कारण), और इससे इंडेक्सिंग और सर्चिंग दोनों में लगने वाला समय बढ़ जाएगा। इसके विपरीत, जब '-' को 'forget_chars' सूची में डाला गया, तो एक समान टेक्स्ट को "abcdef" सर्च टर्म के रूप में सूचीबद्ध किया गया। डिफ़ॉल्ट रूप से, सभी रैंकिंग चार्ट 0 पर सेट होते हैं, जिसका अर्थ है कि यह वाक्यांश में नहीं पाया जा सकता है और इसे एक उत्कृष्ट विभाजक के रूप में माना जा सकता है।

स्टेप 1 से नंबरिंग स्वतः शुरू हो जाती है, लेकिन "start_passage_id" विकल्प के साथ इसे ओवरराइड किया जा सकता है। यह कीवर्ड मैच से ठीक पहले डालने के लिए एक सेट है। यह सर्च में आपकी मदद करता है, इसके लिए दिए गए डेटा फ़ाइलों से अंश (स्निपेट) बनाने की आवश्यकता होती है, और आप परिणाम को बेहतर बना सकते हैं।
यह वास्तव में केवल सिंटैक्स ग्लूकोज है – यह शब्द में शामिल शर्तों में एक सटीक सेटिंग मॉडिफायर जोड़ता है। यह एक अच्छा मॉडिफायर है जो नए कीवर्ड अर्थ को प्रभावित करता है जिसका उपयोग उदाहरण के लिए शब्दों, दूरी और कोरम प्रदाताओं जैसे कार्यों में किया जा सकता है। उदाहरण के लिए, "pet puppy mouse"~5 ask का अर्थ है कि 8 से कम कीवर्ड अवधि होनी चाहिए जिसमें चरण तीन की सभी शब्दावली हो, यानी। इस प्रकार, "@system hello" उन फ़ाइलों को संतुष्ट नहीं करेगा जिनमें कीवर्ड 'hello' स्थिति 51 के दौरान आता है और आप बॉडी में इससे कम होंगे। पेशे की स्थिति पर प्रतिबंध, जो संस्करण 0.9.9-rc1 में बनाया गया था, इस विचार व्यवसाय (अन्यथा फ़ील्ड) में बुनियादी N स्थिति के लिए नई खोज को भी सीमित करता है। तकनीकी रूप से, स्फिंक्स सभी आईडी की सूची नहीं रखता है।
अनुशंसित मानक लैटिन और सिरिलिक ईमेल हैं। उदाहरण के लिए, यदि minute_word_len 4 है, तो 'the' इंडेक्स नहीं होगा, लेकिन 'they' इंडेक्स हो सकता है। अनुशंसित डिफ़ॉल्ट चरण 1 (आप जो चाहें उसे सूचीबद्ध करें) है। इसलिए, नई फ़ाइल में बदलाव करने के लिए searchd को पुनः इंडेक्स और पुनरारंभ करना आवश्यक है।