0

ट्वीट थ्रेड स्प्लिटर

एक लंबी पोस्ट चिपकाएँ और वास्तविक भारित वर्ण-गणना नियमों का उपयोग करके इसे एक वास्तविक

यह टूल मानक 280-वर्ण सीमा के विरुद्ध विभाजित होता है जो डिफ़ॉल्ट रूप से सभी की टाइमलाइन पर लागू होता है। एक्स प्रीमियम/ब्लू सब्सक्राइबर अधिक लंबे "लॉन्ग-फॉर्म" पोस्ट (लगभग 25,000 अक्षरों तक) पोस्ट कर सकते हैं, जिन्हें विभाजित करने की बिल्कुल भी आवश्यकता नहीं है - लेकिन मानक सीमा के साथ बनाया गया थ्रेड हर खाते द्वारा पढ़ने योग्य है, इसलिए यह यहां ईमानदार डिफ़ॉल्ट बना हुआ है। यदि आप विशेष रूप से एक अलग सीमा को लक्षित करना चाहते हैं तो उपरोक्त कस्टम सीमा पर स्विच करें।

Buy Me a Coffee at ko-fi.com
प्रसंस्करण... 0%
भारित वर्णों की गिनती
स्मार्ट स्प्लिट पॉइंट ढूँढना
क्रमांकन धागा
हो गया

नतीजा

एक ट्वीट की 280-अक्षर सीमा एक साधारण `text.length` जांच नहीं है, और अधिकांश भोले-भाले चरित्र काउंटर इस मायने में गलत हो जाते हैं। यह उपकरण वास्तविक एक्स/ट्विटर भारित-लंबाई एल्गोरिथ्म को कार्यान्वित करता है: प्रत्येक कोड बिंदु को उसी भारित-श्रेणी तालिका के विरुद्ध देखा जाता है जो प्लेटफ़ॉर्म की अपनी ट्विटर-टेक्स्ट लाइब्रेरी का उपयोग करती है, जहां अधिकांश लैटिन, सिरिलिक, ग्रीक और सामान्य-विराम चिह्न वर्णों को 1 वर्ण के रूप में गिना जाता है, लेकिन उन सीमाओं के बाहर सब कुछ - सीजेके विचारधारा, अधिकांश इमोजी, कई प्रतीक - 2 के रूप में गिना जाता है। उतना ही महत्वपूर्ण, वास्तविक यूनिकोड कोड बिंदु द्वारा पाठ को पुनरावृत्त करना (कच्चे यूटीएफ -16 नहीं) यूनिट्स) का मतलब है कि एक सरोगेट-जोड़ी चेहरे या ध्वज की तरह एक सूक्ष्म-प्लेन इमोजी को एक बार सही ढंग से गिना जाता है, गलती से उस तरह से डबल-गिनती नहीं की जाती है जिस तरह से एक अनुभवहीन `.लंबाई` चेक होता है।

दूसरा आसानी से छूटने वाला वास्तविक नियम यह टूल ईमानदारी से लागू करता है: प्रत्येक http(s):// या www। आपके पाठ में यूआरएल बिल्कुल 23 अक्षरों के रूप में गिना जाता है, भले ही शाब्दिक लिंक 20 अक्षर या 200 हो। यह किसी भी लिंक के लिए वास्तविक टी.सीओ-छोटी लंबाई एक्स विकल्प है, और इसका मतलब है कि एक लंबे ट्रैकिंग यूआरएल के साथ पैक किए गए ट्वीट में वास्तविक शब्दों के लिए एक अनुभवहीन अक्षर गणना की तुलना में कहीं अधिक जगह बची है - एक ट्वीट कहां समाप्त होता है यह तय करते समय स्प्लिटर इसका ध्यान रखता है।

एक लंबी पोस्ट को एक धागे में विभाजित करना हर 280 अक्षरों को काटने से कहीं अधिक है। यह उपकरण प्राथमिकता के क्रम में सीमाओं के तीन स्तरों के माध्यम से काम करता है: यह पहले पूरे पैराग्राफ को एक साथ रखने की कोशिश करता है, जब पैराग्राफ बहुत लंबा होता है तो वास्तविक वाक्य-सीमा अनुमान पर वापस आ जाता है (एक रेगेक्स-आधारित स्प्लिटर जो वाक्य-समाप्ति अवधि और "डॉ" या "जैसे" जैसे संक्षिप्त नाम या "3.14" जैसी दशमलव संख्या के बीच अंतर जानता है), और अंतिम उपाय के रूप में केवल व्यक्तिगत शब्दों पर टूटता है जब एक भी वाक्य सीमा से अधिक हो जाता है - पर प्रत्येक स्तर पर, एक यूआरएल को एक अविभाज्य टोकन के रूप में माना जाता है और यह कभी भी बीच में विभाजित नहीं होता है।

थ्रेड नंबरिंग ("1/7", "2/7"...) में वास्तव में आसानी से छूटने वाला एज केस है: नंबरिंग टेक्स्ट स्वयं उस ट्वीट में वर्णों का उपयोग करता है जिससे वह जुड़ा हुआ है, और उस नंबरिंग की चौड़ाई कुल ट्वीट गिनती पर निर्भर करती है, जिसे आप विभाजित होने तक नहीं जानते हैं। यह टूल प्रत्येक पास से पहले नंबरिंग की वास्तविक भारित लंबाई को आरक्षित करके, पुनरावृत्त रूप से पुन: विभाजित करके हल करता है, जब तक कि आरक्षित बजट वास्तविक परिणामी ट्वीट गिनती से मेल नहीं खाता। मानक 280-वर्ण सीमा का उपयोग डिफ़ॉल्ट रूप से किया जाता है, एक ईमानदार नोट के साथ कि एक्स प्रीमियम ग्राहकों को उन पोस्ट के लिए बहुत अधिक लंबी-फ़ॉर्म सीमा (लगभग 25,000 वर्ण तक) मिलती है, जिन्हें सार्वजनिक थ्रेड के रूप में काम करने की आवश्यकता नहीं होती है - एक टॉगल आपको एक कस्टम सीमा पर स्विच करने देता है यदि आप यही लक्ष्य कर रहे हैं।