ऑब्जेक्टिव-सी / कोको टच में HTML कैरेक्टर डिकोडिंग


103

सबसे पहले, मैंने यह पाया: उद्देश्य सी HTML से बच / अनस्केप , लेकिन यह मेरे लिए काम नहीं करता है।

मेरे एन्कोड किए गए अक्षर (RSS फ़ीड, btw से आते हैं) इस तरह दिखते हैं: &

मैंने सभी नेट पर खोज की और संबंधित चर्चाएं कीं, लेकिन मेरे विशेष एन्कोडिंग के लिए कोई फिक्स नहीं है, मुझे लगता है कि उन्हें हेक्साडेसिमल अक्षर कहा जाता है।


3
यह टिप्पणी मूल प्रश्न के छह महीने बाद की है, इसलिए यह उन लोगों के लिए अधिक है जो इस सवाल का जवाब और समाधान की तलाश में ठोकर खाते हैं। इसी तरह का एक सवाल हाल ही में सामने आया था कि मैंने stackoverflow.com/questions/2254862/… का जवाब दिया था। यह RegexKitLite और Blocks का उपयोग करके &#...;एक स्ट्रिंग को उसके समतुल्य चरित्र के साथ खोज और प्रतिस्थापित करने के लिए करता है।
जॉनी

क्या विशेष रूप से "काम नहीं करता है"? मुझे इस प्रश्न में ऐसा कुछ भी नहीं दिखाई दे रहा है जो पहले वाले प्रश्न का डुप्लिकेट नहीं है।
पीटर होसी

यह दशमलव है। हेक्साडेसिमल है 8
kennytm

दशमलव और हेक्साडेसिमल के बीच का अंतर यह है कि दशमलव बेस -10 है, जबकि हेक्साडेसिमल बेस -16 है। "38" प्रत्येक आधार में एक अलग संख्या है; आधार 10 में, यह 3 × 10 + 8 × 1 = अड़तीस है, जबकि आधार -16 में, यह 3 × 16 + 8 × 1 = पचहत्तर है। उच्च अंक आधार की उच्च शक्तियाँ (गुणक) हैं; सबसे कम संपूर्ण अंक आधार 0 (= 1) है, अगला उच्च अंक आधार 1 (= आधार) है, अगला एक आधार ** 2 (= आधार * आधार) है, आदि। यह कार्य में प्रतिपादक है।
पीटर होसी

जवाबों:


46

जिन्हें कैरेक्टर एंटिटी रेफरेंस कहा जाता है । जब वे इसका रूप &#<number>;लेते हैं तो उन्हें संख्यात्मक इकाई संदर्भ कहा जाता है । असल में, यह बाइट का एक स्ट्रिंग प्रतिनिधित्व है जिसे प्रतिस्थापित किया जाना चाहिए। के मामले में &#038;, यह ISO-8859-1 चरित्र एन्कोडिंग योजना में 38 के मूल्य के साथ चरित्र का प्रतिनिधित्व करता है, जो है &

एम्परसैंड को RSS में एनकोड करने का कारण यह एक आरक्षित विशेष चरित्र है।

आपको जो करने की आवश्यकता है वह स्ट्रिंग को पार्स करना है और एक बाइट के साथ संस्थाओं को प्रतिस्थापित करना है &#और इसके बीच के मूल्य का मिलान करना है ;। मैं उद्देश्य सी में यह करने के लिए किसी भी महान तरीके के बारे में नहीं जानता, लेकिन यह स्टैक ओवरफ्लो प्रश्न कुछ मदद का हो सकता है।

संपादित करें: दो साल पहले इसका जवाब देने के बाद से कुछ महान समाधान हैं; नीचे @Michael Waterfall का उत्तर देखें।


2
+1 मैं बस एक ही उत्तर प्रस्तुत करने वाला था (एक ही लिंक सहित, कोई कम नहीं!)
e.James

"मूल रूप से, यह बाइट का एक स्ट्रिंग प्रतिनिधित्व है जिसे प्रतिस्थापित किया जाना चाहिए।" चरित्र अधिक पसंद है। यह पाठ है, डेटा नहीं; पाठ को डेटा में परिवर्तित करने पर, चरित्र और एन्कोडिंग के आधार पर, चरित्र कई बाइट्स पर कब्जा कर सकता है।
पीटर होसी

उत्तर के लिए धन्यवाद। आपने कहा "यह ISO-8859-1 चरित्र एन्कोडिंग योजना में 38 के मूल्य के साथ चरित्र का प्रतिनिधित्व करता है, जो &" है। क्या अापको उस बारे में पूर्ण विशवास है? क्या आपके पास इस प्रकार की किसी वर्ण तालिका का लिंक है? क्योंकि मुझे याद है कि एक एकल उद्धरण था।
treznik

en.wikipedia.org/wiki/ISO/IEC_8859-1#ISO-8859-1 या सिर्फ टाइप करें & # 038; गूगल में।
मैट ब्रिजेस

और क्या & amp के बारे में; या & कॉपी; प्रतीकों?
वोकिलम

162

HTML के लिए मेरी NSString श्रेणी देखें । यहां उपलब्ध तरीके हैं:

- (NSString *)stringByConvertingHTMLToPlainText;
- (NSString *)stringByDecodingHTMLEntities;
- (NSString *)stringByEncodingHTMLEntities;
- (NSString *)stringWithNewLinesAsBRs;
- (NSString *)stringByRemovingNewLinesAndWhitespace;

3
यार, उत्कृष्ट कार्य। आपके stringByDecodingXMLEntities विधि ने मेरा दिन बना दिया! धन्यवाद!
ब्रायन मोसकाऊ

3
कोई समस्या नहीं;) खुशी है कि आप इसे उपयोगी पाया!
माइकल वाटरफॉल

4
कुछ घंटों की खोज के बाद मुझे पता है कि यह ऐसा करने का एकमात्र तरीका है जो वास्तव में काम करता है। NSString एक स्ट्रिंग विधि के लिए अतिदेय है जो ऐसा कर सकता है। बहुत बढ़िया।
एडम एबरबैक

1
मुझे माइकल के लाइसेंस पर (2) मेरे उपयोग के मामले में भी प्रतिबंधात्मक पाया गया, इसलिए मैंने निकिता के समाधान का उपयोग किया। Google टूलबॉक्स से तीन अपाचे-2.0-लाइसेंस प्राप्त फ़ाइलों को शामिल करना मेरे लिए बहुत अच्छा काम करता है।
जैमे

10
ARC के लिए कोड अपडेट करना आसान होगा .. Xcode ARC त्रुटियों और निर्माण पर चेतावनियों का टन फेंक रहा है
Matej

52

डैनियल द्वारा एक मूल रूप से बहुत अच्छा है, और मैंने वहां कुछ मुद्दे तय किए हैं:

  1. NSSCanner के लिए लंघन चरित्र को हटा दिया गया (अन्यथा दो निरंतर संस्थाओं के बीच रिक्त स्थान को अनदेखा किया जाएगा

    [स्कैनर setCharactersToBeSkipped: nil];

  2. पार्सिंग को तब अलग किया जाता है जब अलग-अलग 'और' चिह्न होते हैं (मुझे यकीन नहीं है कि इसके लिए 'सही' आउटपुट क्या है, मैंने इसकी तुलना फ़ायरफ़ॉक्स से की है):

जैसे

    &#ABC DF & B&#39;  & C&#39; Items (288)

यहाँ संशोधित कोड है:

- (NSString *)stringByDecodingXMLEntities {
    NSUInteger myLength = [self length];
    NSUInteger ampIndex = [self rangeOfString:@"&" options:NSLiteralSearch].location;

    // Short-circuit if there are no ampersands.
    if (ampIndex == NSNotFound) {
        return self;
    }
    // Make result string with some extra capacity.
    NSMutableString *result = [NSMutableString stringWithCapacity:(myLength * 1.25)];

    // First iteration doesn't need to scan to & since we did that already, but for code simplicity's sake we'll do it again with the scanner.
    NSScanner *scanner = [NSScanner scannerWithString:self];

    [scanner setCharactersToBeSkipped:nil];

    NSCharacterSet *boundaryCharacterSet = [NSCharacterSet characterSetWithCharactersInString:@" \t\n\r;"];

    do {
        // Scan up to the next entity or the end of the string.
        NSString *nonEntityString;
        if ([scanner scanUpToString:@"&" intoString:&nonEntityString]) {
            [result appendString:nonEntityString];
        }
        if ([scanner isAtEnd]) {
            goto finish;
        }
        // Scan either a HTML or numeric character entity reference.
        if ([scanner scanString:@"&amp;" intoString:NULL])
            [result appendString:@"&"];
        else if ([scanner scanString:@"&apos;" intoString:NULL])
            [result appendString:@"'"];
        else if ([scanner scanString:@"&quot;" intoString:NULL])
            [result appendString:@"\""];
        else if ([scanner scanString:@"&lt;" intoString:NULL])
            [result appendString:@"<"];
        else if ([scanner scanString:@"&gt;" intoString:NULL])
            [result appendString:@">"];
        else if ([scanner scanString:@"&#" intoString:NULL]) {
            BOOL gotNumber;
            unsigned charCode;
            NSString *xForHex = @"";

            // Is it hex or decimal?
            if ([scanner scanString:@"x" intoString:&xForHex]) {
                gotNumber = [scanner scanHexInt:&charCode];
            }
            else {
                gotNumber = [scanner scanInt:(int*)&charCode];
            }

            if (gotNumber) {
                [result appendFormat:@"%C", (unichar)charCode];

                [scanner scanString:@";" intoString:NULL];
            }
            else {
                NSString *unknownEntity = @"";

                [scanner scanUpToCharactersFromSet:boundaryCharacterSet intoString:&unknownEntity];


                [result appendFormat:@"&#%@%@", xForHex, unknownEntity];

                //[scanner scanUpToString:@";" intoString:&unknownEntity];
                //[result appendFormat:@"&#%@%@;", xForHex, unknownEntity];
                NSLog(@"Expected numeric character entity but got &#%@%@;", xForHex, unknownEntity);

            }

        }
        else {
            NSString *amp;

            [scanner scanString:@"&" intoString:&amp];  //an isolated & symbol
            [result appendString:amp];

            /*
            NSString *unknownEntity = @"";
            [scanner scanUpToString:@";" intoString:&unknownEntity];
            NSString *semicolon = @"";
            [scanner scanString:@";" intoString:&semicolon];
            [result appendFormat:@"%@%@", unknownEntity, semicolon];
            NSLog(@"Unsupported XML character entity %@%@", unknownEntity, semicolon);
             */
        }

    }
    while (![scanner isAtEnd]);

finish:
    return result;
}

इस सवाल का निश्चित जवाब होना चाहिए !! धन्यवाद!
boliva

इसने बहुत अच्छा काम किया। दुर्भाग्य से उच्चतम श्रेणी के उत्तर का कोड एआरसी मुद्दों के कारण अब काम नहीं करता है, लेकिन यह करता है।
टेड कुलप

@TedKulp यह ठीक काम करता है, आपको बस ARC प्रति फ़ाइल को अक्षम करना होगा। stackoverflow.com/questions/6646052/…
काइल

अगर मैं कर सकता तो मैं तुम्हें दो बार अंगूठे लगाता।
किबित्ज़ोक

2016 में अभी भी इस सवाल पर आने वाले लोगों के लिए स्विफ्ट अनुवाद: stackoverflow.com/a/35303635/1153630
मैक्स चुक्विया

46

IOS 7 के रूप में, आप एक का उपयोग करके मूल रूप से एचटीएमएल पात्रों को डिकोड कर सकते हैं NSAttributedStringके साथ NSHTMLTextDocumentTypeविशेषता:

NSString *htmlString = @"&#63743; &amp; &#38; &lt; &gt; &trade; &copy; &hearts; &clubs; &spades; &diams;";
NSData *stringData = [htmlString dataUsingEncoding:NSUTF8StringEncoding];

NSDictionary *options = @{NSDocumentTypeDocumentAttribute:NSHTMLTextDocumentType};
NSAttributedString *decodedString;
decodedString = [[NSAttributedString alloc] initWithData:stringData
                                                 options:options
                                      documentAttributes:NULL
                                                   error:NULL];

डिकोड किए गए स्ट्रिंग को अब प्रदर्शित किया जाएगा: & & <> ™ © ♥ attribut string string।

नोट: यह केवल तभी काम करेगा जब मुख्य धागे पर बुलाया जाएगा।


6
सबसे अच्छा जवाब अगर आपको आईओएस 6 और पुराने का समर्थन करने की आवश्यकता नहीं है
jarsarmobile

1
नहीं, सबसे अच्छा नहीं अगर कोई इसे bg धागा पर एनकोड करना चाहता है, O
बेडेलेक्स

4
यह एक इकाई को डिकोड करने के लिए काम करता है, लेकिन इसने गैर-एन्कोडेड डैश को भी गड़बड़ कर दिया।
एंड्रयू

यह मुख्य धागे पर होने के लिए मजबूर किया जाता है। यदि आप नहीं करना चाहते हैं तो आप शायद ऐसा नहीं करना चाहते हैं।
कीथ स्माइली

जब यह UITableView की बात है तो यह GUI को लटका देता है। इसलिए, सही ढंग से काम नहीं कर रहा है।
आसिफ बिलाल

35

कोई भी सबसे सरल विकल्पों में से एक का उल्लेख नहीं करता है: मैक के लिए Google टूलबॉक्स
(नाम के बावजूद, यह आईओएस पर भी काम करता है)।

https://github.com/google/google-toolbox-for-mac/blob/master/Foundation/GTMNSString%2BHTML.h

/// Get a string where internal characters that are escaped for HTML are unescaped 
//
///  For example, '&amp;' becomes '&'
///  Handles &#32; and &#x32; cases as well
///
//  Returns:
//    Autoreleased NSString
//
- (NSString *)gtm_stringByUnescapingFromHTML;

और मुझे परियोजना में केवल तीन फाइलें शामिल करनी थीं: हेडर, कार्यान्वयन और GTMDefines.h


मैंने इसे तीन स्क्रिप्ट में शामिल किया है, लेकिन अब मैं इसका उपयोग कैसे कर सकता हूं?
बोरुत तोमाज़िन

@ borut-t [myString gtm_stringByUnesformationFromHTML]
निकिता

2
मैंने केवल उन तीन फ़ाइलों को शामिल करना चुना, इसलिए मुझे इसे चाप के साथ संगत बनाने के लिए ऐसा करने की आवश्यकता थी: code.google.com/p/google-toolbox-for-mac/wiki/ARC_Compatibility
jaime

मुझे कहना है कि यह अब तक का सबसे सरल और सबसे हल्का समाधान है
लेंसोवेट

काश मुझे यह पूरी तरह से काम करने के लिए मिल सके। यह मेरे तार में उनमें से कई पर छोड़ करने के लिए लगता है।
जोसेफ टोरंटो

17

मैं GitHub या कुछ पर यह पोस्ट करना चाहिए। यह NSString की एक श्रेणी में जाता है, NSScannerकार्यान्वयन के लिए उपयोग करता है , और दोनों हेक्स और दशमलव संख्यात्मक वर्ण संस्थाओं के साथ-साथ सामान्य प्रतीकात्मक वाले को संभालता है।

इसके अलावा, यह विकृत स्ट्रिंग्स को संभालता है (जब आपके पास वर्णों का एक अमान्य अनुक्रम होता है) अपेक्षाकृत शान से, जो इस कोड का उपयोग करने वाले मेरे जारी किए गए ऐप में महत्वपूर्ण हो गया है

- (NSString *)stringByDecodingXMLEntities {
    NSUInteger myLength = [self length];
    NSUInteger ampIndex = [self rangeOfString:@"&" options:NSLiteralSearch].location;

    // Short-circuit if there are no ampersands.
    if (ampIndex == NSNotFound) {
        return self;
    }
    // Make result string with some extra capacity.
    NSMutableString *result = [NSMutableString stringWithCapacity:(myLength * 1.25)];

    // First iteration doesn't need to scan to & since we did that already, but for code simplicity's sake we'll do it again with the scanner.
    NSScanner *scanner = [NSScanner scannerWithString:self];
    do {
        // Scan up to the next entity or the end of the string.
        NSString *nonEntityString;
        if ([scanner scanUpToString:@"&" intoString:&nonEntityString]) {
            [result appendString:nonEntityString];
        }
        if ([scanner isAtEnd]) {
            goto finish;
        }
        // Scan either a HTML or numeric character entity reference.
        if ([scanner scanString:@"&amp;" intoString:NULL])
            [result appendString:@"&"];
        else if ([scanner scanString:@"&apos;" intoString:NULL])
            [result appendString:@"'"];
        else if ([scanner scanString:@"&quot;" intoString:NULL])
            [result appendString:@"\""];
        else if ([scanner scanString:@"&lt;" intoString:NULL])
            [result appendString:@"<"];
        else if ([scanner scanString:@"&gt;" intoString:NULL])
            [result appendString:@">"];
        else if ([scanner scanString:@"&#" intoString:NULL]) {
            BOOL gotNumber;
            unsigned charCode;
            NSString *xForHex = @"";

            // Is it hex or decimal?
            if ([scanner scanString:@"x" intoString:&xForHex]) {
                gotNumber = [scanner scanHexInt:&charCode];
            }
            else {
                gotNumber = [scanner scanInt:(int*)&charCode];
            }
            if (gotNumber) {
                [result appendFormat:@"%C", charCode];
            }
            else {
                NSString *unknownEntity = @"";
                [scanner scanUpToString:@";" intoString:&unknownEntity];
                [result appendFormat:@"&#%@%@;", xForHex, unknownEntity];
                NSLog(@"Expected numeric character entity but got &#%@%@;", xForHex, unknownEntity);
            }
            [scanner scanString:@";" intoString:NULL];
        }
        else {
            NSString *unknownEntity = @"";
            [scanner scanUpToString:@";" intoString:&unknownEntity];
            NSString *semicolon = @"";
            [scanner scanString:@";" intoString:&semicolon];
            [result appendFormat:@"%@%@", unknownEntity, semicolon];
            NSLog(@"Unsupported XML character entity %@%@", unknownEntity, semicolon);
        }
    }
    while (![scanner isAtEnd]);

finish:
    return result;
}

कोड का बहुत उपयोगी टुकड़ा, हालांकि इसमें कुछ मुद्दे हैं जो वाल्टी द्वारा संबोधित किए गए थे। साझा करने के लिए धन्यवाद!
माइकल वाटरफॉल

क्या आप अपने XML संस्थाओं जैसे & माइक्रो को डिकोड करके लैम्ब्डा, म्यू, न्यू, पाई प्रतीकों को दिखाने का एक तरीका जानते हैं; ... ect ????
चिन्तकपाद

आपको gotoइसकी भयानक कोड शैली के रूप में उपयोग करने से बचना चाहिए । आप लाइन बदल दिया जाना चाहिए goto finish;के साथ break;
स्टनर

4

यह वह तरीका है जो मैं RegexKitLite फ्रेमवर्क का उपयोग करके करता हूं :

-(NSString*) decodeHtmlUnicodeCharacters: (NSString*) html {
NSString* result = [html copy];
NSArray* matches = [result arrayOfCaptureComponentsMatchedByRegex: @"\\&#([\\d]+);"];

if (![matches count]) 
    return result;

for (int i=0; i<[matches count]; i++) {
    NSArray* array = [matches objectAtIndex: i];
    NSString* charCode = [array objectAtIndex: 1];
    int code = [charCode intValue];
    NSString* character = [NSString stringWithFormat:@"%C", code];
    result = [result stringByReplacingOccurrencesOfString: [array objectAtIndex: 0]
                                               withString: character];      
}   
return result;  

}

आशा है कि यह किसी की मदद करेगा।


4

आप इस समस्या को हल करने के लिए सिर्फ इस फ़ंक्शन का उपयोग कर सकते हैं।

+ (NSString*) decodeHtmlUnicodeCharactersToString:(NSString*)str
{
    NSMutableString* string = [[NSMutableString alloc] initWithString:str];  // #&39; replace with '
    NSString* unicodeStr = nil;
    NSString* replaceStr = nil;
    int counter = -1;

    for(int i = 0; i < [string length]; ++i)
    {
        unichar char1 = [string characterAtIndex:i];    
        for (int k = i + 1; k < [string length] - 1; ++k)
        {
            unichar char2 = [string characterAtIndex:k];    

            if (char1 == '&'  && char2 == '#' ) 
            {   
                ++counter;
                unicodeStr = [string substringWithRange:NSMakeRange(i + 2 , 2)];    
                // read integer value i.e, 39
                replaceStr = [string substringWithRange:NSMakeRange (i, 5)];     //     #&39;
                [string replaceCharactersInRange: [string rangeOfString:replaceStr] withString:[NSString stringWithFormat:@"%c",[unicodeStr intValue]]];
                break;
            }
        }
    }
    [string autorelease];

    if (counter > 1)
        return  [self decodeHtmlUnicodeCharactersToString:string]; 
    else
        return string;
}

2

यहाँ वाल्टी येंग के जवाब का एक स्विफ्ट संस्करण है :

extension String {
    static private let mappings = ["&quot;" : "\"","&amp;" : "&", "&lt;" : "<", "&gt;" : ">","&nbsp;" : " ","&iexcl;" : "¡","&cent;" : "¢","&pound;" : " £","&curren;" : "¤","&yen;" : "¥","&brvbar;" : "¦","&sect;" : "§","&uml;" : "¨","&copy;" : "©","&ordf;" : " ª","&laquo" : "«","&not" : "¬","&reg" : "®","&macr" : "¯","&deg" : "°","&plusmn" : "±","&sup2; " : "²","&sup3" : "³","&acute" : "´","&micro" : "µ","&para" : "¶","&middot" : "·","&cedil" : "¸","&sup1" : "¹","&ordm" : "º","&raquo" : "»&","frac14" : "¼","&frac12" : "½","&frac34" : "¾","&iquest" : "¿","&times" : "×","&divide" : "÷","&ETH" : "Ð","&eth" : "ð","&THORN" : "Þ","&thorn" : "þ","&AElig" : "Æ","&aelig" : "æ","&OElig" : "Œ","&oelig" : "œ","&Aring" : "Å","&Oslash" : "Ø","&Ccedil" : "Ç","&ccedil" : "ç","&szlig" : "ß","&Ntilde;" : "Ñ","&ntilde;":"ñ",]

    func stringByDecodingXMLEntities() -> String {

        guard let _ = self.rangeOfString("&", options: [.LiteralSearch]) else {
            return self
        }

        var result = ""

        let scanner = NSScanner(string: self)
        scanner.charactersToBeSkipped = nil

        let boundaryCharacterSet = NSCharacterSet(charactersInString: " \t\n\r;")

        repeat {
            var nonEntityString: NSString? = nil

            if scanner.scanUpToString("&", intoString: &nonEntityString) {
                if let s = nonEntityString as? String {
                    result.appendContentsOf(s)
                }
            }

            if scanner.atEnd {
                break
            }

            var didBreak = false
            for (k,v) in String.mappings {
                if scanner.scanString(k, intoString: nil) {
                    result.appendContentsOf(v)
                    didBreak = true
                    break
                }
            }

            if !didBreak {

                if scanner.scanString("&#", intoString: nil) {

                    var gotNumber = false
                    var charCodeUInt: UInt32 = 0
                    var charCodeInt: Int32 = -1
                    var xForHex: NSString? = nil

                    if scanner.scanString("x", intoString: &xForHex) {
                        gotNumber = scanner.scanHexInt(&charCodeUInt)
                    }
                    else {
                        gotNumber = scanner.scanInt(&charCodeInt)
                    }

                    if gotNumber {
                        let newChar = String(format: "%C", (charCodeInt > -1) ? charCodeInt : charCodeUInt)
                        result.appendContentsOf(newChar)
                        scanner.scanString(";", intoString: nil)
                    }
                    else {
                        var unknownEntity: NSString? = nil
                        scanner.scanUpToCharactersFromSet(boundaryCharacterSet, intoString: &unknownEntity)
                        let h = xForHex ?? ""
                        let u = unknownEntity ?? ""
                        result.appendContentsOf("&#\(h)\(u)")
                    }
                }
                else {
                    scanner.scanString("&", intoString: nil)
                    result.appendContentsOf("&")
                }
            }

        } while (!scanner.atEnd)

        return result
    }
}

1

वास्तव में माइकल वाटरफॉल का महान MWFeedParser फ्रेमवर्क (उनके उत्तर के लिए संदर्भित) rmchaara द्वारा फोर्क किया गया है जिन्होंने इसे ARC समर्थन के साथ अद्यतन किया है!

आप इसे गितुब में यहां पा सकते हैं

यह वास्तव में बहुत अच्छा काम करता है, मैंने stringByDecodingHTMLEntities विधि का उपयोग किया और त्रुटिपूर्ण तरीके से काम करता है।


जो एआरसी मुद्दों को ठीक करता है - लेकिन कुछ चेतावनियों का परिचय देता है। मुझे लगता है कि उन्हें अनदेखा करना सुरक्षित है?
रॉबर्ट जे। क्लेग

0

जैसे कि आपको कोई और उपाय चाहिए! यह एक बहुत ही सरल और काफी प्रभावी है:

@interface NSString (NSStringCategory)
- (NSString *) stringByReplacingISO8859Codes;
@end


@implementation NSString (NSStringCategory)
- (NSString *) stringByReplacingISO8859Codes
{
    NSString *dataString = self;
    do {
        //*** See if string contains &# prefix
        NSRange range = [dataString rangeOfString: @"&#" options: NSRegularExpressionSearch];
        if (range.location == NSNotFound) {
            break;
        }
        //*** Get the next three charaters after the prefix
        NSString *isoHex = [dataString substringWithRange: NSMakeRange(range.location + 2, 3)];
        //*** Create the full code for replacement
        NSString *isoString = [NSString stringWithFormat: @"&#%@;", isoHex];
        //*** Convert to decimal integer
        unsigned decimal = 0;
        NSScanner *scanner = [NSScanner scannerWithString: [NSString stringWithFormat: @"0%@", isoHex]];
        [scanner scanHexInt: &decimal];
        //*** Use decimal code to get unicode character
        NSString *unicode = [NSString stringWithFormat:@"%C", decimal];
        //*** Replace all occurences of this code in the string
        dataString = [dataString stringByReplacingOccurrencesOfString: isoString withString: unicode];
    } while (TRUE); //*** Loop until we hit the NSNotFound

    return dataString;
}
@end

0

यदि आपके पास एक स्ट्रिंग के रूप में कैरेक्टर एंटिटी संदर्भ है, उदाहरण के लिए @"2318", आप सही यूनिकोड वर्ण का उपयोग करके एक पुनरावर्ती NSString निकाल सकते हैं strtoul;

NSString *unicodePoint = @"2318"
unichar iconChar = (unichar) strtoul(unicodePoint.UTF8String, NULL, 16);
NSString *recoded = [NSString stringWithFormat:@"%C", iconChar];
NSLog(@"recoded: %@", recoded");
// prints out "recoded: ⌘"

0

जुगले के जवाब के 3 संस्करण स्विफ्ट

extension String {
    static private let mappings = ["&quot;" : "\"","&amp;" : "&", "&lt;" : "<", "&gt;" : ">","&nbsp;" : " ","&iexcl;" : "¡","&cent;" : "¢","&pound;" : " £","&curren;" : "¤","&yen;" : "¥","&brvbar;" : "¦","&sect;" : "§","&uml;" : "¨","&copy;" : "©","&ordf;" : " ª","&laquo" : "«","&not" : "¬","&reg" : "®","&macr" : "¯","&deg" : "°","&plusmn" : "±","&sup2; " : "²","&sup3" : "³","&acute" : "´","&micro" : "µ","&para" : "¶","&middot" : "·","&cedil" : "¸","&sup1" : "¹","&ordm" : "º","&raquo" : "»&","frac14" : "¼","&frac12" : "½","&frac34" : "¾","&iquest" : "¿","&times" : "×","&divide" : "÷","&ETH" : "Ð","&eth" : "ð","&THORN" : "Þ","&thorn" : "þ","&AElig" : "Æ","&aelig" : "æ","&OElig" : "Œ","&oelig" : "œ","&Aring" : "Å","&Oslash" : "Ø","&Ccedil" : "Ç","&ccedil" : "ç","&szlig" : "ß","&Ntilde;" : "Ñ","&ntilde;":"ñ",]

    func stringByDecodingXMLEntities() -> String {

        guard let _ = self.range(of: "&", options: [.literal]) else {
            return self
        }

        var result = ""

        let scanner = Scanner(string: self)
        scanner.charactersToBeSkipped = nil

        let boundaryCharacterSet = CharacterSet(charactersIn: " \t\n\r;")

        repeat {
            var nonEntityString: NSString? = nil

            if scanner.scanUpTo("&", into: &nonEntityString) {
                if let s = nonEntityString as? String {
                    result.append(s)
                }
            }

            if scanner.isAtEnd {
                break
            }

            var didBreak = false
            for (k,v) in String.mappings {
                if scanner.scanString(k, into: nil) {
                    result.append(v)
                    didBreak = true
                    break
                }
            }

            if !didBreak {

                if scanner.scanString("&#", into: nil) {

                    var gotNumber = false
                    var charCodeUInt: UInt32 = 0
                    var charCodeInt: Int32 = -1
                    var xForHex: NSString? = nil

                    if scanner.scanString("x", into: &xForHex) {
                        gotNumber = scanner.scanHexInt32(&charCodeUInt)
                    }
                    else {
                        gotNumber = scanner.scanInt32(&charCodeInt)
                    }

                    if gotNumber {
                        let newChar = String(format: "%C", (charCodeInt > -1) ? charCodeInt : charCodeUInt)
                        result.append(newChar)
                        scanner.scanString(";", into: nil)
                    }
                    else {
                        var unknownEntity: NSString? = nil
                        scanner.scanUpToCharacters(from: boundaryCharacterSet, into: &unknownEntity)
                        let h = xForHex ?? ""
                        let u = unknownEntity ?? ""
                        result.append("&#\(h)\(u)")
                    }
                }
                else {
                    scanner.scanString("&", into: nil)
                    result.append("&")
                }
            }

        } while (!scanner.isAtEnd)

        return result
    }
}
हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.