xml - XML 1 バイト UTF-8 シーケンスのバイト 1 が無効です

Question

私は 2 つの xml ファイルを取得して 1 つにマージするプログラムを持っています。これを行っているときに、「and」から「and '」に変換することができました。なぜ私がこれを行っているのかについては話していませんが、ここにコードスニペットを示します。「’」エラーを削除すると、もはや存在しないため、ここに貼り付けます。

convertedString = replace(convertedString, (String)"and ", 
                (String)"and &#8217;");
convertedString = replace(convertedString, (String)"&quot;", 
                (String)"\\\"");
convertedString = StringEscapeUtils.unescapeHtml(convertedString);

printDocument メソッドを使用:

private static void printDocument(Document doc, OutputStream out) 
    throws IOException, TransformerException 
    {     
        TransformerFactory tf = TransformerFactory.newInstance();     
        Transformer transformer = tf.newTransformer();     
        transformer.setOutputProperty(OutputKeys.OMIT_XML_DECLARATION, "no");     
        transformer.setOutputProperty(OutputKeys.METHOD, "xml");     
        transformer.setOutputProperty(OutputKeys.INDENT, "yes");     
        transformer.setOutputProperty(OutputKeys.ENCODING, "UTF-8");     
        transformer.setOutputProperty("{http://xml.apache.org/xslt}indent-" +
                "amount", "4");      
        transformer.transform(new DOMSource(doc),           
                new StreamResult(new OutputStreamWriter(out, "UTF-8"))); 
    }

私が得る私のプログラムを実行する

com.sun.org.apache.xerces.internal.impl.io.MalformedByteSequenceException: Invalid byte 1 of 1-byte UTF-8 sequence.
    at com.sun.org.apache.xerces.internal.impl.io.UTF8Reader.invalidByte(UTF8Reader.java:684)
    at com.sun.org.apache.xerces.internal.impl.io.UTF8Reader.read(UTF8Reader.java:554)
    at com.sun.org.apache.xerces.internal.impl.XMLEntityScanner.load(XMLEntityScanner.java:1742)
    at com.sun.org.apache.xerces.internal.impl.XMLEntityScanner.skipChar(XMLEntityScanner.java:1416)
    at com.sun.org.apache.xerces.internal.impl.XMLDocumentFragmentScannerImpl$FragmentContentDriver.next(XMLDocumentFragmentScannerImpl.java:2793)
    at com.sun.org.apache.xerces.internal.impl.XMLDocumentScannerImpl.next(XMLDocumentScannerImpl.java:648)
    at com.sun.org.apache.xerces.internal.impl.XMLNSDocumentScannerImpl.next(XMLNSDocumentScannerImpl.java:140)
    at com.sun.org.apache.xerces.internal.impl.XMLDocumentFragmentScannerImpl.scanDocument(XMLDocumentFragmentScannerImpl.java:511)
    at com.sun.org.apache.xerces.internal.parsers.XML11Configuration.parse(XML11Configuration.java:808)
    at com.sun.org.apache.xerces.internal.parsers.XML11Configuration.parse(XML11Configuration.java:737)
    at com.sun.org.apache.xerces.internal.parsers.XMLParser.parse(XMLParser.java:119)
    at com.sun.org.apache.xerces.internal.parsers.DOMParser.parse(DOMParser.java:235)
    at com.sun.org.apache.xerces.internal.jaxp.DocumentBuilderImpl.parse(DocumentBuilderImpl.java:284)

printDocument() メソッドで UTF-8 に関係している可能性がありますが、ISO-8859-1 に変更しても効果はありませんでした。

それで、誰が問題が何であるかを助けてくれますか？とても有難い

score 1 · Accepted Answer

日食を使用している場合。Preferences/General/Workspace に移動してみてください。次に、「テキストファイルのエンコード」をUTF-8に変更します

score 0 · Accepted Answer

XML パーサーは入力を UTF-8 として解釈しようとしていますが、UTF-8 ではありません。

xml - XML 1 バイト UTF-8 シーケンスのバイト 1 が無効です

2 に答える 2

Related

Reference