1

シンボルごとに文字列を読み取ることにより、文字列リテラルを認識しようとしています。私のスキャナースケルトンの例:

public sealed class Scanner
{        
    // some class inner implementations        
    /// <summary>
    /// 
    /// </summary>
    /// <param name="Line"></param>
    /// <param name="LineNumber"></param>
    public void Run(String Line, Int32 LineNumber)
    {
        var ChPosition = default(Int32);
        var ChCurrent  = default(Char);
        var Value      = new StringBuilder();

        while (default(Char) != Line.ElementAtOrDefault<Char>(ChPosition))
        {
            ChCurrent = Line.ElementAtOrDefault<Char>(ChPosition);

            #region [Whitespace]
            if (Char.IsWhiteSpace(ChCurrent))
            {
                ChPosition++;
            }
            #endregion
            else
            {
                switch (ChCurrent)
                {                        
                    #region [String Literal (")]
                    case '"':
                        {
                            // skipping " sign, include only string inner value
                            ChCurrent = Line.ElementAtOrDefault<Char>(++ChPosition);

                            // ...? Problematic place!!!

                            this.Tokens.Enqueue(new SharedEntities.Token
                            {
                                Class = SharedEntities.Token.TokenClass.StringLiteral,
                                Value = Value.ToString()
                            }
                            );
                            Value.Clear();
                            ChPosition++;
                            break;
                        }
                    #endregion                        
                        {
                            throw new ScanningException(
                            "<syntax_error#" + ChCurrent.ToString() + ">\n"
                            + "Unsupported character appeared at: {ln: "
                            + LineNumber.ToString()
                            + "; pos: "
                            + (ChPosition + 1).ToString()
                            + "}"
                            );
                        }
                } // [switch(ChCurrent)]                   
            } // [if(Char.IsWhiteSpace(ChCurrent))...else]
        } // [while(default(Char) != Line.ElementAtOrDefault<Char>(ChPosition))]
    } // [public void Run(String Line, Int32 LineNumber)]
} // [public sealed class Scanner]

私の目標、パスカルのような文字列を解析することです

4

1 に答える 1

4

まず、明らかにある種の解析ライブラリを使用しています。たとえば、私のようにコードを変更して、誰でもコードをコピー、貼り付け、実行できるようにすると、より良い可能性があります。

答えは簡単です。(文字列リテラル) 解析領域はすべての入力を解析しません。これは、追加のライブラリなしで使用できるように変更されたコードです。

public class Test
{
    static char ElementAtOrDefault(string value, int position)
    {
        return position >= value.Length ? default(char) : value[position];
    }
    static string parseStringLiteral(string value, ref int ChPosition)
    {
        StringBuilder Value = new StringBuilder();
        char ChCurrent = ElementAtOrDefault(value, ++ChPosition);
        while (ChCurrent != '"')
        {
            Value.Append(ChCurrent);
            ChCurrent = ElementAtOrDefault(value, ++ChPosition);
            if (ChCurrent == '"')
            {
                // "" sequence only acceptable
                if (ElementAtOrDefault(value, ChPosition + 1) == '"')
                {
                    Value.Append(ChCurrent);
                    // skip 2nd double quote
                    ChPosition++;
                    // move position next
                    ChCurrent = ElementAtOrDefault(value, ++ChPosition);
                }
            }
            else if (default(Char) == ChCurrent)
            {
                // message: unterminated string
                throw new Exception("ScanningException");
            }
        }
        ChPosition++;
        return Value.ToString();
    }

    public static void test(string literal)
    {
        Console.WriteLine("testing literal with " + literal.Length + 
            " chars:\n" + literal);
        try
        {
            int pos = 0;
            string res = parseStringLiteral(literal, ref pos);
            Console.WriteLine("Parsed " + res.Length + " chars:\n" + res);
        }
        catch (Exception ex)
        {
            Console.WriteLine("Error: " + ex.Message);
        }
        Console.WriteLine();
    }

    public static int Main(string[] args)
    {
        test(@"""Hello Language Design""");
        test(@"""Is there any problems with the """"strings""""?""");
        test(@"""v#:';?325;.<>,|+_)""(*&^%$#@![]{}\|-_=""");
        return 0;
    }
}

このプログラムを実行すると、次の出力が生成されます。

23 文字のリテラルのテスト:
「こんにちは言語設計」
解析された 21 文字:
こんにちは言語設計

45 文字のリテラルのテスト:
「「ひも」に問題はありませんか?」
解析された 41 文字:
「文字列」に問題はありますか?

39 文字のリテラルのテスト:
"v#:';?325;.,|+_)"(*&^%$#@![]{}\|-_="
解析された 18 文字:
v#:';?325;.,|+_)

したがって、テストでは機能しますが、アルゴリズムが正しくありません。実行してみてください:

//literal with "", should produce ", but it does not
test(@"""""""""");

そして、あなたは間違って得ます:

4 文字のリテラルのテスト:
""""
解析された 0 文字:

問題は、 while 条件で文字 " に遭遇した場合、次の文字が " であるかどうかをチェックしないことです。

while (ChCurrent != '"') //bug

もちろん、私はあなたのために正しいバージョンを作成しました :-) ここにあります (それはあなたのスタイルを使用し、あなたのバージョンを編集しただけです):

static string parseStringLiteral(string value, ref int ChPosition)
{
    StringBuilder Value = new StringBuilder();
    char ChCurrent = ElementAtOrDefault(value, ++ChPosition);
    bool goon = true;
    while (goon)
    {
        if (ChCurrent == '"')
        {
            // "" sequence only acceptable
            if (ElementAtOrDefault(value, ChPosition + 1) == '"')
            {
                Value.Append(ChCurrent);
                // skip 2nd double quote
                ChPosition++;
                // move position next
                ChCurrent = ElementAtOrDefault(value, ++ChPosition);
            }
            else goon = false; //break;
        }
        else if (default(Char) == ChCurrent)
        {
            // message: unterminated string
            throw new Exception("ScanningException");
        }
        else
        {
            Value.Append(ChCurrent);
            ChCurrent = ElementAtOrDefault(value, ++ChPosition);
        }
    }
    ChPosition++;
    return Value.ToString();
}

幸せなコーディング:-)

于 2011-01-12T21:48:17.920 に答える