词法分析:

编译程序的第一步工作,编译程序的一部分。

核心作用,将字符序列转化为计算机的内部表示

读出字符序列,逐个拼出单词,并构造相应的内部表示。

检查词法错误。

例如对于字符序列源文件,经过词法分析

if (position > 10) rate = 3.14 * initial;

则应该产生下面的内容。

<$if,->,<$open,<$id,position>,<$gt,<$num,10>

<$close,rate>,<$eq,3.14>,<$mult,

<$id,initial><$semi,->

词法分析器的接口:

1,仅仅作为语法分析的子程序

read

call

Src词法分析语法分析

Char

Token

2 另一类作为编译器的独立一遍处理器

srcchar 词法分析 Token 语法分析

在这里我们讲述一下单词的含义:

单词:指的是语言中具有独立含义的最小单位。对于上面的程序语句而言。

if (position > 10) rate = 3.14 * initial;

这条语句,在词法分析的阶段我们考录3.14这个字符序列。我们可以有多种单词构成。例如

3.14 * initial这三个部分,当然这是表达式乘积,但是倘若我们再进一步的把3.14分为3 . 14

这样的划分方式就不太合理了。因为对于我们而言,3.14作为一个具有独立含义的单位,表示数字

在一个程序中,单词可以分为下列几类:

保留字:-------whiledo

标识符:identifier a,b,class T

Word

常量:

true

10 A

1 运算符 + -* /

2 界限符 { }

特殊符号:

3 格式符 EOF

那么如何实现词法程序:

需求:

描述方式

算法正则表达式

单词的描述工具分为两种:

自动机

字母表:。程序中所有可能出现的符号。A / - j 等等

符号串:符号组成的任意有穷序列

符号串的连接:

ɑ,β 分别为字母表组成的符号串,ɑ = abc β = def

则两者的连接为:ɑβ = abcdef

符号串的方幂

符号串集合的乘积

A B分别是两个符号串集合,其中A = {ab,cd},B = {ef,gh}

AB的的乘积还是一个集合{abef,abgh,cdef,cdgh}

而方幂则表示为

假如符号串集合为A = {a,b}

则A0={e},A1=A, A2=AA,…,An=AA… A

A3次方幂为AAA = (AA)A ={aa,ab,ba,bb}{a,b} = {aaa,aba,baa,bba,aab,abb,bab,bbb}

符号串的正闭包

A是符号串集合,则A+称为符号串集合A的正闭包

A+ = A+=A1A2A3 …An…

符号串集合的的星闭包

A* =A0A1A2A3 …An…=A0A+

正则表达式的定义:

为字母表,RE为定义在的正则表达式,则有

正则表达式对应的语义解释被称作正则集,正则集也是正则表达式所对应的语言。

在词法分析中,正则表达式是针对单词进行描述的,为此,我们要建立一种从正则表达式到字符串集合的映射关系。

使得正则表达式的语义解释描述成字符串的形式。

e,e1,e2上的正则表达式,则e所对应的正则集L(e)取值如下:

正则表达式的性质:

+ = * > . > |运算优先级

A | B = B | A

A | (B | C) = A ( B | C) |的可结合性

A|(BC) = (AB) | (AC) 连接的可分配性

A** = A* 幂的等价性

用正则表达式表示描述词法:

L= A|BC|D|……|a|b|……|z

D = 0|1|2|……|9 D1 = 1|2|3|……|9

标识符:(L|(L|D)*

常数: +|-|Φ|D1D*|0

实数: +|-|Φ|D1D*|0.D*

特殊符号:使用枚举

保留字: while | if | do|……

运算符: +|-|*|……

分界符: { | } | |……

控制符: \t \n

当然正则表达式不仅仅可以用于词法分析也可以在其它的地方使用,例如手机号码归属地,程序分析技术等等。

正则表达式的局限性:

正则表达式缺乏对对称性字符串的表达能力。

编译原理之词法分析的更多相关文章

  1. HTML5数字输入仅接受整数的实现代码

    这篇文章主要介绍了HTML5数字输入仅接受整数的实现代码,本文给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友可以参考下

  2. ios – 使用大写符号在字符串swift中获取URL的正则表达式

    我尝试在文本中获取URL.所以,在此之前,我使用了这样一个表达式:但是当用户输入带有大写符号的URL时(例如Http://Google.com,它与它不匹配)我遇到了问题.我试过了:但什么都没发生.解决方法您可以使用正则表达式中的i内联标志关闭区分大小写,有关可用正则表达式功能的详细信息,请参阅FoundationFrameworkReference.(?ismwx-ismwx)Flagsetti

  3. ios – 如何在Swift 3中使用正则表达式?

    解决方法我相信.当没有其他选项适用时,将使用.allZeros.因此,使用Swift3,您可以传递一个空的选项列表或省略options参数,因为它默认为无选项:要么请注意,在Swift3中,您不再使用error参数.它现在抛出.

  4. ios – lldb断点在类目标c中的所有方法

    如何使用lldb在ObjectiveC类中的所有方法上自动设置断点?

  5. swift的正则表达式(NSRegularExpression)

    init(_pattern:String){varerror:NSError?

  6. swift 正则表达式运用实例选自《swifter 100个swift开发必备tip 》

  7. Swift截取HTML中的所有图片url

    在Swift中,要从HTML格式的String中截取出所有的img的所有图片url,要截取的url就要匹配url,需要用到正则表达式。

  8. 收藏swift正则表达式的各种验证

    1.验证邮箱classfuncvalidateEmail(email:String)->Bool{varemailString="[A-Z0-9a-z._%-]@[A-Za-z0-9.-]\\.[A-Za-z]{2,4}"varemailPredicate=nspredicate(format:"SELFMATCHES%@",emailString)returnemailPredicate.eva

  9. Swift3.0-正则表达式 &lt;待续&gt;

    贡献者:赵大财博客:https://my.oschina.net/zhaodacaiGitHub:https://github.com/zhaodacai邮箱:zhaodacai@yeah.comQQ:327532817=============================先直接来代码:NSRegularExpression.OptionscaseInsensitive不区分大小写allowC

  10. 迅速 – IBInspectable创建一个下拉和更好的组织

    简而言之,我想创建一个@IBInspectable属性,使您可以在故事板中从下拉菜单中选择一系列的内容.另外如果有办法创建分隔符,更好地组织IBInspectables,我想知道这是否也可能.在我的示例中,我想为电话号码创建正则表达式字符串,以便当我去故事板时,我可以在下拉菜单中选择“电话号码”项,而不是输入正则表达式字符串.目前,我已经将一个TextField子类化,以便我可以将更多的IBIns

随机推荐

  1. 法国电话号码的正则表达式

    我正在尝试实施一个正则表达式,允许我检查一个号码是否是一个有效的法国电话号码.一定是这样的:要么:这是我实施的但是错了……

  2. 正则表达式 – perl分裂奇怪的行为

    PSperl是5.18.0问题是量词*允许零空间,你必须使用,这意味着1或更多.请注意,F和O之间的空间正好为零.

  3. 正则表达式 – 正则表达式大于和小于

    我想匹配以下任何一个字符:或=或=.这个似乎不起作用:[/]试试这个:它匹配可选地后跟=,或者只是=自身.

  4. 如何使用正则表达式用空格替换字符之间的短划线

    我想用正则表达式替换出现在带空格的字母之间的短划线.例如,用abcd替换ab-cd以下匹配字符–字符序列,但也替换字符[即ab-cd导致d,而不是abcd,因为我希望]我如何适应以上只能取代–部分?

  5. 正则表达式 – /bb | [^ b] {2} /它是如何工作的?

    有人可以解释一下吗?我在t-shirt上看到了这个:它似乎在说:“成为或不成为”怎么样?我好像没找到’e’?

  6. 正则表达式 – 在Scala中验证电子邮件一行

    在我的代码中添加简单的电子邮件验证,我创建了以下函数:这将传递像bob@testmymail.com这样的电子邮件和bobtestmymail.com之类的失败邮件,但是带有空格字符的邮件会漏掉,就像bob@testmymail也会返回true.我可能在这里很傻……当我测试你的正则表达式并且它正在捕捉简单的电子邮件时,我检查了你的代码并看到你正在使用findFirstIn.我相信这是你的问题.findFirstIn将跳转所有空格,直到它匹配字符串中任何位置的某个序列.我相信在你的情况下,最好使用unapp

  7. 正则表达式对小字符串的暴力

    在测试小字符串时,使用正则表达式会带来性能上的好处,还是会强制它们更快?不会通过检查给定字符串的字符是否在指定范围内比使用正则表达式更快来强制它们吗?

  8. 正则表达式 – 为什么`stoutest`不是有效的正则表达式?

    isthedelimiter,thenthematch-only-onceruleof?PATTERN?

  9. 正则表达式 – 替换..与.在R

    我怎样才能替换..我尝试过类似的东西:但它并不像我希望的那样有效.尝试添加fixed=T.

  10. 正则表达式 – 如何在字符串中的特定位置添加字符?

    我正在使用记事本,并希望使用正则表达式替换在字符串中的特定位置插入一个字符.例如,在每行的第6位插入一个逗号是什么意思?如果要在第六个字符后添加字符,请使用搜索和更换从技术上讲,这将用MatchGroup1替换每行的前6个字符,后跟逗号.

返回
顶部