求一简单词法分析程序

ccpp1982 2004-05-06 05:47:05
随便什么语法都行,只是想看看究竟是怎么做的
...全文
133 1 打赏 收藏 举报
写回复
用AI写文章
1 条回复
切换为时间正序
请发表友善的回复…
发表回复
Cathryn0000000 2004-05-06
  • 打赏
  • 举报
回复
#define BUFLEN 256 /* 读入行缓冲区大小 */
#define MAXTOKENLEN 20 /* 存放表达式字符数组大小 */

#define ENDFILE 0 /* 文件结束标志 */
#define ERROR 1 /* 出错标志 */


#define MAIN 2 /* 关键字main */
#define IF 3 /* 关键字if */
#define WHILE 4 /* 关键字while */
#define ID 5 /* 标识符 */
#define NUM 6 /* 数字 */
#define ASSIGN 7 /* = */
#define EQ 8 /* == */
#define NE 9 /* != */
#define MORE 10 /* > */
#define ME 11 /* >= */
#define LESS 12 /* < */
#define LE 13 /* <= */
#define LBRACKET 14 /* { */
#define RBRACKET 15 /* } */
#define PLUS 16 /* + */
#define MINUS 17 /* - */
#define TIMES 18 /* * */
#define OVER 19 /* / */
#define LPAREN 20 /* ( */
#define RPAREN 21 /* ) */
#define SEMI 22 /* ; */

#include <stdio.h>
#include <ctype.h>
#include <conio.h>


typedef enum /* 状态集 */
{
START, INEQULE, INNEQULE, INMORE, INLESS, INNUM, INID, DONE
} StateType;


char tokenString[MAXTOKENLEN + 1];

static char lineBuf[BUFLEN];
static int linepos = 0;
static int lineno = 0;
static int bufsize = 0;
FILE *fpin,*fpout;

static void openInputFile(){
if((fpin=fopen("in.txt","r"))==NULL){
printf("open InputFile error!!");
exit(-1);
}
}

static void openOutputFile(){
if((fpout=fopen("out.txt","w"))==NULL){
printf("open OutputFile error!!");
exit(-1);
}
}

static char getNextChar(void)
{
if ( !(linepos < bufsize) ) {
lineno++;
if ( fgets(lineBuf, BUFLEN - 1, fpin) ) {
bufsize = strlen(lineBuf);
linepos = 0;
return lineBuf[linepos++];
}
else {
return EOF;
}
}
else
return lineBuf[linepos++];
}

static void ungetNextChar(void)
{
linepos--;
}


static struct
{
char* str;
int tok;
} reservedWords[3] =
{ {"main",MAIN},
{"if", IF },
};
int getToken(void)
{
int tokenStringIndex = 0;
int currentToken;
StateType state = START;
int save;
static j=0;

while (state != DONE) {
char c = getNextChar();
save = 1;

switch (state) {
case START:
if (isdigit(c))
state = INNUM;
else if (isalpha(c))
state = INID;
else if (c == '=')
state = INEQULE;
else if (c == '>')
state =INMORE;
else if (c == '<')
state =INLESS;
else if (c == '!')
state =INNEQULE;
else if ( (c == ' ') || (c == '\t') || (c == '\n') )
save = 0;
else {
state = DONE;
switch (c) {
case EOF:
save = 0;
currentToken = ENDFILE;
break;
case '+':
currentToken = PLUS;
break;
case '-':
currentToken = MINUS;
break;
case '*':
currentToken = TIMES;
break;
case '/':
currentToken = OVER;
break;
case '(':
currentToken = LPAREN;
break;
case ')':
currentToken = RPAREN;
break;
case ';':
currentToken = SEMI;
break;
case '{':
currentToken = LBRACKET;
break;
case '}':
currentToken = RBRACKET;
break;
default:

currentToken = ERROR;
break;
}
}
break;
case INEQULE:
state = DONE;
if (c == '=')
currentToken = EQ;
else {
ungetNextChar();
save = 0;
currentToken = ASSIGN;
}
break;
case INNEQULE:
state = DONE;
if (c == '=')
currentToken = NE;
else {
ungetNextChar();
save = 0;
currentToken = ERROR;
}
break;
case INMORE:
state = DONE;
if (c == '=')
currentToken = ME;
else {
ungetNextChar();
save = 0;
currentToken = MORE;
}
break;
case INLESS:
state = DONE;
if (c == '=')
currentToken = LE;
else {
ungetNextChar();
save = 0;
currentToken = LESS;
}
break;

case INNUM:
if (!isdigit(c)) {
if(!isalpha(c)){
ungetNextChar();
save = 0;
state = DONE;
currentToken = NUM;
}
else{
save = 1;
state = DONE;
currentToken =ERROR;
}
}
break;

case DONE:
default:

state = DONE;
currentToken = ERROR;
break;
}

if ( (save) && (tokenStringIndex <= MAXTOKENLEN) )
tokenString[tokenStringIndex++] = c;
if ( state == DONE) {
tokenString[tokenStringIndex] = '\0';
if (currentToken == ID)
currentToken = reservedLookup(tokenString);
}

}

if (currentToken!=ERROR) {
if(currentToken){
printf("(%d,%s) ",currentToken,tokenString);
fprintf(fpout,"(%d,%s)",currentToken,tokenString);
if(!(++j%10)) printf("\n");
}
else {
gotoxy(1,24);
printf("Succeed! Result been put into 'out.txt'.");
printf("\nPress any key to continue... ");
getch();
}
}
else {
gotoxy(1,24);
printf("Illegal character '%s' (Row %d,Column %d)",tokenString,lineno,linepos);
printf("\nPress any key to continue... ");
window(linepos,lineno+2,linepos,lineno+2);
textbackground(4);
clrscr();
printf("%c",tokenString[tokenStringIndex-1]);
textbackground(0);
fclose(fpin);
fclose(fpout);
getch();
exit(-1);
}


return currentToken;
}



void main(){
textbackground(0);
clrscr();
openInputFile();
openOutputFile();
while(getToken());
fclose(fpin);
fclose(fpout);
}
输入为in.txt中的程序,输出到out.txt,为二元组
该数据集名为“6200印章数据集-圆椭方矩-红蓝灰”,包含6200多张印章图像,涵盖圆形、椭圆形、方形和矩形四种几何形状,并包含红色、蓝色和灰色三种颜色。其目标是服务于印章识别、印章文本识别以及印章OCR技术的研究与开发。由于形状和颜色种类丰富,该数据集有助于开发者训练出适应性更强的识别系统,以应对不同应用场景。 这些印章图像均为真实印章的高清照片,能够为印章识别算法提供充足的视觉信息。不过,该数据集不包含预标注的地面真实(GT)标签,因此开发者在使用时可能需要进行一定的数据清洗和标注,才能满足模型训练要求。尽管增加了额外工作量,但其规模和多样性仍使其成为重要的研究资源。 印章识别技术广泛应用于文档审核、版权验证、金融交易验证等领域。随着机器学习和深度学习不断发展,印章识别算法已从简单的模板匹配逐渐转向更复杂的图像处理和模式识别方法。这一进步需要大量高质量训练数据,而此类数据集正是满足这一需求的关键工具之一。 考虑到印章识别在实际应用中会遇到磨损、变形以及复杂背景等问题,该数据集在设计时也兼顾了这些现实挑战。通过提供不同形状和颜色的印章图像,它有助于研究者开发出能够应对真实世界复杂情况的算法。同时,由于缺乏GT标签,研究者在训练模型前还需解决如何高效、准确地进行图像标注的问题,这既提高了研究难度,也带来了更贴近实际应用的挑战与机会。 “6200印章数据集-圆椭方矩-红蓝灰”是一个面向印章识别技术的综合性训练数据集。它的推出对推动印章识别技术发展具有重要意义。通过有效利用该数据集,开发者可以构建更强大、更准确的印章识别系统,进一步促进相关技术的落地应用。
源码下载地址: https://pan.quark.cn/s/ae487cba003d 在计算机视觉与图像处理技术领域中,OpenCV作为一个被广泛采纳的开源框架,提供了大量的函数和工具,用于对图像进行操作和分析。本篇文章将深入阐释OpenCV在处理含有RGBA通道的图像时的应用,以及如何进行通道的分离与融合。 让我们首先掌握RGBA图像的基本构成。RGB分别象征红色(Red)、绿色(Green)以及蓝色(Blue),这三种颜色的不同强度组合能够产生多样的色彩效果。而A则代表Alpha通道,它用来指示图像的透明程度或完全不透明性。在0至255的数值区间内,0值代表完全透明,255值则表示完全不透明。当处理PNG等支持透明特性的图像格式时,RGBA模型被频繁使用。 在OpenCV软件中,我们可以借助`cv::Mat`结构体来储存和操作图像数据。对于RGBA图像,`cv::Mat`结构体的数据类型通常是`CV_8UC4`,这表明每个像素点由4个8位无符号整数(Uint8)构成,分别对应R、G、B和A四个通道。 接下来,我们将讨论如何从RGBA图像中分离各个通道。在OpenCV中,`cv::split()`函数能够实现这一功能。该函数会构建一个新的`cv::Mat`数组,数组中的每个元素都是原图像的一个独立通道。例如: ```cpp cv::Mat rgbaImage; // 加载RGBA图像 cv::imread("image.png", cv::IMREAD_UNCHANGED); // 分离通道 std::vector channels; cv::split(rgbaImage, channels); cv::Mat redChannel = ...
代码转载自:https://pan.quark.cn/s/a4b39357ea24 在信息技术领域,"后处理"一般是指在计算机辅助设计(CAD)或计算机辅助制造(CAM)系统中,将设计图纸转化为机器设备操作指令的过程。在此情形下,"佳铁雕刻机后处理.rar"是一个压缩文件,其中存放了与佳铁雕刻机相关的后处理工具或配置数据。佳铁雕刻机是一种常见的数字控制机床,主要用于精细的雕刻和加工作业,比如电脑锣、精雕机或雕铣机等设备。 雕刻机后处理包含的核心知识要点有: 1. **数字控制(NC)代码的编制**:当在CAD/CAM软件中完成工件设计后,需要将其转换为机床能够识别的数字控制指令。这一步骤即为后处理,它将三维设计转化为一系列的G代码和M代码,这些指令指导雕刻机的刀具如何移动。 2. **后处理器的个性化设置**:由于不同的雕刻机可能配备不同的控制系统和机械属性,因此需要专门设计的后处理器来适配这些特性。针对佳铁雕刻机的后处理器可能包含特定的参数调整,例如进给速率、切削深度、刀具路径优化等,以实现最佳的加工效果和效率。 3. **G代码与M代码的应用**:G代码是控制刀具运动的指令,例如G00表示快速移动,G01表示线性插补,G02和G03分别代表顺时针和逆时针的圆弧插补;M代码则是辅助操作指令,如M03代表主轴正转,M05代表主轴停转。这些指令的组合构成了完整的加工程序。 4. **机床参数设定**:后处理流程会考虑到机床的具体参数,包括电机类型、丝杠螺距、工作台尺寸等,以确保生成的NC代码与实际设备相符。 5. **刀具路径的优化**:高效的后处理能够改进刀具的运动轨迹,减少无效运行时间,提升生产效率,同时避免刀具与工件的碰撞以及工件形变,确保加工的精确度。...

70,040

社区成员

发帖
与我相关
我的任务
社区描述
C语言相关问题讨论
社区管理员
  • C语言
  • 花神庙码农
  • 架构师李肯
加入社区
  • 近7日
  • 近30日
  • 至今
社区公告
暂无公告

试试用AI创作助手写篇文章吧