forked from 2liang/AutoBuildDocFromDB
- Notifications
You must be signed in to change notification settings - Fork 1
Expand file tree
/
Copy pathFileParserClass.py
More file actions
Latest commit
105 lines (94 loc) · 3.75 KB
/
Copy pathFileParserClass.py
File metadata and controls
105 lines (94 loc) · 3.75 KB
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
100
101
102
103
104
105
# -*- coding:utf-8 -*-
importre
classFileParser:
def__init__(self):
pass
# 定义分离SQL文件匹配模式
# table_pattern = r'CREATE TABLE([\s\S]*?)LOCK TABLES' #分离表
table_pattern=r'CREATE TABLE([\s\S]*?);'
name_pattern=r'.*?`(.*?)`.*?'# 获取表名称或字段名称
table_content_pattern=r'COMMENT=\'(.*?)\''#获取表详情
defseparatTable(self, content):
'''将SQL文件中各个表分离开来
:param content:文件内容
:return:表分离后的内容
'''
pattren=re.compile(self.table_pattern)
table_list=re.findall(pattren, content)
returntable_list
defparserTableName(self, table_list):
'''
解析出数据库中所有表的表名
列表中前者为表名,后者为表含义
:param table_list:
:return:
'''
dirty_table_name= []
dirty_table_content= []
table_name= []
# 取出表名和表含义行脏数据
fortableintable_list:
tmp=table.split('\n')
dirty_table_name.append(tmp[0])
dirty_table_content.append(tmp[-1])
foriinrange(len(dirty_table_name)):
tmp= []
# 从脏数据中取出表名
# print dirty_table_name[i].strip()
name=re.match(self.name_pattern, dirty_table_name[i].strip())
ifname!=None:
# print name.group(1)
tmp.append(name.group(1))
# 从脏数据中取出表含义
content=re.match(self.table_content_pattern, dirty_table_content[i].split(' ')[-1])
ifcontent!=None:
tmp.append(content.group(1))
else:
tmp.append('')
table_name.append(tmp)
returntable_name
defparserColumn(self, table_list, table_name):
'''
获取字段情况
:param table_list: separatTable中分离出的数据
:param table_name: parserTableName中解析出的数据
:return:
'''
dirty_column_list= []
fortableintable_list:
dirty_column_list.append(table.split('\n')[1:-1])
table_data= []
foriinrange(len(dirty_column_list)):
dirty_column= []
dirty_column=dirty_column_list[i]
column_tmp= []
'''
先取两边空格
用空格分割
第一个有没有``,有取出来,无舍弃
'''
forcolumnindirty_column:
tmp_list=column.strip().split(' ')
clean_list= []
foreleintmp_list:
if''!=eleandnoteleinclean_list:
clean_list.append(ele)
if0==len(clean_list):
continue
column_name=re.match(r'`(.*?)`', clean_list[0])
ifcolumn_name!=None:
column_name=column_name.group(1)
column_type=clean_list[1]
# TODO:此处无法正确匹配,使用取列表最后一项,可能会有bug
column_comment=re.match(r'.*?COMMENT \'(.*?)\'.*?', column.strip())
ifcolumn_commentisnotNone:
column_comment=column_comment.group(1)
else:
column_comment=''
# if '\'' in clean_list[-1]:
# column_comment = clean_list[-1][1:-2]
# else:
# column_comment = ''
column_tmp.append([column_name, column_type, column_comment])
table_data.append([table_name[i], column_tmp])
returntable_data