上传者: 38686080
|
上传时间: 2023-01-29 10:29:39
|
文件大小: 48KB
|
文件类型: PDF
TihuanWords.txt文档格式
注意:同一行的词用单个空格隔开,每行第一个词为同行词的替换词。
年休假 年假 年休
究竟 到底
回家场景 我回来了
代码
import jieba
def replaceSynonymWords(string1):
# 1读取同义词表,并生成一个字典。
combine_dict = {}
# synonymWords.txt是同义词表,每行是一系列同义词,用空格分割
for line in open(TihuanWords.txt, r, encoding='utf-8'):
seperate_word = line.str