手动规避分词失败
Author: vapleCreated Mar 6, 2026Updated Mar 6, 2026
版本: jieba==0.42.1
最小可重现用例:
import jieba
if __name__ == '__main__':
text="""IU_Query_Test_Port_[Link_port4-5] FAIL Down
整机测试查询Port(4-5)端口链路自检测试失败,更换环境复测验证故障复现,分析为单板故障"""
jieba.add_word("IU_Query_Test_Port_[Link_port4-5]")
jieba.suggest_freq("IU_Query_Test_Port_[Link_port4-5]", tune=True)
token_list = jieba.lcut(text)
print(token_list)输出结果:
['IU', '_', 'Query', '_', 'Test', '_', 'Port', '_', '[', 'Link', '_', 'port4', '-', '5', ']', ' ', ' ', 'FAIL', ' ', ' ', 'Down', '\n', '整机', '测试', '查询', 'Port', '(', '4', '-', '5', ')', '端口', '链路', '自检', '测试', '失败', ',', '更换', '环境', '复测', '验证', '故障', '复现', ',', '分析', '为', '单板', '故障']为啥IU_Query_Test_Port_[Link_port4-5]这个禁止分词失败了?怎么解决?
Source: fxsjy/jieba