簡體   English   中英

在Python中使用nltk的非ASCII字符錯誤

[英]Non-ASCII character error using nltk in Python

我正在嘗試使用以下鏈接中提供的解決方案代碼: Python NLTK中的Unicode標記

在由omerbp給出的解決方案中:

from nltk.corpus import indian
from nltk.tag import tnt

train_data = indian.tagged_sents('hindi.pos')
tnt_pos_tagger = tnt.TnT()
tnt_pos_tagger.train(train_data) #Training the tnt Part of speech tagger with hindi data

print tnt_pos_tagger.tag(nltk.word_tokenize(word_to_be_tagged))

我收到以下錯誤:

'SyntaxError:第1行的文件q12.py中的非ASCII字符'\\ xe0',但未聲明編碼; 有關詳情,請參見http://www.python.org/peps/pep-0263.html第1行。

將這兩行添加到文件頂部:

#!/usr/bin/python
# -*- coding: utf-8 -*-

他們將指示解釋器將每個字符編碼為UTF-8而不是ASCII。

暫無
暫無

聲明:本站的技術帖子網頁,遵循CC BY-SA 4.0協議,如果您需要轉載,請注明本站網址或者原文地址。任何問題請咨詢:yoyou2525@163.com.

 
粵ICP備18138465號  © 2020-2024 STACKOOM.COM