Як завантажити та встановити NLTK
⚡ Розумний підсумок
Завантажте та встановіть NLTK на Windows, Mac або Linux, встановивши Python спочатку, а потім додавання натурального Language Toolкомплект через pip або Anaconda та завантаження наборів даних корпусу.

Встановлення NLTK в Windows
Дізнайтеся, як налаштувати NLTK на Windows з командного рядка. Наведені нижче інструкції передбачають Python ще не встановлено, тому першим кроком є встановлення Python.
Установка Python in Windows
Крок 1) Відкрийте посилання https://www.python.org/downloads/, та виберіть найновішу Windows звільнення.
Примітка:: Щоб переглянути всі випуски старішої версії, перейдіть на вкладку Завантаження.
Крок 2) Клацніть завантажений файл інсталятора.
Крок 3) Виберіть «Налаштувати інсталяцію».
Крок 4) Натисніть ДАЛІ.
Крок 5) На наступному екрані:
- Виберіть розширені параметри.
- Вкажіть власне місце встановлення. У цьому прикладі для легшого доступу вибрано папку на диску C.
- Натисніть Установити.
Крок 6) Натисніть кнопку «Закрити» після завершення встановлення.
Крок 7) Скопіюйте шлях до вашої папки Scripts.
Крок 8) Перейдіть на вкладку Windows командний рядок:
- Перейдіть до розташування папки pip.
- Введіть команду для встановлення NLTK:
pip3 install nltk
- Інсталяція має завершитися успішно.
ПРИМІТКА: Для Python 2, скористайтеся командою pip2 install nltk.
Крок 9) Від Windows меню «Пуск», знайдіть і відкрийте Python Оболонка.
Крок 10) Перевірте, чи інсталяція працює, виконавши команду нижче:
import nltk
Якщо помилок не з'явилося, встановлення завершено.
Встановлення NLTK у Mac/Linux
Для встановлення NLTK на Mac або Linux потрібна Python менеджер пакетів pip. Якщо pip не встановлено, виконайте наведені нижче інструкції, щоб завершити процес.
Крок 1) Оновити індекс пакета за допомогою typing команда нижче:
sudo apt update
Крок 2) Встановити pip для Python 3:
sudo apt install python3-pip
Ви також можете встановити pip через easy_install:
sudo apt-get install python-setuptools python-dev build-essential
Після встановлення easy_install виконайте команду нижче, щоб встановити pip:
sudo easy_install pip
Крок 3) Використайте таку команду для встановлення NLTK:
sudo pip install -U nltk sudo pip3 install -U nltk
Встановлення NLTK через Anaconda
Крок 1) Встановіть Anaconda, відвідавши https://www.anaconda.com/products/individual та вибір Python потрібну вам версію.
Примітка. Зверніться до цього підручника, щоб отримати докладні кроки встановити Анаконду.
Крок 2) У командному рядку Anaconda:
- Введіть команду:
conda install -c anaconda nltk
- RevПерегляньте інформацію про оновлення, зниження версії та встановлення пакета, а потім введіть «так».
- NLTK завантажено та встановлено.
Набір даних NLTK
Модуль NLTK постачається з багатьма наборами даних, які потрібно завантажити перед використанням. Технічно кожен набір даних називається тілоТипові приклади включають стоп-слова, Гутенберг, framenet_v15, великі_граматики, коричневий та ворднет.
Як завантажити всі пакети NLTK
Крок 1) Запустіть Python Перекладач in Windows або Linux.
Крок 2)
- Введіть команди:
import nltk nltk.download ()
- Відкриється вікно завантажувача NLTK. Натисніть кнопку «Завантажити», щоб отримати набір даних. Цей процес займає певний час залежно від вашого інтернет-з’єднання.
ПРИМІТКА: Ви можете змінити місце завантаження, натиснувши Файл > Змінити каталог завантажень.
Крок 3) Щоб перевірити встановлені дані, використовуйте наступний код:
>>> from nltk.corpus import brown >>>brown.words()
["The", "Fulton", "County", "Grand", "Jury", "said", …]
Запуск сценарію НЛП
У цьому розділі пояснюється, як NLP-скрипт працює на локальному ПК. Вибір правильної бібліотеки залежить від ваших вимог. Див. офіційний список Бібліотеки НЛП для альтернатив, таких як spaCy, gensim та TextBlob.
Як запустити сценарій NLTK
Крок 1) У вашому улюбленому редакторі коду скопіюйте код і збережіть файл як NLTKsample.py:
from nltk.tokenize import RegexpTokenizer
tokenizer = RegexpTokenizer(r'\w+')
filterdText=tokenizer.tokenize('Hello Guru99, You have build a very good site and I love visiting your site.')
print(filterdText)
Code Пояснення:
- Мета цієї програми — видалити всі види пунктуації з заданого тексту. Ми імпортували «RegexpTokenizer», модуль НЛТК який видаляє будь-який вибраний вами вираз, символ, символ або числове значення.
- Регулярний вираз передається модулю «RegexpTokenizer».
- Текст токенізується за допомогою методу «tokenize», а результат зберігається у змінній «filterdText».
- Результат друкується за допомогою функції «print()».
Крок 2) У командному рядку:
- Перейдіть до місця, де ви зберегли файл.
- Запустіть команду
python NLTKsample.py.
Вихід:
['Привіт', 'Guru99', 'Ви', 'маєте', 'побудувати', 'а', 'дуже', 'добре', 'сайт', 'і', 'я', 'люблю', 'відвідую', 'ваш', 'сайт']


















