Introduction to Text Classification in R with quanteda

提供方
在此指導項目中,您將:

Import text documents, reshape texts from documents to paragraphs, and turn your texts into a machine readable format.

Classify presidential concession speeches by political party using a Naive Bayes algorithm and assess the accuracy of the predictions.   

2 hours
初級
無需下載
分屏視頻
英語(English)
僅限桌面

In this guided project you will learn how to import textual data stored in raw text files into R, turn these files into a corpus (a collection of textual documents), reshape them into paragraphs from documents and tokenize the text all using the R software package quanteda. You will then learn how to classify the texts using the Naive Bayes algorithm. This guided project is for beginners interested in quantitative text analysis in R. It assumes no knowledge of textual analysis and focuses on exploring textual data (US Presidential Concession Speeches). Users should have a basic understanding of the statistical programming language R.

您要培養的技能

  • Ordered Pair

  • Text Analysis

  • Algorithms

  • Statistical Programming Languages

  • Computer Programming

分步進行學習

在與您的工作區一起在分屏中播放的視頻中,您的授課教師將指導您完成每個步驟:

  1. Load text documents into R studio, convert a number of text documents into a corpus, and extract data from text document file names and add them to a new column in a dataframe. 

  2. Reshape the dataset into paragraphs from documents and check for balance in your labels. 

  3. Split up a text document corpus into tokens, or individual words and punctuations. Then clean the data by removing specific words and spellings.

  4. Create a Document Feature Matrix, divide it into train and test sets and run a Naive Bayes model. Then examine the model’s prediction accuracy and learn about accuracy, precision, and recall.   

  5. Run Naive Bayes models for a second and third time. Then examine the models' predictions and compare the model outputs with results from the previous task.

指導項目工作原理

您的工作空間就是瀏覽器中的雲桌面,無需下載

在分屏視頻中,您的授課教師會為您提供分步指導

常見問題

購買指導項目後,您將獲得完成指導項目所需的一切,包括通過 Web 瀏覽器訪問云桌面工作空間,工作空間中包含您需要了解的文件和軟件,以及特定領域的專家提供的分步視頻說明。

由於您的工作空間包含適合筆記本電腦或台式計算機使用的雲桌面,因此指導項目不在移動設備上提供。

指導項目授課教師是特定領域的專家,他們在項目的技能、工具或領域方面經驗豐富,並且熱衷於分享自己的知識以影響全球數百萬的學生。

您可以從指導項目中下載並保留您創建的任何文件。為此,您可以在訪問云桌面時使用‘文件瀏覽器’功能。

指導項目不符合退款條件。 請查看我們完整的退款政策

指導項目不提供助學金。

指導項目不支持旁聽。

您可在頁面頂部點按此指導項目的經驗級別,查看任何知識先決條件。對於指導項目的每個級別,您的授課教師會逐步為您提供指導。

是,您可以在瀏覽器的雲桌面中獲得完成指導項目所需的一切。

您可以直接在瀏覽器中於分屏環境下完成任務,以此從做中學。在屏幕的左側,您將在工作空間中完成任務。在屏幕的右側,您將看到有授課教師逐步指導您完成項目。