Learn R Programming

⚠️There's a newer version (0.7-16) of this package.Take me there.

tm (version 0.7-9)

Text Mining Package

Description

A framework for text mining applications within R.

Copy Link

Version

Install

install.packages('tm')

Monthly Downloads

64,484

Version

0.7-9

License

GPL-3

Maintainer

Ingo Feinerer

Last Published

October 19th, 2022

Functions in tm (0.7-9)

XMLTextDocument

XML Text Documents

Combine Corpora, Documents, Term-Document Matrices, and Term Frequency Vectors

Volatile Corpora

Weighting Function

ZIP File Source

Uniform Resource Identifier Source

50 Exemplary News Articles from the Reuters-21578 Data Set of Topic acq

Explore Corpus Term Frequency Characteristics

Parallelized ‘lapply’

content_transformer

Content Transformers

Find Associations in a Term-Document Matrix

Read In a Text Document

Read In a Reuters Corpus Volume 1 Document

Visualize a Term-Document Matrix

getTransformations

Transformations

TermDocumentMatrix

Term-Document Matrix

Find Frequent Terms

Metadata Management

Read In a Text Document from a Data Frame

20 Exemplary News Articles from the Reuters-21578 Data Set of Topic crude

Remove Words from a Text Document

Read In a MS Word Document

stripWhitespace

Strip Whitespace from a Text Document

Term Frequency Vector

Read In a PDF Document

Inspect Objects

findMostFreqTerms

Find Most Frequent Terms

Read In an XML Document

Filter and Index Functions on Corpora

Transformations on Corpora

Read In a POS-Tagged Word Text Document

SMART Weightings

Weight by Term Frequency

readReut21578XML

Read In a Reuters-21578 XML Document

Read Document-Term Matrices

removePunctuation

Remove Punctuation Marks from a Text Document

removeSparseTerms

Remove Sparse Terms from a Term-Document Matrix

Weight by Term Frequency - Inverse Document Frequency

Write a Corpus to Disk

Combine Transformations

Remove Numbers from a Text Document

Compute Score for Matching Terms

Directory Source

Permanent Corpora

PlainTextDocument

Plain Text Documents

Access Document IDs and Terms

DataframeSource

Data Frame Source