Rdocumentation
powered by
Learn R Programming
tm (version 0.7-20)
Text Mining Package
Description
A framework for text mining applications within R.
Copy Link
Link to current version
Version
Version
0.7-20
0.7-19
0.7-18
0.7-17
0.7-16
0.7-15
0.7-14
0.7-12
0.7-11
0.7-10
0.7-9
0.7-8
0.7-7
0.7-6
0.7-5
0.7-4
0.7-3
0.7-2
0.7-1
0.6-2
0.6-1
0.5-10
0.5-9.1
0.5-8.3
0.5-8.1
0.5-7.1
0.5-6
0.5-5
0.5-4.1
0.5-3
0.5-2
0.5-1
0.4
0.3-4.1
0.3-3
0.3-2
0.3-1
0.2-3.7
0.2-1
0.1-1
Install
install.packages('tm')
Monthly Downloads
29,543
Version
0.7-20
License
GPL-3
Maintainer
Kurt Hornik
Last Published
September 30th, 2026
Functions in tm (0.7-20)
Search all functions
VectorSource
Vector Source
Zipf_n_Heaps
Explore Corpus Term Frequency Characteristics
WeightFunction
Weighting Function
URISource
Uniform Resource Identifier Source
XMLSource
XML Source
tm_combine
Combine Corpora, Documents, Term-Document Matrices, and Term Frequency Vectors
acq
50 Exemplary News Articles from the Reuters-21578 Data Set of Topic acq
ZipSource
ZIP File Source
VCorpus
Volatile Corpora
getTokenizers
Tokenizers
hpc
Parallelized ‘lapply’
getTransformations
Transformations
XMLTextDocument
XML Text Documents
content_transformer
Content Transformers
findAssocs
Find Associations in a Term-Document Matrix
generics
Imports from package
NLP
crude
20 Exemplary News Articles from the Reuters-21578 Data Set of Topic crude
findFreqTerms
Find Frequent Terms
findMostFreqTerms
Find Most Frequent Terms
foreign
Read Document-Term Matrices
inspect
Inspect Objects
readReut21578XML
Read In a Reuters-21578 XML Document
meta
Metadata Management
readRCV1
Read In a Reuters Corpus Volume 1 Document
readPDF
Read In a PDF Document
readPlain
Read In a Text Document
TermDocumentMatrix
Term-Document Matrix
readDOC
Read In a MS Word Document
readDataframe
Read In a Text Document from a Data Frame
plot
Visualize a Term-Document Matrix
stemDocument
Stem Words
stopwords
Stopwords
readTagged
Read In a POS-Tagged Word Text Document
stripWhitespace
Strip Whitespace from a Text Document
removeWords
Remove Words from a Text Document
readXML
Read In an XML Document
removeSparseTerms
Remove Sparse Terms from a Term-Document Matrix
removeNumbers
Remove Numbers from a Text Document
stemCompletion
Complete Stems
removePunctuation
Remove Punctuation Marks from a Text Document
weightTf
Weight by Term Frequency
weightBin
Weight Binary
weightTfIdf
Weight by Term Frequency - Inverse Document Frequency
tokenizer
Tokenizers
termFreq
Term Frequency Vector
tm_map
Transformations on Corpora
tm_term_score
Compute Score for Matching Terms
tm_filter
Filter and Index Functions on Corpora
tm_reduce
Combine Transformations
weightSMART
SMART Weightings
writeCorpus
Write a Corpus to Disk
Corpus
Corpora
TextDocument
Text Documents
DataframeSource
Data Frame Source
SimpleCorpus
Simple Corpora
PCorpus
Permanent Corpora
Docs
Access Document IDs and Terms
PlainTextDocument
Plain Text Documents
DirSource
Directory Source
Reader
Readers
Source
Sources