Skip to main content

Tokenizing, Tokenisasi

tokenizing

Sistem temu kembali adalah suatu sistem komputerisasi penemuan kembali dokumen yang telah dicari secara otomatis, biasanya dalam bentuk teks. Dalam dunia komputer ini, sistem temu kembali sangat dibutuhkan, terutama dalam pencarian dokumen baik pada online atau dunia maya maupun pada dunia offline.
Salah satu cara untuk mengaplikasikan sistem temu kembali, yaitu dengan menggunakan cara text mining. Text mining adalah suatu proses pengambilan data dalam bentuk teks dari beberapa dokumen dengan tujuan mencari kata-kata yang dapat mewakili isi dari dokumen tersebut, sehingga dapat dilakukan analisa keterhubungan antar dokumen.

Popular posts from this blog

Pengertian Text Mining

Text mining memiliki definisi menambang data yang berupa teks dimana sumber data biasanya di dapatkan dari dokumen, dan tujuannya adalah mencari kata-kata yang dapat mewakili isi dari dokumen sehingga dapat dilakukan analisa keterhubungan antardokumen.

Sistem Temu Kembali

Ketika kita memasukkan query pada sebuah mesin pencari, baik itu mesin pencari di google.com, bing.com, yahoo.com dan lain sebagainya, kita mendapatkan hasil yang beragam atau tidak sama.  Suatu saat anda coba, dengan menuliskan keyword yang sama pada 3 search engine yang berbeda, maka hasil pencarianpun tidak sama bahkan jauh berbeda. Apa penyebabnya ?

Manfaat Tokenizing

Manfaat Tokenizing yaitu mempermudah dalam melakukan proses text mining, karena pada dasarnya Tokenizing merupakan tahap pertama yang harus dilalui sebelum melakukan tahapan selanjutnya pada text mining.