Pengecaman Tulisan Tangan Teksjawi Menggunakan Pengkelas Multiaras

Omar, Khairuddin (2000) Pengecaman Tulisan Tangan Teksjawi Menggunakan Pengkelas Multiaras. PhD thesis, Universiti Pertanian Malaysia.

[img] PDF
3181Kb

Abstract

Pengecaman tulisan tangan teks Jawi adalah satu tugas yang sangat mencabar di dalam bidang Pengecaman Aksara Optik (PAO) disebabkan Jawi adalah satu tulisan jenis bersambung. Tesis ini mengenegahkan teknik untuk memperbaiki kadar pengecaman teks Jawi tulisan tangan. Skema barn yang lebih cekap untuk prapemprosesan, penemberengan, penyarian fitur dan pemonnalan aksara, dan pengkelasan telah direka untuk memenuhi objektif tersebut. Dntuk prapemprosesan, kaedah pembetulan pencongan dan erotan menggunakan kaedah histogram orientasi cerunan (HOC) yang asalnya digunakan untuk dokumen Latin telah dimasukkan sebagai satu daripada modul prapemprosesan. Satu skema barn untuk penemberengan telah diperkenalkan. Ia berasaskan kepada gabungan kaedah unjuran profail histogram dan penentuan titik tembereng ubah suai (PIT) membentuk kaedah penentuan titik tembereng (PTT). Fitur-fitur disarikan daripada aksara yang telah ditemberengkan menggunakan tiga jenis fitur. Fitur-fitur ini ialah struktur, fitur Momen Tak-berubah (MTB) dan Taburan Pilrsel Hitam (TPH). Algoritma penyingkiran bahagian sekunder aksara Jawi (seperti titik-titik, A" " dan maddah) juga telah diperkenalkan supaya dapat mengelakkan daripada salah cam sekunder ini.Ia perlu dipisahkan terlebih dahulu sebelum melalui proses p'engecaman. Hal ini dapat mengurangkan bilangan kelas aksara Jawi daripada 124 kepada 60. Sebanyak 200 sampel setiap kelas aksara Jawi telah diujikan untuk tujuan pengkelasan. Dua aras sistem pengkelasan terdiri daripada Pengkelas Kumpulan berasaskan Ukuran Keserupaan (PKUK) dan Pengkelas berganda Genetik-Perambat-balik (PGPB). Di aras pertama, PKUK menggunakan fitur struktur dan MTB untuk mengelompokkan kesemua aksara. Tujuh jenis primitif diperoleh menggunakan fitur struktur, dan proses pengelompokan berdasarkan kepada jenis primitif ini. Fitur MTB digunakan untuk mengirakan ukuran keserupaan dan kemudian menentukan kadar pengkelasan untuk setiap kumpulan. Setelah kesemua sampel aksara telah dikelompokkan, PGPB digunakan untuk mengkelaskan setiap aksara dalam kumpulan masing-masing dan dilarikan secara berasingan. Kelas aksara yang terbanyak ialah 14 aksara. Di aras kedua, PGPB dilaksanakan dalam dua peringkat iaitu peringkat pembelajaran, dan peringkat ujian. Di peringkat pembelajaran, pengkelasan ini menggunakan fitur MTB dan TPH, manakala di peringkat ujian pengkelas ini menggunakan maklumat tambahan iaitu maklumat yang diperoleh ketika menyingkirkan juzuk sekunder, dan di samping fitur MTB serta TPH. Pemecahan masalah ini kepada dua aras telah mengurangkan masa pembelajaran yang diambil oleh pengkelas dan beIjaya menambah kadar pengecaman. Tesis ini membicarakan secara terperinci setiap algoritma dan prestasinya terhadap sampel yang digunakan didalam ujikaji. Perbandingan juga dibuat terhadap kaedah pengawalan pemberat PB menggunakan pendekatan Sifar, Rawak, serta Rawak Nguyen-Widrow, di samping pendekatan ubah suai AG. Prestasi menggunakan AG (ubah suai) memberikan hasil pengkelasan yang dijanjikan.

Item Type:Thesis (PhD)
Subject:Jawi alphabet - Technology innovation
Chairman Supervisor:Ramlan bin Mahmod, PhD
Call Number:FSKTM 2000 1
Faculty or Institute:Faculty of Computer Science and Information Technology
ID Code:9645
Deposited By: Laila Azwa Ramli
Deposited On:18 Feb 2011 06:50
Last Modified:18 Feb 2011 06:53

Repository Staff Only: item control page

Document Download Statistics

This item has been downloaded for since 18 Feb 2011 06:50.

View statistics for "Pengecaman Tulisan Tangan Teksjawi Menggunakan Pengkelas Multiaras"


Universiti Putra Malaysia Institutional Repository

Universiti Putra Malaysia Institutional Repository is an on-line digital archive that serves as a central collection and storage of scientific information and research at the Universiti Putra Malaysia.

Currently, the collections deposited in the IR consists of Master and PhD theses, Master and PhD Project Report, Journal Articles, Journal Bulletins, Conference Papers, UPM News, Newspaper Cuttings, Patents and Inaugural Lectures.

As the policy of the university does not permit users to view thesis in full text, access is only given to the first 24 pages only.