PENERBITGOODWOODPENERBITGOODWOOD
Jurnal Ilmu Siber dan Teknologi DigitalJurnal Ilmu Siber dan Teknologi DigitalTwitter merupakan salah satu situs media sosial yang sedang berkembang pesat dengan lebih dari 3,7 juta pengguna aktif mem-posting sekitar 10 juta tweet per hari. Selain digunakan untuk update status, Twitter juga digunakan sebagai platform penyebaran informasi berbagai topik yang cukup akurat dan terpercaya. Pencarian tweet pada aplikasi Twitter dapat menggunakan fitur search dengan mengetikkan kata kunci atau hashtag. Akan tetapi, penggunaan kata kunci atau hashtag terkadang kurang akurat ketika menggunakan kata yang memiliki beberapa arti, sehingga, perlu dilakukan pemberian kategori terhadap tweet berdasarkan konteksnya untuk menghindari adanya bias pada kata yang memiliki beberapa arti serta meningkatkan ranking pada hasil pencarian Google. Pemrosesan bahasa alami (Natural Language Processing - NLP) merupakan cabang dari kecerdasan buatan (Artificial Intelligence) yang memberikan kemampuan pada komputer untuk memahami teks dan kata-kata yang diucapkan dengan cara yang sama seperti yang dapat dilakukan manusia. Klasifikasi teks merupakan salah satu tugas NLP yang dapat memberikan kategori terhadap teks secara otomatis berdasarkan konteks dari teks tersebut dengan bantuan metode machine learning maupun deep learning. Klasifikasi teks menjadi area penelitian yang sering muncul dalam pemrosesan bahasa alami karena meningkatnya jumlah unggahan pengguna di berbagai jejaring sosial. Proses pengklasifikasian teks dapat terbagi menjadi dua jenis, yaitu binary classification dan multiclass classification.
Pada penelitian ini telah dibahas mengenai model klasifikasi teks berbasis multiclass classification pada tweet berbahasa Indonesia yang diberi nama IndoBERT-LSTM.Adapun kesimpulan yang dapat diambil dari penelitian yang telah dilakukan yaitu.Berdasarkan hasil pengujian dan perbandingan, kombinasi model pre-trained IndoBERT dan Long Short-Term Memory (LSTM) terbukti dapat memberikan pemahaman yang lebih baik dalam mengklasifikasikan teks, baik pada dataset yang tidak termodifikasi maupun dataset yang telah termodifikasi.Model IndoBERT-LSTM dengan skenario kombinasi hyperparameter terbaik (batch size sebesar 16, learning rate sebesar 2e-5, dan menggunakan average pooling) berhasil mendapatkan F1-score sebesar 98,90% pada dataset yang tidak termodifikasi (peningkatan 0,70% dari model Word2Vec-LSTM dan 0,40% dari model fine-tuned IndoBERT) dan 92,83% pada dataset yang telah termodifikasi (peningkatan 4,51% dari model Word2Vec-LSTM dan 0,69% dari model fine-tuned IndoBERT).Peningkatan performa model IndoBERT-LSTM dari model fine-tuned IndoBERT tidak terlalu signifikan.Total waktu pelatihan model Word2Vec-LSTM masih jauh lebih cepat, yaitu sekitar 3 menit untuk kedua dataset, dibandingkan dengan model IndoBERT-LSTM yang membutuhkan waktu sekitar 30 dan 45 menit.Akan tetapi, model IndoBERT-LSTM masih lebih cepat jika dibandingkan dengan model fine-tuned IndoBERT yang membutuhkan waktu sekitar 40 dan 55 menit.
Saran untuk penelitian-penelitian berikutnya bisa mengombinasikan IndoBERT dengan metode pengklasifikasi yang lebih bervariasi, seperti Convolutional Neural Network (CNN), Bidirectional Long Short-Term Memory (Bi-LSTM), atau dengan melatih model pada multiclass dataset berbasis emosi atau sentimen karena memiliki tingkat pemahaman bahasa yang lebih sulit.
- Jurnal RESTI (Rekayasa Sistem dan Teknologi Informas)i. identifying emotion indonesian tweets neural... doi.org/10.29207/RESTI.V5I3.3137Jurnal RESTI Rekayasa Sistem dan Teknologi Informas i identifying emotion indonesian tweets neural doi 10 29207 RESTI V5I3 3137
- Chinese Text Classification Method Based on BERT Word Embedding | Proceedings of the 2020 5th International... dl.acm.org/doi/10.1145/3395260.3395273Chinese Text Classification Method Based on BERT Word Embedding Proceedings of the 2020 5th International dl acm doi 10 1145 3395260 3395273
| File size | 2.19 MB |
| Pages | 28 |
| DMCA | Report |
Related /
PIPI YouTube menjadi platform utama untuk menyebarkan informasi dan masyarakat beropini. Penelitian ini bertujuan untuk mengidentifikasi sentimen publik mengenaiYouTube menjadi platform utama untuk menyebarkan informasi dan masyarakat beropini. Penelitian ini bertujuan untuk mengidentifikasi sentimen publik mengenai
PENERBITGOODWOODPENERBITGOODWOOD Aplikasi ini kemudian dipublikasikan secara online menggunakan domain dan hosting dengan nama situs https://catpsut. online. Tanggapan dari pihak guruAplikasi ini kemudian dipublikasikan secara online menggunakan domain dan hosting dengan nama situs https://catpsut. online. Tanggapan dari pihak guru
PENERBITGOODWOODPENERBITGOODWOOD Hasil pengujian menunjukkan bahwa ketika data sensor (kebakaran, suhu, dan asap) tidak memenuhi kondisi kebakaran, maka semua tindakan penanganan kebakaranHasil pengujian menunjukkan bahwa ketika data sensor (kebakaran, suhu, dan asap) tidak memenuhi kondisi kebakaran, maka semua tindakan penanganan kebakaran
UNIPASBYUNIPASBY The research method used is waterfall, which through interviews and observations, system design using UML, implementation with Laravel 10 and React. jsThe research method used is waterfall, which through interviews and observations, system design using UML, implementation with Laravel 10 and React. js
UMGUMG Toko Pelangi Jaya Motor menghadapi kesulitan dalam mengelola stok sparepart akibat ketidaksesuaian antara jumlah persediaan dan permintaan pelanggan. UntukToko Pelangi Jaya Motor menghadapi kesulitan dalam mengelola stok sparepart akibat ketidaksesuaian antara jumlah persediaan dan permintaan pelanggan. Untuk
UNESAUNESA Meanwhile, negligence is displayed by abandonment of finance and education, as well as hostile behavior. Finally, the manifestation of domestic violenceMeanwhile, negligence is displayed by abandonment of finance and education, as well as hostile behavior. Finally, the manifestation of domestic violence
PIPI 96 atau 96,53%, yang dapat dikategorikan sebagai sangat baik. Dengan demikian, dapat disimpulkan bahwa algoritma Random Forest Classifier dengan model96 atau 96,53%, yang dapat dikategorikan sebagai sangat baik. Dengan demikian, dapat disimpulkan bahwa algoritma Random Forest Classifier dengan model
UBMUBM Aplikasi ini berhasil berjalan dengan baik dan dapat membantu anak dalam mengenal angka, huruf, dan warna. Pengembangan aplikasi ini diharapkan dapat menjadiAplikasi ini berhasil berjalan dengan baik dan dapat membantu anak dalam mengenal angka, huruf, dan warna. Pengembangan aplikasi ini diharapkan dapat menjadi
Useful /
UNIPASBYUNIPASBY Robot beroda telah berkembang secara signifikan, mulai dari desain sederhana yang menggunakan satu roda untuk manuver hingga saat ini terdapat banyak jenisRobot beroda telah berkembang secara signifikan, mulai dari desain sederhana yang menggunakan satu roda untuk manuver hingga saat ini terdapat banyak jenis
UNIPASBYUNIPASBY Objek penelitian adalah penyulang CD 12. Simulasi mengevaluasi arus gangguan dan waktu tunda recloser yang sesuai pada beberapa lokasi bus. Hasil menunjukkanObjek penelitian adalah penyulang CD 12. Simulasi mengevaluasi arus gangguan dan waktu tunda recloser yang sesuai pada beberapa lokasi bus. Hasil menunjukkan
UNIPASBYUNIPASBY The study successfully designed and built a web-based employee attendance and payroll system for CV Expressa, addressing issues of data inaccuracy, payrollThe study successfully designed and built a web-based employee attendance and payroll system for CV Expressa, addressing issues of data inaccuracy, payroll
PIPI Hasil menunjukkan bahwa 80% elemen visual memenuhi standar pengguna, dan 60% responden menganggap peta dan grafik efektif. Namun, beberapa elemen masihHasil menunjukkan bahwa 80% elemen visual memenuhi standar pengguna, dan 60% responden menganggap peta dan grafik efektif. Namun, beberapa elemen masih