พบ 2 รายการ (ค้นหา: "การจำแนกข้อความ")
วารสารวิชาการ ระดับชาติ (TCI) TCI กลุ่ม 2
Classifying Thai SMS Messages from Scammers using Machine Learning
ผศ.สุรเทพ แป้นเกิด 2569 วารสารวิทยาศาสตร์และเทคโนโลยี มทร.ก 1,085 0 คณะบริหารธุรกิจ
Collection : วารสารวิชาการ  |  ปี : 2569  |  เจ้าของผลงาน : ผศ.สุรเทพ แป้นเกิด
การวิจัยครั้งนี้มีวัตถุประสงค์ 1) เพื่อการจําแนกข้อความ SMS ภาษาไทยจากมิจฉาชีพด้วย Machine Learning 2) ศึกษาการใช้อัลกอริทึม PyThaiNLP ร่วมกับเทคนิค TF-IDF ในการสกัดคุณลักษณะข้อความ และประยุกต์ใช้เทคนิค SMOTE เพื่อแก้ไขปัญหาความไม่สมดุลของข้อมูล ก่อนนําไปฝึกด้วยอัลกอริทึม Naïve Bayes และ 3) ศึกษาผลของแบบจําลองในการจําแนกข้อความ SMS ภาษาไทยออกเป็น 3 กลุ่ม ได้แก่ ข้อความปกติ ข้อความมิจฉาชีพ และข้อความส่งเสริมการขาย โดยใช้ข้อมูลจํานวน 5,000 รายการผลการทดลองด้วยอัลกอริทึม Naïve Bayes พบว่า กลุ่มข้อความปกติมีค่า Precision (ความแม่นยํา) 0.94 Recall (ความระลึก) 0.84 และ F1-Score (ค่าความถ่วงดุล) 0.88 กลุ่มข้อความส่งเสริมการขายมีค่า Precision 0.57 Recall 0.81 และ F1-Score 0.67 และกลุ่มข้อความมิจฉาชีพมีค่า Precision 0.84 Recall 0.91 และ F1-Score 0.87 ซึ่งแสดงให้เห็นถึงประสิทธิภาพที่ดีของแบบจําลอง โดยเฉพาะในการตรวจจับข้อความมิจฉาชีพนอกจากนี้ การประยุกต์ใช้เทคนิค SMOTE ช่วยเพิ่มประสิทธิภาพของแบบจําลอง โดยให้ค่าความถูกต้อง (Accuracy) สูงสุดร้อยละ 85.00 พร้อมทั้งให้ค่าความแม่นยํา ความระลึก และค่าความถ่วงดุลอยู่ในระดับดีเยี่ยม สรุปได้ว่าแนวทางดังกล่าวสามารถนําไปใช้ในการตรวจจับข้อความ SMS มิจฉาชีพได้อย่างมีประสิทธิภาพ
บทความประชุมวิชาการ ระดับชาติ
Fake News Detection on the Fake News Dataset Using GRU
ผศ.ดร.นิกร กรรณิกากลาง 2569 8 0 คณะบริหารธุรกิจ
Collection : บทความประชุมวิชาการ  |  ปี : 2569  |  เจ้าของผลงาน : ผศ.ดร.นิกร กรรณิกากลาง
งานวิจัยนี้มีวัตถุประสงค์เพื่อ (1) ศึกษาประสิทธิภาพของโครงข่ายประสาทเทียมแบบ Gated Recurrent Unit (GRU) ในการตรวจจับข่าวปลอม และ (2) เปรียบเทียบประสิทธิภาพของโมเดล GRU กับ เทคนิคพื้นฐานในการจำแนกข่าวจริงและข่าวปลอม โดยใช้ชุดข้อมูลข่าวจากแหล่งข้อมูลสาธารณะเป็น กรณีศึกษา คือ ชุดข้อมูลข่าวปลอม (Fake News Dataset) ประกอบด้วยข่าวจริงและข่าวปลอมอย่าง ละ 10,400 รายการ รวมทั้งหมด 20,800 รายการ กระบวนการวิจัยประกอบด้วยการเตรียมและทำความ สะอาดข้อมูลข้อความ ได้แก่ การตัดคำ การลบคำหยุด และการปรับรูปแบบข้อความ จากนั้นแปลงข้อมูล ข้อความให้อยู่ในรูปแบบเวกเตอร์ด้วยเทคนิค การฝังคำ เพื่อนำไปใช้ในการฝึกสอนและทดสอบโมเดล GRU และโมเดลพื้นฐาน โดยทำการแบ่งชุดข้อมูลออกเป็นชุดฝึกสอน (Training Set) ร้อยละ 80 และชุดทดสอบ (Testing Set) ร้อยละ 20 ของข้อมูลทั้งหมด โดยชุดฝึกสอนประกอบด้วยข้อมูลจำนวน 16,640 รายการ ใช้สำหรับการเรียนรู้และปรับค่าพารามิเตอร์ของแบบจำลอง ขณะที่ชุดทดสอบประกอบด้วยข้อมูลจำนวน 4,160 รายการ ใช้สำหรับประเมินประสิทธิภาพของแบบจำลองหลังจากกระบวนการฝึกสอนเสร็จสิ้น การประเมินประสิทธิภาพของโมเดลดำเนินการโดยใช้ตัวชี้วัด ได้แก่ ความแม่นยำ ความเที่ยงตรง ความ ครอบคลุม ค่าคะแนนเอฟหนึ่ง และ ตารางคอนฟิวชัน ผลการวิจัยพบว่า (1) โมเดล GRU สามารถจำแนกข่าว จริงและข่าวปลอมได้อย่างมีประสิทธิภาพในระดับสูง และ (2) โมเดล GRU มีค่าความแม่นยำเท่ากับร้อยละ 97.19 ซึ่งสูงกว่าเทคนิคพื้นฐานที่นำมาเปรียบเทียบ แสดงให้เห็นว่าโครงข่ายประสาทเทียมแบบ GRU มีศักยภาพในการคัดกรองข่าว เพื่อช่วยลดผลกระทบจากการเผยแพร่ข่าวปลอมในสังคมดิจิทัล