Word Sense Clustering in TNC4
จุดมุ่งหมายแรกของการใช้คลังข้อมูลภาษาคือเป็นแหล่งข้อมูลเพื่อช่วยในการทำพจนานุกรม. นอกจากการดึงตัวอย่างคำพร้อมบริบท (concordance) การมีเครื่องมือกำกับหมวดคำและการหาคำปรากฏร่วมแล้ว การจัดกลุ่มตัวอย่างข้อมูลตามความหมาย (sense clustering) ก็เป็นอีกเครื่องมือหนึ่งที่สำคัญ ช่วยให้ผู้ทำพจนานุกรมเห็นตัวอย่างเป็นกลุ่มชัดเจนได้ง่ายขึ้น.
Thai Language Toolkit
TLTK is a Python package designed for Thai language processing, which includes functionalities such as syllable and word...
โครงการภูมิศาสตร์ภาษาของประเทศไทย
โครงการภูมิศาสตร์ภาษาของประเทศไทยบนระบบสารสนเทศภูมิศาสตร์ (GIS-BASED LINGUISTIC GEOGRAPHY OF THAILAND PROJECT) ดำเนินงานภายใต้ โครงการพัฒนาแผนที่ภาษาไทยถิ่นด้วยระบบสารสนเทศภูมิศาสตร์ ซึ่งเป็นโครงการย่อยในโครงการของกลุ่มวิจัยภาษาและเทคโนโลยี คณะอักษรศาสตร์ จุฬาลงกรณ์มหาวิทยาลัย โครงการนี้ได้รับการสนับสนุนงบประมาณภายใต้แผนพัฒนาวิชาการ 100 ปีของจุฬาลงกรณ์มหาวิทยาลัย เริ่มดำเนินการในปีพ.ศ. 2552 และเสร็จสิ้นโครงการ...
แชตบอตคำไทยมักเขียนผิด
เว็บแอปพลิเคชันแชตบอตนี้เป็นเครื่องมือที่รวบรวมคำที่มักเขียนผิดในภาษาไทยจากเว็บไซต์ต่าง ๆ เพียงผู้ใช้งานพิมพ์คำที่ต้องการตรวจสอบแชตบอตจะตอบว่าคำที่ผู้ใช้กรอกเป็นคำที่เขียนถูกต้องหรือไม่ แชตบอตนี้เป็นส่วนหนึ่งของโครงการเทคโนโลยีภาษาของ นางสาวเกวสิน วงศ์วิวัฒน์ชัย นิสิตชั้นปีที่ 4 ปีการศึกษา 2565 อ.ที่ปรึกษา รศ.ดร.วิโรจน์ อรุณมานะกุล หลักสูตรเทคโนโลยีภาษาและสารสนเทศ คณะอักษรศาสตร์ จุฬาลงกรณ์มหาวิทยาลัย ดูแลและเผยแพร่โดยสถาบันภาษาไทยสิรินธร จุฬาลงกรณ์มหาวิทยาลัย