การแปลด้วยเครื่องเชิงสถิติ
การแปลด้วยเครื่องเชิงสถิติ (อังกฤษ: statistical machine translation; SMT) เป็นแนวทางหนึ่งของการแปลด้วยเครื่อง ที่สร้างคำแปลจากแบบจำลองทางสถิติที่มีพารามิเตอร์มาจากการวิเคราะห์คลังข้อความสองภาษา แนวทางเชิงสถิตินี้มีความแตกต่างจากแนวทางการแปลด้วยเครื่องตามกฎ และการแปลด้วยเครื่องตามตัวอย่าง[1] ซึ่งได้เข้ามาแทนที่แนวทางตามกฎในอดีต ที่ต้องอธิบายกฎเกณฑ์ทางภาษาศาสตร์ทุกข้ออย่างละเอียด ซึ่งมีต้นทุนสูงและมักจะไม่สามารถนำไปใช้กับภาษาอื่น ๆ ได้อย่างมีประสิทธิภาพ
แนวคิดแรกของการแปลด้วยเครื่องเชิงสถิติถูกเสนอโดย วอร์เรน วีเวอร์ ในปี พ.ศ. 2492[2] ซึ่งรวมถึงแนวคิดของการประยุกต์ใช้ทฤษฎีสารสนเทศของคล็อด แชนนอน การแปลด้วยเครื่องเชิงสถิติได้รับการนำกลับมาศึกษาอีกครั้งในช่วงปลายคริสต์ทศวรรษ 1980 และต้นคริสต์ทศวรรษ 1990 โดยนักวิจัยจากศูนย์วิจัยโทมัส เจ. วัตสัน ของไอบีเอ็ม[3][4][5] ก่อนการถือกำเนิดของการแปลด้วยเครื่องประสาท วิธีการนี้เป็นวิธีการแปลด้วยเครื่องที่ได้รับการศึกษาอย่างกว้างขวางที่สุด
แบบจำลองภาษาเป็นองค์ประกอบสำคัญของระบบการแปลด้วยเครื่องเชิงสถิติทุกระบบ ซึ่งช่วยทำให้คำแปลมีความลื่นไหลมากที่สุด แบบจำลองนั้นทำหน้าที่รับประโยคที่แปลแล้วและคำนวณความน่าจะเป็นที่ประโยคนั้นจะถูกพูดโดยเจ้าของภาษา ยกตัวอย่าง แบบจำลองภาษาที่ดีจะกำหนดค่าความน่าจะเป็นให้กับประโยค "the house is small" สูงกว่า "small is the house" นอกจากเรื่องลำดับคำแล้ว แบบจำลองภาษายังสามารถช่วยในการเลือกใช้คำได้ด้วย กล่าวคือ หากคำในภาษาต่างประเทศแปลได้หลายอย่าง ฟังก์ชันเหล่านี้อาจช่วยให้ค่าความน่าจะเป็นที่ดีกว่า สำหรับบางคำแปลที่เหมาะสมกับบริบทเฉพาะของภาษาเป้าหมาย[6]
อ้างอิง
[แก้]- ↑ Koehn, Philipp (2009). "Introduction". Statistical Machine Translation. Cambridge University Press. p. 27. doi:10.1017/CBO9780511815829.002. ISBN 978-0521874151. สืบค้นเมื่อ 22 March 2015.
Statistical machine translation is related to other data-driven methods in machine translation, such as the earlier work on example-based machine translation. Contrast this to systems that are based on hand-crafted rules.
- ↑ W. Weaver (1955). Translation (1949). In: Machine Translation of Languages, MIT Press, Cambridge, MA.
- ↑ P. Brown; John Cocke; S. Della Pietra; V. Della Pietra; Frederick Jelinek; Robert L. Mercer; P. Roossin (1988). "A statistical approach to language translation". Coling'88. Association for Computational Linguistics. 1: 71–76. สืบค้นเมื่อ 22 March 2015.
- ↑ P. Brown; John Cocke; S. Della Pietra; V. Della Pietra; Frederick Jelinek; John D. Lafferty; Robert L. Mercer; P. Roossin (1990). "A statistical approach to machine translation". Computational Linguistics. MIT Press. 16 (2): 79–85. สืบค้นเมื่อ 22 March 2015.
- ↑ P. Brown; S. Della Pietra; V. Della Pietra; R. Mercer (1993). "The mathematics of statistical machine translation: parameter estimation". Computational Linguistics. MIT Press. 19 (2): 263–311. สืบค้นเมื่อ 22 March 2015.
- ↑ Koehn, Philipp (2010). Statistical Machine Translation. Cambridge University Press. ISBN 978-0-521-87415-1.