dependent samples t-test คือ: คืออะไร อธิบายให้เข้าใจง่ายพร้อมตัวอย่าง

dependent samples t-test คืออะไร?

คุณเคยสงสัยไหมว่าโปรแกรมฝึกอบรมใหม่ที่เพิ่งนำมาใช้ได้ผลจริงหรือไม่? หรือยาตัวใหม่ที่คิดค้นขึ้นมาช่วยลดอาการป่วยของผู้ป่วยแต่ละรายได้มากน้อยแค่ไหน? การตอบคำถามเหล่านี้มักเกี่ยวข้องกับการเปรียบเทียบข้อมูลจากกลุ่มตัวอย่างชุดเดียวกัน แต่ถูกวัดผลในสองช่วงเวลาหรือสองเงื่อนไขที่แตกต่างกัน นี่คือสถานการณ์ที่ dependent samples t-test เข้ามามีบทบาทสำคัญ

บทความนี้จะพาคุณไปทำความรู้จักกับ dependent samples t-test ตั้งแต่พื้นฐาน หลักการทำงาน ไปจนถึงตัวอย่างการใช้งานจริง และข้อผิดพลาดที่พบบ่อย เพื่อให้คุณสามารถนำไปประยุกต์ใช้ในการวิเคราะห์ข้อมูลได้อย่างมั่นใจและถูกต้อง

dependent samples t-test หรือที่รู้จักกันในชื่อ paired samples t-test หรือ t-test สำหรับข้อมูลที่จับคู่กัน เป็นการทดสอบทางสถิติที่ใช้เพื่อเปรียบเทียบค่าเฉลี่ยของประชากรสองกลุ่มที่ “สัมพันธ์กัน” หรือ “จับคู่กัน”

ข้อมูลที่สัมพันธ์กันในที่นี้หมายถึงข้อมูลที่มาจากหน่วยการทดลองเดียวกัน เช่น:

  • การวัดผลก่อนและหลังการทดลอง (pre-test/post-test) ในกลุ่มคนกลุ่มเดิม
  • การเปรียบเทียบผลลัพธ์จากคู่แฝด
  • การเปรียบเทียบผลลัพธ์จากคู่ที่ถูกจับคู่กันตามคุณลักษณะบางอย่าง

วัตถุประสงค์หลักคือ เพื่อดูว่ามีความแตกต่างอย่างมีนัยสำคัญทางสถิติระหว่างค่าเฉลี่ยของสองการวัดนั้นหรือไม่

ทำไมต้องใช้ dependent samples t-test?

การใช้ dependent samples t-test มีข้อดีเหนือกว่า independent samples t-test เมื่อข้อมูลมีความสัมพันธ์กัน เพราะมันช่วยควบคุมความแปรปรวนที่เกิดจากความแตกต่างระหว่างบุคคลได้

เมื่อเราวัดผลจากคนคนเดิมสองครั้ง ความแตกต่างที่เกิดขึ้นมักจะมาจากผลของการทดลองหรือการเปลี่ยนแปลงที่เราสนใจ ไม่ใช่ความแตกต่างโดยธรรมชาติของแต่ละบุคคล ซึ่ง dependent samples t-test จะพิจารณา “ความแตกต่าง” ของแต่ละคู่โดยตรง ทำให้การทดสอบมีความแม่นยำและมีกำลังการทดสอบ (statistical power) สูงกว่า

ยกตัวอย่างเช่น หากเราต้องการดูว่ายาตัวใหม่ช่วยลดความดันโลหิตได้หรือไม่ การวัดความดันโลหิตของผู้ป่วยคนเดิมก่อนและหลังการให้ยา จะให้ข้อมูลที่มีประสิทธิภาพมากกว่าการเปรียบเทียบผู้ป่วยกลุ่มหนึ่งที่ได้ยา กับอีกกลุ่มที่ไม่ได้ยา เพราะเราสามารถตัดปัจจัยเรื่องความแตกต่างทางสรีรวิทยาของแต่ละบุคคลออกไปได้

หลักการทำงานของ dependent samples t-test

หัวใจสำคัญของ dependent samples t-test คือการคำนวณ “คะแนนความแตกต่าง” (difference scores) สำหรับแต่ละคู่ข้อมูล โดยมีขั้นตอนหลักๆ ดังนี้:

  1. คำนวณความแตกต่าง: สำหรับแต่ละคู่ข้อมูล (เช่น ค่าก่อน – ค่าหลัง) เราจะหาผลต่าง
  2. หาค่าเฉลี่ยความแตกต่าง: นำผลต่างทั้งหมดมาหาค่าเฉลี่ย (mean difference)
  3. ตั้งสมมติฐาน:
    • สมมติฐานว่าง (Null Hypothesis, H0): ค่าเฉลี่ยความแตกต่างของประชากรเท่ากับศูนย์ (ไม่มีความแตกต่างอย่างมีนัยสำคัญ)
    • สมมติฐานทางเลือก (Alternative Hypothesis, H1): ค่าเฉลี่ยความแตกต่างของประชากรไม่เท่ากับศูนย์ (มีความแตกต่างอย่างมีนัยสำคัญ)
  4. คำนวณค่า t: ใช้สูตรทางสถิติเพื่อคำนวณค่า t โดยพิจารณาจากค่าเฉลี่ยความแตกต่าง ส่วนเบี่ยงเบนมาตรฐานของความแตกต่าง และขนาดตัวอย่าง
  5. หาค่า p-value: เปรียบเทียบค่า t ที่คำนวณได้กับค่า t ในตารางการแจกแจง t โดยพิจารณาจากระดับขั้นความเป็นอิสระ (degrees of freedom) เพื่อหาค่า p-value
  6. ตัดสินใจ: หากค่า p-value น้อยกว่าระดับนัยสำคัญที่เรากำหนดไว้ (เช่น นัยสำคัญทางสถิติที่ระดับ .05 คือ) เราจะปฏิเสธสมมติฐานว่าง และสรุปว่ามีความแตกต่างอย่างมีนัยสำคัญทางสถิติ

ตัวอย่างการใช้งาน dependent samples t-test

สมมติว่าบริษัทแห่งหนึ่งต้องการประเมินประสิทธิภาพของโปรแกรมฝึกอบรมการบริการลูกค้าแบบใหม่ โดยวัดคะแนนความพึงพอใจของลูกค้าก่อนและหลังพนักงานเข้าร่วมโปรแกรม

ข้อมูล (สมมติ)

พนักงาน คะแนนก่อนอบรม คะแนนหลังอบรม ความแตกต่าง (หลัง – ก่อน)
A 70 85 15
B 65 75 10
C 80 90 10
D 72 88 16
E 68 78 10

ขั้นตอนการวิเคราะห์

  1. กำหนดสมมติฐาน:
    • H0: ค่าเฉลี่ยความแตกต่างของคะแนนความพึงพอใจของลูกค้าก่อนและหลังอบรมเท่ากับศูนย์ (โปรแกรมไม่มีผล)
    • H1: ค่าเฉลี่ยความแตกต่างของคะแนนความพึงพอใจของลูกค้าก่อนและหลังอบรมไม่เท่ากับศูนย์ (โปรแกรมมีผล)
  2. คำนวณค่าเฉลี่ยความแตกต่าง: (15 + 10 + 10 + 16 + 10) / 5 = 12.2
  3. คำนวณค่า t และ p-value: (ในทางปฏิบัติจะใช้โปรแกรมสถิติ) สมมติว่าผลการวิเคราะห์แสดงค่า t = 4.5 และ p-value = 0.005
  4. สรุปผล: เนื่องจาก p-value (0.005) น้อยกว่าระดับนัยสำคัญ 0.05 เราจึงปฏิเสธ H0 และสรุปได้ว่าโปรแกรมฝึกอบรมการบริการลูกค้าแบบใหม่นี้ส่งผลให้คะแนนความพึงพอใจของลูกค้าเพิ่มขึ้นอย่างมีนัยสำคัญทางสถิติ

ข้อผิดพลาดที่พบบ่อยในการใช้ dependent samples t-test

การใช้ dependent samples t-test อย่างถูกต้องนั้นสำคัญ เพื่อให้ได้ผลลัพธ์ที่น่าเชื่อถือ ข้อผิดพลาดที่พบบ่อยมีดังนี้:

  • ใช้ผิดประเภท: ใช้ dependent samples t-test กับข้อมูลที่เป็นอิสระต่อกัน (independent samples) เช่น เปรียบเทียบคะแนนเฉลี่ยของนักเรียนชายกับนักเรียนหญิง ซึ่งควรใช้ independent samples t-test แทน
  • ละเลยข้อสมมติฐาน: dependent samples t-test มีข้อสมมติฐานว่า “คะแนนความแตกต่าง” ควรมีการแจกแจงแบบปกติ (normally distributed) และข้อมูลควรเป็นระดับอันตรภาคหรืออัตราส่วน หากไม่เป็นไปตามนี้ ผลลัพธ์อาจไม่น่าเชื่อถือ
  • ตีความ p-value ผิด: ค่า p-value บอกเพียงโอกาสที่จะได้ผลลัพธ์เช่นนี้หากสมมติฐานว่างเป็นจริง ไม่ได้บอกขนาดของผลกระทบหรือความสำคัญในทางปฏิบัติ
  • สับสนระหว่างสหสัมพันธ์กับความเป็นเหตุเป็นผล: แม้ว่าข้อมูลจะมีความสัมพันธ์กัน แต่การทดสอบนี้เพียงบอกว่ามีความแตกต่างเกิดขึ้น ไม่ได้หมายความว่าตัวแปรหนึ่งเป็นสาเหตุของอีกตัวแปรหนึ่งเสมอไป
  • ไม่พิจารณาขนาดผลกระทบ (Effect Size): การรายงานเพียงค่า p-value อาจไม่เพียงพอ ควรพิจารณาขนาดผลกระทบ (เช่น Cohen’s d) เพื่อดูว่าความแตกต่างที่พบนั้น “ใหญ่” หรือ “เล็ก” ในทางปฏิบัติ

ข้อควรพิจารณาก่อนใช้ dependent samples t-test

ก่อนที่จะตัดสินใจใช้ dependent samples t-test ควรพิจารณาประเด็นสำคัญเหล่านี้:

  • ตรวจสอบข้อสมมติฐาน:
    • ข้อมูลจับคู่กัน: แต่ละหน่วยการทดลองต้องมีข้อมูลสองชุดที่สัมพันธ์กัน
    • การแจกแจงปกติของผลต่าง: คะแนนความแตกต่างระหว่างสองการวัดควรมีการแจกแจงแบบปกติ (สามารถตรวจสอบได้ด้วยกราฟ Q-Q plot หรือ Shapiro-Wilk test) หากตัวอย่างมีขนาดใหญ่ (n > 30) มักจะอนุโลมได้ตาม Central Limit Theorem
    • ระดับการวัด: ข้อมูลควรเป็นระดับอันตรภาค (interval) หรืออัตราส่วน (ratio)
  • ขนาดตัวอย่าง: แม้จะไม่มีกฎตายตัว แต่ขนาดตัวอย่างที่เล็กมากอาจทำให้กำลังการทดสอบต่ำและไม่สามารถตรวจจับความแตกต่างที่มีอยู่จริงได้
  • ทางเลือกอื่น: หากข้อสมมติฐานการแจกแจงปกติของผลต่างไม่เป็นไปตามที่กำหนด และขนาดตัวอย่างเล็ก อาจพิจารณาใช้การทดสอบแบบนอนพาราเมตริก เช่น Wilcoxon Signed-Rank Test แทน
  • ความเข้าใจเชิงลึก: การทำความเข้าใจสถิติพื้นฐานเป็นสิ่งสำคัญอย่างยิ่ง หากคุณต้องการศึกษาเพิ่มเติมเกี่ยวกับสถิติและการวิเคราะห์ข้อมูลในภาพรวม สามารถดูได้จาก คู่มือสถิติและการวิเคราะห์ข้อมูล ฉบับสมบูรณ์
  • การเลือกใช้เครื่องมือ: การเลือกใช้การทดสอบทางสถิติที่เหมาะสมเป็นหัวใจสำคัญของการวิเคราะห์ข้อมูล ไม่ว่าจะเป็น f test คือ ที่ใช้ในการเปรียบเทียบความแปรปรวนหรือวิเคราะห์ความแปรปรวน (ANOVA) หรือแม้แต่ irr คือ ที่ใช้ในการประเมินความน่าเชื่อถือของผู้ให้คะแนนหลายคน ซึ่งแต่ละเครื่องมือก็มีวัตถุประสงค์และข้อจำกัดที่แตกต่างกันไป

dependent samples t-test เป็นเครื่องมือที่มีประสิทธิภาพและใช้งานได้จริงสำหรับการเปรียบเทียบข้อมูลที่จับคู่กัน ช่วยให้นักวิจัยและนักวิเคราะห์สามารถประเมินผลของการเปลี่ยนแปลงหรือการแทรกแซงได้อย่างแม่นยำยิ่งขึ้น การทำความเข้าใจหลักการ ข้อสมมติฐาน และข้อควรระวัง จะช่วยให้คุณสามารถใช้การทดสอบนี้ได้อย่างถูกต้องและได้ข้อสรุปที่น่าเชื่อถือในการตัดสินใจ

คำถามที่พบบ่อย

ควรใช้ dependent samples t-test เมื่อใด แทนที่จะเป็น independent samples t-test?

คุณควรใช้ dependent samples t-test เมื่อข้อมูลของคุณมาจากกลุ่มตัวอย่างชุดเดียวกันที่ถูกวัดผลสองครั้ง (เช่น ก่อน-หลัง) หรือเมื่อข้อมูลถูกจับคู่กันอย่างเป็นธรรมชาติ (เช่น คู่แฝด) หากข้อมูลมาจากสองกลุ่มที่แยกจากกันโดยสิ้นเชิงและไม่มีความสัมพันธ์กัน ควรใช้ independent samples t-test

ถ้าข้อมูลความแตกต่างของฉันไม่เป็นไปตามการแจกแจงปกติ จะทำอย่างไร?

หากขนาดตัวอย่างของคุณเล็กและข้อมูลความแตกต่างไม่เป็นไปตามการแจกแจงปกติ คุณอาจพิจารณาใช้การทดสอบแบบนอนพาราเมตริก (non-parametric test) เช่น Wilcoxon Signed-Rank Test ซึ่งเป็นทางเลือกสำหรับ dependent samples t-test ที่ไม่ต้องอาศัยข้อสมมติฐานการแจกแจงปกติ

ค่า p-value ที่มีนัยสำคัญหมายความว่าอย่างไรในการทดสอบนี้?

ค่า p-value ที่มีนัยสำคัญ (โดยทั่วไปคือ p < 0.05) หมายความว่ามีความเป็นไปได้น้อยมากที่จะสังเกตเห็นความแตกต่างของค่าเฉลี่ยที่คุณพบ หากไม่มีความแตกต่างที่แท้จริงในประชากร ซึ่งนำไปสู่การปฏิเสธสมมติฐานว่างและสรุปว่ามีความแตกต่างอย่างมีนัยสำคัญทางสถิติ

dependent samples t-test สามารถใช้เปรียบเทียบข้อมูลมากกว่าสองช่วงเวลาได้หรือไม่?

ไม่ได้ dependent samples t-test ถูกออกแบบมาเพื่อเปรียบเทียบข้อมูลเพียงสองช่วงเวลาหรือสองเงื่อนไขเท่านั้น หากคุณต้องการเปรียบเทียบข้อมูลจากสามช่วงเวลาขึ้นไปสำหรับกลุ่มตัวอย่างเดียวกัน คุณควรพิจารณาใช้ Repeated Measures ANOVA แทน

มีข้อจำกัดเรื่องขนาดตัวอย่างขั้นต่ำสำหรับการใช้ dependent samples t-test หรือไม่?

ไม่มีข้อจำกัดตายตัว แต่โดยทั่วไปแล้ว ขนาดตัวอย่างที่เล็กมาก (เช่น น้อยกว่า 10 คู่) อาจทำให้กำลังการทดสอบ (statistical power) ต่ำ ทำให้ยากที่จะตรวจจับความแตกต่างที่มีอยู่จริงได้ และข้อสมมติฐานเรื่องการแจกแจงปกติของผลต่างจะมีความสำคัญมากขึ้น

การใช้ dependent samples t-test บอกความสัมพันธ์เชิงสาเหตุได้หรือไม่?

การทดสอบนี้สามารถบอกได้ว่ามีความแตกต่างอย่างมีนัยสำคัญทางสถิติระหว่างสองการวัด แต่ไม่ได้ยืนยันความสัมพันธ์เชิงสาเหตุโดยตรง การสรุปความสัมพันธ์เชิงสาเหตุต้องอาศัยการออกแบบการวิจัยที่ดี (เช่น การทดลองแบบสุ่มและมีกลุ่มควบคุม) และการพิจารณาปัจจัยอื่นๆ อย่างรอบคอบ

Scroll to Top