SEO & AI

AI ตรวจสอบหน้า 404 ได้ไหม? เคสจริงที่ผมไม่รอให้คนอ่านเจอทางตัน

AI ตรวจสอบหน้า 404 ได้ไหม ภาพประกอบเส้นทางเว็บไซต์ที่เจอทางตัน

AI ตรวจสอบหน้า 404 ได้ครับ ถ้าให้มันดู URL ที่คนและ crawler เดินมาจริง แล้วทดสอบปลายทาง ไม่ใช่แค่สแกนคำว่า “404” ในหน้าเว็บ มันช่วยรวบรวมทางตันและเรียงความสำคัญให้ได้ แต่การตัดสินใจว่า URL ไหนควร redirect, คืนหน้าเดิม หรือปล่อยให้หายไป ยังต้องเป็นของคนครับ

สำหรับเว็บที่มีบทความราว 190 หน้าอย่างเว็บผม งานนี้มีค่าเพราะ URL เปลี่ยนนิดเดียวก็ทำให้ลิงก์เก่า, bookmark หรือผลค้นหา พาคนไปผิดที่ได้ ผมเลยใช้ AI เป็นคนไล่หลักฐานก่อน ไม่รอให้คนอ่านทักว่า “ลิงก์นี้เข้าไม่ได้ครับ” 555

หน้า 404 คืออะไร และเมื่อไรถึงเป็นปัญหา?

404 คือคำตอบจาก server ว่าไม่พบหน้าที่ถูกขอครับ และมันไม่ใช่ error ที่ต้องรีบซ่อนทุกครั้ง ถ้าผมลบบทความทดลองที่ไม่มีใครควรเข้าถึงแล้ว URL นั้นตอบ 404 ก็ตรงไปตรงมาดีมาก ดีกว่าส่งคนไปหน้าแรกแบบงง ๆ

มันกลายเป็นปัญหาเมื่อยังมีคนสำคัญเดินมาหามันอยู่ เช่น ลิงก์ในบทความตัวเอง, เมนู, sitemap, แคมเปญเก่า, หรือผล Google ที่ยังเก็บ URL ไว้ คนที่ตั้งใจอ่านเรื่องหนึ่งแล้วถูกโยนกลับหน้าแรกไม่ได้รับคำตอบ ส่วน crawler ก็ได้สัญญาณขัดกันว่าหน้านี้เรายังเสนอให้ค้นพบอยู่หรือเปล่า

นี่ต่างจากเรื่อง AI ตรวจสอบลิงก์เสียได้ไหม นิดหนึ่งครับ ลิงก์เสียคือจุดเริ่มต้นที่พาไปผิด ส่วนการตรวจ 404 คือดูปลายทางและตัดสินใจว่าทางตันนั้นควรมีอยู่ไหม ทั้งสองอย่างต้องทำคู่กัน

AI ตรวจสอบหน้า 404 ได้จากข้อมูลอะไรบ้าง?

AI จะหา 404 ได้ดีเมื่อมีรายการ URL หลายมุมมาเทียบกันครับ ถ้าให้มันเปิดสุ่ม ๆ มันอาจเจอเพียงหน้า 404 สวย ๆ แต่ไม่รู้ว่ามีใครกระทบจริงหรือไม่

  • Internal link — ลิงก์จากบทความและหน้าหลักของเราเอง เพราะนี่คือทางที่แก้ได้ทันที
  • Sitemap — URL ที่เราบอก crawler ว่าควรไปดู ไม่ควรมีปลายทาง 404 ปนอยู่
  • Access log — คำขอจริงที่เกิดขึ้น ช่วยเห็น URL เก่าหรือ typo ที่คนยังพยายามเข้า
  • Google Search Console — ช่วยมองสิ่งที่ Googlebot พบและบริบทของ index
  • รายการ redirect — เอาไว้แยกว่า URL หายจริง, redirect แล้ว, หรือ redirect วน

AI ไม่ได้มีพลังเห็นทุก URL บนอินเทอร์เน็ตนะครับ มันเห็นเท่าหลักฐานที่เราส่งให้เท่านั้น แต่ความเก่งของมันคือเอารายการยาว ๆ มารวม, ตัดซ้ำ, ทดลอง request และสรุปเป็นรายการที่อ่านง่ายกว่ากอง log

เคสจริง: ผมไล่ทางตันบนเว็บบทความราว 190 หน้าอย่างไร?

ผมเริ่มจาก inventory ของเว็บก่อน แล้วให้ AI รายงาน “ข้อยกเว้น” แทนการเชื่อว่าทุกลิงก์น่าจะถูกครับ ตอนตรวจ SEO ชุดล่าสุด ผมมีบทความประมาณ 190 หน้า, sitemap และลิงก์ข้ามบทความจำนวนมากพอที่เปิดคลิกด้วยมือทีละจุดไม่คุ้มเวลาแล้ว

วิธีที่ผมใช้คือดึง URL ภายในเว็บออกมา, ตัด URL ซ้ำ, request ปลายทาง แล้วแบ่งผลเป็น 200, 3xx, 404 และ 5xx จากนั้นให้ AI จับคู่ 404 กับต้นทางที่ลิงก์หาและชนิดหน้าที่มันเคยเป็น ผลลัพธ์ที่ผมต้องการไม่ใช่ “มี 404 กี่หน้า” แต่เป็นตารางสั้น ๆ ว่า หน้าไหนยังมีทางเข้า, ทางเข้ามาจากไหน, และมีหน้าทดแทนจริงหรือไม่

ตัวเลข 190 หน้าไม่ได้ใหญ่ระดับเว็บ e-commerce หรอกครับ แต่ก็ใหญ่พอให้ความมั่นใจจากการคลิกสุ่มหลอกเราได้ งานนี้คล้ายตอนผม ตรวจ Sitemap: sitemap บอกว่าเราเชิญ crawler ไปที่ไหน ส่วน 404 บอกว่าพอไปถึงแล้วมีประตูปิดรออยู่หรือเปล่า

ที่สำคัญ ผมไม่ให้ AI ยิง redirect เอง เพราะ redirect ผิดแค่ครั้งเดียวก็พาคนไปหน้าที่ไม่เกี่ยวกว่าเดิมได้ ให้มันเสนอหลักฐานและตัวเลือก ส่วนผมเป็นคนอนุมัติครับ

เจอ 404 แล้วควรแก้แบบไหน?

คำตอบที่ถูกขึ้นอยู่กับความตั้งใจของ URL เก่า ไม่ใช่ขึ้นอยู่กับว่าเราเกลียดเลข 404 แค่ไหนครับ ผมใช้กติกาง่าย ๆ สี่แบบเพื่อไม่ให้ทุกปัญหาจบที่ redirect หน้าแรก

  • แก้ลิงก์ต้นทาง เมื่อบทความของเราเองพิมพ์ URL ผิดหรือชี้ slug เก่า วิธีนี้สะอาดที่สุด เพราะคนได้ไปยังหน้าที่ต้องการทันที
  • 301 redirect เมื่อมีหน้าใหม่ที่ตอบเจตนาเดียวกับหน้าเดิมจริง ๆ เช่น ย้าย slug หรือรวมเนื้อหาหัวข้อเดียวกัน
  • คืนหน้าเดิม เมื่อ URL นั้นยังควรมีค่าทางธุรกิจหรือมีคนตามหาเนื้อหาเฉพาะของมัน
  • ปล่อย 404 หรือใช้ 410 เมื่อของเดิมถูกเลิกและไม่มีสิ่งทดแทนที่ซื่อสัตย์พอจะส่งต่อ

การ redirect ทุกอย่างไปหน้าแรกดูเหมือนแก้เร็ว แต่สำหรับคนอ่านมันเหมือนถามหาหนังสือแล้วเจ้าหน้าที่พาไปยืนกลางร้าน 555 Google ก็ไม่ได้อยากให้เราแกล้งทำว่าทุก URL ที่หายไปมีคำตอบเดียวกันด้วย

จะตั้งระบบตรวจ 404 โดยไม่ทำให้ทีมจมรายงานได้ยังไง?

เริ่มจากรายงานเล็กและจัดลำดับตามผลกระทบครับ ไม่ใช่ส่ง CSV หลายพันบรรทัดให้คนหนึ่งคนไปจ้อง สำหรับเว็บเล็ก ผมมองเฉพาะ 404 ที่มาจาก internal link, sitemap, หน้า traffic สูง หรือมีคนขอซ้ำก่อน ส่วน URL สุ่มจาก bot แปลก ๆ อาจเก็บไว้ดูแนวโน้ม ไม่ต้องรีบสร้าง redirect ให้ทุกอัน

รอบตรวจที่ดีควรบอกได้ว่า URL ไหนเพิ่งเกิด, เกิดกี่ครั้ง, referrer มาจากไหน และข้อเสนอคืออะไร โดยมีลิงก์หลักฐานให้เปิดดูต่อได้ การทำแบบนี้ทำให้ AI ช่วยลดงาน “หา” และ “จัดกลุ่ม” แต่ไม่แอบข้ามขั้น “ตัดสินใจ”

ถ้าเพิ่งเริ่มทำ SEO แบบจับมือทำ ผมสอนวิธีใช้ AI วางระบบงานและตรวจของจริงไว้ใน คอร์ส LearnAI ครับ จุดสำคัญไม่ใช่จำคำสั่งยาว ๆ แต่คือรู้ว่าจะเอาหลักฐานอะไรมาให้ AI ดูก่อนสั่งมัน

AI ตรวจ 404 แทนคนได้ทั้งหมดไหม?

แทนการไล่รายการและทดสอบซ้ำได้เยอะมาก แต่แทนความเข้าใจเจตนาของหน้าไม่ได้ทั้งหมดครับ AI อาจเห็นว่า URL เก่ากับหน้าใหม่มีคำคล้ายกันและเสนอ redirect แต่คนที่รู้ธุรกิจเท่านั้นจะบอกได้ว่าสองหน้านั้นตอบลูกค้าคนเดียวกันจริงไหม

ผมจึงให้ AI มีสิทธิ์อ่านข้อมูลและสร้างรายงาน แต่ไม่ให้แก้ redirect production, ลบหน้า หรือเปลี่ยน sitemap เอง หลักเดียวกับตอน ตรวจ Redirect เว็บไซต์ เลยครับ: ให้เครื่องทำงานที่ซ้ำและเสี่ยงพลาดง่าย ส่วนงานที่เปลี่ยนเส้นทางลูกค้ายังต้องมีเจ้าของรับผิดชอบ

คำถามที่พบบ่อย

AI ตรวจสอบหน้า 404 ได้ไหม?

ได้ครับ AI ช่วยรวม URL จากลิงก์, sitemap, log และ Search Console แล้วทดสอบปลายทางเพื่อชี้หน้า 404 ที่ควรดูต่อ แต่คนควรเป็นผู้อนุมัติการแก้ URL หรือ redirect เสมอ

เจอหน้า 404 ต้อง redirect ทุกหน้าหรือไม่?

ไม่ต้องครับ Redirect เฉพาะกรณีที่มีหน้าทดแทนซึ่งตอบเจตนาเดิมได้จริง ถ้าไม่มี การตอบ 404 หรือ 410 อย่างตรงไปตรงมาดีกว่าส่งคนไปหน้าแรกแบบไม่เกี่ยวข้อง

หน้า 404 ทำให้ SEO แย่เสมอไหม?

ไม่เสมอไปครับ หน้าเก่าที่ตั้งใจลบควรตอบ 404 ได้ตามปกติ ปัญหาคือเมื่อ internal link, sitemap หรือผลค้นหาที่ยังมีคนเข้า พาไปยังหน้านั้นต่อเนื่อง

ธุรกิจเล็กควรตรวจ 404 บ่อยแค่ไหน?

เช็กทุกครั้งหลังย้าย URL, ปรับโครงสร้างเว็บ หรือปล่อยเนื้อหาชุดใหญ่ก็เพียงพอสำหรับเริ่มต้นครับ ถ้ามีการอัปเดตต่อเนื่อง ควรมีรายงานสั้นรายสัปดาห์

สำหรับผม ผู้ช่วย AI ที่ดีไม่ใช่ตัวที่แก้เว็บเองเร็วที่สุด แต่คือตัวที่เอาหลักฐานของทางตันมาให้ผมตัดสินใจก่อนมันกระทบคนอ่าน ถ้าคุณอยากมี AI ที่รู้บริบทธุรกิจและช่วยไล่งานหลังบ้านแบบนี้ ลองดู Newton ครับ

— Pond