llms.txt คือไฟล์ข้อความที่สรุปเว็บไซต์ให้ AI อ่าน เพิ่มเข้าไปได้แทบไม่มีต้นทุน แต่ ณ วันนี้ยังไม่มี AI engine รายใหญ่รายไหนประกาศว่าจะอ่านไฟล์นี้ ถ้าเคยอ่านเรื่อง GEO มาบ้าง คงเคยเห็น llms.txt ถูกขายเป็นไฟล์วิเศษที่ทำให้เข้าไปอยู่ในคำตอบ AI ได้ เราเองก็ใส่ไฟล์นี้ให้เว็บของลูกค้า — แต่เราคิดว่าคุณควรได้รู้เวอร์ชันตรงไปตรงมาว่ามันทำอะไรได้จริง
มันคืออะไร
"llms.txt" เป็นข้อเสนอ (เดือนกันยายน 2024 จาก Jeremy Howard แห่ง Answer.AI) ให้มีไฟล์ข้อความรูปแบบ Markdown อยู่ที่ root ของเว็บไซต์ สรุปให้โมเดลภาษารู้ว่าคุณคือใครและหน้าสำคัญอยู่ที่ไหน มีไฟล์คู่กันชื่อ "llms-full.txt" สำหรับเวอร์ชันขยาย มองเป็นโต๊ะต้อนรับสำหรับเครื่องจักรก็ได้ ชื่อ การวางตำแหน่งหนึ่งบรรทัด บริการหลัก หน้าสำคัญ ช่องทางติดต่อ
มันไม่ใช่อะไร
นี่คือส่วนที่กระแสข่าวมักไม่พูดถึง ณ วันนี้ ไม่มี AI engine รายใหญ่รายไหนประกาศว่าจะอ่าน llms.txt มันไม่ใช่สัญญาณจัดอันดับ ไม่มีหลักฐานว่า ChatGPT, Gemini หรือ Perplexity อ่านไฟล์นี้ตอนประกอบคำตอบ เวลาเราทดสอบการอ้างอิง สิ่งที่เอนจินหยิบไปใช้จริงคือ หน้า HTML ของคุณ — title, description, เนื้อหาที่มองเห็นได้ในหน้า ข้อเท็จจริงที่มีอยู่แค่ใน llms.txt เท่ากับไม่มีอยู่จริงสำหรับการดึงข้อมูลของ AI
นี่คือเหตุผลที่ในกรอบการตรวจสุขภาพ 24 ข้อของเรา รายการที่เกี่ยวกับ llms.txt ถูกระบุชัดเจนว่าเป็นข้อ ให้ข้อมูลเฉยๆ ไม่นับคะแนน เว็บที่ไม่มีไฟล์นี้ไม่ได้แปลว่ามีปัญหา เว็บที่มีไฟล์นี้สมบูรณ์แบบแต่หน้าแรกอ่านไม่ออก ก็ยังมองไม่เห็นอยู่ดี
ทำไมเรายังใส่ให้
สามเหตุผล ทุกข้อไม่ใหญ่โต
- แทบไม่มีต้นทุน เป็นไฟล์ข้อความธรรมดาไฟล์เดียว เขียนครั้งเดียวจากข้อเท็จจริงที่มีอยู่แล้ว
- ข้อตกลงนี้อาจได้รับการยอมรับมากขึ้น ถ้าวันหนึ่งมีเอนจินเริ่มอ่านไฟล์นี้ เว็บที่มีไว้แล้วจะได้ประโยชน์ย้อนหลัง นี่คือตรรกะแบบ "ประกัน"
- การเขียนมันเป็นวินัยที่มีประโยชน์ การบังคับตัวเองให้เขียนเป็นข้อความธรรมดาว่าเราคืออะไร ให้บริการที่ไหน มีอะไรบ้างพร้อมตัวเลขจริง มักเผยให้เห็นว่าเว็บไซต์จริงของคุณเองก็ไม่ได้พูดเรื่องพวกนี้ชัดเจนเหมือนกัน ให้แก้เว็บไซต์ก่อน
กฎข้อเดียวถ้าจะใส่ไฟล์นี้
ทุกตัวเลขใน llms.txt ต้องปรากฏอยู่ในเนื้อหาที่มองเห็นได้บนหน้าเว็บด้วย เราตรวจข้อนี้ตรงๆ ในการตรวจสุขภาพ ถ้า llms.txt อ้างว่า "ลูกค้ากว่า 500 ราย" แต่ไม่มีหน้าไหนบนเว็บพูดแบบนี้เลย เท่ากับคุณเอาหลักฐานที่ดีที่สุดไปฝากไว้ในไฟล์เดียวที่เครื่องจักรยังไม่อ่าน และสร้างความไม่ตรงกันรอวันที่มันเริ่มอ่าน ไฟล์นี้ควรเป็นดัชนีที่ตรงกับเว็บจริง ไม่ใช่โลกคู่ขนาน
สรุป
ใส่ llms.txt แบบเดียวกับที่ใส่ "humans.txt" หรือ favicon ที่ทำมาอย่างดี คือทำให้เร็ว ถูกต้อง ครั้งเดียว แล้วเอาแรงจริงไปทุ่มตรงที่การดึงข้อมูลเกิดขึ้นจริง หน้าเว็บที่ server-render ได้ meta description ที่เขียนในรูปคำตอบ ตัวเลขจริงเหนือ fold และคลังเนื้อหาที่มีอยู่จริง ถ้าข้อเสนอ GEO จากเอเจนซี่ไหนเปิดเรื่องด้วย llms.txt เป็นอันดับแรก ให้ถามกลับว่าอีกเก้าส่วนสิบของแผนคืออะไร