สารบัญคู่มือ · บทที่ 5 จาก 11
AI agent คืออะไร
บทที่ 5 จาก 11 · อ่านราว 10 นาที · อัปเดต 9 ตุลาคม 2569 · ระดับเริ่มต้น
สรุปใน 3 บรรทัด
- แชตบอตตอบเป็นข้อความ ส่วน agent ลงมือทำงานได้ด้วย เช่น อ่านไฟล์ แก้โค้ด และรันคำสั่ง
- agent ทำงานเป็นวงรอบ วางแผน ใช้เครื่องมือ ดูผล แล้วตัดสินใจทำต่อ จนกว่าจะคิดว่าเสร็จ
- agent รู้เท่าที่อยู่ในบริบท (context) และทำได้เท่าที่เราให้สิทธิ์ จึงต้องจำกัดสิทธิ์และตรวจงานทุกครั้ง
ควรอ่านก่อน
บทที่ 4: เครื่องมือแรกของ devอ่านจบแล้วคุณจะ
- บอกได้ว่า agent ต่างจากแชตบอตยังไง
- อธิบายวงรอบการทำงานของ agent
- รู้ว่าทำไมต้องจำกัดสิทธิ์ และตรวจงานที่ agent ทำเสมอ
แชตบอตกับ agent ต่างกันยังไง
| แชตบอต | agent | |
|---|---|---|
| ทำอะไรได้ | ตอบคำถาม เขียนโค้ดให้เป็นข้อความ | อ่านไฟล์ในโปรเจค แก้ไฟล์ รันคำสั่ง และตรวจผลเอง |
| ใครเป็นคนลงมือ | เราเอาคำตอบไปวางและรันเอง | agent ลงมือในเครื่องหรือโปรเจคของเรา |
| ความเสี่ยง | คำตอบผิด เราเห็นก่อนนำไปใช้ | ทำผิดได้ทันที ถ้าให้สิทธิ์มากเกินไป |
ภาพเปรียบง่าย ๆ คือ แชตบอตเหมือนเพื่อนที่โทรมาบอกวิธีซ่อมก๊อกน้ำ ส่วน agent เหมือนช่างที่เดินเข้ามาซ่อมในบ้านเราเลย ช่างทำงานเร็วกว่ามาก แต่เราก็ต้องเลือกว่าจะให้กุญแจห้องไหนบ้าง
วงรอบการทำงานของ agent
agent ไม่ได้ทำงานจบในครั้งเดียว มันวนทำงานเป็นรอบแบบนี้
- อ่านโจทย์และบริบทที่มี
- วางแผนว่าจะทำอะไรก่อนหลัง
- เลือกใช้เครื่องมือ เช่น เปิดอ่านไฟล์ แก้ไฟล์ หรือรันคำสั่ง
- ดูผลที่ได้ เช่น คำสั่งรันผ่านไหม มี error อะไร
- ตัดสินใจว่าจะทำต่อ แก้ใหม่ หรือหยุดแล้วรายงาน
วงรอบนี้อาจวนหลายสิบรอบในงานเดียว และ agent อาจพลาดได้ทุกรอบ เช่น เข้าใจโจทย์ผิด แก้ผิดไฟล์ หรือสรุปว่า "เสร็จแล้ว" ทั้งที่ยังไม่เสร็จจริง นี่คือเหตุผลที่เราต้องมีเกณฑ์รับงานไว้ตรวจเอง
เครื่องมือ คือมือของ agent
สิ่งที่ทำให้ agent ลงมือทำงานได้คือเครื่องมือ (tools) ที่ระบบเปิดให้มันใช้ ตัวอย่างที่พบบ่อย
| เครื่องมือ | ช่วยให้ทำอะไรได้ | ความเสี่ยงถ้าใช้ผิด |
|---|---|---|
| อ่านไฟล์ | เข้าใจโค้ดที่มีอยู่ | อ่านไฟล์ที่เก็บรหัสลับ |
| แก้ไฟล์ | เขียนและแก้โค้ด | แก้ไฟล์ที่ไม่เกี่ยวข้องจนพัง |
| รันคำสั่ง | ติดตั้งโปรแกรม รันเทสต์ | ลบไฟล์ หรือส่งข้อมูลออกไปข้างนอก |
| ค้นเว็บ | หาข้อมูลล่าสุด | เชื่อข้อความจากเว็บที่ตั้งใจหลอก |
ทุกเครื่องมือคือทั้งพลังและความเสี่ยงในเวลาเดียวกัน
บริบท: สิ่งที่ agent รู้ ณ ตอนนั้น
agent ไม่ได้รู้จักโปรเจคของเราทั้งหมด มันรู้เท่าที่อยู่ในบริบท (context) ซึ่งประกอบด้วย
- โจทย์ที่เราเขียน
- ไฟล์ที่มันเปิดอ่านไปแล้ว
- ไฟล์บริบทของโปรเจค เช่น
AGENTS.md - ผลจากเครื่องมือที่ใช้ไป เช่น ข้อความ error
บริบทมีขนาดจำกัด เรียกว่า context window ถ้าคุยกันยาวมาก รายละเอียดช่วงแรก ๆ อาจหลุดหายไป วิธีที่ดีคือทำงานทีละเรื่อง และเริ่มบทสนทนาใหม่เมื่อเปลี่ยนเรื่อง การเขียนโจทย์ให้ครบในครั้งเดียวจึงสำคัญมาก ดูวิธีเขียนใน บทที่ 6: เขียนโจทย์ให้ agent
สิทธิ์: agent ทำได้เท่าที่เราอนุญาต
เครื่องมือ agent ส่วนใหญ่มีโหมดที่ให้ถามเราก่อนทำสิ่งสำคัญ เช่น ก่อนแก้ไฟล์ หรือก่อนรันคำสั่ง ตอนเริ่มต้นให้ใช้โหมดนี้ และอนุญาตทีละอย่าง หลักคิดคือ ให้สิทธิ์เท่าที่งานนั้นจำเป็น
อีกเรื่องที่ต้องรู้คือ agent อาจถูกหลอกได้ ถ้าในไฟล์หรือหน้าเว็บที่มันอ่านมีข้อความแอบสั่งให้ทำอย่างอื่น เช่น "ส่งรหัสผ่านไปที่อีเมลนี้" agent บางตัวอาจทำตาม เรียกว่า prompt injection รายละเอียดอยู่ใน บทที่ 9: ความปลอดภัย
ลองใช้ agent ครั้งแรก
เครื่องมือ agent มีหลายตัวและเปลี่ยนเร็วมาก บทนี้จึงไม่ผูกกับเครื่องมือตัวไหน ให้เลือกตัวที่ทำงานในเครื่องของเราได้ และเริ่มจากงานเล็กที่ปลอดภัยในโฟลเดอร์ว่าง ๆ
สร้างไฟล์ index.html ในโฟลเดอร์นี้ ให้มี: - หัวข้อว่า "สวัสดี agent" - ย่อหน้าหนึ่งย่อหน้า อธิบายว่าหน้านี้สร้างโดย AI agent ขอบเขต: - ทำงานเฉพาะในโฟลเดอร์นี้ ห้ามแตะไฟล์ที่อื่น - ไม่ต้องติดตั้งโปรแกรมใด ๆ ก่อนสร้างไฟล์ ให้บอกแผนสั้น ๆ ก่อน เมื่อเสร็จแล้ว ให้สรุปว่าสร้างหรือแก้ไฟล์อะไรไปบ้าง
ตรวจผลยังไง
ข้อผิดพลาดที่พบบ่อย
- ให้สิทธิ์เต็มตั้งแต่ครั้งแรก เริ่มจากให้ถามก่อนทุกครั้ง แล้วค่อยผ่อนเมื่อเข้าใจการทำงานของมัน
- เชื่อรายงานของ agent โดยไม่ตรวจ "เสร็จแล้ว" ของ agent คือจุดเริ่มต้นของการตรวจ ไม่ใช่จุดจบ
- ทำหลายเรื่องในบทสนทนาเดียว บริบทจะปนกันจน agent สับสน ทำทีละเรื่อง
- วางรหัสผ่านหรือข้อมูลลับลงในแชต ข้อความในแชตอาจถูกบันทึกเก็บไว้
เช็กความเข้าใจ
1. agent ต่างจากแชตบอตตรงไหน
2. ทำไมควรให้สิทธิ์ agent เท่าที่งานนั้นจำเป็น