หน้าต่างบริบทของเอเจนต์ AI คือ 'งบประมาณ' ไม่ใช่ 'สมุดบันทึก' — นี่คือวิธีที่ Anthropic ใช้จ่ายมัน
แนวทางด้านวิศวกรรมบริบทของ Anthropic มองหน้าต่างบริบทเป็นทรัพยากรที่มีจำกัดและเสื่อมค่าลงเรื่อยๆ โดยมีเทคนิคหลัก 4 ประการที่บันทึกไว้ ได้แก่ การแก้ไขบริบท เครื่องมือหน่วยความจำภายนอก การบีบอัดข้อมูล และเอเจนต์ย่อยที่มีหน้าต่างบริบทสะอาดเป็นของตัวเอง
คำตอบโดยย่อ
Anthropic แนะนำวิธีจัดการบริบทในเซสชันเอเจนต์ AI ที่ทำงานต่อเนื่องยาวนานอย่างไร
แนวทางของ Anthropic ปรับกรอบความคิดจาก 'วิศวกรรมพรอมป์' ไปสู่ 'วิศวกรรมบริบท' นั่นคือการคัดสรรชุดโทเคนที่มีนัยสำคัญสูงในจำนวนน้อยที่สุดสำหรับแต่ละรอบการทำงาน แทนที่จะสะสมทุกอย่างไว้ ในการทดสอบภายในของบริษัทเอง การล้างผลลัพธ์เก่าจากเครื่องมือโดยอัตโนมัติ ร่วมกับไฟล์หน่วยความจำภายนอก ช่วยเพิ่มประสิทธิภาพงานค้นหาได้ถึง 39% และลดการใช้โทเคนลง 84% ตลอด 100 รอบการสนทนา
ประเด็นสำคัญ
- Anthropic กำหนดกรอบเป้าหมายว่าคือการค้นหาชุดโทเคนที่มีนัยสำคัญสูงในจำนวนน้อยที่สุดที่จะเพิ่มโอกาสสูงสุดในการได้ผลลัพธ์ที่ต้องการ ไม่ใช่การใส่เนื้อหาให้ได้มากที่สุดเท่าที่หน้าต่างบริบทจะรองรับได้
- การแก้ไขบริบทจะลบการเรียกใช้เครื่องมือและผลลัพธ์ที่ล้าสมัยโดยอัตโนมัติเมื่อเซสชันใกล้ถึงขีดจำกัดโทเคน ในการทดสอบภายในของ Anthropic เองที่ยาว 100 รอบ วิธีนี้ช่วยลดการใช้โทเคนลงถึง 84%
- เครื่องมือหน่วยความจำช่วยให้เอเจนต์สามารถเขียนไฟล์ลงในไดเรกทอรีที่คงอยู่ข้ามบทสนทนา อยู่นอกหน้าต่างบริบทโดยสิ้นเชิง แทนที่จะต้องพยายามคิดทุกอย่างขึ้นใหม่จากบันทึกการสนทนาที่กำลังหดตัวลง
- การบีบอัด ซึ่งคือการสรุปประวัติการสนทนาและเริ่มต้นใหม่จากบทสรุปนั้น ควรปรับแต่งให้ความครบถ้วนมาก่อนความแม่นยำ โดยใช้ร่องรอยการทำงานจริงของเอเจนต์แทนตัวอย่างที่สมมติขึ้น
- เอเจนต์ย่อยที่สำรวจงานด้วยหน้าต่างบริบทสะอาดเป็นของตัวเองและรายงานกลับมาเป็นบทสรุปแบบย่อ (Anthropic ระบุว่าอยู่ที่ประมาณ 1,000-2,000 โทเคน) ช่วยไม่ให้หน้าต่างบริบทของเอเจนต์หลักเต็มไปด้วยงานร่างของตัวอื่น
เซสชันเอเจนต์ที่ทำงานยาวนานไม่ได้หมดความฉลาดลงไป แต่หมดพื้นที่ต่างหาก การเรียกใช้เครื่องมือทุกครั้ง ไฟล์ทุกไฟล์ที่มันอ่าน การลองใหม่ทุกครั้ง ล้วนถูกเพิ่มเข้าไปในบันทึกการสนทนา และไม่มีสิ่งใดหลุดออกไปเองเลย จนกระทั่งหน้าต่างบริบทกลายเป็นเพียงบันทึกสิ่งที่เอเจนต์เคยลองทำมาแล้วเป็นส่วนใหญ่ เหลือพื้นที่น้อยลงเรื่อยๆ สำหรับสิ่งที่มันควรทำต่อไป ทีมวิศวกรของ Anthropic ได้เผยแพร่คำตอบที่ชัดเจนสำหรับปัญหานี้ และมันไม่ใช่แค่ "เขียนพรอมป์ให้ดีขึ้น" แต่เป็น "บริหารงบประมาณที่กำลังหดตัว"
ปรับกรอบความคิดใหม่: วิศวกรรมบริบท ไม่ใช่วิศวกรรมพรอมป์
กรอบความคิดของ Anthropic เองสรุปได้ในประโยคเดียว คือการค้นหาชุดโทเคนที่มีนัยสำคัญสูงในจำนวนน้อยที่สุดที่จะเพิ่มโอกาสสูงสุดในการบรรลุผลลัพธ์ที่ต้องการ นี่คือเป้าหมายที่ต่างไปจาก "ใส่เนื้อหาที่เกี่ยวข้องให้ได้มากที่สุดเท่าที่จะทำได้" เซสชันเอเจนต์ที่ยาวนานจะสะสมข้อมูลไม่ว่าข้อมูลนั้นจะยังมีประโยชน์อยู่หรือไม่ และทางแก้ไม่ใช่หน้าต่างที่ใหญ่ขึ้น แต่คือการตัดสินใจอย่างจริงจังว่าอะไรควรเก็บไว้
การแก้ไขบริบท: ล้างสิ่งที่ล้าสมัย
เครื่องมือที่ตรงไปตรงมาที่สุดคือการแก้ไขบริบท (context editing) ซึ่งจะลบการเรียกใช้เครื่องมือเก่าและผลลัพธ์ของมันโดยอัตโนมัติเมื่อเซสชันใกล้ถึงขีดจำกัดโทเคน แทนที่จะปล่อยให้มันค้างอยู่เป็นภาระที่ไร้ประโยชน์ ในการทดสอบภายในของ Anthropic เพียงแค่วิธีนี้อย่างเดียวก็ช่วยเพิ่มประสิทธิภาพงานค้นหาแบบเอเจนต์ได้ถึง 29% และเมื่อรวมกับเครื่องมือหน่วยความจำที่จะกล่าวถึงต่อไป ตัวเลขนี้เพิ่มขึ้นเป็น 39% ในการทดสอบการค้นหาเว็บแยกต่างหากที่ยาวถึง 100 รอบ การแก้ไขบริบทช่วยลดการใช้โทเคนโดยรวมลงถึง 84% และยังทำให้เอเจนต์สามารถทำงานให้เสร็จสิ้นได้ ในขณะที่หากไม่มีวิธีนี้งานจะล้มเหลวโดยสิ้นเชิง เพราะบันทึกการสนทนาหมดพื้นที่ก่อนที่งานจะเสร็จ
หน่วยความจำที่อยู่นอกหน้าต่างบริบท
เครื่องมือหน่วยความจำ (memory tool) มอบไดเรกทอรีให้เอเจนต์สามารถสร้าง อ่าน อัปเดต และลบไฟล์ได้ และไดเรกทอรีนี้จะคงอยู่ข้ามการสนทนาแต่ละครั้ง โดยไม่ใช่ส่วนหนึ่งของหน้าต่างบริบทเลย แทนที่จะต้องคิดใหม่ในสิ่งที่มันเคยค้นพบแล้วเมื่อสามรอบก่อนจากบันทึกการสนทนาที่ถูกตัดทอนอยู่ตลอดเวลา เอเจนต์สามารถเขียนบันทึกไว้เพียงครั้งเดียวนอกบทสนทนา แล้วอ่านกลับมาใช้เมื่อจำเป็น
การบีบอัด: สรุปแล้วเริ่มต้นใหม่
สำหรับเซสชันที่ยาวเกินกว่าจะคอยแก้ไขทีละเล็กละน้อย การบีบอัด (compaction) จะสรุปประวัติการสนทนาและเริ่มต้นเอเจนต์ใหม่จากบทสรุปนั้นแทนที่จะใช้บันทึกฉบับเต็ม แนวทางของ Anthropic ในการปรับแต่งพรอมป์สำหรับการบีบอัดระบุลำดับไว้อย่างชัดเจน คือให้ความสำคัญกับความครบถ้วนก่อน โดยตรวจสอบให้แน่ใจว่าไม่มีสิ่งสำคัญใดถูกตัดทิ้งไป จากนั้นจึงค่อยปรับให้แม่นยำขึ้นเมื่อมั่นใจแล้วว่าไม่มีอะไรขาดหายไป ในทางกลับกัน การล้างผลลัพธ์เก่าจากเครื่องมือถูกอธิบายว่าเป็นรูปแบบการบีบอัดที่เบามือและปลอดภัยที่สุดรูปแบบหนึ่งที่มีอยู่ ซึ่งเป็นจุดเริ่มต้นที่เหมาะสมก่อนที่จะไปถึงขั้นตอนการสรุปข้อมูลแบบเต็มรูปแบบ
เอเจนต์ย่อยเก็บความยุ่งเหยิงไว้กับตัวเอง
นี่คือเทคนิคที่ Anthropic ชี้ให้เห็นสำหรับการสำรวจแบบขนาน เอเจนต์ย่อยหลายตัวสามารถใช้พื้นที่ทำงานร่างของตัวเองได้อย่างเต็มที่โดยไม่ทำให้หน้าต่างบริบทของเอเจนต์หลักเปื้อนไปด้วยทางตันของตัวอื่น รายงานของ Anthropic อ้างถึงเอเจนต์สาธิตที่เล่นเกม Pokémon และรักษาความแม่นยำของงานตลอดหลายพันขั้นตอนในเกมโดยใช้เทคนิคเหล่านี้ร่วมกัน
บันทึกที่มีโครงสร้าง เก็บไว้นอกบทสนทนา
ส่วนสุดท้ายนี้จงใจให้เป็นเทคนิคง่ายๆ คือการที่เอเจนต์เก็บบันทึกภายนอกที่อัปเดตอยู่ตลอด เช่น รายการสิ่งที่ต้องทำ หรือไฟล์ NOTES.md แทนที่จะพึ่งพาบทสนทนาเองเป็นความทรงจำเพียงอย่างเดียวว่าทำอะไรไปแล้วและยังไม่ได้ทำอะไร Claude Code ของ Anthropic เองคือตัวอย่างที่ถูกอ้างถึงสำหรับรูปแบบนี้ มันไม่มีต้นทุนในการสร้างและไม่แย่งพื้นที่กับหน้าต่างบริบท เพราะมันไม่ได้อยู่ในนั้นตั้งแต่แรก
ตรวจสอบวันที่ด้วย การแก้ไขบริบทและเครื่องมือหน่วยความจำถูกบันทึกไว้ว่าอยู่ในสถานะเบต้าสาธารณะ ณ เวลาที่เขียนบทความนี้ (Anthropic ระบุวันที่โพสต์ของตนเองเป็นวันที่ 29 กันยายน 2025 โดยอธิบายถึง Claude Sonnet 4.5) ฟีเจอร์เบต้าเปลี่ยนแปลงอย่างรวดเร็ว ควรอ่านหน้าเว็บที่เชื่อมโยงไว้โดยตรงเพื่อดูความพร้อมใช้งานปัจจุบัน แทนที่จะอ้างอิงบทสรุปนี้เมื่อเวลาผ่านไปหลายเดือน
คำถามที่พบบ่อย
- การแก้ไขบริบทเป็นสิ่งที่ผมต้องสร้างขึ้นเองหรือไม่
- ไม่ใช่ Anthropic เปิดให้ใช้งานเป็นฟีเจอร์เบต้าสาธารณะบน Claude Developer Platform, Amazon Bedrock และ Google Cloud Vertex AI สำหรับ Claude Sonnet 4.5 ซึ่งยังมีความสามารถในการรับรู้การใช้งานโทเคนของตัวเองในตัวอยู่แล้วด้วย
- เครื่องมือหน่วยความจำต่างจากการเขียนพรอมป์ระบบให้ยาวขึ้นอย่างไร
- เครื่องมือหน่วยความจำเป็นไดเรกทอรีแยกต่างหากที่ Claude อ่านและเขียนเป็นไฟล์ได้ข้ามบทสนทนา มันอยู่นอกหน้าต่างบริบทโดยสิ้นเชิง แทนที่จะไปกินพื้นที่ในทุกๆ รอบของการสนทนา
- OpenAI มีการเผยแพร่แนวทางที่เทียบเท่ากันสำหรับ ChatGPT หรือ Agents API หรือไม่
- จากการค้นคว้าสำหรับบทความนี้ไม่พบข้อมูลดังกล่าว Anthropic ได้เผยแพร่แนวทางด้านวิศวกรรมโดยละเอียดและฟีเจอร์เบต้าที่ถูกกำหนดกรอบไว้ชัดเจนว่าเป็นวิศวกรรมบริบท ส่วนเอกสารของ OpenAI ที่เทียบเคียงกันได้โดยตรงนั้นไม่พบในการค้นคว้าของเราสำหรับบทความชิ้นนี้
- เวอร์ชันที่ง่ายที่สุดของแนวทางนี้ที่ควรลองก่อนคืออะไร
- Anthropic เรียกการล้างผลลัพธ์เก่าจากเครื่องมือว่าเป็นรูปแบบการบีบอัดที่ "ปลอดภัยและเบามือที่สุดรูปแบบหนึ่ง" ซึ่งเป็นการเปลี่ยนแปลงเล็กที่สุดที่ควรทำก่อนไปถึงขั้นตอนการใช้เครื่องมือหน่วยความจำหรือสถาปัตยกรรมเอเจนต์ย่อย
แหล่งข้อมูล
- Effective context engineering for AI agents — Anthropic
- Managing context on the Claude Developer Platform — Anthropic