context window ทำงานยังไง — และทำไม prompt cache ถูกลง ~10 เท่า
AI 'จำ' บทสนทนาได้ยังไง ทั้งที่ LLM ลืมทุก turn? เข้าใจ context window (payload ต่อ turn ≠ ไฟล์ประวัติแชท), อะไรกิน window, และ prompt caching ที่ทำให้คุยรัว ๆ ถูกกว่าทิ้งไว้นาน — vendor-neutral