CLOUD & INFRA

Kubernetes v1.37 เปิดฟีเจอร์ Scale to Zero สำหรับ HPA เป็นสถานะ Beta

Kubernetes02 Sep 2026
1 min read
Key Takeaways
  • Kubernetes สามารถสเกล Pod ลงเหลือศูนย์และเปิดกลับมาใหม่เองได้แล้วผ่าน HPA มาตรฐาน โดยไม่ต้องพึ่งพาซอฟต์แวร์เสริม

ทำไมเรื่องนี้ถึงสำคัญ

ช่วยให้องค์กรลดค่าใช้จ่ายด้านคลาวด์ได้อย่างมาก โดยเฉพาะเมื่อใช้ทรัพยากรราคาแพงอย่าง GPU หรือ CPU ขนาดใหญ่ที่มักจะถูกเปิดทิ้งไว้แม้ไม่มีโหลดงานจริง

ในเวอร์ชัน v1.37 ฟีเจอร์การลดจำนวน Replicas ของ Workload ลงเหลือศูนย์ผ่าน HorizontalPodAutoscaler (HPA) ได้รับการอัปเกรดเป็นสถานะ Beta และเปิดใช้งานเป็นค่าเริ่มต้น ฟีเจอร์นี้ช่วยให้นักพัฒนาสามารถจัดการทรัพยากรได้อย่างคุ้มค่า โดยเฉพาะสำหรับงานประเภทประมวลผลเป็นชุด (Batch Processing) หรือการทำงานตามคิว (Queue Consumers) ที่ไม่จำเป็นต้องทำงานตลอดเวลา

การใช้งาน Scale to Zero จำเป็นต้องใช้ Object Metrics หรือ External Metrics เช่น ความยาวของคิวใน Prometheus เนื่องจากทรัพยากรพื้นฐานอย่าง CPU หรือ Memory จะหายไปเมื่อไม่มี Pod ทำงานอยู่ ทำให้ HPA ไม่สามารถรับสัญญาณเพื่อสเกลกลับมาได้ หากใช้เมตริกภายนอก HPA จะสามารถตรวจสอบสถานะและดึงระบบกลับมาทำงานเมื่อมีงานใหม่เข้ามาได้ทันที

สรุปประเด็นหลัก

ฟีเจอร์ Scale to Zero ปรับเป็น Beta และเปิดใช้โดย default ใน v1.37

จำเป็นต้องใช้ External หรือ Object Metrics ในการส่งสัญญาณสเกลกลับจากศูนย์

ช่วยประหยัดทรัพยากรสำหรับงานที่ไม่ได้รันตลอดเวลา แต่ต้องแลกกับ Cold-start time

นวัตกรรมและเทคโนโลยี

infrastructure

HPA Scale to Zero

ความสามารถในการลดจำนวน Pod เหลือ 0 และสเกลกลับขึ้นมาตามเมตริกภายนอก

tools

ScaledToZero Status Condition

ตัวบ่งชี้สถานะใหม่ที่ช่วยให้ HPA แยกแยะระหว่างการสเกลเป็นศูนย์อัตโนมัติกับการหยุดทำงานด้วยตนเอง

Developer Impact
วิศวกร DevOps และ Site Reliability Engineers (SRE) สามารถลดค่าใช้จ่าย Infrastructure ได้ด้วยการใช้ minReplicas: 0 ใน HPA แต่ต้องคำนึงถึง Cold-start และการตั้งค่า Metrics Adapter เช่น Prometheus Adapter ให้ถูกต้อง
Keywords
#kubernetes #hpa #autoscaling #cloud computing
Original Source

อ่านข้อมูลเพิ่มเติมจากแหล่งข่าวหลัก

Kubernetes