<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>HPA on Cloudkaramchari</title><link>https://www.cloudkaramchari.com/tags/hpa/</link><description>Recent content in HPA on Cloudkaramchari</description><generator>Hugo -- gohugo.io</generator><language>en</language><copyright>cloudkaramchari</copyright><lastBuildDate>Mon, 31 Aug 2026 10:42:00 +0530</lastBuildDate><atom:link href="https://www.cloudkaramchari.com/tags/hpa/index.xml" rel="self" type="application/rss+xml"/><item><title>Kubernetes 1.37 HPA Scale-to-Zero: Setup Guide and Cold-Start Gotchas</title><link>https://www.cloudkaramchari.com/blog/kubernetes-1-37-hpa-scale-to-zero-setup-guide/</link><pubDate>Mon, 31 Aug 2026 10:42:00 +0530</pubDate><guid>https://www.cloudkaramchari.com/blog/kubernetes-1-37-hpa-scale-to-zero-setup-guide/</guid><description>
&lt;h1 id="kubernetes-137-hpa-scale-to-zero-setup-guide-and-cold-start-gotchas">Kubernetes 1.37 HPA Scale-to-Zero: Setup Guide and Cold-Start Gotchas&lt;/h1>
&lt;p>Kubernetes v1.37 (&amp;quot;Garhwal&amp;quot;) shipped on August 26, 2026, and the change most teams will actually feel is quiet: &lt;code>HorizontalPodAutoscaler&lt;/code> scale-to-zero graduated from Alpha to Beta, and &lt;strong>it's enabled by default&lt;/strong>. If you're running batch consumers, queue workers, or GPU inference pods that sit idle for long stretches, you can now let the HPA take a Deployment all the way down to zero replicas and bring it back up when demand returns — no cron job, no KEDA required for the basic case, no &lt;code>kubectl scale&lt;/code> script in a Lambda.&lt;/p></description></item></channel></rss>