GPU должны быть готовы до всплеска: как построить упреждающее масштабирование в Kubernetes
Практическая схема predictive autoscaling для GPU: измерить lead time, прогревать ёмкость волнами, проверить прогноз в shadow mode и оставить реактивный safety net.