实体
Keda
Keda
PulseAugur coverage of Keda — every cluster mentioning Keda across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 3 条
-
通过选择更好的信号修复 vLLM 自动扩缩容抖动问题
本文解决了 vLLM 自动扩缩容中出现的“抖动”问题,即 Pod 在运行和失败状态之间快速循环,导致成本和延迟增加。作者解释说,这个问题通常源于选择了不合适的自动扩缩容信号,而不是配置不正确。文章详细介绍了通过三个步骤来改进自动扩缩容,即从任意阈值转移到计算阈值,最终实现一个稳定的设计,该设计使用更健壮的信号来防止振荡。
-
中国公司预测2026年上半年利润强劲,市场复苏在望
多家中国公司公布了2026年上半年强劲的利润预测,预示着积极的经济前景。泛海信息预计净利润增长41.50%至52.32%,而江苏风电子预计增长89.99%至121.65%。其他公司如科达和艾仕顿预计增长更为可观,科达预测增长1006%-1191%,艾仕顿预测增长2144.74%-2593.68%。这些预测的驱动因素包括产品竞争力提升、市场需求复苏以及成本控制措施的加强。
-
Kubernetes 算子实现 LLM 服务的缩减至零
新的 Kubernetes 算子正在涌现,以解决运行大型语言模型的成本问题,特别是闲置 GPU 烧钱的问题。Hearth 是一个处于 alpha 阶段的算子,允许用户声明式地服务开源 LLM,并在不使用时将其缩减至零,在冷启动期间缓冲请求。另一种方法是构建一个使用 NVML 的 KEDA 外部扩展器,以实现基于实际 GPU 利用率的自动扩展,从而减少对 Prometheus 等完整指标堆栈的需求。