实体
containerd
containerd
PulseAugur coverage of containerd — every cluster mentioning containerd across labs, papers, and developer communities, ranked by signal.
总计 · 30天
3
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
关系
情绪 · 30 天
2 天有情绪数据
最近 · 第 1/1 页 · 共 3 条
-
使用 MutatingAdmissionWebhook 在 Kubernetes 中自动化 GPU 共享
本文讨论了如何使用 MutatingAdmissionWebhook 在 Kubernetes 环境中自动化 GPU 共享。文章探讨了将 GPU 共享机制集成到 Pod 中的实用方法,重点关注易于实现和补丁能力。该文旨在为容器化工作负载中图形处理单元的高效管理和分配提供解决方案。
-
DGX Spark 内存管理挑战详解 LLM 服务
DGX Spark 系统配备 NVIDIA GB10 Grace Blackwell Superchip,在扣除系统进程和 CUDA 分配后,为 LLM 服务提供约 115 GiB 的可用内存。然而,管理这个共享内存池至关重要,因为驱动程序分配可能会超出进程级别的 cgroup 限制,可能导致系统冻结和自动重启循环。缓解这些问题的策略包括仔细监控内存使用情况、禁用或缩小交换空间,以及在重启前实施特定命令来更新容器重启策略。
-
Kubernetes DaemonSets 确保 Pod 在每个节点上运行
Kubernetes 中的 DaemonSets 是确保特定 Pod 在集群的每个节点上运行的关键组件。此功能由系统自动管理,保证日志记录或监控代理等基本服务得到一致部署。系统负责在所有节点上分发和维护这些 Pod,从而简化集群操作。