91超碰碰碰碰久久久久久综合_超碰av人澡人澡人澡人澡人掠_国产黄大片在线观看画质优化_txt小说免费全本

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

tkestack/gpu-manager在k8s1.23版本之后如何使用

發布時間:2023-04-27 15:25:47 來源:億速云 閱讀:125 作者:iii 欄目:開發技術

這篇文章主要介紹“tkestack/gpu-manager在k8s1.23版本之后如何使用”的相關知識,小編通過實際案例向大家展示操作過程,操作方法簡單快捷,實用性強,希望這篇“tkestack/gpu-manager在k8s1.23版本之后如何使用”文章能幫助大家解決問題。

異常

在1.25版本的k8s集群中部署gpu-manage時,雖然顯示gpu節點上gpu-manage的pod實例都是running狀態,但是給pod申領tencent.com/vcuda-memory資源時,卻始終找不到有資源的節點。
查看節點的詳情時,返回的allocatable字段中也沒有相關資源:

Allocatable:
  cpu:                       48
  ephemeral-storage:         48294789041
  hugepages-1Gi:             0
  hugepages-2Mi:             0
  memory:                    65291520Ki
  pods:                      110
System Info:
  Machine ID:                 50ca20960ea94552bd5ef84a20ce7e47

說明gpu-manager并沒有正確運行。

排查

查看任意gpu-manager的pod日志,可以看到如下異常信息:

rebuild ldcache
launch gpu manager
E0426 06:17:06.729262    2384 server.go:131] Unable to set Type=notify in systemd service file?
E0426 06:17:11.731947    2384 server.go:152] can't create container runtime manager: context deadline exceeded

說明gpu-manager和容器運行時接口通信失敗了。
查看異常信息指向的代碼:

...
	containerRuntimeManager, err := containerRuntime.NewContainerRuntimeManager(
		m.config.CgroupDriver, m.config.ContainerRuntimeEndpoint, m.config.RequestTimeout)
	if err != nil {
		klog.Errorf("can't create container runtime manager: %v", err)
		return err
	}
	klog.V(2).Infof("Container runtime manager is running")
...

可以看到是訪問m.config.ContainerRuntimeEndpoint超時,這個變量的默認值定義在cmd/manager/options/options.go

const (
	DefaultDriver                   = "nvidia"
	DefaultQueryPort                = 5678
	DefaultSamplePeriod             = 1
	DefaultVirtualManagerPath       = "/etc/gpu-manager/vm"
	DefaultAllocationCheckPeriod    = 30
	DefaultCheckpointPath           = "/etc/gpu-manager/checkpoint"
	DefaultContainerRuntimeEndpoint = "/var/run/dockershim.sock"
	DefaultCgroupDriver             = "cgroupfs"
)

可以看到這里用的運行時接口是/var/run/dockershim.sock,但是在k8s1.23版本之后,接口路徑已經改為/var/run/cri-dockerd.sock,所以修改默認之后重新編譯即可。

編譯

使用make img既可以用源碼的Makefile自動編譯打包成新的鏡像,但是源碼的/home/zp/work/gpu-manager/build/Dockerfile中的git222不一定能裝上,可以改成git,另外有一些依賴需要國際上的支持。
編譯后的鏡像在1.25版本的k8s中可以正常使用。

關于“tkestack/gpu-manager在k8s1.23版本之后如何使用”的內容就介紹到這里了,感謝大家的閱讀。如果想了解更多行業相關的知識,可以關注億速云行業資訊頻道,小編每天都會為大家更新不同的知識點。

向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

铜川市| 石城县| 崇礼县| 施秉县| 长垣县| 象山县| 日土县| 峡江县| 黄大仙区| 浏阳市| 河源市| 新民市| 西吉县| 栖霞市| 永胜县| 尚义县| 伊春市| 上蔡县| 英山县| 县级市| 赣榆县| 徐州市| 济宁市| 高要市| 信宜市| 茂名市| 社旗县| 尚志市| 太谷县| 安塞县| 上蔡县| 延寿县| 定结县| 泗水县| 图木舒克市| 安陆市| 淮北市| 白河县| 福清市| 蓬安县| 岱山县|