pull-npd-e2e-test failing ssh handshake
まだ誰も着手していません。
評価
- 難易度
- 4/5
- 見積もり時間
- 3〜5日
- 初心者へのやさしさ
- 35/100
- issue の種類
- バグ
- 明瞭さ
- 説明が足りない
- 活発さ
- 停滞
- 技術スタック
- go, kubernetes
- 領域
- ci-cd, infrastructure, testing
調査の方向性
test/e2e/metriconly/metrics_test.go の158行目から始め、リンクされた TestGrid ジョブで発生した pull-npd-e2e-test の失敗を再現します。prow ホストへのアクセスに使用される SSH と、メトリクスおよび journal ログを収集するコマンドを調査します。e2e テストが SSH ハンドシェイクエラーなしで完了し、デバッグデータを保存できれば完了です。
索引モデルが issue の本文から書いたものです。
説明
https://testgrid.k8s.io/presubmits-node-problem-detector#pull-npd-e2e-test starts to fail recently.
[1] NPD should export Prometheus metrics. When OOM kills and docker hung happen
[1] NPD should update problem_counter and problem_gauge
[1] /home/prow/go/src/k8s.io/node-problem-detector/test/e2e/metriconly/metrics_test.go:158
[2] error dialing [email protected]:22: 'ssh: handshake failed: read tcp 10.32.2.7:54804->35.184.209.153:22: read: connection reset by peer', retrying
[2] error dialing [email protected]:22: 'ssh: handshake failed: read tcp 10.32.2.7:52980->35.184.209.153:22: read: connection reset by peer', retrying
[2] error dialing [email protected]:22: 'ssh: handshake failed: read tcp 10.32.2.7:53002->35.184.209.153:22: read: connection reset by peer', retrying
[2] error dialing [email protected]:22: 'ssh: handshake failed: read tcp 10.32.2.7:44696->35.184.209.153:22: read: connection reset by peer', retrying
[2] Error storing debugging data to test artifacts: [Error running command: {prow 35.184.209.153 curl http://localhost:20257/metrics 0 error getting SSH client to [email protected]:22: 'ssh: handshake failed: read tcp 10.32.2.7:52990->35.184.209.153:22: read: connection reset by peer'}
[2] Error running command: {prow 35.184.209.153 sudo journalctl -u node-problem-detector.service 0 error getting SSH client to [email protected]:22: 'ssh: handshake failed: read tcp 10.32.2.7:44688->35.184.209.153:22: read: connection reset by peer'}
[2] Error running command: {prow 35.184.209.153 sudo journalctl -k 0 error getting SSH client to [email protected]:22: 'ssh: handshake failed: read tcp 10.32.2.7:44708->35.184.209.153:22: read: connection reset by peer'}
[2] ]
This is affecting several different PRs: https://github.com/kubernetes/node-problem-detector/pull/955, https://github.com/kubernetes/node-problem-detector/pull/961, https://github.com/kubernetes/node-problem-detector/pull/969.
- 主要言語
- Go
- スター
- 3.5k
- フォーク
- 704
- 平均マージ
- 12時間 21分
- マージ済み PR(30日)
- 3
環境構築
はじめの一歩
- issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
- 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
- リポジトリをフォークし、ブランチを切って変更します。
- issue 番号を参照したプルリクエストを送ります。
kubernetes/node-problem-detector のほかの issue
-
Flag --enable-k8s-exporter=false causes loss of /healthz, /conditions, and /debug/pprof endpointsオープン
難易度 4/5 3〜5日 初心者へのやさしさ 56/100
kubernetes/node-problem-detector#1332 ·
-
kind/cleanup sig/node
難易度 5/5 1週間以上 初心者へのやさしさ 45/100
kubernetes/node-problem-detector#1331 ·
-
NPD needs significant unit test coverage再び着手できるかも @DigitalVeer が 64 日前に担当しましたが、オープン中のプルリクエストはありません。 オープンkind/cleanup sig/node
kubernetes/node-problem-detector#1328 · コメント 2 件 · 担当者 1 名 ·
-
kind/bug
難易度 3/5 1〜2日 初心者へのやさしさ 58/100
kubernetes/node-problem-detector#1176 · コメント 7 件 ·
-
kind/feature lifecycle/frozen
難易度 5/5 1週間以上 初心者へのやさしさ 35/100
kubernetes/node-problem-detector#1112 · コメント 8 件 ·
kubernetes/node-problem-detector の issue をすべて見る
似ている issue
-
[Docs] - Document minimum Terraform/OpenTofu version (>= 1.11) required by write-only argumentsオープン
難易度 2/5 1〜3時間 初心者へのやさしさ 92/100
MagaluCloud/terraform-provider-mgc#323 ·
メンテナーはふだん 11 日以内に返信
-
難易度 2/5 1〜3時間 初心者へのやさしさ 76/100
rossoctl/context-guru#366 ·
メンテナーはふだん 1 日以内に返信
-
stage-fail
難易度 2/5 1〜3時間 初心者へのやさしさ 72/100
siyuan-note/bazaar#2293 ·
メンテナーはふだん 1 日以内に返信
-
難易度 2/5 1〜3時間 初心者へのやさしさ 84/100
piraeusdatastore/piraeus-operator#1070 ·
メンテナーはふだん 1 日以内に返信
-
難易度 2/5 1〜3時間 初心者へのやさしさ 68/100
メンテナーはふだん 1 日以内に返信