diff --git a/tensorflow-volcano-trainjob-integration.yaml b/tensorflow-volcano-trainjob-integration.yaml index 7122669..1b6f76f 100644 --- a/tensorflow-volcano-trainjob-integration.yaml +++ b/tensorflow-volcano-trainjob-integration.yaml @@ -253,9 +253,13 @@ data: verbose=verbose, ) - # 평가 (worker 0만 출력) + # 평가 (모든 워커가 참여해야 함 - MultiWorkerMirroredStrategy 요구사항) + eval_verbose = 2 if worker_index == 0 else 0 + loss, accuracy = model.evaluate( + test_dataset, verbose=eval_verbose + ) + if worker_index == 0: - loss, accuracy = model.evaluate(test_dataset, verbose=2) print(f"\n===== Final Results =====") print(f"Test Loss: {loss:.4f}") print(f"Test Accuracy: {accuracy:.4f}")