
임베딩 예제
다음 리소스에서는 직접 사용해 보기 전에 Embedding Projector가 실제로 어떻게 작동하는지 확인할 수 있습니다:Hello world
이 최소 예시는 임베딩을 로깅하고 projector에서 확인하는 데 필요한 가장 적은 코드만 보여줍니다. W&B에서는wandb.Table 클래스를 사용해 임베딩을 로깅할 수 있습니다. 각각 5개 차원으로 이루어진 3개의 임베딩 예시를 살펴보세요:

Digits MNIST
다음 예시는 더 높은 차원의 데이터와 더 다양한 오버레이를 사용하는, 보다 현실적인 워크플로를 보여줍니다. 앞선 예시에서는 임베딩 로깅의 기본 메커니즘을 보여주었지만, 일반적으로는 훨씬 더 많은 차원과 샘플을 다루게 됩니다. SciKit-Learn에서 제공하는 MNIST Digits 데이터셋(UCI ML hand-written digits dataset)을 살펴보세요. 이 데이터셋에는 1,797개의 레코드가 있으며, 각 레코드는 64차원입니다. 이 문제는 10개 클래스 분류 문제입니다. 또한 시각화를 위해 입력 데이터를 이미지로 변환할 수도 있습니다.
로깅 옵션
다음 섹션에서는 데이터를 W&B에 로깅할 때 임베딩 데이터를 구조화할 수 있는 지원되는 방법을 설명합니다. 임베딩은 여러 형식으로 로깅할 수 있습니다.- 단일 임베딩 열: 데이터가 이미 행렬과 비슷한 형식인 경우가 많습니다. 이 경우 단일 임베딩 열을 만들 수 있으며, 셀 값의 데이터 유형은
list[int],list[float]또는np.ndarray일 수 있습니다. - 여러 숫자 열: 앞선 두 예시는 이 방식을 사용하며, 각 차원마다 열을 하나씩 만듭니다. W&B는 셀 값으로 Python
int또는float를 허용합니다.


- 데이터프레임에서 직접 생성:
wandb.Table(dataframe=df)를 사용합니다. - 데이터 목록에서 직접 생성:
wandb.Table(data=[...], columns=[...])를 사용합니다. - Table을 행별로 점진적으로 구축(코드에 루프가 있는 경우에 적합):
table.add_data(...)를 사용해 Table에 행을 추가하세요. - Table에 임베딩 열 추가(예측 목록이 임베딩 형식인 경우에 적합):
table.add_col("col_name", ...). - 계산 열 추가(Table 전체에 적용하려는 함수나 모델이 있는 경우에 적합):
table.add_computed_columns(lambda row, ndx: {"embedding": model.predict(row)}).
플로팅 옵션
임베딩을 로깅한 후에는 임베딩이 투영되고 렌더링되는 방식을 조정할 수 있습니다.2D Projection을 선택한 후 톱니바퀴 아이콘을 클릭하면 렌더링 설정을 편집할 수 있습니다. 원하는 열을 선택하는 것(이전 섹션 참조) 외에도 관심 있는 알고리즘과 원하는 매개변수를 선택할 수 있습니다. 아래 이미지는 UMAP과 t-SNE의 매개변수를 보여줍니다.


W&B는 세 알고리즘 모두에 대해 1,000개 행과 50개 차원의 무작위 부분집합으로 다운샘플링합니다.