For AI agents: a documentation index is available at /docs/llms.txt. Append .md to any page URL for markdown, or send Accept: text/markdown.
프로필
프로필은 데이터 웨어하우스의 고객 프로필 데이터와 Amplitude에 이미 있는 행동 제품 데이터를 결합합니다.
프로필은 독립형 속성으로 작동합니다. 각 속성은 특정 이벤트가 아닌 사용자 프로필에 연결되므로 기존의 사용자 속성과 다르며 보다 광범위한 분석을 지원합니다.
프로필에는 항상 웨어하우스에서 동기화된 최신 데이터가 표시됩니다.
성향 점수나 계정 계층과 같은 사용자 속성의 현재 값이 필요한 경우 프로필을 사용하십시오. 매출이나 상태 점수와 같이 시간에 따라 변화하는 사전 계산된 지표 값을 가져오려면 대신 집계된 지표를 사용하십시오.
시작하기 전에
Snowflake를 사용하든 Databricks를 사용하든 관계없이 변경 데이터 캡처(CDC)는 기존 테이블 교체를 지원하지 않습니다. 대신 증분 모델링을 사용해야 합니다. 통합한 테이블이 삭제되고 데이터를 대체하면 연결이 끊어집니다.
프로필 제한
| 계획 | 제한 |
|---|---|
| 엔터프라이즈 | 매달 10억 건의 작업(삽입/업데이트/삭제) |
| 그로쓰 | 매달 3억 건의 작업(삽입/업데이트/삭제) |
각 프로파일은 user_id을 참조해야 합니다.
Snowflake 사용자
이 테이블에서 데이터를 처음 가져오는 경우에는 다음 명령을 사용하여 데이터 리텐션 시간을 설정하고 Snowflake에서 변경 내용 추적을 활성화하십시오.
ALTER TABLE DATAPL_DB_STAG.PUBLIC.PROFILES_PROPERTIES_TABLE_1 SET DATA_RETENTION_TIME_IN_DAYS = 7;
ALTER TABLE DATAPL_DB_STAG.PUBLIC.PROFILES_PROPERTIES_TABLE_1 SET CHANGE_TRACKING = TRUE;
Snowflake Standard Edition 플랜의 경우 최대 리텐션 시간은 1일입니다. 이 요금제를 이용하고 있는 경우, 이후 단계에서 빈도를 12시간으로 설정하세요.
Databricks 사용자
변경 내용 추적을 활성화하려면 다음 지침을 따르십시오.
새 테이블로 작업하는 경우
CREATE TABLE명령에서 테이블 속성delta.enableChangeDataFeed = true를 설정하십시오:CREATE TABLE student (id INT, name STRING, age INT) TBLPROPERTIES (delta.enableChangeDataFeed = true)또한 모든 새 테이블에 대해
spark.databricks.delta.properties.defaults.enableChangeDataFeed = true설정하십시오.기존 테이블로 작업하는 경우
ALTER TABLE명령에서 테이블 속성delta.enableChangeDataFeed = true를 설정하십시오:ALTER TABLE myDeltaTable SET TBLPROPERTIES (delta.enableChangeDataFeed = true)
데이터 리텐션 기간을 설정합니다. 이 기간은 최소 하루여야 하지만 대부분의 경우 이 기간을 7일 이상으로 설정합니다. 리텐션 기간이 너무 짧으면 가져오기 프로세스가 실패할 수 있습니다.
프로필 설정(Snowflake 사용자)
Amplitude에서 프로필을 설정하려면 다음 단계를 따르십시오.
Amplitude 데이터에서 연결 요약으로 이동합니다. 그런 다음 [소스] 패널에서 **[더 추가]**를 클릭합니다. 스노우플레이크 타일을 찾을 때까지 아래로 스크롤한 다음 클릭합니다.
연결 설정 탭에서 Snowflake 데이터 가져오기 가이드에 설명된 Snowflake 자격 증명 아래의 모든 관련 필드를 입력하여 Amplitude를 데이터 웨어하우스에 연결하십시오. 새 연결을 생성하거나 기존 연결을 재사용할 수 있습니다. 작업이 완료되면 다음을 클릭합니다.
테이블 선택 아래에서 테이블 목록을 찾을 수 있습니다. 열 매핑을 시작하려면 원하는 테이블을 클릭합니다.
열 매핑 아래의 필수 필드 목록에서 해당 필드에 열 이름을 입력하여 열을 필수 필드에 일치시킵니다. 필드를 더 추가하려면 + 필드 추가를 클릭합니다.
데이터 선택 탭에서
profiles데이터 유형을 선택합니다. Amplitude는 필요한 변경 데이터 캡처 가져오기 전략을 미리 선택하며, 이 전략은 가져오기 전략 선택 드롭다운 아래에 나타납니다.- 삽입: 항상 켜져 있으므로 테이블에 추가될 때 새 프로파일을 만듭니다.
- 업데이트: 테이블의 값 변경 사항을 Amplitude로 데이터 동기화합니다.
- 삭제: 테이블에서 삭제된 내용을 Amplitude로 데이터 동기화합니다.
완료되면 매핑 테스트를 클릭하여 매핑 정보를 확인합니다. 그런 다음 다음을 클릭합니다.
소스의 이름을 지정하고 Amplitude가 데이터 웨어하우스에서 프로필을 새로 고치는 빈도를 설정하십시오. Snowflake Standard Edition을 사용하는 경우 빈도를 12시간으로 설정하십시오.
프로필 설정(Databricks 사용자)
Amplitude에서 프로필을 설정하려면 다음 단계를 따르십시오.
Amplitude 데이터에서 연결 요약으로 이동합니다. 그런 다음 [소스] 패널에서 [더 추가]를 클릭합니다. Databricks 타일을 찾을 때까지 아래로 스크롤한 다음 클릭하십시오.
연결 설정 탭에서 Amplitude를 데이터 웨어하우스에 연결하세요. 다음 정보를 준비하십시오.
- 서버 호스트 이름: Databricks 클러스터의 호스트 이름입니다. 고급옵션 > JDBC/ODBC > 서버 호스트 이름으로 이동하여 클러스터 구성에서 찾을 수 있습니다.
- HTTP 경로: 연결하려는 클러스터의 HTTP 경로입니다. 이 설정은 클러스터 구성에서 고급 옵션 > JDBC/ODBC > HTTP 경로 로 이동하여 찾을 수 있습니다.
- 개인 액세스 토큰: 개인 액세스 토큰을 사용하여 Databricks 클러스터를 통해 인증합니다. 이를 만드는 방법을 여기에서 알아보세요.
작업이 완료되면 다음을 클릭합니다.
테이블 선택 아래에서 테이블 목록을 찾을 수 있습니다. 열 매핑을 시작하려면 원하는 테이블을 클릭합니다.
열 매핑 아래의 필수 필드 목록에서 해당 필드에 열 이름을 입력하여 열을 필수 필드에 일치시킵니다. 필드를 더 추가하려면 + 필드 추가를 클릭합니다.
데이터 선택 탭에서
profiles데이터 유형을 선택합니다.완료되면 매핑 테스트를 클릭하여 매핑 정보를 확인합니다. 그런 다음 다음을 클릭합니다.
소스의 이름을 지정하고 Amplitude가 데이터 웨어하우스에서 프로필을 새로 고치는 빈도를 설정하십시오. 기본 빈도는 12시간이지만 변경할 수 있습니다.
프로필 설정(S3 사용자)
Amplitude에서 프로파일을 설정하려면 다음을 수행하십시오.
Amplitude에서 데이터 > 소스로 이동한 후 + 소스 추가를 클릭합니다. Amazon S3를 찾아 클릭합니다.
Amplitude를 S3 버킷에 연결하세요. Amplitude에 S3 버킷에 대한 액세스 권한을 부여하는 방법에 대한 자세한 내용은 Amazon S3를 참조하십시오. 또한 계측 검증 탭에 사용할 수 있는 다음 정보를 준비하십시오.
- 버킷 이름 및 프로필이 저장되는 접두사입니다.
- AWS 역할 ARN, AWS 외부 ID 및 AWS 리전입니다.
Test Credentials를 클릭하여 Amplitude가 귀하의 S3 버킷에 액세스할 수 있는지 확인한 후 Next를 클릭하고 소스의 이름을 지정합니다.
Select File 탭에서 파일 유형을 선택하고 See Preview를 클릭하여 가져올 파일을 확인한 후 Next를 클릭합니다.
변환기 구성 탭에서 프로파일 데이터 유형을 선택합니다.
user_id및mutation_type의 소스 필드를 완료하고 필요한 경우 추가 속성을 추가합니다. 데이터 미리보기 섹션은 Amplitude가 수집하도록 설정된 내용의 예를 보여줍니다.mutation_type정확히 다음 문자열 중 하나여야 합니다. 그렇지 않으면 Amplitude가 프로파일을 수집하지 않습니다.INSERT새 파일을 만들 때.UPDATE새 값을 동기화할 때.DELETE프로필을 제거합니다.
작업이 완료되면 저장 및 활성화를 클릭하여 프로필의 가져오기 및 새로 고침을 활성화합니다.
데이터 사양
| 필드 | 설명 | 예제 |
|---|---|---|
user_id | 사용자의 식별자입니다. 최소 길이는 5이어야 합니다. | |
Profile Property 1 | 사용자 수준에서 설정된 프로파일 속성입니다. 이 필드의 값은 마지막 동기화 이후 고객의 소스에서 얻은 값입니다. | |
Profile Property 2 | 사용자 수준에서 설정된 프로파일 속성입니다. 이 필드의 값은 마지막 동기화 이후 고객의 소스에서 얻은 값입니다. |
예:
{
"user_id": 12345,
"number of purchases": 10,
"title": "Data Engineer"
}
Snowflake 프로파일에 대한 자세한 내용은 이 문서를 참조하십시오.
SQL 템플릿
SELECT
AS "user_id",
AS "profile_property_1",
AS "profile_property_2"
FROM DATABASE_NAME.SCHEMA_NAME.TABLE_OR_VIEW_NAME
프로파일 값 지우기
데이터 웨어하우스에서 프로필 값을 제거하면 해당 값은 다음 동기화 작업 동안 Amplitude와 동기화됩니다. 또한 Amplitude 데이터를 사용하여 Amplitude의 사용자로부터 사용되지 않는 속성 필드를 제거할 수도 있습니다.
샘플 쿼리
SELECT
user_id as "user_id",
upgrade_propensity_score as "Upgrade Propensity Score",
user_model_version as "User Model Version"
FROM
ml_models.prod_propensity_scoring
SELECT
m.uid as "user_id",
m.title as "Title",
m.seniority as "Seniority",
m.dma as "DMA"
FROM
prod_users.demo_data m
이 내용이 도움이 되었나요?