작동 방식

집계 서비스는 광고 기술에 고객과의 캠페인 효과를 개선하는 데 필요한 실적 통계를 제공합니다.

이 문서에서는 다음 내용을 다룹니다.

이 문서의 대상

이 페이지에서는 Google API가 효과적이고 개인 정보를 보호하는 광고 측정을 지원하는 방법을 광고 기술 및 개발자가 이해할 수 있도록 설명합니다.

이 문서에서는 Private Aggregation API, Attribution Reporting API, Protected Audience API, Shared Storage, 신뢰할 수 있는 실행 환경에 대해 잘 알고 있다고 가정합니다.

주요 용어 및 개념

계속 진행하기 전에 핵심 용어를 숙지하세요.

용어 설명

애드테크

광고 플랫폼은 광고 게재를 위한 서비스를 제공하는 회사입니다.

집계 가능한 보고서

Aggregatable reports are encrypted reports sent from individual user devices. These reports contain data about cross-site user behavior and conversions. Conversions (sometimes called attribution trigger events) and associated metrics are defined by the advertiser or ad tech. Each report is encrypted to prevent various parties from accessing the underlying data.

Learn more about aggregatable reports.

집계 가능한 보고서 회계

A distributed ledger, located in both coordinators, that tracks the allocated privacy budget and enforces the 'No Duplicates' rule. This is the privacy preserving mechanism, located and run within coordinators, that ensures no reports pass through the Aggregation Service beyond the allocated privacy budget.

Read more on how batching strategies relate to aggregatable reports.

집계 가능한 보고서 회계 예산

References to the budget that ensures individual reports are not processed more than once.

Aggregation Service

An ad tech-operated service that processes aggregatable reports to create a summary report.

Read more about the Aggregation Service backstory in our explainer and the full terms list.

증명

A mechanism to authenticate software identity, usually with cryptographic hashes or signatures. For the aggregation service proposal, attestation matches the code running in your ad tech-operated aggregation service with the open source code.

Read more about attestation.

기여도 결합
코디네이터

Entities responsible for key management and aggregatable report accounting. A Coordinator maintains a list of hashes of approved aggregation service configurations and configures access to decryption keys.

노이즈 및 스케일링

Statistical noise that is added to summary reports during the aggregation process to preserve privacy and ensure the final reports provide anonymized measurement information.

Read more about additive noise mechanism, which is drawn from Laplace distribution.

신고 출처

The entity that receives aggregatable reports—in other words, you or an ad tech that called the Attribution Reporting API. Aggregatable reports are sent from user devices to a well-known URL associated with the reporting origin. The reporting origin is designated during enrollment.

공유 ID

A computed value that consists of shared_info, reporting_origin, destination_site (for Attribution Reporting API only), source_registration-time (for Attribution Reporting API only), scheduled_report_time, and version.

Multiple reports that share the same attributes in the shared_info field should have the same shared ID. Shared IDs play an important role within Aggregatable Report Accounting.

Read more about Trusted Servers.

요약 보고서

An Attribution Reporting API and Private Aggregation API report type. A summary report includes aggregated user data, and can contain detailed conversion data with noise added. Summary reports are made up of aggregate reports. They allow for greater flexibility and provide a richer data model than event-level reporting, particularly for some use-cases like conversion values.

신뢰할 수 있는 실행 환경 (TEE)

A secure configuration of computer hardware and software that allows external parties to verify the exact versions of software running on the machine without fear of exposure. TEEs allow external parties to verify that the software does exactly what the software manufacturer claims it does—nothing more or less.

To learn more about TEEs used for the Privacy Sandbox proposals, read the Protected Audience API services explainer and the Aggregation Service explainer.

집계 서비스 워크플로

집계 서비스는 원시 집계 가능 보고서에서 세부 전환 및 도달범위 데이터의 요약 보고서를 생성합니다. 보고서 생성 흐름은 다음 단계로 구성됩니다.

  1. 브라우저가 공개 키를 가져와 암호화된 보고서를 생성합니다.
  2. 암호화된 집계 가능 보고서가 광고 기술 서버로 전송됩니다.
  3. 광고 기술 서버는 보고서 (avro 형식)를 일괄 처리하여 집계 서비스에 전송합니다.
  4. 집계 작업자는 복호화할 집계된 보고서를 가져옵니다.
  5. 집계 작업자는 코디네이터에서 복호화 키를 가져옵니다.
  6. 집계 작업자는 집계 및 노이즈 추가를 위해 보고서를 복호화합니다.
  7. 집계 가능한 보고서 회계 서비스는 지정된 집계 가능한 보고서에 대한 요약 보고서를 생성하기에 충분한 개인 정보 보호 예산이 있는지 확인합니다.
  8. 집계 서비스가 최종 요약 보고서를 제출합니다.

다음 다이어그램은 웹 및 모바일 기기에서 보고서를 수신한 시점부터 집계 서비스에서 요약 보고서를 생성하는 시점까지 집계 서비스가 작동하는 방식을 보여줍니다.

엔드 투 엔드 집계 서비스 흐름
엔드 투 엔드 집계 서비스 흐름

요약하자면 Attribution Reporting API 또는 Private Aggregation API는 여러 브라우저 인스턴스에서 보고서를 생성합니다. Chrome은 코디네이터의 키 호스팅 서비스에서 7일마다 순환되는 공개 키를 가져와 광고 기술 보고 출처로 전송하기 전에 보고서를 암호화합니다. 광고 기술 보고 출처는 수신 보고서를 수집하여 avro 형식으로 변환하고 집계 서비스로 전송합니다. 그런 다음 집계 서비스에 일괄 요청이 전송되면 보고서를 생성할 수 있는 충분한 개인 정보 보호 예산이 있는 한 키 호스팅 서비스에서 복호화 키를 가져오고, 보고서를 복호화하고, 집계하고, 노이즈를 추가하여 요약 보고서를 생성합니다.

구현 섹션에서 집계 가능한 보고서를 준비하는 방법을 자세히 알아보세요.

집계 가능한 보고서 일괄 처리

등록 절차 중에 지정한 지정된 보고 출처 서버의 도움이 없으면 보고 흐름이 완료되지 않습니다. 보고 출처는 집계 가능 보고서를 수집, 변환, 일괄 처리하고 Google Cloud 또는 Amazon Web Services의 집계 서비스로 전송할 준비를 합니다. 집계 가능한 보고서를 준비하는 방법을 자세히 알아보세요.

클라우드 구성요소

집계 서비스는 여러 클라우드 서비스 구성요소로 구성됩니다. 제공된 Terraform 스크립트를 사용하여 필요한 모든 클라우드 서비스 구성요소를 프로비저닝하고 구성합니다.

집계 서비스 클라우드 구성요소입니다.
집계 서비스 클라우드 구성요소입니다.

프런트엔드 서비스

관리형 클라우드 서비스: Cloud Functions (Google Cloud) / API Gateway (Amazon Web Services)

프런트엔드 서비스는 작업 생성 및 작업 상태 검색을 위한 집계 API 호출의 기본 진입점인 서버리스 게이트웨이입니다. 집계 서비스 사용자로부터 요청을 수신하고, 입력 매개변수를 검증하고, 집계 작업 예약 프로세스를 시작하는 역할을 합니다.

프런트엔드 서비스에는 다음 두 가지 API가 있습니다.

엔드포인트 설명
createJob 이 API는 집계 서비스 작업을 트리거합니다. 작업을 트리거하려면 작업 ID, 입력 스토리지 세부정보, 출력 스토리지 세부정보, 보고 출처와 같은 정보가 필요합니다.
getJob 이 API는 지정된 작업 ID가 있는 작업의 상태를 반환합니다. '수신됨', '진행 중', '완료됨'과 같은 작업 상태에 관한 정보를 제공합니다. 작업이 완료되면 작업 실행 중에 발생한 오류 메시지를 포함한 작업 결과도 반환됩니다.

집계 서비스 API 문서를 확인하세요.

작업 대기열

관리형 클라우드 서비스: Pub/Sub (Google Cloud) / Amazon SQS (Amazon Web Services)

작업 대기열은 집계 서비스의 작업 요청이 포함된 메시지 대기열입니다. 프런트엔드 서비스는 작업 요청을 대기열에 삽입하고, 이 요청은 이를 처리하는 집계 작업자가 사용합니다.

클라우드 스토리지

관리형 클라우드 서비스: Google Cloud Storage (Google Cloud) / Amazon S3 (Amazon Web Services)

집계 서비스에서 사용되는 입력 및 출력 파일(예: 암호화된 보고서 파일 및 출력 요약 보고서)은 클라우드 스토리지에 보관됩니다.

작업 메타데이터 데이터베이스

관리형 클라우드 서비스: Spanner (Google Cloud) / DynamoDB (Amazon Web Services)

작업 메타데이터 데이터베이스는 집계 작업의 상태를 저장하고 추적하는 데 사용됩니다. 생성 시간, 요청 시간, 업데이트 시간, 상태(예: 수신됨, 진행 중, 완료됨)와 같은 메타데이터를 기록합니다. 집계 작업자는 작업이 진행됨에 따라 작업 메타데이터 데이터베이스를 업데이트합니다.

집계 작업자

관리형 클라우드 서비스: 컨피덴셜 스페이스가 있는 Compute Engine (Google Cloud) / Nitro Enclave가 있는 Amazon Web Services EC2 (Amazon Web Services)

집계 작업자는 작업 대기열에서 작업 요청을 처리하고, 코디네이터의 키 생성 및 배포 서비스 (KGDS)에서 가져온 키를 사용하여 암호화된 입력을 복호화합니다. 작업 처리 지연 시간을 최소화하기 위해 집계 작업자는 8시간 동안 복호화 키를 캐시하고 처리하는 작업 전반에서 이를 사용합니다.

집계 작업자는 신뢰할 수 있는 실행 환경 (TEE) 인스턴스 내에서 작동합니다. 작업자는 한 번에 하나의 작업만 처리합니다. 자동 확장 구성을 설정하여 여러 작업자가 작업을 동시에 처리하도록 구성할 수 있습니다. 사용되는 경우 자동 확장 기능은 작업 대기열의 메시지 수에 따라 작업자 수를 동적으로 조정합니다. Terraform 환경 파일을 통해 자동 확장 처리의 최소 및 최대 작업자 수를 구성할 수 있습니다. 자동 확장에 대한 자세한 내용은 Amazon Web Services 또는 Google Cloud의 Terraform 스크립트를 참고하세요.

집계 작업자는 집계 가능한 보고서 회계를 위해 집계 가능한 보고서 회계 서비스를 호출합니다. 이 서비스는 개인 정보 보호 예산 한도가 초과되지 않은 경우에만 작업이 실행되도록 확인합니다. ('중복 없음' 규칙 참고) 예산을 사용할 수 있는 경우 노이즈가 추가된 집계를 사용하여 요약 보고서가 생성됩니다. 집계 가능한 보고서 회계에 관한 추가 세부정보를 읽어보세요.

집계 작업자는 작업 메타데이터 데이터베이스에서 작업 메타데이터를 업데이트합니다. 이 정보에는 부분 보고 실패의 경우 작업 반환 코드와 보고 오류 카운터가 포함됩니다. 사용자는 getJob 작업 상태 검색 API를 사용하여 상태를 가져올 수 있습니다.

집계 서비스에 대한 자세한 설명은 이 설명을 참고하세요.

다음 단계

이제 집계 서비스의 작동 방식을 알았으므로 시작 가이드에 따라 Google Cloud 또는 Amazon Web Services를 통해 자체 인스턴스를 배포하세요.