Sr. Associate Director, Data and Analytics (AI Data Engineer)

HSBC
Guangzhou
Workplace: OnsiteFull timeFunction: Data Analytics & Business IntelligenceSkills: ["Data quality","Observability","Lineage","Privacy-by-design","Stakeholder collaboration"]

Build and operate governed structured and unstructured data pipelines that power AI across KYC, credit facilities, risk grades, and portfolio performance. Create embedding/vectorisation pipelines with managed vector indices and data governance controls. Own data quality, observability, lineage, privacy-by-design, dataset versioning, and reproducibility, partnering with Agent Engineers to define evaluation datasets and feedback loops while supporting production operations and continuous improvement.

Loading

Loading job details...

Preparing the role view and application actions.

FursaFursa
HSBC
HSBC
18 hours ago

Sr. Associate Director, Data and Analytics (AI Data Engineer)

✓ Verified Job

Canonical indexed version, validated from employer's careers page.

Source: Company careers pageValidated by: Fursa AI
Last checked: 5 hours agoStatus: Live

Job Summary

Build and operate governed structured and unstructured data pipelines that power AI across KYC, credit facilities, risk grades, and portfolio performance. Create embedding/vectorisation pipelines with managed vector indices and data governance controls. Own data quality, observability, lineage, privacy-by-design, dataset versioning, and reproducibility, partnering with Agent Engineers to define evaluation datasets and feedback loops while supporting production operations and continuous improvement.
Location: Guangzhou
Workplace: Onsite
Employment Type: Full time
Job Function: Data Analytics & Business Intelligence
Seniority: Sr. Director level

Key Responsibilities

  • •Build and operate pipelines for structured domain data including onboarding events, customer/entity data, credit facilities/exposures, limits, risk grades, portfolio hierarchies, and performance/arrears.
  • •Build unstructured data pipelines for domain documents (e.g., KYC documents, corporate registry extracts, credit memos, financial statements) including parsing, metadata enrichment, deduplication, and retention handling.
  • •Develop embedding/vectorisation pipelines and manage vector indices with refresh and deletion strategies aligned to data governance.
  • •Implement data quality, observability, and lineage with automated testing, SLAs, anomaly detection, monitoring, and runbooks.
  • •Apply privacy-by-design (PII handling, masking/tokenisation, access controls, audit trails) and ensure dataset versioning and reproducibility to support repeatable evaluations.

Key Requirements

  • •Deliver reliable, fresh, well-governed datasets and indices used by KYC, credit, and portfolio AI solutions.
  • •Improve retrieval relevance and answer grounding by strengthening metadata, chunking inputs, and data quality.
  • •Reduce operational incidents with strong testing, monitoring, and disciplined change management.
  • •Make AI datasets reproducible and auditable to support reviews and control expectations.
Experience:AIKYCCreditRiskData engineeringData governance
Skills:Data qualityObservabilityLineagePrivacy-by-designStakeholder collaboration
Tech Stack:VectorisationEmbeddingsPII maskingTokenisationData governanceData lineageDataset versioningData contracts

Company Brief

HSBC
Global banking and financial services organisation offering retail, commercial, corporate and investment banking, wealth management, and global markets services across Europe, Asia, the Americas and the Middle East.
Industry: Banking
Company Size: Enterprise (1,001+ employees)
Revenue: USD 1B+
Growth: Public Company
Valuation: Public Company (Market Cap in USD)
Funding: IPO / Publicly Listed
Headquarters: London, United Kingdom
Founded: 1865
Glassdoor
Glassdoor: 3.6
WebsiteLinkedIn