Kỹ năng


Mô tả công việc

- Xây dựng, phát triển các nền tảng dữ liệu hợp nhất (unified data platform) trên Microsoft Fabric (OneLake, Lakehouse, Data Warehouse, Data Factory, Real-Time Intelligence) để lưu trữ, xử lý và quản lý dữ liệu lớn (Big Data).
- Thiết kế, xây dựng và vận hành các nền tảng xử lý dữ liệu mở (open data lakehouse) như IBM watsonx.data; làm chủ các định dạng/bảng mở như Apache Iceberg, Delta Lake, Parquet và các query engine mở (Presto/Trino, Spark, Hive Metastore).
- Thiết kế, xây dựng, tối ưu hóa luồng dữ liệu và giải pháp ETL/ELT có khả năng mở rộng linh hoạt, độ tin cậy cao để ingest/khai thác dữ liệu vào Lakehouse, Data Lake, Data Warehouse trên Microsoft Fabric và nền tảng mở.
- Phát triển các chương trình, thuật toán và quy trình tự động để tích hợp, làm sạch dữ liệu từ nhiều nguồn khác nhau và xử lý logic nghiệp vụ phức tạp bằng các công cụ có sẵn (Fabric Notebooks/Spark, Dataflow Gen2, watsonx.data).
- Xây dựng, triển khai các công cụ quản trị dữ liệu (data governance) như phân quyền dữ liệu, quản lý master data, quản lý chất lượng dữ liệu; tích hợp với Microsoft Purview và lớp governance của nền tảng mở.
- Thiết kế, xây dựng kho dữ liệu, Data Lake, Data Warehouse, Data Lakehouse; đảm bảo dữ liệu được tổ chức, lưu trữ hiệu quả, chất lượng cao, đáng tin cậy và mở rộng linh hoạt; hạn chế khóa cứng nhà cung cấp (vendor lock-in) nhờ kiến trúc mở.
- Xử lý, khai thác dữ liệu trên các hệ thống xử lý tài chính - ngân hàng (Banking/BFSI) tại Việt Nam.

Yêu cầu công việc

- Có kinh nghiệm làm việc vị trí Data Engineer, ưu tiên đã triển khai thực tế trên Microsoft Fabric (OneLake, Lakehouse, Synapse Data Engineering/Warehouse, Data Factory).
- Có kinh nghiệm/hiểu biết về các nền tảng xử lý dữ liệu mở (open lakehouse) như IBM watsonx.data; thành thạo các định dạng bảng mở Apache Iceberg, Delta Lake, Parquet và query engine mở (Presto/Trino, Spark, Hive Metastore).
- Thành thạo ETL/ELT với công cụ của Fabric (Dataflow Gen2, Pipelines, Notebooks) và các ETL/ELT tools phổ biến (Azure Data Factory, AWS Glue...).
- Có kinh nghiệm thiết kế Business data model và Data Warehouse theo mô hình star schema, snowflake và các data design pattern; hiểu kiến trúc medallion (Bronze/Silver/Gold).
- Kỹ năng sử dụng thành thạo SQL và Python (PySpark), hiểu biết thêm các ngôn ngữ data khác (Scala, Java, R...).
- Làm việc tốt trên nhiều loại CSDL SQL, NoSQL (Oracle, SQL Server, MySQL, Neo4j, HBase, Cassandra, MongoDB...).
- Có kinh nghiệm với hệ sinh thái xử lý dữ liệu lớn: Spark, Kafka, Airflow, Hadoop, Nifi, Hive, Impala... là lợi thế.
- Hiểu biết về data governance, data security và tích hợp Microsoft Purview / lớp quản trị của nền tảng mở là lợi thế.
- Chủ động học hỏi công nghệ mới, ưu tiên kiến trúc mở (open standards), khả năng giải quyết vấn đề tốt.
- Đã làm việc với các hệ thống tài chính - ngân hàng (BFSI) là lợi thế.

Thời gian làm việc

Trong tuần: Từ thứ 2 - thứ 6

Trong ngày: Từ 08:30 giờ - 18:00 giờ


Quyền lợi ứng viên

- Cơ hội làm việc nhóm với nhiều chuyên gia hàng đầu trong lĩnh vực CNTT trong nước và quốc tế.
- Cơ hội thực hiện các dự án đầy tham vọng ở nhiều quốc gia, tiếp xúc với các công nghệ mới nhất và học hỏi từ những đồng nghiệp giỏi.
- Làm việc trong môi trường trẻ, năng động, hiện đại và đa văn hóa; Các hoạt động truyền thông, sự kiện vào các ngày lễ diễn ra thường xuyên.
- Cơ hội thăng tiến theo năng lực với mức tăng cấp bậc và tăng lương tương ứng.
- Được quyền tham gia các khóa đào tạo kỹ năng mềm (tư duy logic, tư duy sáng tạo, kỹ năng giao tiếp, kỹ năng quản lý dự án, kỹ năng đàm phán…) và các lớp học tiếng Nhật.
- Và nhiều quyền lợi hấp dẫn khác...

Địa chỉ làm việc

Duy Tân

Tiền thưởng

Đăng nhập để xem

Mức lương

20-25 triệu

Thông tin

  • Kinh nghiệm 4 năm
  • Trình độ Đại học
  • Vị trí Middle
  • Hình thức Remote
  • Hạn nộp hồ sơ 2026-10-08
  • Số lượng 1 người
  • Phỏng vấn 1 vòng
  • Ngôn ngữ Không có ngoại ngữ
Hỗ trợ ứng tuyển
Báo cáo lỗi