Data Platform Engineer
Job Summary
次世代VPPプラットフォームの開発を推進する当社にて、蓄電池サイトからの高頻度テレメトリーデータを処理し、MLモデルや取引システムへリアルタイムに供給するデータ基盤の開発をお任せいたします。国家規模のエネルギーシステムのデータバックボーンを構築するポジションです。Kafka等の技術を活用した高スループットなデータ取り込みパイプラインの設計や時系列DBのスキーマ設計を担当していただきます。
Responsibilities
- Kafka等を用いた高スループットなデータ取り込みパイプラインの設計
- Airflowを用いたETLワークフローの構築とデータ品質管理
- 時系列DBやリレーショナルDBのスキーマ設計
- ML向け特徴量ストアとData Hub APIの構築・運用
Required Skills
- 高頻度データを扱う本番データパイプラインの設計・運用経験(3年以上)
- Apache Kafka、Apache Airflow等の運用経験
- 時系列DB(InfluxDB/TimescaleDB等)の設計経験
- Python(Pandas/FastAPI)でのデータ変換やAPI開発
Job Details
Job Description
次世代VPPプラットフォームの開発を推進する当社にて、蓄電池サイトからの高頻度テレメトリーデータを処理し、MLモデルや取引システムへリアルタイムに供給するデータ基盤の開発をお任せいたします。
国家規模のエネルギーシステムのデータバックボーンを構築します。
■Kafka等を用いた高スループットなデータ取り込みパイプラインの設計
■Airflowを用いたETLワークフローの構築とデータ品質管理
■時系列DBやリレーショナルDBのスキーマ設計
■ML向け特徴量ストアとData Hub APIの構築・運用
【業務内容の変更範囲】会社の定める業務全般
Working Hours
09:00〜 18:00
Job Requirements
【必須】
■高頻度データを扱う本番データパイプラインの設計・運用経験(3年以上)
■エンドツーエンドでのデータ品質管理のオーナーシップ経験
■時系列データのスキーマ設計経験
【必須要件(続き)】
■Apache Kafka、Apache Airflow等の運用経験
■時系列DB(InfluxDB/TimescaleDB等)の設計経験
■Python(Pandas/FastAPI)でのデータ変換やAPI開発
■複雑なSQLクエリ設計経験
【尚可要件】
■クラウドストレージ(S3等)やストリーム処理(Flink等)経験
■ML特徴量ストアの設計・維持経験
Japanese Level
Fluent(JLPT Level 1 or N1)
Holidays
年間休日 130日
Job Contract Period
正社員