Data Engineer con experiencia profesional en pipelines, modelado, calidad y operación de plataformas de datos. Trabajo en Tragsatec dentro de ImpulsaDATA, donde conecto Python, SQL, PostgreSQL, CKAN, DCAT-AP-ES, RDF/JSON-LD, SHACL y contenedores para publicar metadatos interoperables en la Administración General del Estado.
El gobierno del dato es mi diferenciador técnico. Mi foco profesional más amplio es diseñar, construir y operar sistemas de datos fiables, trazables y mantenibles.
Python, SQL, PostgreSQL, Databricks, PySpark, Spark, Kafka, Airflow, Delta Lake, MLflow, AWS, Docker, CKAN y GitLab CI/CD.
Lakehouse Medallion y flujo MLOps con datos sintéticos, PySpark, Auto Loader, Delta Lake, Unity Catalog y MLflow. Proyecto académico aplicado con desarrollo end-to-end compartido y producción simulada.
https://github.com/AlonsoMarcosM/databricks-telco-churn-lakehouse
Plataforma IoT serverless en AWS con 40 sensores simulados, MQTT/TLS, Lambda, DynamoDB, API GeoJSON y dashboard Streamlit.
https://github.com/AlonsoMarcosM/smart-parking-albacete
Plataforma batch y streaming con arquitectura Medallion, Spark, Kafka, Airflow, Delta Lake, SQL Server y MinIO.
https://github.com/AlonsoMarcosM/spark-kafka-airflow-data-platform
- Portfolio: https://alonsomarcosm.github.io/es/
- LinkedIn: https://www.linkedin.com/in/alonsomarcosm99/
- GitHub: https://github.com/AlonsoMarcosM
Estoy abierto a oportunidades de Data Engineering y Data Platform donde importen la calidad, la operación, la automatización y la trazabilidad.

