PySpark de verdad
Tu código corre en Apache Spark real, aislado y seguro. Nada de emulaciones: los errores, los tipos y los planes son los mismos que verás en el trabajo.
Beta cerrada · PySpark + SQL
Escribe PySpark y SQL que se ejecutan de verdad, recibe validación al instante y descubre si tu solución también es eficiente: revisamos el plan físico de Spark, no solo el resultado.
from pyspark.sql import functions as F
result = (
orders.join(F.broadcast(products), "product_id")
.groupBy("category")
.agg(F.sum("revenue").alias("revenue"))
)
✓ 15 filas coinciden con el resultado esperado
✓ El plan físico usa BroadcastHashJoin
✓ Sin SortMergeJoin: evitaste el shuffle de la tabla grande
En una entrevista de Data Engineering no basta con que el resultado salga bien. Te preguntan por qué es eficiente.
Tu código corre en Apache Spark real, aislado y seguro. Nada de emulaciones: los errores, los tipos y los planes son los mismos que verás en el trabajo.
Broadcast joins, partition pruning, cache, coalesce contra repartition, salting para data skew. Revisamos cómo lo resolviste, no solo qué devolviste.
Pregunta aleatoria, cronómetro y la solución bloqueada hasta que termines. Letra grande para compartir pantalla, como en la entrevista real.
Practica en tu idioma y cambia a inglés cuando te prepares para una vacante en Estados Unidos. Cada pregunta incluye pistas y puntos para comentar con el entrevistador.
PySpark o SQL, de fácil a difícil: ventanas, deduplicación, sesionización, data skew, SCD tipo 2 y más.
Editor a la derecha, enunciado y datos a la izquierda. Ejecuta las veces que quieras y pide pistas progresivas.
Ves exactamente qué fila no coincide y qué parte del plan falló, y comparas con la solución de referencia.
Estamos abriendo lugares poco a poco. Déjanos tu correo y te enviamos tu enlace de acceso cuando haya lugar.
No. Todo corre en el navegador; Spark y SQL se ejecutan en nuestros servidores, en un entorno aislado.
Data Engineer, Analytics Engineer y Data Analyst con SQL avanzado. Los retos van desde lo básico hasta optimización de Spark.
Lo anunciaremos al abrir la beta. Elegiremos uno estándar y cercano a lo que te piden en las entrevistas.
La beta cerrada es gratuita. Después habrá un plan gratuito y uno de pago en pesos mexicanos y en dólares.
Tu código solo se usa para ejecutarlo y validarlo. No vendemos tus datos. Publicaremos el aviso de privacidad antes de abrir los registros.