Ir al contenido principal

Datalake: exportación de datos para BI y data warehouse

Conoce qué es el Datalake de Coodesh, quién puede solicitar acceso, qué recursos están disponibles y cómo configurar la exportación a tu data warehouse.

Qué es el Datalake

El Datalake es un conjunto de endpoints REST que exporta de forma masiva los datos de tu área de trabajo en Coodesh hacia herramientas de BI, un data warehouse o cualquier pipeline de datos interno.

A diferencia de los endpoints operativos de la API, el Datalake está pensado para carga continua: cada ejecución lee solo lo que cambió desde la anterior, lo que permite mantener una copia sincronizada de los datos sin reprocesar todo cada vez.

Los datos se entregan en JSON, autenticados con una clave de integración, en la URL base https://api.coodesh.com/assessments/v2/datalake.

Documentación técnica

La referencia completa de los endpoints, con parámetros, campos de respuesta, ejemplos en Python y JavaScript y tabla de errores, está en:

Consulta esa página antes de iniciar la integración: es la fuente oficial del contrato de datos.

Quién puede solicitar el acceso

El acceso al Datalake se realiza mediante una clave de integración del área de trabajo.

  1. Quien tenga el permiso Gestionar claves de integración puede crear la clave en Área de trabajo › Integraciones. Los perfiles de Administrador y Gerente lo tienen por defecto, y también puede concederse a una persona en Personas › Permisos.

  2. Al crear la clave, selecciona en Recursos accesibles los alcances del grupo Datalake que necesita tu integración. Si no seleccionas ningún recurso, la clave tendrá acceso completo a la API: por seguridad, selecciona solo lo necesario.

  3. La clave se muestra una sola vez. Cópiala y guárdala en un lugar seguro. Consulta Claves de integración para el paso a paso.

Dos alcances no aparecen en la pantalla de creación y debe habilitarlos el equipo de Coodesh a solicitud, a través de tu contacto comercial o del soporte: eventos de integridad e imágenes de proctoring. Contienen evidencia sensible de monitoreo, por eso están restringidos.

Recursos disponibles

Recurso

Una fila por

Alcance necesario

assessment_attempts

intento de evaluación

Resultados de evaluaciones (datalake)

users_profiles

persona

Perfiles y skills de usuarios (datalake)

users_skills

persona y habilidad

Perfiles y skills de usuarios (datalake)

users_skill_maps

mapa de habilidades respondido

Perfiles y skills de usuarios (datalake)

integrity_events

evento de la línea de tiempo de integridad

Eventos de integridad (a solicitud)

assessment_attempts trae la nota, el estado, los plazos, los enlaces de resultado, las secciones, la distribución de habilidades, la carrera y el resumen de integridad del intento. integrity_events trae la evidencia detrás de ese resumen, un evento por fila.

Configuraciones disponibles

Parámetros de consulta

  • updated_since — fecha ISO 8601 (ej.: 2026-01-01T00:00:00Z) que abre el flujo desde ese punto. Omítelo en la primera ejecución para exportar todo el histórico.

  • limit — elementos por página. Por defecto 100, máximo 200. Los valores superiores se rechazan, no se recortan.

  • cursor — posición opaca devuelta en next_cursor. Úsalo para avanzar dentro de la misma ejecución. No puede enviarse junto con updated_since.

Filtro por subcuenta

La cabecera x-subaccount-id limita la exportación a las evaluaciones de una subcuenta específica. Disponible en assessment_attempts e integrity_events.

Imágenes de proctoring

Las imágenes capturadas durante el monitoreo están detrás de un alcance propio. Las claves que no lo tienen reciben ai_metadata, la lectura de la imagen hecha por IA, y nunca la imagen. Cuando se habilita, la imagen llega en snapshot_url, un enlace temporal firmado cuya validez se indica en snapshot_expires_at: descarga el archivo durante la ingesta, no almacenes la URL como si fuera permanente.

Reglas de consumo

  • La entrega es at-least-once: un registro modificado después de haber sido entregado vuelve a aparecer. Escribe siempre con upsert usando el identificador del registro, nunca por inserción.

  • La respuesta no trae totales. El campo has_more es la única señal de parada.

  • Las páginas son secuenciales: cada solicitud depende de la respuesta anterior, así que la exportación es un bucle, no solicitudes en paralelo.

  • Guarda el mayor updated_at visto en la ejecución: es lo que abre la siguiente.

Preguntas frecuentes

¿Necesito contratar algo aparte para usar el Datalake?

El Datalake forma parte de la API de Coodesh. Habla con tu contacto comercial para confirmar la disponibilidad en tu plan y para habilitar los alcances de eventos de integridad e imágenes de proctoring.

¿Con qué frecuencia puedo ejecutar la exportación?

No hay una frecuencia obligatoria: tú defines el intervalo según la necesidad de tu pipeline. Como cada ejecución lee solo lo que cambió desde la anterior, una sincronización diaria suele ser suficiente en la mayoría de los casos.

Recomendamos programar la exportación en horarios de baja demanda, preferentemente durante la noche. Las cargas completas o de gran volumen compiten con el uso de la plataforma por parte de tu equipo y de las personas candidatas en evaluación; ejecutarlas fuera del horario comercial reduce ese impacto y disminuye la probabilidad de alcanzar el límite de solicitudes.

Existe un límite de solicitudes por segundo: al recibir el código 429, espera el tiempo indicado en la cabecera X-RateLimit-Reset y repite la llamada.

Perdí mi clave de integración. ¿Qué hago?

La clave no puede volver a visualizarse. Elimina la clave antigua y crea una nueva en Área de trabajo › Integraciones.

¿Los valores vienen traducidos?

Los campos de enumeración como event_type, severity y signal llegan siempre con el valor técnico, sin traducir, para que el data warehouse no tenga que tratar variaciones por idioma. Las etiquetas traducidas, cuando existen, vienen en campos separados con el sufijo _formatted.

¿Ha quedado contestada tu pregunta?