Qué cambió
OpenMetadata publicó la versión 2.0 el 24 de agosto de 2026. Tres cambios se notan apenas la abrís:
- El profiler ya no escanea el 100% de las filas. Ahora usa muestreo dinámico por defecto, lo que baja bastante el costo y el tiempo de consulta en tablas grandes.
- La distribución de cardinalidad dejó de recolectarse en cada corrida. Si algo tuyo dependía del conteo de valores distintos, hay que pedirla explícitamente en la configuración del profiler.
- Knowledge Center ahora es Context Center. Las páginas existentes se migran solas como Articles, y se suman Documents (texto libre atado a un activo o a un equipo) y una vista de tablero para administrar todo eso.
En gobierno entran además formularios de admisión personalizados —para certificación de activos, asignación de propietarios o clasificación— e importación de OWL, que permite cargar ontologías y taxonomías ya existentes en vez de tipearlas de nuevo.
Qué significa si estás aprendiendo
El cambio del profiler es el que más te cambia el día. Hasta ahora, apuntar el perfilador a una tabla grande de verdad era caro: escaneaba todo. Con muestreo por defecto podés probarlo sobre datos reales sin miedo a la factura, que es exactamente la práctica que hace falta para entender qué te dice un perfil de datos.
El precio es que un perfil por muestreo es una estimación, no un censo. Para distribuciones y nulos alcanza y sobra; para afirmar "esta columna no tiene duplicados", no. Saber cuál de las dos preguntas estás haciendo es la habilidad, y esta versión te obliga a distinguirlas.
A quién no le afecta
- Si ya tenías una configuración de profiler propia, no cambia nada. El release dice explícitamente que las configuraciones existentes se preservan: solo cambian los pipelines que usaban la configuración por defecto del agente.
- Si usás OpenMetadata solo para catálogo y linaje —el caso más común cuando recién empezás— nada de esto te toca.
- Si conectás Databricks Pipeline, sí mirá el release: la autenticación pasó de un
campo
tokensuelto a un objetoauthTypecon PAT, OAuth de Databricks y Azure AD. Las configuraciones guardadas se migran solas.