OneLake es el lago de datos único de Microsoft Fabric donde viven todas las cargas de trabajo, y el OneLake Catalog es la capa que permite descubrir, gobernar y confiar en esos datos. Para implementarlos se define primero la separación por entorno, capa o dominio con workspaces, se referencian fuentes con shortcuts sin copiarlas, y se registran propietarios, descripciones, sensibilidad y señales de confianza desde el inicio.
¿Qué es OneLake y por qué es el punto de partida?
OneLake es la base común de almacenamiento para todas las cargas de trabajo de Microsoft Fabric. En lugar de tener un lago por herramienta, todos los activos de datos conviven en un mismo lugar, lo que evita copias dispersas y versiones que no coinciden. Esa es la idea de única verdad: dirección y equipo miran los mismos números en Excel, Power BI o cualquier IA.
El catálogo entra justo después. OneLake ordena dónde viven los datos, pero por sí solo no dice de quién son, qué tan confiables son ni de dónde vienen. El OneLake Catalog reúne descubrimiento, gobierno y seguridad para que cada activo tenga contexto y propietario. Sin esa capa, un lago único termina siendo un desorden ordenado.
¿Cómo se organizan los workspaces?
Los workspaces son la primera decisión de diseño. Separan entornos, capas o dominios y asignan responsabilidad sin duplicar la plataforma. Es la forma de que cada equipo sepa qué le corresponde y de aislar riesgos.
Hay tres criterios habituales para separar workspaces:
- Por entorno: desarrollo, prueba y producción, para que un cambio en curso no toque los datos que consume el negocio.
- Por capa: siguiendo la arquitectura medallion (Bronze, Silver, Gold), donde cada nivel refina y da forma a los datos.
- Por dominio: finanzas, ventas, operaciones, para que cada área de negocio sea dueña de sus activos.
No hace falta elegir uno solo. Muchos proyectos combinan dominio en el nivel alto y capa dentro de cada dominio. La regla práctica: la topología debe reflejar cómo se reparten las responsabilidades reales, no un organigrama ideal. Antes de definir las capas conviene saber por dónde empezar para elegir entre un lakehouse y un warehouse, porque ese formato de almacenamiento condiciona la topología.
¿Cómo conectar datos sin duplicarlos con shortcuts?
Uno de los errores más caros al construir un lago es copiar los mismos datos una y otra vez. Los shortcuts resuelven eso: referencian datos internos o externos sin copiarlos y hacen visible de dónde proviene cada activo.
En la práctica, un shortcut apunta a una fuente (otro workspace, otra cuenta de almacenamiento, un sistema externo) y la deja disponible dentro de tu lakehouse como si estuviera ahí, pero sin mover ni multiplicar el dato. Esto tiene dos beneficios directos:
- Menos copias: se reduce el costo de almacenamiento y el riesgo de tener versiones que no coinciden.
- Linaje visible: queda claro cuál es la fuente original, algo clave cuando alguien pregunta de dónde salió una cifra.
El shortcut es la pieza que mantiene una sola versión de los datos incluso cuando nacen en sistemas distintos.
¿Qué hace el OneLake Catalog?
El OneLake Catalog es la capa de confianza sobre el lago. Permite explorar elementos, revisar confianza y linaje, gobernar activos y centralizar el acceso. En vez de preguntar por chat quién es el dueño de una tabla, el catálogo lo muestra.
Sus funciones principales son:
- Descubrimiento: encontrar los activos de datos disponibles sin depender del conocimiento de una sola persona.
- Confianza y linaje: ver de dónde viene cada elemento y qué tan fiable es, para no construir decisiones sobre datos frágiles.
- Gobierno: aplicar reglas coherentes sobre los activos publicados.
- Acceso centralizado: administrar desde un lugar quién puede ver o usar qué.
Esto convierte un conjunto de tablas en verdaderos productos de datos: activos con propietario, descripción y contexto, pensados para ser consumidos con confianza. Ese contexto es buena parte de lo que tu empresa gana con OneLake y el catálogo de datos: decisiones apoyadas en activos confiables en lugar de planillas sueltas.
¿Cómo se reparten dominios y seguridad?
Los dominios distribuyen responsabilidades por área de negocio y permiten aplicar roles coherentes sobre los activos publicados. La seguridad no es un paso final que se agrega al terminar, sino parte del diseño desde el principio.
En Fabric, el acceso se decide combinando varias piezas: los roles, los permisos de los elementos y la seguridad del motor. El Modelo de control de acceso de OneLake explica cómo se combinan esas capas, de modo que un usuario vea exactamente lo que le corresponde y nada más. Definir esto temprano evita el escenario típico donde, meses después, nadie sabe por qué cierto equipo tiene acceso a datos sensibles.
¿Necesito una topología compleja desde el primer día?
No. No todo proyecto necesita dominios, múltiples entornos y catálogo poblado desde el arranque. La clave está en decidir con criterio según hacia dónde va el proyecto.
| Situación | Topología recomendada |
|---|---|
| Proyecto pequeño, un solo equipo | Simplificar: pocos workspaces, separación mínima |
| Proyecto que va a escalar | Separar por entorno, capa o dominio desde el inicio |
| Varias áreas de negocio | Dominios con propietarios y roles definidos |
| Datos sensibles o regulados | Seguridad y gobierno registrados desde el primer día |
El principio que ordena la decisión es simple: criterio antes que herramienta. Si el proyecto es pequeño, se simplifica. Si va a crecer, se define la separación y se registran propietarios, descripciones, sensibilidad y señales de confianza desde el inicio, porque agregar gobierno tarde siempre cuesta más que hacerlo temprano.
Pasos para implementar OneLake y el catálogo
Una secuencia práctica para poner esto en marcha:
- Definir la topología: decidir cómo separar workspaces (entorno, capa o dominio) según el tamaño y el crecimiento esperado.
- Crear los workspaces y asignar responsables claros a cada uno.
- Conectar las fuentes con shortcuts, evitando copiar datos y dejando visible el origen.
- Aplicar la arquitectura medallion dentro del lago: Bronze para datos crudos, Silver para datos limpios, Gold para datos listos para consumo.
- Poblar el OneLake Catalog: registrar propietarios, descripciones, sensibilidad y señales de confianza de cada activo.
- Configurar dominios y seguridad, combinando roles, permisos de elementos y seguridad del motor.
- Revisar linaje y confianza de forma periódica, porque un catálogo desactualizado deja de ser confiable.
El siguiente paso
Implementar OneLake y su catálogo es sobre todo una decisión de diseño: cuánta estructura necesita hoy tu proyecto y cuánta necesitará mañana. La tecnología acompaña, pero el criterio es lo que mantiene los datos coherentes en el tiempo.
Si quieres ver cómo se aplica este enfoque a la arquitectura de datos de tu empresa, con ejemplos reales de workspaces, shortcuts y catálogo en funcionamiento, mira la demo gratuita. Es el mejor punto de partida para decidir si conviene implementar con tu equipo, con acompañamiento o con desarrollo a medida.
Preguntas relacionadas
¿Qué es OneLake en Microsoft Fabric?
Es el lago de datos único de Fabric: la base común de almacenamiento donde viven todas las cargas de trabajo, para evitar copias dispersas y versiones que no coinciden.
¿Para qué sirve el OneLake Catalog?
Reúne descubrimiento, gobierno y seguridad. Permite explorar los activos, revisar su confianza y linaje, gobernarlos y centralizar el acceso, para que cada dato tenga contexto y propietario.
¿Qué es un shortcut y por qué conviene usarlo?
Un shortcut referencia datos internos o externos sin copiarlos. Reduce el almacenamiento duplicado y deja visible el origen de cada activo, lo que evita versiones divergentes del mismo dato.
¿Necesito dominios y múltiples entornos desde el inicio?
No siempre. Si el proyecto es pequeño se simplifica. Si va a escalar, conviene definir la separación por entorno, capa o dominio y registrar gobierno desde el primer día.
¿Cómo se controla el acceso en OneLake?
Combinando roles, permisos de los elementos y la seguridad del motor. El modelo de control de acceso de OneLake explica cómo se integran esas capas para que cada usuario vea solo lo que le corresponde.